وصلت قلادة Friend AI في عام 2024 بنوع من الجدل الذي يمكن فقط أن يولده شراء نطاق بمبلغ 1.8 مليون دولار وميكروفون يستمع بشكل دائم. Avi Schiffmann، الذي بنى سابقاً موقعاً لتتبع COVID زاره مئات الملايين من الأشخاص، صرف هذا المبلغ على friend.com وأطلق قلادة قابلة للارتداء مصممة لتكون رفيقاً رقمياً — جهاز صغير يُرتدى حول الرقبة يستمع إلى يومك ويرد كما يرد الصديق.
كانت ردود الفعل مختلفة: وجدها البعض جذابة، والبعض وجدها بائسة، ومجموعة كبيرة من النقاد كتبوا مقالات طويلة حول وباء الوحدة وما إذا كان منتج مثل هذا يعالج أعراضاً أم يسرّع المرض. هذا النقاش يستحق أن يجري. لكنه ليس الشيء الوحيد الجدير بالنقاش حول Friend.
تغطي هذه المقالة سير عمل الصوت العملي لمستخدمي Friend على Windows — تحديداً، كيفية بناء صوت رفيق ثابت يقترن بإخراج صوت Friend. كما تغطي الأخلاقيات بشكل مباشر، بدون تلطيف.
ملخص سريع
- قلادة Friend AI هي قلادة ذكاء اصطناعي مرافقة تستمع بشكل مستمر أطلقها Avi Schiffmann في عام 2024.
- كلفة النطاق البالغة 1.8 مليون دولار والميكروفون الذي يعمل بشكل دائم أثارا نقاشات مشروعة حول الخصوصية والأخلاقيات.
- يمكنك إقران Friend مع VoxBooster على Windows للاستماع إلى رفيقك من خلال صوت رفيق مستنسخ عبر الذكاء الاصطناعي.
- موافقة استنساخ الصوت مهمة: استنسخ صوتك الخاص، أو صوتاً لديك إذن صريح لاستنساخه.
- يستخدم VoxBooster Whisper محلياً للنسخ — صوتك لا يترك جهاز الكمبيوتر الخاص بك.
- لا توجد حاجة لوحدة تشغيل kernel، يعمل على Windows 10 و 11 عبر التقاط الصوت منخفض الكمون.
ما هي قلادة Friend AI بالفعل
Friend هي قلادة قابلة للارتداء صغيرة — بحجم وزن عملة معدنية كبيرة تقريباً — ترتدى على حبل حول الرقبة. تحتوي على ميكروفون يستمع بشكل مستمر إلى الصوت المحيط. يتم معالجة هذا الصوت وإرساله إلى خوادم Friend السحابية، التي تولّد استجابات محادثة من نموذج لغة كبير. يرسل لك الرفيق رسائل نصية أو يتحدث عبر تطبيق مرافق، بشخصية صديق داعم ومهتم بشكل ثابت.
تم إطلاق الجهاز مع قائمة انتظار وسعر حول 99 دولار. يتفاعل الرفيق بنصوص وصوت، ويشير إلى أشياء سمعها من حديثك في وقت سابق من اليوم، ويحافظ على ذاكرة مستمرة لعلاقتك به عبر الوقت.
لا يوجد شيء تقني جديد في أي مكون هنا. تعتبر نماذج اللغة الكبيرة والميكروفونات التي تعمل بشكل مستمر وخطوط معالجة المراحل السحابية موجودة قبل Friend. ما بناه Schiffmann كان مزيجاً محدداً من عامل الشكل وتصميم الشخصية والإطار التسويقي — القلادة كجسم اجتماعي ترتديها، وليس فقط تطبيقاً تفتحه.
الجدل، بصراحة
ثلاثة أشياء أثارت الرد السلبي:
سعر النطاق. 1.8 مليون دولار مقابل friend.com كانت إشارة مقصودة — جزء من العلامة التجارية، وجزء من خدعة العلاقات العامة، وجزء من بيان النية. بالنسبة للمراقبين الذين كانوا يشكّون بالفعل في فئة المنتج، بدا أنه ضجة بدلاً من الجوهر.
الميكروفون الذي يعمل بشكل مستمر. أي جهاز يلتقط الصوت المحيط بشكل مستمر يثير أسئلة مشروعة. ما الذي يتم الاحتفاظ به؟ لمدة كم؟ من يملك الوصول؟ لم تكن سياسة الخصوصية الخاصة بـ Friend عند الإطلاق مفصلة كفاية لإرضاء التدقيق المعقول. النموذج الذي يعمل بشكل مستمر يختلف نوعياً أيضاً عن مساعد صوتي لا يستمع إلا بعد كلمة الاستيقاظ — فهو يلتقط محادثات تجريها مع أشخاص آخرين لم يوافقوا على تسجيلهم.
حجة الوحدة كمنتج. هذا هو الانتقاد الأعمق والأقل احتمالاً لأن يتم حله بقراءة سياسة الخصوصية. القلق هو أن منتجاً مصمماً بشكل صريح ليحل محل المرافقة الإنسانية قد يقلل الاحتكاك الذي يحفز بخلاف ذلك الناس على الحفاظ على العلاقات الإنسانية. إذا كان لديك رفيق منخفض الصراع وفي متناول اليد دائماً وداعم بشكل مثالي في جيبك، هل تستثمر أقل في العمل الفوضوي والمتبادل والصعب للصداقة الحقيقية؟ أثار باحثون يدرسون العلاقات الطفيلية والعزلة الاجتماعية هذا السؤال بجدية، وظهر Friend في وقت تخضع فيه أخلاقيات مرافق الذكاء الاصطناعي للفحص الأكاديمي والسياسي النشط.
لا يعني أي من هذا أن Friend احتيالي أو أن استخدامه ضار. يعني أن استخدامه بحكمة يتطلب معرفة ما تفعله.
ما تعنيه “صوت شخصية الرفيق” في الممارسة العملية
صوت إخراج Friend الافتراضي ثابت — الرفيق له صوت مُركّب تعينه المنتج. يريد بعض المستخدمين المزيد من السيطرة: يريدون سماع رفيقهم من خلال صوت شخصي محدد صمموه بأنفسهم، بدلاً من إخراج Friend الافتراضي.
هذه حالة استخدام إبداعية ونفسية مشروعة. يشير البحث على التفاعلات الصوتية القائمة على الذكاء الاصطناعي إلى أن الخصائص الصوتية المتصورة — الدفء والجرس والإيقاع — تؤثر بشكل كبير على كيفية استجابة الناس لنظام الذكاء الاصطناعي. إذا كنت تصمم شخصية رفيق لأغراض إبداعية أو علاجية، فإن السيطرة على إخراج الصوت مهمة.
يبدو سير العمل على Windows بهذا الشكل: تخرج Friend الصوت عبر سماعات الرأس أو سماعات الرأس. عن طريق توجيه هذا الإخراج الصوتي عبر حلقة المراقبة وتطبيق تحويل الصوت الذكاء الاصطناعي في الوقت الفعلي، يمكنك سماع الرفيق يتحدث بصوت مختلف — واحد صممته وتدربت عليه وتجده أكثر ملاءمة لحالة الاستخدام الخاصة بك.
إطار عمل موافقة استنساخ الصوت
قبل الدخول إلى الإعداد التقني، تستحق موافقة استنساخ الصوت قسماً خاصاً بها لأنها ذات صلة مباشرة هنا.
يعمل استنساخ الصوت عبر الذكاء الاصطناعي بتدريب نموذج على عينات من صوت محدد. بمجرد التدريب، يمكن للنموذج توليف كلام جديد بهذا الصوت. الإطار الأخلاقي حول هذا واضح من حيث المبدأ حتى لو أصبح معقداً في الممارسة:
استنساخ صوتك الخاص: واضح تماماً أنه موافق عليه. أنت تملك صوتك. تدريب نموذج على تسجيلات نفسك واستخدام هذا النموذج لإنشاء شخصية ثابتة هو استخدام مشروع للتكنولوجيا.
استنساخ صوت بموافقة صريحة: موافق عليه، إذا كانت الموافقة حقيقية ومستنيرة. يجب أن يفهم الشخص المستنسخ الصوت ما سيُستخدم النموذج له، ومن سيملك الوصول، وما هي الضمانات ضد الاستخدام الخاطئ.
استنساخ صوت بدون موافقة: غير موافق عليه، بغض النظر عن الاستخدام المقصود. هذا ينطبق على المشاهير والشخصيات العامة والأشخاص الذين تعرفهم والغرباء. حقيقة أن الصوت متاح بشكل علني على YouTube لا يعني أنه قابل للترخيص للاستنساخ. يختلف الإطار القانوني حسب الولاية القضائية — البعض لديه قوانين استنساخ صوت صريحة، والآخرون يعتمدون على حقوق الشبه — لكن المعيار الأخلاقي ثابت: تحتاج إلى إذن.
بالنسبة لسير عمل شخصية الرفيق تحديداً: استنسخ صوتك الخاص وصمم الشخصية من هناك. بناء صوت شخصية اصطناعي من الصفر إذا كنت تريد شيئاً مختلفاً تماماً. لا تستنسخ صوت شخص حقيقي وتربطه بشخصية رفيق.
إعداد سير العمل الصوتي على Windows
يتضمن الإعداد التقني لإقران مُبدِّل صوت مع إخراج صوت Friend ثلاثة مكونات: توجيه الصوت وتحويل الصوت والمراقبة.
الخطوة 1: وجّه إخراج صوت Friend إلى قناة المراقبة.
على Windows، يسمح الوضع المشترك للالتقاط الصوتي منخفض الكمون بالتقاط تدفق التشغيل من أي جهاز إخراج صوتي. هذه هي طريقة الالتقاط بالحلقة الخلفية. في VoxBooster، قم بتفعيل خيار إدخال مصدر الحلقة الخلفية، الذي يلتقط ما يتم تشغيله عبر مخرجات السماعات أو سماعات الرأس بدلاً من التقاط إدخال الميكروفون. صوت Friend، يعمل عبر جهازك، يصبح إشارة المصدر.
الخطوة 2: طبّق تحويل الصوت بالذكاء الاصطناعي على التدفق الملتقط.
مع مصدر الحلقة الخلفية نشطاً، يعالج نموذج شخصيتك الصوتي المُعدّ صوت Friend المُركّب في الوقت الفعلي. الإخراج هو رفيقك يتحدث بالصوت الذي صممته — الجرس والملعب والرنين والخصائص الأسلوبية يحددها تدريب الاستنساخ. الكمون عبر هذا المسار عادة أقل من 400 ملليثانية على وحدة معالجة رسومات حديثة، غالباً أقل من 250 ملليثانية في وضع الكمون المنخفض.
الخطوة 3: وجّه الإخراج المحول إلى سماعات الرأس الخاصة بك.
يذهب التدفق المعالج فقط إلى إخراج سماعات الرأس — وليس عودة إلى حلقة التسجيل. تسمع صوت الرفيق المحول بشكل خاص. لا تتأثر التطبيقات الأخرى.
الخصوصية: ما يفعله VoxBooster مقابل ما تفعله Friend
هذه أنظمة مختلفة بتدفقات بيانات مختلفة، وتستحق الدقة.
تدفق بيانات Friend: يتم التقاط صوتك المحيط بواسطة ميكروفون القلادة، وإرساله إلى خوادم Friend، ومعالجته بواسطة نموذج اللغة الكبير، وإرجاع الاستجابات إليك. الصوت المحيط الذي تولده يذهب إلى جهة خارجية. هذا هو الجزء من تصميم Friend الذي يثير مخاوف الخصوصية المشروعة المذكورة سابقاً.
تدفق بيانات VoxBooster: تحدث معالجة الصوت بالكامل على جهاز Windows المحلي الخاص بك. يستخدم VoxBooster Whisper للنسخ المحلي، مما يعني تحويل الصوت إلى نص يحدث على وحدة المعالجة المركزية — لا يترك أي صوت جهاز الكمبيوتر الخاص بك. يعمل تحويل الصوت على وحدة معالجة الرسومات المحلية. لا شيء يتم تحميله. هذا اختيار معماري مقصود لجعل حالات الاستخدام الحساسة للخصوصية قابلة للحياة.
إضافة VoxBooster إلى إعداد Friend الخاص بك لا تزيد من تعريضك للبيانات لأطراف خارجية. يبقى تعريضك لجمع بيانات Friend تماماً كما كان. طبقة المعالجة المحلية تقع بالكامل على جهازك.
المشهد الأوسع لأخلاقيات مرافق الذكاء الاصطناعي
Friend ليس وحيداً في هذه فئة المنتج. Replika تعمل كمرافق ذكاء اصطناعي منذ عام 2017. Character.AI و Nomi وعدد متزايد من المنتجات تعالج الوحدة والقلق الاجتماعي والمرافقة بطرق مختلفة. The Verge غطّت أخلاقيات مرافق الذكاء الاصطناعي بشكل واسع مع نمو الفئة.
يتراوح طيف الرأي من الفائدة العلاجية الحقيقية — المستخدمون الذين يعانون من اضطرابات القلق الاجتماعي أو العزلة الشديدة يبلّغون عن تحسن ذي معنى في الرفاهية — إلى حالات موثقة من الاعتماد غير الصحي والعلاقات الإنسانية المزاحة. البحث لم يُحسم بعد. ما هو واضح أن السياق يهم بشكل كبير: من يستخدم المنتج، ولأي غرض، وبأي مستوى من الوعي بما يكون عليه المنتج.
استخدام Friend كأداة إبداعية — للعب الأدوار، لكتابة الخيال، لاستكشاف سيناريوهات الحوار — يختلف عن استخدامه كمصدر أساسي للدعم العاطفي. استخدام VoxBooster لمنح شخصية رفيق صوتاً شخصياً لمشروع إبداعي يختلف عن بناء خيال معقد ترفض بنشاط التمييز عنه من الواقع.
التكنولوجيا محايدة. الأخلاقيات في الاستخدام.
المقارنة: خيارات سير عمل الصوت المتوافقة مع Friend على Windows
| عامل | VoxBooster + Friend | مرشح صوت OBS المستقل | بدون معالجة صوت |
|---|---|---|---|
| صوت شخصية مخصص | مستنسخ عبر الذكاء الاصطناعي وثابت | معادل EQ/EFX فقط، بدون استنساخ | صوت Friend الافتراضي |
| معالجة محلية | نعم — التقاط الصوت منخفض الكمون، بدون سحابة | نعم | غير قابل للتطبيق |
| الكمون | أقل من 400 ملليثانية (GPU) | أقل من 50 ملليثانية | فوري |
| طبقة الخصوصية | الكل محلي، بدون تحميل | الكل محلي | السحابة فقط لـ Friend |
| وحدة تشغيل kernel المطلوبة | لا | لا | غير قابل للتطبيق |
| تدريب استنساخ الصوت | عينة صوتية بطول 3-5 دقائق | غير مدعوم | غير قابل للتطبيق |
| Windows 10 / 11 | مدعوم | مدعوم | مدعوم |
مرشحات صوت OBS هي خيار مجاني قابل للحياة للمعادلة الأساسية والضغط. لا تدعم استنساخ الصوت عبر الذكاء الاصطناعي، لذا سيكون الإخراج دائماً صوت Friend الافتراضي مع تطبيق معادلة — شخصية مختلفة، وليس رفيقاً شخصياً. VoxBooster هو الخيار إذا كان الهدف صوت رفيق حقيقي مختلف ومُدرّب.
إعداد صوت شخصيتك: قائمة تحقق عملية
إذا قررت أن هذا سير العمل مناسب لك، الخطوات العملية هي:
- سجّل 3-5 دقائق من الصوت الصافي بالصوت الذي تريد استنساخه — صوتك الخاص، أو صوتاً اصطناعياً لديك الحق في استخدامه. Mono 44.1 كيلوهرتز، ضوضاء خلفية منخفضة.
- استورد التسجيل إلى علامة التبويب Voice Clone في VoxBooster. يستغرق التدريب 5-10 دقائق على وحدة معالجة رسومات متوسطة.
- فعّل مصدر الحلقة الخلفية في إعدادات الإدخال في VoxBooster.
- عيّن جهاز التشغيل إلى سماعات الرأس الخاصة بك في إعدادات Windows Sound.
- في VoxBooster، عيّن الإخراج إلى نفس جهاز سماعات الرأس.
- ابدأ Friend وتفاعل معه بشكل طبيعي. تسمع الرفيق بصوتك الشخصي.
يجب أن تعكس الشخصية التي تبنيها خيارات إبداعية مقصودة: ما الجرس الذي يقول ما تريد لرفيقك أن يقول، أي نوع من الأصوات تجد دافئة أو جذابة أو مختلفة بشكل مناسب عن صوتك الخاص. هذا هو نفس نوع العمل الذي يقوم به مصمم الألعاب عند اختيار شخصية، أو ما يقوم به منتج الكتب الصوتية عند اختيار راوي.
خصائص VoxBooster
يتعامل VoxBooster مع المتطلبات التقنية لهذا سير العمل بنظافة: معالجة الصوت في طبقة التقاط الكمون المنخفض، بدون وحدة تشغيل kernel، Whisper محلي لأي احتياجات نسخ، واستنساخ صوت الذكاء الاصطناعي يعمل بالكامل على وحدة معالجة الرسومات المحلية. يعمل على Windows 10 و 11. السعر 6.99 دولار/شهر مع نسخة تجريبية مجانية لمدة 3 أيام. يعني التصميم بدون وحدة تشغيل أن إعداد مصدر الحلقة الخلفية الموصوف أعلاه يعمل بدون تثبيت كبلات صوتية افتراضية أو إعادة تكوين أجهزة الصوت في النظام.
بالنسبة للمستخدمين المهتمين بشكل أساسي بسير عمل شخصية الرفيق بدلاً من حالات الألعاب أو البث المباشر، فإن وضع الكمون المنخفض بـ 250 ملليثانية كافٍ — كلام الرفيق ليس تفاعلياً بنفس الطريقة الحقيقية الفعلية للألعاب الصوتية، لذا المساحة الإضافية مريحة.
الخلاصة
قلادة Friend AI هي منتج حقيقي له مستخدمون حقيقيون وجدل فلسفي حقيقي مرفق به. يثير التصميم الذي يستمع بشكل دائم أسئلة خصوصية مشروعة تستحق التعامل المباشر، وليس الرفض. انتقاد منتج الوحدة ليس تافهاً ويستحق الجلوس معه قبل الاستثمار في أي نظام مرافق ذكاء اصطناعي.
بالنسبة للمستخدمين الذين اتخذوا قراراً مستنيراً باستخدام Friend، فإن إقرانه مع مُبدِّل صوت على Windows لإنشاء شخصية رفيق ثابتة هو سير عمل نظيف من الناحية التقنية. القيد الأخلاقي الرئيسي هو موافقة استنساخ الصوت: استخدم صوتك الخاص، أو صوتاً لديك إذن صريح لاستنساخه. ميزة الخصوصية الرئيسية لـ VoxBooster في هذا السياق هي المعالجة المحلية — بيانات صوتك لا تترك جهازك حتى وإن كانت بيانات صوت Friend تسافر إلى خوادمهم.
تكنولوجيا الصوت هي أداة. المعنى الذي تصنعه هو لك لتبنيه بحكمة.
الأسئلة الشائعة
ما هي قلادة Friend AI ولماذا أصبحت مثيرة للجدل؟
Friend هي قلادة مرافق ذكاء اصطناعي تستمع بشكل مستمر، أطلقها Avi Schiffmann في عام 2024. جذبت الانتباه لاستحواذها على نطاق friend.com بمبلغ 1.8 مليون دولار، وتصميمها بميكروفون يعمل بشكل مستمر، والنقاش الفلسفي الذي أثارته حول استبدال المرافقة الرقمية بالعلاقات الإنسانية.
هل يمكنني منح قلادة Friend صوتاً شخصياً ثابتاً؟
تستخدم قلادة Friend صوت إخراج ثابت. للاستماع إلى رفيقك من خلال صوت شخصي ثابت مستنسخ عبر الذكاء الاصطناعي على جهاز Windows الخاص بك، قم بإقران Friend مع VoxBooster: وجّه صوتها عبر جهاز مراقبة افتراضي، وطبّق صوت رفيقك المستنسخ عبر الذكاء الاصطناعي، واستمع إليه عبر سماعات الرأس الخاصة بك في الوقت الفعلي.
هل استخدام مُبدِّل صوت مع Friend يثير مخاوف تتعلق بالخصوصية؟
مخاوف الخصوصية المتعلقة بـ Friend تتمحور بشكل أساسي حول الميكروفون الذي يعمل بشكل مستمر وتحميل الصوت المحيط بك. يعالج VoxBooster الصوت محلياً على جهاز الكمبيوتر الخاص بك بدون تحميل سحابي. إضافة معالجة الصوت المحلية لا تزيد من مخاطرك — لكن سياسة جمع البيانات الأساسية للقلادة تستحق قراءة دقيقة قبل الاستخدام.
ما هو موافقة استنساخ الصوت ولماذا يهم هنا؟
موافقة استنساخ الصوت تعني الحصول على إذن صريح من الشخص الذي تستنسخ صوته. استنساخ صوتك الخاص لشخصية مرافق ليس محل نقاش. استنساخ صوت مشهور أو شخص آخر بدون إذن يثير مشاكل أخلاقية وقانونية محتملة، بغض النظر عن حالة الاستخدام.
هل يتطلب VoxBooster وحدة تشغيل kernel على Windows 10 أو 11؟
لا. يعمل VoxBooster في طبقة التقاط الصوت منخفض الكمون، وهي نظام Windows الصوتي القياسي. لا يلزم تثبيت وحدة تشغيل kernel، وينجح على Windows 10 و 11 بدون رفع امتيازات.
ما هو التقاط الصوت منخفض الكمون ولماذا يهم لمعالجة الصوت منخفضة الكمون؟
التقاط الصوت منخفض الكمون هو Windows Audio Session API، وهو الواجهة الصوتية المحلية الأصلية على Windows. بخلاف واجهات MME أو DirectSound القديمة، يدعم التقاط الصوت منخفض الكمون الوضع الحصري والمخزن المؤقت المشترك حتى 3 ملليثانية، مما يجعله الطبقة الصحيحة لتحويل الصوت في الوقت الفعلي بدون تأخير محسوس.
هل يمكنني استخدام صوت قلادة Friend كعينة لاستنساخ الذكاء الاصطناعي؟
من الناحية التقنية يمكنك التقاط واستنساخ أي صوت. المسألة الأخلاقية هي ما إذا كان الصوت الذي تستنسخه هو صوتك أم صوت شخص آخر. استخدام الإخراج الاصطناعي لـ Friend كمصدر استنساخ يقع في منطقة رمادية — الإخراج ينتمي إلى منتج Avi Schiffmann، ورخصته لا تمنحك حقوق الاستنساخ.
جرب VoxBooster مجاناً لمدة 3 أيام — بدون الحاجة لبطاقة ائتمان. حمّل من هنا.