العاملون بالمعرفة الذين يأخذون ملاحظات في Obsidian يفهمون بالفعل قيمة نص عادي محفوظ محليا في العقل الثاني. لكن ما لم يستكشفه كثيرون هو وضع معالجة صوت في الوقت الفعلي فوق الإملاء — تحويل الميكروفون إلى جهاز إدخال يحافظ على الخصوصية وقائم على الشخصية يغذي مباشرة خزانة PKM الخاصة بك.
يغطي هذا الدليل سير العمل الكامل: توجيه ميكروفونك من خلال معالجة الصوت بالذكاء الاصطناعي من VoxBooster، وتوجيه تلك الإشارة إلى ملحقات النسخ المدعومة من Whisper في Obsidian، وربط الإخراج في Daily Notes والمخططات Mermaid وجلسات مراجعة الصوت. يهدف إلى العاملين بالمعرفة على Windows 10/11 الذين يستخدمون بالفعل Obsidian ويريدون طريقة التقاط أسرع وأكثر خصوصية.
ملخص
- ميكروفون الالتقاط الافتراضي منخفض الزمن الحقيقي من VoxBooster يتصل مباشرة بملحقات Speech to Text و Audio Notes في Obsidian
- معالجة الصوت بالذكاء الاصطناعي أقل من 300 ملي ثانية تحافظ على طبيعة الإملاء؛ لا تأخير ملحوظ بين الكلام والنسخ
- نسخ Whisper المحلي يعني أن لا بصمة صوت خام ترسل إلى الخوادم الخارجية
- شخصيات صوتية تتيح لك سرد ومراجعة ملاحظات بصوت “قراءة” مميز منفصل عن صوت الالتقاط
- Obsidian متعدد المنصات؛ VoxBooster خاص بـ Windows 10/11 فقط — الملاحظات تتزامن في كل مكان، معالجة الصوت تبقى على Windows
- لا يوجد برنامج تشغيل kernel مطلوب؛ لا برنامج كابل صوت افتراضي؛ يثبت في أقل من دقيقتين
ما هو Obsidian ولماذا يهم إدخال الصوت لـ PKM
Obsidian هو تطبيق إدارة معرفة قائم على Markdown مبني حول خزانة محلية من ملفات نصية عادية. بخلاف أدوات الملاحظات الموجهة للسحابة، كل ملاحظة تعيش على جهازك كملف .md تمتلكه. بنت مجتمع إدارة المعرفة الشخصية نظاما بيئيا كثيفا من الملحقات حوله — ملاحظات يومية، عروض رسوم بيانية، قوالب، وبشكل متزايد، التقاط صوت.
إدخال الصوت يسرع PKM بطرق محددة. السير في حل مشكلة بصوت عالٍ يلتقط المنطق الذي ينقطع عنه كتابة لوحة المفاتيح — يديك مشغولتان، تدفقك التحليلي يبقى سليما. ملاحظات ميدانية، تفريغ أدمغة بعد الاجتماع، وأفكار الحمام الليلية تخرج أسرع ملفوظة من المطبوعة. تقليل الاحتكاك حقيقي بما يكفي أن الباحثين والمستشارين يلتقطون بشكل روتيني 2000-3000 كلمة في الساعة عبر الإملاء مقابل 600-800 كلمة في الساعة بالكتابة.
القطعة المفقودة في معظم الإعدادات هي ما يحدث لإشارة الصوت تلك قبل النسخ. التقاط ميكروفون خام يرسل بصمة صوتك الفعلية إلى Whisper (أو خدمة نسخ سحابية). بالنسبة لعاملي المعرفة الذين يهتمون بالخصوصية، هذا تعرض ذو مغزى. لأي شخص يستخدم مراجعة صوتية — تشغيل ملاحظات بصوت هادئ مميز شخصية — التسجيل الميكروفون غير المعالج أيضا أصعب التمييز بين الضوضاء المحيطة وأصعب للانتباه ذهنيا.
هذا هو الفراغ الذي يملأه سير العمل هذا.
ملحقات Obsidian الرئيسية
Speech to Text
ملحق Speech to Text (متاح في دليل ملحقات مجتمع Obsidian) يلتقط صوتا من جهاز الإدخال المحدد لديك ويرسله إلى نقطة نهاية Whisper للنسخ. النص الناتج ينشر مباشرة في موضع المؤشر. تشمل خيارات التكوين:
- اختيار جهاز الإدخال — اختر أي إدخال صوت بما في ذلك ميكروفونات افتراضية منخفضة الزمن الحقيقي
- نقطة نهاية Whisper — سحابة (مطلوب مفتاح API OpenAI) أو محلية (خادم Whisper.cpp، Faster-Whisper، إلخ)
- ملف الهدف — أدرج في المؤشر، أو أضف إلى مسار ملاحظة يومية مكونة
- تلميحات اللغة — يساعد دقة Whisper للإملاء غير الإنجليزي أو المختلط
للإعداد الذي يحافظ على الخصوصية، وجه نقطة النهاية إلى مثيل Whisper محلي. يدعم ملحق Speech to Text أي نقطة نهاية متوافقة مع OpenAI /v1/audio/transcriptions، لذا أي خادم Whisper محلي يحاكي تلك الواجهة يعمل.
Audio Notes
ملحق Audio Notes يأخذ مقاربة مختلفة: يسجل ملف الصوت الخام في خزانتك بجانب النسخة. ينتهي بك الحال إلى ملاحظة Markdown تحتوي على تضمين التشغيل (![[recording-2026-06-10.m4a]]) والنص المنسوخ تحته. هذا مفيد لـ:
- التسجيلات المرجعية حيث تريد التحقق من النسخة لاحقا
- ملاحظات الاجتماع حيث تهم الإسناد إلى متحدثين معينين
- جلسات مراجعة بشخصية منسوخة — سجل نفسك وأنت تقرأ ملاحظة بصوت هادئ، ضمن الصوت، شارك الملف عبر Obsidian Publish
Audio Notes أيضا يدعم اختيار جهاز إدخال، لذا يلتقط ميكروفون الالتقاط الافتراضي منخفض الزمن الحقيقي من VoxBooster بنفس طريقة Speech to Text.
إعداد VoxBooster كميكروفونك Obsidian
VoxBooster هو مغير صوت Windows 10/11 وأداة استنساخ صوت بالذكاء الاصطناعي تعالج ميكروفونك في الوقت الفعلي عبر التقاط صوت منخفض الزمن الحقيقي — لا برنامج تشغيل kernel، لا برنامج كابل صوت افتراضي. الإعداد لسير عمل Obsidian يستغرق حوالي دقيقتين.
الخطوة 1 — ثبت VoxBooster. حمل وثبت على Windows 10/11. لا إعادة تشغيل مطلوبة.
الخطوة 2 — اختر صوتا. في علامة تبويب Voice، اختر إعدادا مسبقا أو حمل ملف شخصي صوت مستنسخ بالذكاء الاصطناعي. للإملاء، إعداد “راوٍ هادئ” مع انخفاض طفيف للدرجة وطنين أدنى يعمل بشكل جيد — مختلف عن صوتك الطبيعي (مهم للخصوصية) لكن لا يزال طبيعي الصوت لـ Whisper (مهم لدقة النسخ).
الخطوة 3 — فعّل الميكروفون الافتراضي. في إعدادات الإخراج في VoxBooster، تأكد أن ميكروفون الالتقاط الافتراضي منخفض الزمن الحقيقي نشط. يظهر في إعدادات الصوت في Windows كـ “VoxBooster Virtual Mic”.
الخطوة 4 — كوّن ملحق Obsidian. في إعدادات ملحق Speech to Text أو Audio Notes، اضبط جهاز الإدخال على “VoxBooster Virtual Mic”. اختبر بتسجيل قصير للتحقق من التقاط الملحق للإشارة المحولة.
الخطوة 5 — كوّن نقطة نهاية Whisper. للمعالجة المحلية: ثبت Whisper.cpp أو Faster-Whisper، شغّل الخادم على http://localhost:8080، وجه عنوان URL الخاص بـ API للملحق هناك. للسحابة: الصق مفتاح API OpenAI الخاص بك في إعدادات الملحق.
هذا هو المكدس الكامل: صوتك → معالجة VoxBooster بالذكاء الاصطناعي → ميكروفون افتراضي لالتقاط صوت منخفض الزمن الحقيقي → ملحق Obsidian → Whisper → نص Markdown في خزانتك.
التقاط الصوت المحمي بالخصوصية
الحجة المتعلقة بالخصوصية لهذا الإعداد لها طبقتان.
الطبقة الأولى: إخفاء بصمة الصوت. معالجة الصوت بالذكاء الاصطناعي تغير الخصائص الصوتية لصوتك — الدرجة، والنبرة، والمغلف الزمني — بما يكفي بحيث الإخراج لا يطابق بصمتك الصوتية البيومترية. إن نسختك الصوتية ذهبت إلى نقطة نهاية Whisper سحابية، الصوت المرفوع ليس قابلا للتعرف عليك. هذا يهم الصحفيين والمحامين والمعالجين وأي شخص تسجيلات صوته قد تُستدعى أو تُحصد.
الطبقة الثانية: النسخ المحلي. تشغيل Whisper محليا (Whisper.cpp، Faster-Whisper، أو Ollama مع نموذج كلام) يعني الصوت لا يترك جهازك على الإطلاق. مع معالجة الصوت، تحصل على إملاء معاد الشخصية والمعالجة محليا بكلتا الطريقتين. الشيء الوحيد الذي يوجد خارجيا هو نص Markdown الناتج، الذي تتحكم فيه.
هذا يختلف بشكل ملحوظ عن إملاء ميكروفون خام إلى خدمة نسخ سحابية، حيث بصمة صوتك ومحتوى الملاحظة كلاهما مخزن على الخوادم الخارجية.
سرد ملاحظة قائم على الشخصية ومراجعة صوتية
أسلوب PKM قليل الاستخدام هو مراجعة صوتية — تشغيل ملاحظات بصوت قراءة هادئ مركز بدلا من إعادة قراءتها بصريا. الفكرة تأتي من بحث الذاكرة: الاستماع السلبي إلى محتوى ملخص خلال فترات انخفاض الانتباه (المشي، التنقل) يعزز الاحتفاظ بشكل مختلف عن إعادة القراءة النشطة.
مغير الصوت يضيف التواء مفيدا هنا. سجل ملاحظاتك باستخدام استنساخ الصوت بالذكاء الاصطناعي من VoxBooster مع شخصية “راوٍ” — تغيير درجة طفيفة وإعداد معالجة أبطأ يبدو سلطويا وهادئا. عند تشغيل تسجيلات Audio Notes، أنت تسمع صوتا مميزا يصنفه دماغك بشكل مختلف عن حوارك الداخلي. وفقا للخبرة الشعبية، هذا يسهل استقبال ملاحظاتك كمعلومات بدلا من النقد الذاتي.
سير العمل:
- أملِ الملاحظة باستخدام صوت شخصية الراوي
- Audio Notes يلتقط كل التسجيل والنسخة
- شغّل تضمين
.m4aعند المراجعة — صوت الراوي يحمل الوزن الدلالي - النسخة أدناه توفر عقدة Obsidian قابلة للبحث والارتباط
هذا اختياري بالكامل — سير العمل الأساسي يعمل مع أي صوت — لكنه مميز لعاملي المعرفة الذين لديهم بالفعل ممارسة مراجعة ثقيلة Obsidian.
تكامل Daily Notes
ميزة Obsidian Daily Notes تنشئ ملاحظة جديدة لكل يوم باستخدام قالب قابل للتكوين. يمكن تكوين ملحق Speech to Text لإلحاق النسخ بملاحظة يومية حالية تلقائيا، مرقما كل كتلة إملاء بالوقت.
جزء قالب مفيد للتقاط الصوت:
## Captures الصوتية
<!-- Dictation blocks appended below by Speech to Text plugin -->
مع ضبط الملحق الهدف على Daily/{{date}}.md وتمكين وضع الإلحاق، كل جلسة إملاء تسقط كتلة مثل:
### 14:23
ناقشنا إطار طريق Q3 مع الفريق. التوتر الرئيسي هو بين إكمال الميزة عميق الأول واستقرار المنصة عريض الأول. بند عمل: مشروع مصفوفة قرار تقارن المسارين بحلول يوم الجمعة.
بنهاية اليوم، ملاحظتك اليومية تحتوي على مسار تدقيق مرقوم بالوقت لكل فكرة لفظية التقطتها. هذا يندمج بشكل طبيعي مع رسم بياني الارتباط الخلفي في Obsidian — أي اسم علم، علامة مشروع، أو [[linked note]] تملأها يصبح رابط حي في الرسم البياني.
سير عمل مخطط Mermaid
مخططات Mermaid تعرض داخل Obsidian بشكل طبيعي. التقاط الصوت + معالجة الذكاء الاصطناعي ينشئ خط أنابيب فعال بشكل مفاجئ لتوليدها:
- أملِ العملية — “يرسل المستخدم النموذج، الذي يشغل التحقق من البريد الإلكتروني، ثم عند التأكيد الحساب ينشط وبريد ترحيب يخرج.”
- احصل على نسخة Whisper — نص دقيق يهبط في ملاحظتك
- استفسر من نموذج لغة — الصق نص النسخة واطلب مخطط تدفق Mermaid
- الصق النتيجة — غلف في كتلة
`مخططوسيقدمها Obsidian حيا
خطوة مغير الصوت اختيارية خصيصا لتوليد Mermaid، لكنها تبقي سير العمل كاملا متسقا: أنت دائما تملي إلى نفس ميكروفون الالتقاط الافتراضي منخفض الزمن الحقيقي، دائما تنسخ من خلال نفس نقطة نهاية Whisper محلية، سواء الإخراج يصير نثرا أو نقاط رصاص أو مخطط.
مقارنة: طرق التقاط الصوت لـ Obsidian على Windows
| الطريقة | الخصوصية | النسخ | الإعداد | صوت الشخصية | يعمل بدون اتصال |
|---|---|---|---|---|---|
| ميكروفون خام → Whisper سحابي | منخفضة | ممتازة | سهلة | لا | لا |
| ميكروفون خام → Whisper محلي | متوسطة | جيدة | متوسطة | لا | نعم |
| VoxBooster → Whisper سحابي | متوسط-عالية | ممتازة | سهلة | نعم | لا |
| VoxBooster → Whisper محلي | عالية | جيدة | متوسطة | نعم | نعم |
| الكتابة اليدوية | غير مطبق | غير مطبق | بلا | غير مطبق | نعم |
تركيبة VoxBooster + Whisper محلي تجلس في الزاوية خصوصية عالية، بدون اتصال قابلة للتشغيل من المصفوفة. المقايضة دقة النسخ مقابل Whisper السحابي حقيقية لكن صغيرة — نماذج Whisper المحلية بحجم متوسط تؤدي بشكل قابل للمقارنة مع API السحابي لكلام نظيف في بيئات هادئة، و قمع الضوضاء من VoxBooster يساعد بتنظيف الإشارة قبل أن تضرب Whisper.
تكامل Soundboard لجلسات PKM
قليل الصلة لكن يستحق الملاحظة: soundboard من VoxBooster يمكن استخدامه خلال جلسات التقاط Obsidian كإشارة تركيز. عيّن مقطع صوت قصير (رنة ناعمة، صوت لوحة مفاتيح، بدء حلقة ضوضاء بيضاء) لمفتاح سريع تشغّله قبل بدء كتلة إملاء. الإشارة السمعية تجهز دماغك أن الثواني التالية هي “وضع التقاط” — تنفيذ منخفض التقنية للنوع من طقوس تبديل السياق التي يوصي بها باحثو الإنتاجية.
هذا ليس ميزة في التكامل Obsidian نفسه؛ إنه فقط إخراج الالتقاط الافتراضي منخفض الزمن الحقيقي يشغّل من خلال مكبرات الصوت أو سماعات الرأس منفصلة عن إشارة الميكروفون. صوت Soundboard لا يظهر في تسجيل Obsidian الخاص بك.
حدود صادقة
هذا سير العمل له قيود حقيقية تستحق التسمية.
Windows فقط. VoxBooster يعمل على Windows 10/11. إن تحركت بين سطح مكتب Windows وجهاز MacBook، معالجة الصوت تنطبق فقط على جهاز Windows. خزانتك تتزامن في كل مكان؛ سير عمل الصوت الخاص بك لا.
متطلبات الأجهزة المحلية Whisper. تشغيل Whisper محليا يتطلب موارد CPU أو GPU ذات مغزى. النموذج المتوسط يحتاج 3-4 GB RAM وينتج تأخير نسخ ملحوظ على الأجهزة الأقدم. النموذج الدقيق أسرع لكن الدقة تنخفض على الكلام المرقوع أو المفردات المتخصصة. Whisper السحابي يتجنب هذا بتكلفة الخصوصية.
دقة النسخ للمفردات غير المعتادة. ملاحظات PKM غالبا تحتوي على أسماء رموز مشروع، شروط تقنية، وأسماء علم. Whisper يتعامل مع معظمها بشكل جيد لكن يخطئ بشكل منهجي في مفردات محددة (يسيء تفسير بعض أسماء البرامج بشكل متسق، على سبيل المثال). يدعم ملحق Speech to Text تلميحات مفردات مخصصة في إصدارات Whisper الأحدث — يستحق التكوين إن كانت ملاحظاتك تحتوي على شروط غير معتادة متكررة.
لا مكافئ محمول. Obsidian على iOS و Android من الواضح لا يمكنه استخدام VoxBooster، وهو برنامج سطح مكتب Windows. سير العمل المحمول منفصل — استخدم الميكروفون الأصلي، اقبل أن معالجة الصوت لا تنطبق، وتعتمد على المزامنة الخزانة لإحضار تلك الملاحظات إلى جهاز Windows الخاص بك.
البدء
أسرع مسار إلى إعداد عامل:
- حمل VoxBooster وأكمل تثبيت خمس دقائق
- ثبت ملحق Speech to Text من دليل ملحقات مجتمع Obsidian
- اضبط إدخال الملحق على VoxBooster Virtual Mic ونقطة النهاية على خادم Whisper الخاص بك (أو API السحابي)
- أنشئ ملاحظة اختبار يومية وأملِ فقرة — تأكد من ظهور النسخة
- استكشف pricing — الخطط تبدأ بـ $6.99/شهر؛ كل الخطط تتضمن استنساخ صوت ذكاء اصطناعي وميكروفون افتراضي لالتقاط صوت منخفض الزمن الحقيقي
للمجموعة الكاملة من الميزات بما فيها ملفات استنساخ صوت ذكاء اصطناعي وإدارة الإعدادات المسبقة، صفحة ميزات VoxBooster تغطي الخيارات بالتفصيل.
للقراءة ذات الصلة على سير عمل الصوت، تعمق نسخ Whisper يغطي إعداد نقطة نهاية محلية بمزيد من التفصيل، و دليل مغير الصوت لـ Discord يغطي نفس ميكروفون الالتقاط الافتراضي منخفض الزمن الحقيقي في سياق اتصالات في الوقت الفعلي.
الأسئلة الشائعة
ما هو مغير الصوت في Obsidian ولماذا سأستخدمه؟ مغير صوت Obsidian يوجه الميكروفون الخاص بك من خلال معالجة الصوت بالذكاء الاصطناعي في الوقت الفعلي قبل أن التقط مكون Speech to Text الصوت. هذا يحافظ على الخصوصية أثناء الإملاء، ويضيف سرد قائم على الشخصية لمراجعة الصوت، ويبقي صوتك الفعلي بعيدا عن خدمات النسخ السحابية.
ما هي ملحقات Obsidian الأفضل لالتقاط ملاحظات صوتية؟ أفضل اثنين من الملحقات الموثوقة هما Speech to Text (يرسل الصوت إلى Whisper للنسخ مباشرة) و Audio Notes (يسجل ويدمج ملفات صوتية مع نص منسوخ بجانبه). كلاهما يعمل مع أي جهاز إدخال صوت، بما في ذلك ميكروفون افتراضي منخفض الزمن الحقيقي من VoxBooster.
هل يعمل VoxBooster مع Obsidian على Windows؟ نعم. يوفر VoxBooster ميكروفون افتراضي لالتقاط الصوت منخفض الزمن الحقيقي الذي يمكن لملحقات إدخال الصوت في Obsidian أن تختاره مباشرة. كمون أقل من 300 ملي ثانية يعني أن الصوت المحول يصل إلى Whisper نظيفا وبدون تأخير ملحوظ أثناء جلسات الإملاء.
هل يمكنني استخدام هذا الإعداد لملاحظات صوتية حساسة للخصوصية؟ يمكنك تقليل التعرض بشكل كبير بتشغيل Whisper محليا. مع معالجة الصوت التي تغير خصائصك الصوتية، النسخ المحلي يعني أن لا بصمة صوت خام تترك جهازك.
هل يعمل Obsidian نفسه على Windows؟ Obsidian هو تطبيق عبر أنظمة التشغيل ويعمل على Windows و macOS و Linux و iOS و Android. VoxBooster، ومع ذلك، خاص فقط بـ Windows 10/11. أجزاء مغير الصوت في سير العمل هذا تنطبق فقط على Windows؛ الملاحظات الناتجة تتزامن في كل مكان عبر Obsidian Sync أو أي مجلد سحابي.
كيف أدمج ملاحظات صوتية مع Obsidian Daily Notes؟ يمكن تكوين مكون Speech to Text لإلحاق النص المنسوخ بقالب ملاحظة يومية تلقائيا. اضبط ملف الهدف على مسار Daily Notes الخاص بك وكل جلسة إملاء تضع كتلة مرقومة بالوقت في ملاحظة ذلك اليوم.
هل يمكنني إنشاء مخططات Mermaid من ملاحظات صوتية في Obsidian؟ ليس تلقائيا، لكن سير العمل يتناسب جيدا معه. أملِ وصفا لفظيا لعملية ما، احصل على نسخة Whisper، ثم الصق النص في موجه نموذج لغة يعطي مخطط Mermaid. انسخ النتيجة في كتلة رمز mermaid محاطة وسيقدمها Obsidian حيا.