Ses Değiştirici + Obsidian Ses Notları Rehberi

Whisper transkripsiyonuyla ses değiştiriciyi kullanarak ses notlarını doğrudan Obsidian'a yakalayın. Windows 10/11'de bilgi işçileri için tam kurulum.

Obsidian’da not alan bilgi işçileri, düz metinle yerel olarak depolanan ikinci bir beynin değerini zaten anlıyorlar. Birçok kişinin henüz keşfetmediği şey, dikte üzerine gerçek zamanlı ses işlemesini katmanlamaktır — mikrofonu, gizlilik koruması, kişilik farkında bir giriş cihazına dönüştürerek doğrudan PKM kasanızı besler.

Bu rehber tam iş akışını kapsar: mikrofunu VoxBooster’ın AI ses işlemesi yoluyla yönlendirin, bu sinyali Obsidian’ın Whisper destekli transkripsiyonu eklentilerine besleyin ve çıktıyı Günlük Notlara, Mermaid diyagramlarına ve ses incelemesi oturumlarına bağlayın. Zaten Obsidian kullanan ve daha hızlı, daha gizli bir yakalama yöntemi isteyen Windows 10/11 bilgi işçilerine yöneliktir.

Özet

  • VoxBooster’ın düşük gecikmeli ses yakalama sanal mikrofonuna Obsidian’ın Speech to Text ve Audio Notes eklentilerine doğrudan bağlanır
  • 300ms altında AI ses işlemesi dikte doğallığını korur; konuşma ile transkripsiyonu arasında algılanabilir gecikme yok
  • Yerel Whisper transkripsiyonu, hiçbir ham ses parmak izinin harici sunuculara gönderilmediği anlamına gelir
  • Ses kişilikleri, notları yakalama sesinden ayrı bir düzeltilmiş “okuma sesi”nde anlatmanıza ve incelemenize izin verir
  • Obsidian platformlar arası; VoxBooster yalnızca Windows 10/11 — notlar her yerde senkronize olur, ses işlemesi Windows’ta kalır
  • Çekirdek sürücü gerekli değil; sanal ses kablosu yazılımı gerekli değil; iki dakikadan kısa sürede kurulur

Obsidian Nedir ve PKM için Ses Girişi Neden Önemlidir

Obsidian, düz metin dosyalarının yerel kasası etrafında inşa edilmiş, Markdown tabanlı bir bilgi yönetimi uygulamasıdır. Bulut öncelikli not alma araçlarından farklı olarak, her not sizin sahip olduğunuz bir .md dosyası olarak makinenizde yaşar. Kişisel bilgi yönetimi topluluğu etrafında yoğun bir eklenti ekosistemi inşa etmiştir — günlük notlar, grafik görünümler, şablonlar ve giderek artan şekilde, ses yakalama.

Ses girişi, PKM’yi belirli yollarla hızlandırır. Bir sorunu yüksek sesle tartışmak, klavye yazısının kesintiye uğrattığı muhakemeyi yakalar — elleriniz meşgul, analitik akışınız bozulmamış kalır. Saha notları, toplantı sonrası beyin boşaltma ve gece yarısı duş düşünceleri, yazılı yazıdan daha hızlı konuşulur. Sürtünme azaltması yeterince gerçektir ki araştırmacılar ve danışmanlar rutin olarak dikte yoluyla saat başına 2,000-3,000 kelime yakalarlar; yazılı olarak saat başına 600-800 kelime.

Çoğu kurulumda eksik olan parça, transkripsiyondan önce o ses sinyaline ne olduğudur. Ham mikrofon yakalama, gerçek ses parmak izinizi Whisper’a (veya bulut transkripsiyonu hizmetine) gönderir. Gizliliğe duyarlı bilgi işçileri için bu önemli bir maruziyettir. Ses incelemesi kullanan birisi — notları sakin, belirgin bir kişilik sesinde geri çalıştıran biri — işlenmeyen mikrofon kaydı da arka plan gürültüsünden ayırt etmesi ve zihinsel olarak dikkat etmesi daha zordur.

Bu iş akışının dolduğu boşluktur.

İki Ana Obsidian Eklentisi

Speech to Text

Speech to Text eklentisi (Obsidian topluluk eklentileri dizininde mevcuttur) seçilen giriş cihazından sesi yakalar ve transkripsiyonu için bir Whisper uç noktasına gönderir. Sonuçta metin imleç konumuna satır içinde eklenir. Yapılandırma seçenekleri şunları içerir:

  • Giriş cihazı seçimi — düşük gecikmeli ses yakalama sanal mikrofonları dahil herhangi bir ses giriş seçin
  • Whisper uç noktası — bulut (OpenAI API anahtarı gerekli) veya yerel (Whisper.cpp sunucusu, Faster-Whisper, vb.)
  • Hedef dosya — imleçte ekleme yapın veya yapılandırılmış bir günlük not yoluna ekleyin
  • Dil ipuçları — İngilizce olmayan veya karışık dil dikte için Whisper doğruluğuna yardımcı olur

Gizliliği koruyan kurulum için, uç noktayı yerel bir Whisper örneğine yönlendirin. Speech to Text eklentisi, OpenAI uyumlu /v1/audio/transcriptions uç noktasını destekler, bu nedenle söz konusu arabirimi taklit eden herhangi bir yerel Whisper sunucusu çalışır.

Audio Notes

Audio Notes eklentisi farklı bir yaklaşım alır: ham ses dosyasını kasaya transkripsiyonuyla birlikte kaydeder. Sonunda hem çalma gömme (![[recording-2026-06-10.m4a]]) hem de altındaki transkript metni içeren bir Markdown notu alırsınız. Bu yararlıdır:

  • Transkripsiyonu daha sonra doğrulamak istediğiniz referans kayıtlar
  • Belirli konuşmacılara atfın önemli olduğu toplantı notları
  • Kişilik tabanlı inceleme oturumları — notu sakin sesle okuyarken kendinizi kaydedin, sesi göm, dosyayı Obsidian Publish aracılığıyla paylaş

Audio Notes ayrıca giriş cihazı seçimini destekler, bu nedenle Speech to Text ile aynı şekilde VoxBooster’ın düşük gecikmeli ses yakalama sanal mikrofonunu yakalar.

VoxBooster’ı Obsidian Mikrofonu Olarak Kurma

VoxBooster, Windows 10/11 ses değiştirici ve AI ses klonlama aracıdır ve düşük gecikmeli ses yakalama yoluyla mikrofunu gerçek zamanlı olarak işler — çekirdek sürücü yok, sanal ses kablosu yazılımı yok. Obsidian iş akışının kurulumu yaklaşık iki dakika sürer.

Adım 1 — VoxBooster’ı Kurma. Windows 10/11’de İndirin ve Kurun. Yeniden başlatma gerekli değildir.

Adım 2 — Bir Ses Seçin. Voice sekmesinde, bir ön ayar seçin veya özel bir AI klonlanmış ses profilini yükleyin. Dikte için “sakin anlatıcı” ön ayarı hafif perde düşürme ve minimal yankı ile iyi çalışır — doğal sesinizden farklı (gizlilik için önemli) ancak Whisper için hala doğal ses (transkripsiyonu doğruluğu için önemli).

Adım 3 — Sanal Mikrofonu Etkinleştirin. VoxBooster’ın Çıkış ayarlarında düşük gecikmeli ses yakalama sanal mikrofonunun aktif olduğunu doğrulayın. Windows ses ayarlarında “VoxBooster Virtual Mic” olarak görünür.

Adım 4 — Obsidian Eklentisini Yapılandırın. Speech to Text veya Audio Notes eklentisi ayarlarında giriş cihazını “VoxBooster Virtual Mic” olarak ayarlayın. Eklentinin dönüştürülmüş sinyali aldığını doğrulamak için kısa bir kaydı test edin.

Adım 5 — Whisper Uç Noktasını Yapılandırın. Yerel işlem için: Whisper.cpp veya Faster-Whisper yükleyin, sunucuyu http://localhost:8080’de başlatın ve eklentinin API URL’sini oraya yönlendirin. Bulut için: OpenAI API anahtarınızı eklenti ayarlarına yapıştırın.

Bu tam yığındır: sesiniz → VoxBooster AI işlemesi → düşük gecikmeli ses yakalama sanal mikrofonua → Obsidian eklentisi → Whisper → kasanızda Markdown metni.

Gizlilik Korumalı Ses Yakalama

Bu kurulum için gizlilik argümanının iki katmanı vardır.

Birinci katman: ses parmak izi gizlemesi. AI ses işlemesi sesinizin akustik özelliklerini (perde, timbr, kadans zarfı) değiştirir; çıktı biyometrik ses parmak izinizle eşleşmeyecek kadar. Transkripsiyonunuz bulut Whisper uç noktasına giderse, yüklenen ses sizde tanımlanmaz. Bu gazeteciler, avukatlar, terapistler ve ses kayıtları mahkemede çağrılabilir veya toplanabilir olan herkes için önemlidir.

İkinci katman: yerel transkripsiyonu. Whisper’ı yerel olarak çalıştırmak (Whisper.cpp, Faster-Whisper veya bir konuşma modeli ile Ollama) ses hiç makinenizi terk etmez. Ses işlemesi ile birleştirildiğinde, akustik olarak anonimleştirilmiş ve yerel olarak işlenmiş dikte alırsınız. Dışarıda bulunan tek şey, kontrol ettiğiniz sonuç Markdown metnidir.

Bu, ses parmak izinizin ve not içeriğinin harici sunucularda depolandığı bulut transkripsiyonu hizmetine ham mikrofon diktemesi ile önemli ölçüde farklıdır.

Kişilik Tabanlı Not Anlatımı ve Ses İncelemesi

Az kullanılan bir PKM tekniği ses incelemesidir — notları görsel olarak yeniden okumak yerine sakin, odaklanmış bir okuma sesinde çalma. Fikir bellek araştırmasından gelir: düşük dikkat dönemlerinde (yürüyüş, gidiş-dönüş) özetlenmiş içeriği pasif dinlemek, aktif yeniden okumadan farklı şekilde saklama gücünü güçlendirir.

Ses değiştirici buraya yararlı bir kıvrım ekler. VoxBooster’ın AI ses klonlaması ile notlarınızı “anlatıcı” kişiliğiyle kaydedin — otoriter ve sakin görünen hafif perde değişimi ve daha yavaş işleme ön ayarı. Audio Notes kayıtlarını çalarken, beyin tarafından iç monoloğunuzdan farklı şekilde kategorize edilen benzersiz bir sesi duyarsınız. Anekdot olarak, bu, öz-eleştiri yerine bilgi olarak kendi notlarınızı almayı kolaylaştırır.

İş akışı:

  1. Anlatıcı kişilik sesini kullanarak notu dikte edin
  2. Audio Notes hem kaydı hem de transkripsiyonu yakalar
  3. İnceleme yaparken .m4a gömmesini çalın — anlatıcı sesi anlamsal ağırlığı taşır
  4. Aşağıda transkript, aranabilir, bağlantılanabilir bir Obsidian düğümü sağlar

Bu tamamen isteğe bağlıdır — temel iş akışı herhangi bir sesle çalışır — ancak zaten ağır bir Obsidian inceleme uygulaması olan bilgi işçileri için bir farklılaştırıcıdır.

Günlük Notlar Entegrasyonu

Obsidian’ın Günlük Notları özelliği yapılandırılabilir bir şablonu kullanarak her gün için yeni bir not oluşturur. Speech to Text eklentisi, transkript edilen metni günlük not şablonuna otomatik olarak eklemeye, her dikte bloğunu zaman damgalamaya ayarlanabilir.

Ses yakalama için yararlı bir şablon parçası:

## Ses Yakalamaları

<!-- Dictation blocks appended below by Speech to Text plugin -->

Eklentinin hedefi Daily/{{date}}.md olarak ayarlanmış ve ekleme modu etkinleştirilmiş durumdayken, her dikte oturumu şöyle bir blok ekler:

### 14:23
Q3 yol haritası çerçevelemesi üzerinde takımla tartıştık. Temel gerginlik, önce derinlik özelliğini tamamlamak ile önce genişlik platform istikrarı arasındadır. Eylem öğesi: Cuma gününe kadar iki pisti karşılaştıran bir karar matrisi taslağı.

Günün sonunda, günlük notunuz yakaladığınız her sözlü düşüncenin zaman damgalı bir denetim izini içerir. Bu Obsidian’ın geriye doğru bağlantı grafiğine doğal olarak entegre olur — dikte ettiğiniz herhangi bir uygun isim, proje etiketi veya [[linked note]] grafikteki canlı bir bağlantı haline gelir.

Mermaid Diyagramı İş Akışı

Mermaid diyagramları Obsidian içinde yerel olarak işlenir. Ses yakalama + AI işlemesi onları oluşturmak için şaşırtıcı derecede etkili bir işlem hattı oluşturur:

  1. Süreci dikte edin — “Kullanıcı formu gönderir, bu da e-posta doğrulamasını tetikler, ardından onaylamada hesap etkinleştirilir ve hoş geldiniz e-postası gönderilir.”
  2. Whisper transkripsiyonunu alın — tam metin notunuza iner
  3. Dil modeli istemine edin — transkript metnini yapıştırın ve Mermaid akış diyagramını isteyin
  4. Sonucu yapıştırın — çitli bir mermaid kod bloğunda sarın ve Obsidian onu canlı olarak işler

Ses değiştirici adımı özellikle Mermaid oluşturması için isteğe bağlıdır ancak tam iş akışını tutarlı tutar: her zaman aynı düşük gecikmeli ses yakalama sanal mikrofonuna dikte edersiniz, her zaman aynı yerel Whisper uç noktasından transkripsiyonu yaparsınız, çıktı nesir, madde işareti veya diyagram olsun.

Karşılaştırma: Windows’ta Obsidian için Ses Yakalama Yöntemleri

YöntemGizlilikTranskripsiyonuKurulumKişilik SesiÇevrimdışı Çalışır
Ham mikrofon → bulut WhisperDüşükMükemmelKolayHayırHayır
Ham mikrofon → yerel WhisperOrtaİyiOrtaHayırEvet
VoxBooster → bulut WhisperOrta-YüksekMükemmelKolayEvetHayır
VoxBooster → yerel WhisperYüksekİyiOrtaEvetEvet
Manuel yazıN/AN/AYokN/AEvet

VoxBooster + yerel Whisper kombinasyonu matrisin yüksek gizlilik, çevrimdışı yetenekli köşesinde oturur. Bulut Whisper karşısında transkripsiyonu doğruluğu kompromisi gerçek ama küçüktür — orta boyutlu yerel Whisper modelleri sessiz ortamlarda temiz konuşma için bulut API’sı ile karşılaştırılabilir performans gösterir ve VoxBooster’ın gürültü bastırması sinyali Whisper’a ulaşmadan temizleyerek yardımcı olur.

PKM Oturumları için Soundboard Entegrasyonu

Biraz konu dışı ama dikkate değer: VoxBooster’ın soundboard Obsidian yakalama oturumları sırasında bir odak sinyali olarak kullanılabilir. Kısa bir ses klibini (yumuşak çan, klavye sesi, beyaz gürültü döngüsü başlangıcı) bir dikte bloğu başlatmadan önce tetiklediğiniz bir kısayola atayın. İşitsel ipucu beynini, sonraki birkaç saniyenin “yakalama modu” — üretkenlik araştırmacılarının önerdiği bağlam değiştirme ayini türü — olduğunu hazırlar.

Bu, Obsidian entegrasyonunun bir özelliği değildir; bu sadece düşük gecikmeli ses yakalama çıkışının mikrofon sinyalinden ayrı olarak hoparlör veya kulaklık aracılığıyla çalınmasıdır. Soundboard sesi Obsidian kayıtlarınızda görünmez.

Dürüst Sınırlamalar

Bu iş akışının adı koymaya değer gerçek kısıtlamalar vardır.

Yalnızca Windows. VoxBooster, Windows 10/11’de çalışır. Bir Windows masaüstü ile bir MacBook arasında geçiş yaparsanız, ses işlemesi yalnızca Windows makinesine uygulanır. Kasanız her yerde senkronize olur; ses iş akışınız değil.

Yerel Whisper donanım gereksinimleri. Whisper’ı yerel olarak çalıştırmak önemli CPU veya GPU kaynakları gerektirir. Orta model 3-4 GB RAM gerektirir ve eski donanımda kayda değer transkripsiyonu gecikmesi oluşturur. Tiny model daha hızlıdır ancak aksanlı konuşma veya uzman kelime dağarcığında doğruluk düşer. Bulut Whisper bunu gizlilik pahasına önler.

Alışılmadık kelime dağarcığı için transkripsiyonu doğruluğu. PKM notları genellikle proje kod adları, teknik terimler ve uygun isimler içerir. Whisper çoğunluğu iyi işler ancak belirli kelime dağarcığında sistematik hatalar yapar (örneğin, bazı yazılım adlarını tutarlı bir şekilde yanlış duyur). Speech to Text eklentisi daha yeni Whisper versiyonlarında özel kelime dağarcığı ipuçlarını destekler — notlarınız tekrarlanan alışılmadık terimler içeriyorsa yapılandırmaya değer.

Mobil eşdeğeri yok. iOS ve Android’deki Obsidian açıkça masaüstü Windows yazılımı olan VoxBooster’ı kullanamaz. Mobil iş akışı ayrıdır — yerel mikrofonu kullanın, ses işlemesi uygulanmadığını kabul edin ve bu notları Windows makinenize getirmek için kasa senkronizasyonuna güvenin.

Başlarken

Çalışan kuruluma en hızlı yol:

  1. VoxBooster İndirin ve beş dakikalık kurulumu tamamlayın
  2. Obsidian topluluk eklentileri dizininden Speech to Text eklentisini yükleyin
  3. Eklentinin girişini VoxBooster Virtual Mic’e ayarlayın ve uç noktayı Whisper sunucunuza (veya bulut API’sı) ayarlayın
  4. Bir test günlük notu oluşturun ve bir paragrafı dikte edin — transkripsiyonun görüntülendiğini doğrulayın
  5. Fiyatlandırma’yı keşfedin — planlar $6.99/ay’dan başlar; tüm planlar AI ses klonlamayı ve düşük gecikmeli ses yakalama sanal mikrofonunu içerir

AI ses klonlama profilleri ve ön ayar yönetimi dahil olmak üzere tam özellik seti için VoxBooster özellikler sayfası seçenekleri detaylı olarak kapsar.

Ses iş akışlarıyla ilgili okuması için Whisper transkripsiyonu derinlemesine dalış yerel uç nokta kurulumunu daha ayrıntılı olarak kapsar ve Discord için ses değiştirici rehberi gerçek zamanlı iletişim bağlamında aynı düşük gecikmeli ses yakalama sanal mikrofonunu kapsar.

Sıkça Sorulan Sorular

Obsidian ses değiştirici nedir ve neden onu kullanırım? Obsidian ses değiştirici, mikrofonu Obsidian’ın Speech to Text eklentisinin yakalaması öncesinde gerçek zamanlı AI ses işlemesi yoluyla yönlendirir. Bu, dikte sırasında gizliliği korur, ses incelemesi için kişilik tabanlı anlatım ekler ve gerçek sesinizi bulut transkripsiyonu hizmetlerinden uzak tutar.

Ses notu yakalama için en iyi Obsidian eklentileri hangileridir? En güvenilir iki eklenti Speech to Text (sesi Whisper’a satır içi transkripsiyonu için gönderir) ve Audio Notes (ses dosyalarını kaydeder ve yanında metin transkripsiyonuyla birlikte gömülü hale getirir). Her ikisi de VoxBooster’dan düşük gecikmeli ses yakalama sanal mikrofonunu içeren herhangi bir ses giriş cihazıyla çalışır.

VoxBooster, Windows’ta Obsidian ile çalışır mı? Evet. VoxBooster, Obsidian’ın ses giriş eklentilerinin doğrudan seçebileceği düşük gecikmeli bir ses yakalama sanal mikrofonunu ortaya çıkarır. 300ms altı gecikme, dönüştürülmüş sesin temiz bir şekilde Whisper’a ulaştığı ve dikte oturumları sırasında algılanabilir bir gecikme olmadığı anlamına gelir.

Bu kurulumu gizlilik açısından hassas ses notları için kullanabilir miyim? Whisper’ı yerel olarak çalıştırarak maruziyeti önemli ölçüde azaltabilirsiniz. Ses işlemesiyle birlikte ses özelliklerinizi değiştiren, yerel transkripsiyonu, hiçbir ham ses parmak izi makinenizi terk etmez.

Obsidian’ın kendisi Windows’ta çalışır mı? Obsidian platformlar arası bir uygulamadır ve Windows, macOS, Linux, iOS ve Android’de çalışır. Ancak VoxBooster yalnızca Windows 10/11 için geçerlidir. Bu iş akışındaki ses değiştiricisi bölümleri yalnızca Windows’ta uygulanır; ortaya çıkan notlar Obsidian Sync veya herhangi bir bulut klasörü aracılığıyla her yerde senkronize edilir.

Ses notlarını Obsidian Günlük Notlarıyla nasıl entegre ederim? Speech to Text eklentisi, transkripsiyonu yapılan metni bir günlük not şablonuna otomatik olarak eklemeye ayarlanabilir. Hedef dosyayı Günlük Notlar yolunuzda ayarlayın ve her dikte oturumu o günün notuna zaman damgalı bir blok koyar.

Obsidian’da ses notlarından Mermaid diyagramı oluşturabilir miyim? Otomatik olarak değil, ancak iş akışı bununla iyi eşleşir. Bir işlemin sözlü açıklamasını dikte edin, Whisper transkripsiyonunu alın, ardından metni Mermaid diyagramını çıktı veren bir dil modeli istemine yapıştırın. Sonucu çitli bir mermaid kod bloğuna kopyalayın ve Obsidian onu canlı olarak işler.

VoxBooster'ı dene — 3 günlük ücretsiz deneme.

Gerçek zamanlı ses klonlama, ses tahtası ve efektler — zaten konuştuğun her yerde.

  • Kart gerekmez
  • ~30ms gecikme
  • Discord · Teams · OBS
3 gün ücretsiz dene