Najlepsze czyste ustawienia mikrofonu dla modułu zmiany głosu

Dostosuj najlepsze czyste ustawienia mikrofonu dla każdego zmieniacza głosu w czasie rzeczywistym: wzmocnienie wejścia, tłumienie szumów, filtr górnoprzepustowy, umieszczenie mikrofonu i strojenie bufora o niskim opóźnieniu.

Jeśli zmieniacza głosu w czasie rzeczywistym brzmi syczący, ostro lub robotycznie, naprawa prawie zawsze żyje w ustawieniach mikrofonu, a nie w ustawieniu efektu. Najlepsze czyste ustawienia mikrofonu dla zmieniacza głosu to takie, które dają przetwarzaniu czysty, dobrze wyrównany sygnał od razu, ponieważ wszystko poniżej dziedziczy to, co weszło. Ludzie szukający najlepszych czystych ustawień mikrofonu w Voicemod lub jakimkolwiek podobnym narzędziu zwykle mają ten sam rzeczywisty cel: naturalny, wolny od artefaktów wynik, który nie brzmi tak, jakby wyszedł z dna puszki metalowej.

Ten przewodnik jest niezależny od narzędzia. Zasady wzmocnienia, filtrowania, umieszczenia i bufora poniżej dotyczą każdego zmieniacza głosu w czasie rzeczywistym na Windows. Na koniec pokazujemy, jak dostroić je za pomocą VoxBooster, ale same ustawienia są uniwersalne i poprawią Twój dźwięk bez względu na to, co uruchamiasz.


TL;DR

  • Ustaw wzmocnienie wejścia tak, aby Twój głos osiągał szczyty wokół -12 do -6 dBFS, z zapasem, aby głośne chwile nigdy nie osiągnęły 0 dBFS
  • Dodaj delikatny filtr górnoprzepustowy w pobliżu 80 do 100 Hz, aby odcinać hałas, uderzenia biurka i hałas manipulacyjny
  • Użyj umiarkowanego tłumienia szumów (mniej więcej 50 do 70 procent), a nie na maksimum, aby uniknąć cienkich dźwięków podwodnych
  • Użyj filtra pop i umieść mikrofon kardioidalny blisko i nieznacznie poza osią dla pasywnego odrzucenia hałasu
  • Uruchom 48 kHz i najmniejszy bufor, który Twój procesor obsługuje bez trzeszczeń dla niskiego opóźnienia
  • Monitoruj przez słuchawki, aby wychwycić przycięcie i artefakty w czasie rzeczywistym
  • Unikaj układania nadmiarowych efektów i tłumienia w kilku aplikacjach naraz

Co naprawdę oznaczają „czyste ustawienia mikrofonu”?

Czyste ustawienia mikrofonu to konfiguracja wejścia, która dostarcza dobrze wyrównany, niskoszumowy, wolny od hałasu sygnał do zmieniacza głosu przed zastosowaniem jakiejkolwiek transformacji. To oznacza odpowiednie wzmocnienie z zapasem, filtr górnoprzepustowy do usuwania energii podwokalistycznej, rozsądną kontrolę szumów i dobre umieszczenie mikrofonu. Celem jest czysty punkt wyjścia, ponieważ procesor w czasie rzeczywistym może tylko kształtować to, co mu dajesz.

Powód, dla którego ma to takie znaczenie dla zmieniacza głosu, polega na tym, że zmiana tonacji, kształtowanie formantów i generyczna konwersja głosu AI amplifikuje wszelkie niedoskonałości w źródle. Mały szum tła staje się teksturą fali po przetworzeniu. Obcięty szczyt staje się niemilym cyfrowym trzaskiem. Czysty wejście nie jest dodatkiem miło mieć; to pojedynczy największy dźwignia, którą masz nad jakością wyjścia.

Dlaczego sygnał wejściowy decyduje o wszystkim

Każdy zmieniacza głosu w czasie rzeczywistym działa jako potok: Twój sygnał mikrofonu wchodzi, jest przekształcany i wychodzi. Jeśli wejście niesie hałas, przekształcony głos niesie ten hałas również, często wzmocniony. Jeśli wejście się przytnie, wyjście zniekształca się w taki sposób, że żaden predefiniowany nie może cofnąć.

Dwaj ludzie uruchamiający identyczne oprogramowanie z identycznym ustawieniem mogą uzyskać zupełnie inne wyniki wyłącznie ze względu na ich łańcuch wejściowy. Jeden ma skalibrowane wzmocnienie, filtr górnoprzepustowy i mikrofon kardioidalny sześć cali od ust. Drugi ma gorący, przycięty sygnał z mikrofonu laptopa w drugiej części pokoju odbierającego wentylator sufitowy. To samo oprogramowanie, przeciwne wyniki. Dlatego ustawienia pokonują predefiniowane.

Krok po kroku: czyste ustawienie mikrofonu dla zmieniacza głosu

Postępuj w tej kolejności. Każdy krok zakłada, że poprzedni został ukończony, ponieważ kalibracja wzmocnienia jest bezznaczeniowa, jeśli ustawisz ją przed umieszczeniem mikrofonu, a efekty brzmią prawidłowo tylko wtedy, gdy sygnał pod nimi jest czysty.

  1. Najpierw umieść mikrofon. Umieść mikrofon kardioidalny 6 do 8 cali od ust, pod niewielkim kątem poza osią, aby mówić w poprzek zamiast bezpośrednio do niego. To wykorzystuje biegunowy wzór mikrofonu do biernego odrzucania hałasu pokoju przed dotknięciem sygnału przez jakiekolwiek oprogramowanie, a mówienie w poprzek kapsuły zmniejsza wybuchy wybuchowe.

  2. Dodaj filtr pop lub piankową ekran wiatrowy. Spółgłoski wybuchowe jak “p” i “b” pchają wybuchy powietrza, które trafiają w kapsułę jako niskoczęstościowy hałas. Filtr pop umieszczony na kilka cali przed mikrofonem rozprasza ten wybuch, aby nigdy nie wszedł do sygnału w pierwszej kolejności.

  3. Ustaw wzmocnienie wejścia dla zapasu. Mów normalnym głosem wykonawczym i obserwuj miernik wejścia. Dostosuj Windows lub interfejs wzmocnienia tak, aby Twoje szczyty osiądły wokół -12 do -6 dBFS. To pozostawia zapas, aby nieoczekiwane głośne chwile nie osiągnęły 0 dBFS i przycięcia. Zbyt cicho (poniżej -24 dBFS) jest również błędem, ponieważ przetwarzanie musi następnie wzmocnić sygnał i szum tła z nim.

  4. Włącz delikatny filtr górnoprzepustowy. Ustaw filtr górnoprzepustowy gdzieś między 80 a 100 Hz z delikatnym nachyleniem. To usuwa hałas, brzęk HVAC, wibracje biurka i hałas manipulacyjny, które żyją poniżej zakresu mowy. Utrzymaj częstotliwość narożnika skromną, aby Twój głos zachował naturalny niski koniec; odcinanie zbyt wysoko sprawia, że brzmisz cienka i do słuchawki.

  5. Zastosuj umiarkowane tłumienie szumów. Włącz tłumienie szumów, ale opieraj się pokusie, aby zmaksymalizować go. Zacznij około 50 do 70 procent. To zwykle wystarczy dla wentylatorów i szumów komputera, pozostawiając Twój głos nienaruszony. Agresywne tłumienie to główna przyczyna cienkich, metalicznych, podwodnych artefaktów, którymi ludzie winią sam zmieniacza głosu.

  6. Ustaw szybkość próbkowania i bufor dla niskiego opóźnienia. Wybierz szybkość próbkowania 48 kHz, która jest standardem i więcej niż wystarczająca do głosu. Następnie wybierz najmniejszy bufor audio, który Twój procesor może obsługiwać bez trzeszczeń lub przerw. Mniejsze bufory obniżają opóźnienie, ale zwiększają obciążenie CPU, więc stopniowo zmniejszaj bufor i zatrzymaj się w momencie, gdy usłyszysz błędy.

  7. Włącz monitorowanie przez słuchawki. Skieruj przetworzony wynik do słuchawek, abyś słyszał dokładnie to, co słyszy Twoja publiczność, w czasie rzeczywistym. Użyj słuchawek zamkniętych, aby zapobiec pętlom sprzężenia zwrotnego. Monitorowanie to jak wychwytasz przycięcie, artefakty i nadmierne opóźnienie natychmiast zamiast odkrywania ich po emisji.

  8. Dodaj efekty ostatecznie i oszczędnie. Mając czysty, wyrównany, filtrowany sygnał poniżej, teraz zastosuj predefiniowany zmieniacza głosu. Dodaj jedną transformację na raz i posłuchaj. Układ wielu efektów lub uruchomienie tłumienia w dwóch aplikacjach na raz to co wprowadza artefakty. Powściągliwość tutaj to co oddziela czysty wynik od robotycznego wyjścia.

Tabela ustawień na jednym ekranie

Oto wszystko na jednym rzucie oka. To są rozsądne punkty wyjścia dla każdego zmieniacza głosu w czasie rzeczywistym; dostosuj do swojego pokoju i sprzętu stamtąd.

UstawienieZalecana wartośćDlaczego ma znaczenie
Wzmocnienie wejścia (poziom szczytowy)-12 do -6 dBFSPozostawia zapas, aby szczyty nigdy nie osiągnęły 0 dBFS i zniekształcenia
Filtr górnoprzepustowy80 do 100 Hz, delikatne nachylenieOdcina hałas, brzęk HVAC i hałas manipulacyjny poniżej zakresu mowy
Tłumienie szumów50 do 70 procent (umiarkowane)Usuwa wentylator i szumy komputera bez cienkich artefaktów podwodnych
Szybkość próbkowania48 kHzStandard dla głosu; wystarczająca przepustowość, bez marnotrawionego CPU
Rozmiar buforaNajmniejszy, który działa czystyNiskie opóźnienie do użytku w czasie rzeczywistym bez trzeszczeń lub przerw
Odległość mikrofonu6 do 8 cali, poza osiąBierne odrzucenie hałasu pokoju poprzez wzór kardioidalny
Filtr popWłączonyZatrzymuje wybuchy powietrza przed trafieniem kapsułę
MonitorowanieWłączone, przez słuchawkiSłysz przycięcie i artefakty w czasie rzeczywistym zanim Twoja publiczność
Ułożone efektyMinimalneMniej warstw oznacza mniej artefaktów i mniejsze opóźnienie

Unikaj przycięcia: główna przyczyna brudnego brzmienia

Przycięcie występuje, gdy Twój sygnał przekroczy 0 dBFS, cyfrowy sufit. Gdy próbka uderzy w ten sufit, wierzchołki fali są spłaszczone, a ten prostokątny kształt jest słyszalny jako ostre, trzęsące się zniekształcenie. Zmieniacza głosu nie może naprawić przycięty sygnał, ponieważ informacje, które były powyżej sufitu, po prostu zniknęły.

Miara, która zapobiega przycięciu, to zapas. Ustawiając wzmocnienie tak, aby normalne szczęty mówienia siedziały wokół -6 dBFS, pozostawiasz około 6 dB miejsca na chwile, gdy śmiejesz się, krzyczesz lub stajesz się animowany. Jeśli miernik regularnie uderza w górę, cofnij wzmocnienie, aż się nie stanie. Zawsze lepiej jest biegać nieco cicho i podnosić głos później niż przytnie i permanentnie stracić sygnał. Jeśli chcesz głębszą referencję na praktyce poziomu i głośności, Audio Engineering Society publikuje normy i materiały edukacyjne na ten temat.

Tłumienie szumów bez podwodnego brzmienia

Tłumienie szumów jest potężne i łatwe do przesadzenia. Współczesne modele tłumienia są dobre w rozdzielaniu głosu od stałego szumu tła, takiego jak wentylatory i klimatyzacja, ale każdy algorytm ma punkt, gdzie naciskanie ciężej zaczyna jeść sam głos. To jest miejsce, w którym pochodzi cienka, robotyczna, podwodna jakość, a ludzie często winią zmieniacza głosu, gdy prawdziwym winowajcą jest suwak tłumienia naciśnięty na 100 procent.

Rozwiązaniem jest warstwowe podejście. Zmniejsz szum u źródła za pomocą mikrofonu kardioidalnego, bliskiego umieszczenia i filtra górnoprzepustowego z kroków konfiguracji. Usuwają te fizyczne i filtrujące środki wiele szumu za darmo, bez dotykania Twojego głosu. Następnie zastosuj tylko umiarkowane tłumienie szumów w oprogramowaniu na górze, aby wyczyścić to, co pozostaje. Tłumienie powinno być ostatnie kilka procent pracy, a nie całą pracę. Jeśli chcesz pełny podział, patrz nasz przewodnik na jak usunąć szum tła z mikrofonu.

Opóźnienie: szybkość próbkowania i bufor, wyjaśnione po prostu

Dla zmieniacza głosu w czasie rzeczywistym opóźnienie to opóźnienie między mówieniem a usłyszeniem przetworzonego wyniku. Zbyt dużo opóźnienia dezorientuje podczas monitorowania i jest niezręczne w rozmowie na żywo. Dwa ustawienia kontrolują go większość: szybkość próbkowania i rozmiar bufora.

Szybkość próbkowania to ile razy na sekundę audio jest mierzone. 48 kHz jest standardem dla głosu i daje Ci całą przepustowość, którą potrzebuje mowa. Wyższe stawki, takie jak 96 kHz, dodają obciążenie CPU i użycie dysku bez znaczącego zysku jakości dla zmieniacza głosu, więc 48 kHz to słodka plamka.

Rozmiar bufora to liczba próbek, które system zbiera przed przetworzeniem kawałka. Mniejszy bufor oznacza mniej opóźnienia, ale częstsze przetwarzanie, które wymaga więcej CPU. Jeśli procesor nie może dotrzymać, otrzymasz trzeszczeń i przerw. Prawidłowy bufor to najmniejszy, który nadal działa czysty na Twojej maszynie, znaleziony przez zmniejszenie go o krok na raz, aż usłyszysz błędy, a następnie cofnięcie się o jeden krok.

Błędy, które cicho psują Twój dźwięk

Tłumienie stosu w aplikacjach. Uruchomienie tłumienia szumów w Discord, osobnej aplikacji tłumienia i zmieniacza głosu na raz oznacza trójkrotne przetwarzanie. Wynikiem jest ondulacja i artefakty. Wybierz jedną pierwotną ścieżkę tłumienia i wyłącz pozostałe.

Łańcuchy dwie aplikacje z kablem wirtualnym. Przewodzenie autonomicznego narzędzia tłumienia do oddzielnego zmieniacza głosu przez wirtualny aparat audio dwukrotnie przetwarza Twój sygnał i dodaje opóźnienie przy każdym skoku. Zintegrowany potok, który robi oba w jednym przebiegu, jest czystszy. Dlatego jedno narzędzie, które obsługuje tłumienie i przetwarzanie głosu razem, ma tendencję do pokonania łańcucha klejącego taśmą.

Podnoszenie wzmocnienia w celu kompensacji odległego mikrofonu. Jeśli mikrofon jest dwa stopy, wysokie wzmocnienie amplifikuje pokój wraz z Twoim głosem. Najpierw przenieś mikrofon bliżej, a następnie ustaw wzmocnienie.

Ustawianie filtra górnoprzepustowego zbyt wysoko. Filtr górnoprzepustowy na 200 Hz lub wyżej zaczyna usuwać naturalny corpus Twojego głosu i sprawia, że brzmisz cienka. Utrzymaj go delikatnie i nisko, około 80 do 100 Hz.

Zapominanie monitorowania. Bez monitorowania nie możesz stwierdzić, że przycina się lub generuje artefakty aż będzie za późno. Trzymaj słuchawki i słuchaj przetworzonego wyjścia.

Dostrajanie tych ustawień z VoxBooster

VoxBooster umieszcza każdą z tych kontrolek w jednym lokalnym potoku, co jest dokładnie tym, czego chce czyste wyjście. Ponieważ tłumienie, wyrównanie i przetwarzanie głosu odbywają się w jednym przebiegu, a nie w aplikacjach łańcuchowych, unikasz artefaktów z podwójnym przetwarzaniem opisanych powyżej.

  1. Pobierz i zainstaluj VoxBooster z voxbooster.com/download.
  2. Otwórz aplikację i wybierz swój prawdziwy mikrofon jako wejście. Główny ekran pokazuje żywą miernik wejścia.
  3. Mów normalnie i ustaw Windows lub interfejs wzmocnienia tak, aby szczyty siedziały wokół -12 do -6 dBFS na tym mierzeńcu.
  4. W ustawieniach przetwarzania audio włącz filtr górnoprzepustowy i ustaw umiarkowane tłumienie szumów, około 50 do 70 procent dla typowych wentylatorów i szumów komputera.
  5. Wybierz 48 kHz i zmniejsz bufor, aż opóźnienie będzie ciasne, wycofując się, jeśli usłyszysz trzeszczeń.
  6. Włącz monitorowanie przez słuchawki, abyś słyszał przetworzony wynik w czasie rzeczywistym.
  7. Dopiero teraz dodaj predefiniowany zmieniacza głosu lub generyczny głos AI na górze, jedną warstwę na raz, posłuchaj w czasie.

Ponieważ przetwarzanie działa lokalnie z niskim opóźnieniem i bez sterownika jądra, VoxBooster przechwyci Twój czysty sygnał i je go Discord, OBS, gry lub rozmowy bez przełączania wejść w każdej aplikacji. Jeśli chcesz porównać sprzęt podczas stroiowania, nasz przewodnik do najlepszego mikrofonu do zmieniacza głosu dobrze łączy się z tymi ustawieniami. Możesz spróbować całego łańcucha na 3-dniowej pełnej wersji zanim się zobowiążesz.

FAQ

Jakie są najlepsze czyste ustawienia mikrofonu dla zmieniacza głosu? Ustaw wzmocnienie wejścia tak, aby Twój głos osiągał szczyty wokół -12 do -6 dBFS, włącz delikatny filtr górnoprzepustowy w pobliżu 80 do 100 Hz, włącz umiarkowane tłumienie szumów i wybierz bufor, który utrzymuje niskie opóźnienie bez przerw. Następnie unikaj układania zbyt wielu efektów naraz.

Dlaczego mój zmieniacza głosu brzmi robotycznie lub pełno artefaktów? Najczęściej przyczyny to obcinane sygnały wejściowe, silne tłumienie szumów i efekty ułożone na sobie. Zmniejsz swoje wzmocnienie, aż szczyty osiądą w pobliżu -6 dBFS, poluzuj siłę tłumienia i usuń wszelkie nadmiarowe filtry działające w innej aplikacji w tym samym czasie.

Jaki poziom wzmocnienia wejścia powinienem osiągnąć? Dążyć do szczytów około -12 do -6 dBFS podczas normalnego mówienia. To pozostawia zapas, aby głośne chwile nigdy nie osiągnęły 0 dBFS, gdzie zaczyna się zniekształcenie i ostre artefakty. Sygnały poniżej -24 dBFS są zbyt cicho i zmuszają przetwarzanie do wzmocnienia hałasu tła.

Czy powinienem używać filtra górnoprzepustowego ze zmieniacza głosu? Tak, delikatny filtr górnoprzepustowy w pobliżu 80 do 100 Hz jest jednym z ustawień o najwyższej wartości. Usuwa nisko częstościowy hałas, uderzenia biurka i hałas manipulacyjny, który nic nie dodaje do mowy i daje przetwarzaniu tylko dodatkowy bałagan do pracy. Utrzymuj nachylenie delikatne, aby Twój głos zachował naturalny niski koniec.

Jak zmniejszyć hałas mikrofonu bez cieńszego brzmienia mojego głosu? Najpierw napraw hałas u źródła za pomocą mikrofonu kardioidalnego, bliskiego umieszczenia i filtra górnoprzepustowego. Następnie zastosuj tylko umiarkowane tłumienie szumów w oprogramowaniu, około 50 do 70 procent, zamiast ustawiania go na maksimum. Nadmiernie zastosowane tłumienie to główna przyczyna cienkich, podwodnych jakości, które ludzie nie lubią.

Jaka szybkość próbkowania i rozmiar bufora dają niskie opóźnienie? Szybkość próbkowania 48 kHz jest standardem i wystarczająca do głosu. Dla zmieniacza głosu w czasie rzeczywistym wybierz najmniejszy bufor, który twój procesor może obsługiwać bez trzeszczeń lub przerw. Mniejsze bufory zmniejszają opóźnienie, ale zwiększają obciążenie CPU, więc stopniowo zmniejszaj bufor i zatrzymaj się w momencie, gdy usłyszysz błędy.

Czy muszę monitorować mój własny głos poprzez zmieniacza głosu? Monitorowanie pomaga usłyszeć przetworzony wynik w czasie rzeczywistym, aby móc wychwycić przycięcie, artefakty lub nadmierne opóźnienie zanim zrobi to Twoja publiczność. Użyj słuchawek, aby uniknąć sprzężenia zwrotnego i utrzymaj umierkowony poziom monitorowania, aby mówić na naturalnym poziomie zamiast krzyczeć lub szeptać.

Podsumowanie

Czysty wynik ze zmieniacza głosu w czasie rzeczywistym nie chodzi o znalezienie magicznego predefiniowanego. Chodzi o podanie przetwarzaniu czystego sygnału: wzmocnienie z zapasem, delikatny filtr górnoprzepustowy, umiarkowane tłumienie, mikrofon kardioidalny umieszczony blisko i poza osią, 48 kHz przy niskim buforze i monitorowanie, aby wychwycić problemy na żywo. Dostań to prawo i prawie każde predefiniowane brzmi lepiej, ponieważ wejście pod spodem jest wreszcie czyste.

Zacznij od tabeli ustawień, dostosuj do swojego pokoju i sprzętu i dodaj efekty ostatecznie i oszczędnie. Jeśli chcesz wszystko w jednym lokalnym potoku o niskim opóźnieniu, aby nie łańcuchy aplikacji i nie stosy artefaktów, pobierz VoxBooster i uruchom powyższe kroki na pełnej wersji próbnej. Kilka minut ustawienia to różnica między głosem, który brzmi przetwarzany a głosem, który brzmi czysty.

Wypróbuj VoxBooster — 3 dni za darmo.

Klonowanie głosu w czasie rzeczywistym, soundboard i efekty — wszędzie, gdzie rozmawiasz.

  • Bez karty
  • ~30ms opóźnienia
  • Discord · Teams · OBS
Wypróbuj 3 dni za darmo