Poszukiwanie najlepszego separatora ścieżek wokalnych o najwyższej jakości nawet dla głosów tła to punkt, w którym większość ludzi odkrywa, że wyodrębnienie głównego głosu jest łatwe, ale harmonie towarzyszące to część, która się opiera. Nowoczesny separator może wyciągnąć czysty głos główny w sekundy, ale w momencie, gdy wyizolujesz podkład instrumentalny, nadal słyszysz głosy widmowe, podwójne refreny i mgławicę pogłosu, która nie chce odejść. Ten przewodnik to podejście miłośnika jakości: dlaczego głosy tła są naprawdę najtrudniejszym sygnałem do separacji, co naprawdę wyróżnia wysokiej jakości separator ścieżek od szybkiej zabawki sieciowej i przepływ pracy, który wyciśnie najczystszy możliwy wynik z jakiegokolwiek narzędzia, na którym się wyląduje.
Streszczenie
- Głosy tła są trudne, ponieważ harmonie dzielą częstotliwości z głosem głównym, a ich ogony pogłosu rozprzestrzeniają się po całym miksie.
- Separacja wysokiej jakości pochodzi z modeli wielościeżkowych, przetwarzania pełnego pasma, dedykowanych ścieżek głosów tła i wejścia bezstratnego.
- Najlepszy separator ścieżek dla Twojej piosenki zależy od gatunku, gęstości miksera i tego, jak mokre są głosy, więc przetestuj dwa lub trzy.
- Przepływ pracy maksymalizujący jakość to: wejście bezstratne, separacja dwuetapowa, a następnie ręczne czyszczenie pozostałych harmonii i pogłosu.
- Nawet najlepsze narzędzia pozostawiają delikatne rozmycie, więc planuj ręczną edycję zamiast oczekiwać doskonałości jednym kliknięciem.
- VoxBooster jest narzędziem do tworzenia głosu, a nie separatorem ścieżek, więc znaj różnicę przed wybraniem oprogramowania.
Dlaczego głosy tła są najtrudniejszą częścią usuwania głosu
Jeśli kiedykolwiek próbowałeś usunąć głosy tła z zatłoczonego rekordu pop lub gospel, już znasz frustrację. Głos główny wychodzi czysto, ale ułożone harmonie, ad-liby i podwójne refreny przylegają do podkładu instrumentalnego, jakby były spawane. Są trzy fizyczne powody, dla których tak się dzieje.
Harmonie żyją w tych samych częstotliwościach co głos główny
Separator nie “słyszy” głosów tak jak ty. Uczy się wzorców statystycznych, które rozróżniają energię wokalną od energii instrumentalnej w całym spektrum. Głosy główne i tło są oba ludzkimi głosami, więc zajmują nakładające się zakresy częstotliwości i dzielą podobne struktury harmoniczne. Gdy dwaj śpiewacy trzymają trzecią, model widzi jedną pomieszaną teksturę wokalną, a nie dwa źródła, które może czysto podzielić. To nakładanie się jest sednem problemu oddzielania źródła audio pozostaje otwartym problemem badawczym zamiast rozwiązanym.
Ogony pogłosu i opóźnienia rozmywają granicę
Głosy tła są prawie zawsze bardziej mokre niż głos główny. Producenci cofają je w miksie za pomocą ciężkiego pogłosu i opóźnienia, aby głos główny pozostał z przodu. Te mokre ogony są rozproszone, rozłożone stereo i rozmyte w czasie, więc nie ma ostrej krawędzi, na której separator mógłby ciąć. Mokra energia wycieka również do szyny instrumentalnej, co oznacza, że nawet idealne wyodrębnienie suchego głosu pozostawia dźwięk pokoju.
Głosy tła są nisko umieszczone w miksie
Ponieważ harmonie są ciszej i często rozprowadzone szeroko, ich stosunek sygnału do szumu w stosunku do instrumentów jest słaby. Model wytrenowany do wychwycenia najgłośniejszego, najbardziej centralnego głosu z radością zignoruje miękką harmonię siedzącą na krawędziach obrazu stereo. To dlatego tak wiele narzędzi produkuje świetny utwór karaoke dla strof, a następnie przecieka przy stosach refrenu.
Aby uzyskać szerszy wgląd w to, jak te narzędzia działają pod spodem, przewodnik po /blog/free-vocal-eliminator obejmuje potok separacji od początku do końca.
Co wyróżnia wysokiej jakości separator ścieżek wokalnych od podstawowego
Nie wszystkie separatory są zbudowane w ten sam sposób, a luka między podstawowym splittetem a wysokiej jakości separatorem jest ogromna, gdy wchodzą głosy tła. Oto co należy szukać.
Modele wielościeżkowe pokonują splittety dwuścieżkowe
Starsze lub prostsze narzędzia wyjściowo tworzą dwa stem: wokal i instrumenty. Wszystko co wygląda jak głos trafia do jednej ścieżki. Wysokiej jakości separatory używają modeli wielościeżkowych, które dzielą perkusję, bas, inne i jedną lub więcej ścieżek wokalnych. Więcej ścieżek wyjściowych oznacza, że model został wytrenowany do bardziej precyzyjnych rozróżnień, co zwykle przełada się na mniej harmonii wyciekających do podkładu instrumentalnego.
Dedykowana ścieżka głosu tła jest złotym standardem
Najbardziej ważną cechą dla tego zadania jest separator, który wyjściowo tworzy głosy główne i tło jako oddzielne ścieżki. Gdy narzędzie może wyizolować głosy tła na własnej ścieżce, masz bezpośrednią kontrolę: zachowaj je, wycisz je lub zmiksuj ponownie na niższym poziomie. Narzędzia, które łączą każdy głos w jedną ścieżkę, zmuszają cię do walki z harmoniami ręcznie.
Przetwarzanie pełnego pasma, a nie niski cutoff
Tanie separatory często przetwarzają tylko do 11 lub 14 kHz, aby zaoszczędzić obliczenia, a następnie ponownie przywołują niezmienionym wysoki koniec. To pozostawia połysk cymbałów i powietrze wokalne w niewłaściwej ścieżce. Wysokiej jakości separator przetwarz całe słyszalne pasmo, które zachowuje jasność w podkładzie instrumentalnym i zmniejsza stłumiony, podwodny charakter, który nękuje narzędzia niskiego wysiłku.
Wsparcie wejścia bezstratnego
Jeśli narzędzie w ciszy downsampluje lub przyjmuje tylko skompresowane przesyłki, zmniejszyłeś swój pułap przed rozpoczęciem. Poważna jakość separacji ścieżek wokalnych zależy od podania czystego, nieskompresowanego dźwięku.
Co sprawia, że jakość separacji ścieżek wokalnych jest wysoka?
Jakość separacji ścieżek wokalnych jest połączonym wynikiem czterech czynników: architektury modelu wykonującego separację, czy przetwarzany jest cały pasmo częstotliwości czy obcięty, bitrate i wierność pliku wejściowego oraz czy narzędzie zapewnia dedykowane ścieżki dla głosów głównych w stosunku do głosów tła. Słabość w którymkolwiek z nich ogranicza wynik końcowy, bez względu na to jak dobre są pozostałe.
Pomyśl o tym jako o łańcuchu. Brylantny model zasilany MP3 o niskim bitrate będzie nadal halucynować artefakty z szumu kompresji. Nieskazitelny plik bezstratny uruchomiony przez dwuścieżkowy splitter z niskim cutoffem będzie nadal rozmywać harmonie i przytłumić wysokie. Maksymalizacja jakości oznacza zajęcie się każdym ogniwem, a nie tylko wybór popularnego narzędzia i marzenie. Ocena w /blog/free-vocal-remover dzieli się, jak sądzić te czynniki na rzeczywistych piosenkach.
Poziomy jakości: tabela porównawcza separatorów ścieżek
Różne kategorie narzędzi mają różne sufity jakości. Ta tabela uogólnia krajobraz według poziomów, zamiast wymienić produkty, ponieważ konkretni liderzy przesuwają się w miarę ulepszeń modeli. Użyj go do ustalenia oczekiwań co do tego, jak dobrze każda klasa obsługuje głosy tła.
| Poziom jakości | Typ modelu | Obsługuje głosy tła? | Obsługa ogonów pogłosu | Typowe artefakty | Najlepszy dla |
|---|---|---|---|---|---|
| Podstawowa zabawka sieciowa | Dwuścieżkowy, niski cutoff | Słabo, przecieka do podkładu | Brak | Stłumione wysokie, wokalny mur wodny | Szybkie jednorazowe karaoke |
| Standardowy separator | Czterościeżkowy, pełne pasmo | Uczciwie, niektóre przecieki harmonii | Minimalne | Blady głosy widmowe | Utwory ćwiczeniowe, szkice remiksu |
| Zaawansowany separator | Wielościeżkowy, pełne pasmo | Dobrze, zawarte | Częściowe | Okazjonalne rozmycie na mokrych miksach | Poważne remiksowanie, przygotowanie próbek |
| Maksymalizer jakości | Wielościeżkowy plus dedykowana ścieżka głosu tła | Najlepsze dostępne, własna ścieżka | Częściowe z usuwaniem pogłosu | Minimalne pozostałe harmonie | Profesjonalne instrumentale, pakiety ścieżek |
| Wykańczanie ręczne | Każdy z powyższych plus edytor | Zależy od przejścia źródła | Najlepsze z ręcznym usuwaniem pogłosu | Cokolwiek mogłeś pominąć | Finalne masteringi, wydania |
Wnioskowanie: najlepszy separator ścieżek to rzadko jeden klik. Najwyższej jakości wyniki w tym dolnym rzędzie pochodzą z połączenia silnego separatora z praktyką pracy ręcznej. Aby zapoznać się z przeglądem opcji bezpłatnych w tych poziomach, podsumowanie na /blog/vocal-remover-free to dobra mapa startowa.
Przepływ pracy maksymalizujący jakość w celu usunięcia głosów tła
Oto podejście dwuetapowe, które konsekwentnie pokonuje jeden klik, gdy musisz czysto usunąć głosy tła. Postępuj w kolejności.
- Zacznij od wejścia bezstratnego. Wyjmij lub wyeksportuj źródło jako WAV lub FLAC. Jeśli jedyną kopią jest plik skompresowany, nie koduj go ponownie. Szum kompresji traktowany jest jako sygnał i mnoży artefakty. Formaty bezstratne takie jak FLAC zachowują szczegóły wysokich częstotliwości, których potrzebuje model.
- Wybierz narzędzie wielościeżkowe. Wybierz separator, który wyjściowo tworzy co najmniej cztery ścieżki, najlepiej ten, który może sam wyizolować głosy tła. Więcej ścieżek oznacza precyzyjniejsze rozróżnienia.
- Uruchom pierwszy przebieg. Oddziel pełny miks. Zapisz każdą ścieżkę, włącznie z tymi, które myślisz, że nie będziesz potrzebować. Ścieżki “inne” i wokalne są ważne dla drugiego przebiegu.
- Sprawdź podkład instrumentalny solo. Pętli refren, gdzie harmonie nakładają się najtrudniej. Zanotuj dokładnie, gdzie głosy tła wyciekają. To mówi ci, co drugi przebieg musi naprawić.
- Uruchom drugi przebieg na resztkach. Weź ścieżkę wokalną (lub przeciekający podkład) i oddziel ją ponownie. Drugi przebieg na materiałem izolowanym często łapie harmonie, które pierwszy przebieg pogrzebał pod głosem głównym.
- Umyślnie ponownie połącz. Odbuduj swój podkład z najczystszych ścieżek. Jeśli narzędzie dało ci ścieżkę głosu tła, zdecyduj, czy całkowicie ją usunąć, czy złożyć ją ponownie na niskim poziomie dla naturalnego efektu pokoju.
- Zakończ ręcznie. Przejdź do czyszczenia ręcznego opisanego poniżej dla pozostałości, które żaden model nie złapie.
Ten proces zamienia szybkość na jakość, co jest całą ideą. Jeśli chcesz tylko najszybszą drogę do użytecznego utworu karaoke, prosta instrukcja na /blog/how-to-remove-voice-from-a-song obejmuje wersję jednoetapową.
Jak wyizolować głosy tła jako odrębną ścieżkę
Czasami celem nie jest usunięcie harmonii, ale wyizolowanie głosów tła, aby móc badać układ, pobrać próbę stosu lub ponownie wyważyć miks. Metoda zależy od Twojego narzędzia.
Jeśli separator wyjściowo tworzy ścieżkę głosu tła
Skończone w jednym kroku. Wyizoluj tę ścieżkę, sprawdź przeciek główny i jeśli główny przeciekł, uruchom wyizolowaną ścieżkę głosu tła przez drugi przebieg separacji, aby wypchnąć główny. To najczystszy tor i powód, dla którego warto szukać narzędzi wielościeżkowych.
Jeśli narzędzie tworzy tylko jedną ścieżkę wokalną
Musisz sам zbudować ścieżkę tła. Oddziel pełny miks, a następnie weź połączoną ścieżkę wokalną i uruchom ją przez podział główny czy reszta, jeśli Twoje narzędzie go oferuje. Kiedy tego nie robi, praktycznym zasobem jest ostrożna edycja: harmonie zwykle są szerzej rozprowadzone i niższe niż wycentrowany główny, więc przetwarzanie mid-side i brama ręczna mogą odzyskać przybliżoną ścieżkę głosu tła. Nie będzie chirurgiczna, ale jest często wystarczająca do poboru próbek lub odniesienia.
Czyszczenie ręczne: goni pozostałe harmonie i ogony pogłosu
Żaden separator nie łapie wszystkiego, więc ostatnia luka jakości jest zamykana ręcznie w edytorze. Otwórz swój podkład w edytorze przebiegów takiego jak podręcznik Audacity i pracuj poprzez pozostałości.
Notch i wyciszaj pozostałe harmonie
Pętle sekcji, gdzie harmonie przeciekły. Tam, gdzie głos widmowy siedzi w przestrzeni między instrumentami, prosta zmiana głośności lub wyciszenie klipu usuwa go bez dotykania otaczającej muzyki. Tam, gdzie pokrywa się z utrzymywaną nutą instrumentu, wąski notch EQ w obraźliwym formancie wokalnym zmniejsza go przy minimalnych stratach ubocznych.
Ujarzmij rozmycie pogłosu
Mokry ogon to uporna część, ponieważ jest wpieczony w podkład. Przebieg usuwania pogłosu go zmniejsza, a krótki fade głośności na izolowanych chwilach ogona ukrywa resztę. Zaakceptuj, że faint dźwięk pokoju może pozostać; nawet najlepszy separator ścieżek pozostawia niektóre, a ściganie doskonałości absolutnej często wyrzadza więcej szkody muzyce niż samo rozmycie.
Punkt-napraw z crossfadami
Gdy wytniesz lub wyciszysz pozostałości, zawsze crossfade’uj punkty edycji. Twarde cięcia tworzą kliknięcia, które są bardziej denerwujące niż usunięty głos widmowy. Małe, ostrożne crossfady utrzymują podkład brzmienia nieprzerwanie.
Szczere granice nawet najlepszego dzisiejszego separatora ścieżek
Ustalenie realistycznych oczekiwań jest częścią podejścia nastawionego na jakość. Oto gdzie obecna technologia nadal zawodzi.
- Pogłos jest wspólny, nie rozdzielny. Pokój i opóźnienie zastosowane do głosów tła również barwią podkład instrumentalny. Żadne narzędzie nie odwraca tego czysto.
- Gęste stosy są rozmyte razem. Harmonia sześcio-częściowa nagrana jako jedno wykonanie jest bliżej pojedynczego złożonego źródła niż sześć usuwalnych głosów.
- Artefakty skalują się z trudnością. Im trudniejsza separacja, tym bardziej prawdopodobne jest słyszenie warblingu, metalicznego dzwonienia lub kłębiącą się “podwodną” teksturę w cichu chwilach.
- Jakość zależy od piosenki. Narzędzie, które przybija rzadką balaladę akustyczną, może mieć problemy ze ścianą dźwięku produkcji. Zawsze testuj na rzeczywistym materiale.
- Jeden klik to obietnica marketingowa, a nie wynik masteringu. Instrumentale na poziomie wydania nadal potrzebują ręcznego przejścia opisanego powyżej.
Znając te granice, nie spalisz godzin próbując wymusić czysty wynik z miksem, który po prostu nie będzie się poddawać.
Gdzie VoxBooster pasuje (i gdzie nie)
By być jasnym i szczerym: VoxBooster nie jest separatorem ścieżek wokalnych, a jeśli separowanie istniejącej piosenki jest twoim jedynym celem, powyższe narzędzia to to, czego chcesz. VoxBooster to oprogramowanie Windows 10/11 do tworzenia i transformacji własnego głosu, a nie do rozmontowywania gotowych miksów.
Staje się istotne dla drugiej połowy przepływu pracy wielu twórców. Jeśli trafiłeś tutaj, ponieważ budujesz treść i chcesz czysty podkład do śpiewania, rapu lub narracji, VoxBooster obsługuje stronę głosu: zmianę głosu w czasie rzeczywistym, klonowanie głosu AI wytrenowane na Twoim własnym głosie z całkowicie lokalnym przetwarzaniem na urządzeniu, dzięki czemu nic nie opuszcza Twojego komputera i wirtualny mikrofon, który kieruje przetworzony dźwięk do dowolnej aplikacji nagrywania. Dla streamers i producentów, którzy potrzebują zarówno narzędzia separacyjnego, jak i narzędzia głosu, są się uzupełniające, a nie konkurujące. Możesz zobaczyć cały zestaw funkcji bez zobowiązywania się na trzydniową pełną wersję próbną bez karty kredytowej.
To rozróżnienie ma znaczenie, ponieważ wiele wyszukiwań “vocal remover” to naprawdę “chcę zrobić moją wersję tej piosenki”. Oddziel miks za pomocą właściwego narzędzia separacyjnego, a następnie stwórz warstwę wokalną za pomocą narzędzia głosu. Dwie kategorie, dwa zadania.
Najczęściej zadawane pytania
Jaki jest najlepszy separator ścieżek wokalnych o najwyższej jakości nawet dla głosów tła?
Najlepsze opcje to separatory wielościeżkowe, które wyjściowo utworzą dedykowaną ścieżkę głosu tła lub dodatkowego głosu, przetwarzają pełne spektrum częstotliwości i akceptują wejścia bezstratne. Żadne pojedyncze narzędzie nie wygrywa na każdej piosence, więc miłośnicy jakości uruchamiają dwa przebiegi i ręcznie czyszczą pozostałości.
Dlaczego głosy tła są trudniejsze do usunięcia niż głosy główne?
Głosy tła dzielą te same zakresy częstotliwości co głos główny, znajdują się niżej w miksie i są mocno nasycone pogłosem i opóźnieniami. Te mokre ogony rozciągają się po całym polu stereo, więc separator nie może wyraźnie narysować linii między głosem a instrumentem.
Jak usunąć głosy tła bez szkodzenia do podkładu instrumentalnego?
Zacznij od pliku bezstratnego, wybierz model wielościeżkowy i uruchom separację dwukrotnie. Najpierw wyodrębnij podkład instrumentalny, a następnie ponownie przetwórz wszelkie przecieki głosu. Zakończ poprzez ręczne wycięcie lub wyciszenie pozostałych harmonii w edytorze, aby podkład pozostał nieuszkodzony.
Co sprawia, że jakość separacji ścieżek wokalnych jest wysoka?
Jakość pochodzi z architektury modelu, przetwarzania pełnego pasma zamiast niskiego cutoff, wystarczająco wysokiej bitrate wejścia i dedykowanych ścieżek dla głosów głównych w stosunku do głosów tła. Narzędzia, które łączą wszystkie głosy w jedną ścieżkę, zawsze tracą harmonie.
Czy mogę wyizolować głosy tła jako odrębną ścieżkę?
Niektóre zaawansowane separatory wyjściowo tworzą więcej niż cztery ścieżki, dzieląc głosy główne i tło na oddzielne utwory. Jeśli Twoje narzędzie tworzy tylko jedną ścieżkę wokalną, wyizoluj głosy tła drugim przebiegiem na resztkach, a następnie bramkuj i panoramuj, aby je odzyskać.
Czy wejście bezstratne poprawia jakość separacji ścieżek?
Tak. Pliki stratne odrzucają szczegóły wysokich częstotliwości i dodają szum kompresji, który model błędnie traktuje jako sygnał. Dostarczenie WAV lub FLAC daje separatorowi czystsze dane, co znacznie zmniejsza artefakty zarówno w podkładzie instrumentalnym, jak i wyodrębnionych głosach tła.
Czy istnieje separator ścieżek, który usuwa ogony pogłosu na głosach?
Kilka zaawansowanych separatorów częściowo usuwa pogłos, ale żadne narzędzie nie usuwa długich ogonów idealnie. Mokre refleksje żyją również w podkładzie instrumentalnym. Spodziewaj się delikatnego rozmycia i usuń resztę przebiegiem usuwającym pogłos lub ręczną edycją po separacji.
Podsumowanie
Najlepszy separator ścieżek wokalnych o najwyższej jakości nawet dla głosów tła to mniej jeden produkt, a bardziej zdyscyplinowany proces: silny model wielościeżkowy, wejście bezstratne, dwa przebiegi separacji i cierpliwe czyszczenie ręczne harmonii i ogonów pogłosu, które żaden model w pełni nie łapie. Głosy tła są trudne z naprawdę fizycznych powodów, więc traktuj każdą obietnicę jednym kliknięciem ze zdroworozsądkowym sceptycyzmem i osądzaj narzędzia na tym, jak obsługują twoje najgęstsze, najmokrsze refreny, a nie ich łatwe demo. Jeśli Twój projekt obejmuje również tworzenie lub transformację własnego głosu zamiast tylko wyodrębniania ścieżek, VoxBooster jest jedną wartą rozważenia opcją na jego bezpłatnej wersji próbnej, ponieważ separacja ścieżek i tworzenie głosu to dwa różne zadania, które dobrze się razem parują. Pobierz VoxBooster aby spróbować strony głosu, podczas gdy Twój ulubiony separator zajmuje się ścieżkami.