Audacity용 음성 변조기: 완전한 워크플로우 가이드
Audacity는 팟캐스트 세계의 큰 부분에 대한 기본 DAW입니다 - 무료이고, 검증되었으며, 음성 작업에 실제로 능합니다. 기본적으로 하지 않는 것은 실시간으로 음성을 수정하는 것입니다. 이 격차는 외부 음성 변조기가 들어오는 곳이며, 통합은 대부분의 사람들이 예상하는 것보다 깨끗합니다.
이 가이드는 전체 워크플로우를 안내합니다: 저지연 오디오 캡처를 통해 음성 변조기를 Audacity로 라우팅하고, 처리된 트랙을 기록하고, Audacity의 기본 제공 효과를 사용하여 사후 처리하고, 문자 음성을 위해 AI 음성 클로닝을 사용하고, 최종 녹음을 Whisper를 통해 파이핑하여 쇼 노트 트랜스크립트를 생성합니다.
TL;DR
- Audacity는 저지연 오디오 캡처 호환 입력을 기록합니다 - 음성 변조기가 선택 가능한 녹음 장치가 됩니다.
- Audacity의 장치 도구 모음에서 음성 변조기를 입력 소스로 설정하십시오; Audacity 내에 플러그인이나 확장이 필요하지 않습니다.
- 깨끗한 최종 오디오를 위해 녹음 후 Audacity의 노이즈 감소 + 이퀄라이저 체인을 실행하십시오.
- AI 음성 클로닝을 사용하면 단순히 피치 시프트가 아닌 실제로 다르게 들리는 문자 음성을 녹음할 수 있습니다.
- Whisper 트랜스크립션은 내보낸 WAV에서 몇 분 내에 쇼 노트를 생성합니다.
- 전체 워크플로우는 커널 드라이버를 설치할 필요 없이 모든 Windows 10/11 머신에서 실행됩니다.
Audacity가 여전히 독립 팟캐스터의 최고 선택인 이유
Audacity는 2000년부터 존재해 왔으며 독립 팟캐스트 공간에서 지배적인 상태를 유지하고 있는 간단한 이유는 완전히 무료이고 모든 것에서 실행되며 음성에 집중하는 팟캐스터가 실제로 필요한 모든 것을 수행하기 때문입니다. 버전 3.6(2024년 후반에 릴리스됨)은 실시간 모니터링 개선 사항을 추가했으며 제3자 오디오 라우팅을 훨씬 더 안정적으로 만드는 저지연 오디오 캡처 호스트 지원을 개선했습니다.
오픈 소스 모델은 구독이 없음, 기능 게이트 없음, 클라우드 의존성 없음을 의미합니다. 예산으로 주간 쇼를 운영하는 취미 애호가 또는 음성 데모를 녹음하는 뮤지션의 경우, 이 0 비용 프로필은 중요합니다. 트레이드오프는 Audacity가 기본 음성 변환을 하지 않는다는 것입니다: 수신한 것을 기록하고, 사실 후 처리하고, 깨끗한 오디오를 내보냅니다. 동적 효과는 외부에서 발생합니다.
이 제한은 실제로 이해하면 워크플로우 이점입니다. Audacity는 편집 및 내보내기 계층이 됩니다. 별도의 도구가 실시간 음성 변환을 처리합니다. 두 구성 요소는 독립적입니다 - 다른 구성 요소를 중단하지 않고 어느 하나를 교체할 수 있습니다.
저지연 오디오 캡처 이해: 이 워크플로우가 중요한 이유
저지연 오디오 캡처(Windows 오디오 세션 API)는 Microsoft의 저지연 오디오 인터페이스 계층으로, Vista에서 도입되었으며 Windows 10 및 11을 통해 상당히 개선되었습니다. 애플리케이션과 오디오 하드웨어 사이에 있어서 커널 수준 드라이버를 요구하지 않고 사용자 공간에서 오디오를 처리합니다.
팟캐스터와 뮤지션의 경우, 저지연 오디오 캡처는 두 가지 이유로 중요합니다:
- 구형 MME/DirectSound 인터페이스보다 낮은 지연 - 일반적으로 5-15ms 대 MME의 50+ms. 녹음하는 동안 자신의 음성을 모니터링하기 위해 이 차이는 들을 수 있습니다.
- 저지연 오디오 캡처 루프백 녹음 - Windows를 통해 재생 중인 모든 오디오(음성 변조기의 출력 포함)를 Audacity의 녹음 입력으로 캡처할 수 있습니다. 이것은 전체 워크플로우를 가능하게 하는 메커니즘입니다.
Audacity의 장치 도구 모음(상단의 드롭다운 행)에서 Host를 Windows low-latency audio capture로 설정할 수 있습니다. 이것은 저지연 오디오 캡처 독점 모드(가장 낮은 지연)와 입력 드롭다운의 저지연 오디오 캡처 루프백 장치를 모두 잠금 해제합니다. 저지연 오디오 캡처 장치에 출력하는 모든 애플리케이션 - 가상 오디오 끝점을 만드는 음성 변조기 포함 - 여기에 나타납니다.
Audacity 입력으로 음성 변조기 설정
설정은 약 2분이 걸립니다:
-
음성 변조기를 설치하고 시작하십시오. Audacity를 열기 전에 마이크에서 오디오를 처리 중인지 확인하십시오.
-
Audacity를 열기. 장치 도구 모음에서 Host를 Windows low-latency audio capture로 설정하십시오.
-
녹음 장치 드롭다운을 클릭하십시오. 물리적 마이크와 음성 변조기에서 만든 가상 장치를 볼 수 있습니다. 음성 변조기가 저지연 오디오 캡처 가상 끝점을 사용하는 경우 이름으로 여기에 나타납니다.
-
음성 변조기의 출력 장치를 선택하십시오. 도구에 따라 “음성 변조기 출력” 또는 응용 프로그램 자체의 이름으로 레이블이 지정될 수 있습니다.
-
짧은 테스트 클립을 녹음하십시오. 재생하여 처리된 음성이 아닌 원시 마이크 신호를 듣는지 확인하십시오.
장치가 나타나지 않으면 두 가지를 확인하십시오: 음성 변조기가 활발히 실행 중이어야 하고, Windows 사운드 설정에서 기본 재생 장치로 설정되거나 명시적으로 활성화되어야 합니다. 일부 도구는 루프백 캡처를 노출하기 위해 저지연 오디오 캡처 루프백으로 가상 장치를 시스템 기본값으로 설정해야 합니다.
가상 장치 대신 저지연 오디오 캡처 주입을 사용하는 도구 - VoxBooster의 접근 방식 - 다르게 작동합니다: 이들은 Windows 오디오에 후킹되어 Audacity가 물리적 마이크를 입력으로 보지만 통과하는 오디오는 이미 처리되었습니다. 이 경우 Audacity에서 물리적 마이크를 선택하면 변환된 신호가 투명하게 녹음됩니다.
Audacity에서 세션 녹음
음성 변조기 라우팅이 확인되면 표준 Audacity 녹음 관행이 적용됩니다. 음성에 맞게 조정된 몇 가지 설정:
샘플 레이트: 44,100Hz는 음성 주파수를 여유 있게 다룹니다. 48,000Hz도 좋습니다 - 리샘플링을 피하기 위해 인터페이스가 기본적으로 지원하는 것을 사용하십시오.
비트 깊이: 32비트 부동소수점에서 녹음하십시오. Audacity는 어쨌든 32비트 부동소수점에서 내부적으로 작동하므로, 이를 일치시키면 변환 단계를 피하고 사후 처리 이퀄라이저 및 압축을 위한 헤드룸을 보존합니다.
모니터링: 오버더브 모니터링을 활성화하여(Shift+녹음 버튼 클릭) 녹음하는 동안 실시간으로 처리된 음성을 들을 수 있습니다. 피드백을 방지하도록 모니터링 볼륨을 설정하십시오.
룸 음향: 음성 변조기는 상자 모양의 룸을 고치지 않습니다. 옷으로 배열한 옷장 또는 마이크 뒤의 반사 필터는 모든 처리 체인보다 최종 녹음 품질에 더 큰 차이를 만듭니다.
Audacity에서 사후 처리: 표준 음성 체인
Audacity의 Effect 메뉴에는 원시 녹음에서 출시 준비 오디오로 이동하는 데 필요한 모든 것이 있습니다. 이 체인은 대부분의 음성 자료를 처리합니다:
단계 1 - 노이즈 감소
음성 변조기가 녹음 전에 배경 소음을 이미 억제하지 않은 경우 여기서 먼저 수행하십시오. 각 세션의 시작 부분에 방 톤의 2초를 녹음하십시오(마이크 라이브 상태에서 침묵). 해당 지역을 선택하고, Effect > Noise Reduction로 이동하고, Get Noise Profile을 클릭한 다음, 전체 녹음을 선택하고 Reduction 약 12dB, Sensitivity 6, Frequency smoothing 3으로 효과를 적용하십시오.
음성 변조기가 이미 노이즈 억제를 처리하는 경우, 이 단계를 건너뛰십시오 - 두 노이즈 감소 통과를 스택하면 음성 문자가 저하됩니다.
단계 2 - 정규화
Effect > Normalize -1dB 피크까지. 이것은 조용한 녹음을 일관된 레벨로 가져옵니다. 압축기가 예측 가능한 신호 레벨을 보도록 압축 전에 이것을 실행하십시오.
단계 3 - 이퀄라이저 (필터 커브 EQ)
Effect > Filter Curve EQ는 Audacity 내부에 파라메트릭 EQ를 제공합니다. 음성의 경우:
- 저주파 럼블을 자르기 위해 80-100Hz에서 고역통과 필터
- 존재감을 위해 2-4kHz 주변에서 약간의 부스트(2-3dB)
- 녹음이 상자처럼 들리면 400-600Hz 주변에서 부드러운 자르기
AI 클론된 음성을 녹음한 경우, 대상 음성의 주파수 프로파일은 이미 처리된 신호에 포함되어 있습니다. EQ로 더 가볍게 이동하십시오 - 주로 룸을 수정하고 음성 문자를 형성하지는 않습니다.
단계 4 - 압축
Effect > Compressor 3:1 비율에서, 임계값 약 -18dB, 공격 0.2ms, 감쇠 1초. 이것은 동적 범위를 평평하게 하여 리스너가 볼륨 노브를 타지 않습니다. 자연 음성보다 고유하게 더 일관된 역학이 있는 음성 클론의 경우, 낮은 압축 비율(2:1 이하)이 종종 더 자연스럽게 들립니다.
단계 5 - 음성 정규화
팟캐스트 플랫폼(Spotify, Apple Podcasts)은 모노의 -16LUFS 통합 또는 스테레오의 -14LUFS를 지정합니다. Effect > Loudness Normalization을 사용하면 이 값을 직접 대상으로 할 수 있습니다. 내보내기 전에 마지막 단계로 이것을 실행하십시오.
AI 음성 클로닝 - 문자 음성
AI 음성 클로닝 사용 사례는 음정 변화기 또는 로봇 효과와 다릅니다. 음성을 수학적으로 왜곡하는 대신, 실시간으로 음성 패턴을 대상 음성 프로필에 매핑합니다 - 발음 및 타이밍을 보존하면서 당신의 변경된 버전이 아닌 실제 다른 사람처럼 들리는 음성을 생성합니다.
독립 팟캐스터의 경우, 이것은 구체적인 창의적 문을 열어줍니다: 음성 연기 기술 없이 문자 음성. 인터뷰 쇼는 각 반복 세그먼트에 고유한 페르소나를 제공할 수 있습니다. 소설 팟캐스트는 한 명의 사람이 읽은 여러 문자를 가질 수 있습니다. 튜토리얼 시리즈는 월요일 아침 또는 금요일 밤에 기록하는지 여부에 관계없이 일관된 “호스트” 음성을 가질 수 있습니다.
VoxBooster의 AI 음성 클로닝은 Windows 10/11에서 로컬로 실행됩니다 - 클라우드 처리 없음, 오디오가 머신을 떠나지 않습니다. 지연은 끝에서 끝까지 300ms 미만이며, 이는 녹음 컨텍스트에서 감지할 수 없습니다(라이브 스트리밍도 200-500ms 범위에서 헤드룸을 유지합니다). 커널 드라이버 대신 저지연 오디오 캡처 주입을 사용하므로 Windows는 이를 표준 오디오 장치로 취급합니다. Audacity는 깨끗한 입력을 봅니다.
실제 녹음 워크플로우: Audacity에서 녹음을 누르기 전에 VoxBooster에서 클론된 음성 프로필을 활성화하십시오. 트랙은 클론된 음성을 직접 캡처합니다. 테이크 사이의 프로필을 전환할 수 있습니다 - 소개 내레이션을 위해 자연 음성을 실행하고 대화 섹션을 위해 문자 프로필로 전환하십시오.
Whisper 트랜스크립트 내보내기 - 쇼 노트
Whisper는 OpenAI의 오픈 소스 음성 인식 모델로, Windows에서 로컬로 사용할 수 있습니다. 팟캐스터의 경우 완성된 녹음을 쇼 노트, 폐쇄 캡션 또는 검색 가능한 아카이브 콘텐츠로 제공하는 트랜스크립션으로 변환합니다.
워크플로우:
- 완성된 Audacity 프로젝트를 WAV 또는 FLAC 파일로 내보내십시오(File > Export Audio).
- 내보낸 파일을 Whisper를 통해 실행하십시오. 기본 모델은 대부분의 영어를 정확하게 처리합니다; 소형 또는 중형 모델은 악센트 음성 또는 기술 어휘에 더 좋습니다.
- Whisper는 지정한 출력 형식 플래그에 따라
.txt(일반 트랜스크립트) 또는.srt(타임스탬프 자막)를 출력합니다.
VoxBooster를 사용하는 경우, 내장된 Whisper 통합은 녹음 중 실시간으로 트랜스크립션됩니다. 세션을 마치고 트랜스크립트가 이미 대기 중입니다 - 별도의 사후 처리 단계 없음. 이것은 다중 단계 프로덕션 파이프라인을 유지하는 대신 빠르게 게시하려는 취미 애호가에게 중요합니다.
한 가지 중요한 주의: Whisper는 기본 스피커 신원이 아닌 음성 음소를 트랜스크립션합니다. AI 클론된 음성은 음성이 명확하고 언어 모델이 어휘에 익숙한 경우 올바르게 트랜스크립션됩니다. 실제로 AI 음성 클로닝은 자연 음성과 비교할 때 발음을 약간 부드럽게 하며, 이는 일반적으로 Whisper 정확도를 상처보다는 개선합니다.
Audacity 레이블 트랙 및 타임스탐프
Audacity의 레이블 트랙을 사용하면 텍스트 주석 - 소개, 인터뷰, 스폰서 읽기, 아웃로 등으로 타임라인의 지역을 표시할 수 있습니다. 이 레이블은 오디오 옆에 .txt 파일로 내보내지며, 올바르게 서식화되었을 때 호환 플레이어(Overcast, Pocket Casts)의 팟캐스트 장 표식에 직접 매핑됩니다.
Whisper 타임스탐프와 Audacity 레이블 트랙의 조합은 유료 소프트웨어 없이 전문 등급 에피소드에 대한 완전한 메타데이터 계층을 제공합니다. 편집하는 동안 레이블 트랙으로 장 경계를 표시하십시오; 캡션 업로드를 위해 Whisper .srt를 내보내십시오.
외부 효과 및 Audacity의 플러그인 지원
Audacity는 VST2, VST3, LV2 및 LADSPA 플러그인을 지원합니다. 이것은 기본 제공 효과보다 더 멀리 가고 싶은 취미 뮤지션에게 중요합니다.
음성 작업에 대해 알아야 할 무료 VST 플러그인:
- ReaPlugs ReaEQ - 파라메트릭 EQ, 무료, CPU에 가벼움
- TDR Nova - 별도의 플러그인 없이 de-essing을 처리하는 동적 EQ
- OrilRiver - 너무 건조하게 들리는 음성 클론에 방 분위기를 추가하기 위한 무료 리버브
Effect > Add / Remove Plug-ins > Rescan을 통해 Audacity에서 VST 플러그인을 설치하십시오. 스캔 후 효과는 Effect 메뉴의 범주에 나타납니다.
음성 클로닝을 위해 구체적으로 녹음 전에 리버브 추가를 피하십시오 - Audacity에서 후에 적용하십시오. 리버브를 구우려면 녹음을 하면 편집을 훨씬 더 어렵게 만듭니다. 음성 변조기는 피치, 포르먼트 및 음색을 처리해야 합니다; Audacity는 공간 효과를 처리합니다.
비교: Audacity의 음성 변조기 통합 방법
| 메소드 | 설정 복잡도 | 지연 | 안티-치트 안전 | Audacity 입력 |
|---|---|---|---|---|
| 가상 마이크 장치 | 일회 장치 선택 | ~10-20ms | 도구마다 다름 | 가상 장치 선택 |
| 저지연 오디오 캡처 루프백 | 저지연 호스트 설정, 루프백 선택 | ~5-10ms | 예(사용자 공간) | 루프백 장치 선택 |
| 저지연 오디오 캡처 주입 | 없음 - 자동 | ~5-10ms | 예(커널 드라이버 없음) | 물리적 마이크 선택 |
| 커널 드라이버 가상 장치 | 장치 선택 | ~5-20ms | 위험도는 다양 | 가상 장치 선택 |
| 직접 녹음(음성 변조기 없음) | 없음 | 하드웨어 제한 | N/A | 물리적 마이크 선택 |
저지연 오디오 캡처 기반 접근 방식(루프백 및 주입)은 최소 오버헤드, Windows 10 및 11에서 안정적으로 작동하며, 안티-치트 시스템과 상호 작용하지 않습니다 - 게임을 위해 설정을 사용하는 모든 사람과 관련이 있습니다.
완전한 세션: 녹음에서 게시된 에피소드까지
다음은 이 워크플로우에서 일반적인 독립 팟캐스트 세션이 어떻게 실행되는지입니다:
- 사전 세션: 음성 변조기 시작, 음성 프로필 선택(자연 또는 복제), 레벨 확인.
- Audacity 설정: 호스트를 저지연 오디오 캡처로 설정, 입력 장치 확인, 2초 노이즈 샘플 녹음.
- 녹음: 한 트랙의 전체 에피소드 또는 더 깨끗한 편집을 위해 세그먼트당 별도의 트랙.
- 노이즈 감소: 2초 샘플에서 노이즈 프로필을 가져오고, 전체 트랙에 적용하십시오.
- 편집: 필러 단어 절단, 긴 일시 중지 제거(나누기 위해 Command + I, 제거하려면 Delete).
- 효과 체인: 정규화 → 필터 커브 EQ → 압축기 → 음성 정규화(-16LUFS).
- WAV 내보내기: Whisper 트랜스크립션을 위한 전체 품질.
- Whisper 통과: 내보낸 WAV를 Whisper를 통해 실행; 트랜스크립션 검토 및 정리.
- MP3 내보내기: 128kbps 모노 또는 192kbps 스테레오의 최종 에피소드 파일.
- 게시: 호스팅 플랫폼에 MP3 + 트랜스크립션 업로드.
30분 에피소드에 대한 총 사후 녹음 시간: 트랜스크립트 검토를 포함하여 45-60분. 이것은 유료 프로덕션 도구와 경쟁력이 있습니다.
시작하기: 필요한 것
- Audacity 3.6+ - audacityteam.org에서 무료 다운로드. 저지연 오디오 캡처 호스트 옵션은 설치 직후 장치 도구 모음에 있습니다.
- Windows 10/11 머신 - Audacity는 macOS 및 Linux에서도 실행되지만 저지연 오디오 캡처는 Windows만 해당합니다; 이 가이드는 Windows에 특정입니다.
- 저지연 오디오 캡처 지원이 있는 음성 변조기 - VoxBooster의 3일 무료 평가판(신용 카드 필요 없음)은 여기서 설명한 전체 AI 클로닝 + Whisper 통합을 다룹니다. 유료 계획은 월 6.99달러부터 시작합니다.
- 괜찮은 마이크 - USB 콘덴서(Blue Snowball, Audio-Technica AT2020 USB)는 음성 작업에 충분합니다. 동적 마이크는 룸 노이즈 픽업을 줄입니다.
실시간 AI 음성 변환이 기술적으로 작동하는 방식에 대한 더 많은 컨텍스트는 실시간 음성 클로닝 가이드가 심층적으로 처리 파이프라인을 다룹니다. 팟캐스트 녹음 대신 라이브 스트리밍 컨텍스트를 위해 설정하는 경우, Discord 음성 변조기 설정은 병렬 워크플로우를 다룹니다.
자주 묻는 질문
Audacity 내에서 음성 변조기를 직접 사용할 수 있습니까?
Audacity는 Windows가 선택된 입력 장치로 전송하는 모든 것을 기록합니다. 음성 변조기에서 저지연 오디오 캡처 루프백 또는 가상 마이크를 Audacity의 입력 목록으로 라우팅하면 처리된 오디오가 기본적으로 기록됩니다. Audacity 내부에 플러그인이나 확장이 필요하지 않습니다.
Audacity 녹음을 위한 음성 변조기 설정의 최선의 방법은 무엇입니까?
Audacity의 장치 도구 모음에서 음성 변조기의 저지연 오디오 캡처 출력을 녹음 장치로 선택하십시오. VoxBooster를 포함한 저지연 오디오 캡처를 지원하는 대부분의 도구는 추가 구성 없이 자동으로 나타납니다. 녹음한 다음 Audacity의 기본 제공 효과를 사용하여 노이즈 감소 및 이퀄라이저를 처리하십시오.
음성 변조기 사용이 Audacity의 노이즈 감소 도구에 영향을 줍니까?
Audacity의 노이즈 감소는 녹음된 모든 오디오에서 작동합니다. 음성 변조기가 이미 녹음 전에 노이즈 억제를 적용하는 경우, Audacity의 노이즈 감소 단계는 대부분 불필요합니다. 앱 내 억제를 건너뛰면 Audacity에서 먼저 2초 노이즈 프로파일을 녹음한 다음 Effect 메뉴에서 노이즈 감소를 적용하십시오.
Audacity에서 음성이 변경된 녹음에서 Whisper 트랜스크립트를 내보내려면 어떻게 해야 합니까?
Audacity에서 세션을 WAV 또는 FLAC 파일로 녹음한 다음 Whisper(또는 Whisper 트랜스크립션을 포함하는 VoxBooster와 같은 도구)를 통해 실행하십시오. 결과 .srt 또는 .txt 파일은 쇼 노트 또는 폐쇄 캡션 소스로 직접 작동합니다. Audacity의 레이블 트랙도 타임스탬프를 동기화할 수 있습니다.
Audacity는 Windows 10 및 11 음성 변조기와 호환되합니까?
예. Audacity 3.6+은 기본적으로 저지연 오디오 캡처를 사용하여 낮은 지연 녹음을 위해 사용합니다. 저지연 오디오 캡처 호환 가상 장치를 노출하거나 저지연 오디오 캡처에 직접 연결하는 음성 변조기는 Windows 10 및 11에서 Audacity의 입력 장치 목록에 나타납니다.
실시간 AI 음성 클로닝을 수행한 다음 Audacity에서 편집할 수 있습니까?
예. 마이크를 녹음하는 것처럼 AI 클론된 음성을 Audacity를 통해 녹음하십시오. Audacity는 입력 장치가 생성하는 모든 음성을 캡처하므로 클론된 음성이 표준 오디오 트랙으로 녹음됩니다. 그런 다음 전체 Audacity 도구 세트로 잘라내고, 이퀄라이저를 적용하고, 압축하고, 내보낼 수 있습니다.
팟캐스트를 위해 Audacity에서 음성이 변경된 오디오를 녹음할 때 어떤 오디오 형식을 사용해야 합니까?
Audacity 내에서 32비트 부동소수점 WAV를 44.1kHz로 녹음하십시오 - 이렇게 하면 사후 처리를 위한 헤드룸이 보존됩니다. 최종 파일을 128kbps 모노(음성에 적합)로 MP3로 내보내거나 음악 베드를 혼합하는 경우 192kbps 스테레오로 내보내십시오. Audacity의 기본 제공 LAME 인코더가 변환을 처리합니다.
마무리
Audacity voice changer 워크플로우는 무료 도구 평판이 제안하는 것보다 더 capable합니다. 저지연 오디오 캡처 라우팅은 플러그인이나 해킹 없이 통합을 처리합니다. Audacity의 기본 제공 효과 체인 - 노이즈 감소, 이퀄라이저, 압축, 음성 정규화 - 릴리스 품질 팟캐스트 오디오에 충분합니다. AI 음성 클로닝은 과거에 전문 음성 배우 또는 값비싼 소프트웨어가 필요했던 창의적인 옵션을 추가합니다. Whisper는 자동으로 쇼 노트가 되는 트랜스크립션으로 루프를 닫습니다.
전체 스택은 테스트하는 데 아무 비용이 없습니다: Audacity는 무료, Whisper는 오픈 소스, VoxBooster의 평가판은 신용 카드 없이 3일 동안 전체 기능 세트를 실행합니다. 음성 변조기가 팟캐스트 또는 취미 뮤지션 워크플로우에 추가할 수 있는 것을 탐색하는 것을 미루었다면, 이것은 시작하기 위한 낮은 마찰 장소입니다.
VoxBooster를 다운로드하고 무료 평가판을 시작하십시오 - 10분 미만 안에 Audacity로 작업하는 AI 음성 클로닝, 저지연 오디오 캡처, 내장 Whisper 트랜스크립션을 얻으십시오.