나레이션 워크플로우를 위한 After Effects 음성 변조기
모션 그래픽은 시각적 매체입니다. 성공하기까지입니다. 브랜드 비디오, 설명자 또는 제품 프로모가 나레이션을 추가하는 순간 오디오 워크플로우는 구성만큼 중요합니다. 그러나 대부분의 After Effects 튜토리얼은 음성을 완전히 건너뛰고 제작 결정이 아니라 후반 작업 세부사항으로 취급합니다.
이 게시물은 특히 전문적으로 모션 그래픽을 구축하는 디자이너들을 위한 것입니다. 먼저 애니메이션을 하고 두 번째로 나레이션을 한 다음 고전적인 문제에 직면한 사람들입니다. 클라이언트가 다시 타이밍된 버전, 두 번째 언어 또는 다른 음성 특성을 원하고 원본 녹음 세션이 오래전에 지났을 때입니다.
요약
- After Effects에는 실시간 음성 처리가 없습니다. 실용적인 경로는 Adobe Audition으로 저지연 오디오 캡처를 한 후 Audition에서 AE로 라운드트립하는 것입니다.
- AI 음성 복제는 원본 녹음 후 애니메이션 타이밍이 변경될 때 재나레이션 문제를 해결합니다.
- 각 언어 트랙이 동일한 AI 나레이터 음성을 공유할 때 다국어 모션 그래픽 버전이 확장 가능해집니다.
- 300ms 미만의 저지연 오디오 캡처 지연으로 나레이션 녹음 중 처리된 음성을 자연스럽게 모니터링할 수 있습니다.
- Windows 10/11에서 커널 드라이버 또는 가상 케이블 소프트웨어가 필요하지 않습니다.
After Effects 나레이션이 다른 문제인 이유
팟캐스트 음성 변조기는 대화에 질감을 더합니다. 스트리밍 음성 변조기는 캐릭터를 만듭니다. 이들 중 어느 것도 애니메이션 타이밍과 긴밀한 동기화를 포함하지 않습니다.
모션 그래픽의 나레이션은 다릅니다. 음성이 시각적 비트에 잠겨 있기 때문입니다. 전환은 특정 프레임에서 발생합니다. 애니메이션된 제목은 단어 착지와 일치하도록 배치된 키프레임에 나타납니다. 전체 구성은 나레이터가 도달해야 하는 타이밍 결정 주위에서 호흡합니다.
이는 애니메이션의 모든 변경, 즉 반 초 더 빨리 나타나는 전환 또는 화면에 2초 더 오래 머물러 있는 아래쪽 세 번째가 나레이션 녹음을 무효화할 수 있음을 의미합니다. 음성이 더 이상 동기화되지 않습니다. 다시 녹음해야 합니다.
이것이 이 게시물이 해결하는 워크플로우 문제입니다.
After Effects가 오디오를 처리하는 방식 (및 수행할 수 없는 작업)
Adobe After Effects는 오디오 제작 환경이 아니라 합성 및 모션 그래픽 응용 프로그램입니다. 오디오 기능은 의도적으로 최소화되어 있습니다.
- 오디오 레이어는 비디오와 함께 타임라인에 나타납니다.
- 파형 표시는 대략적인 동기화 참조로 사용 가능합니다.
- 기본 볼륨 및 스테레오 팬 키프레임이 존재합니다.
- RAM 미리보기는 구성과 동기화하여 오디오를 재생합니다.
이것이 기본적으로 전체 목록입니다. 네이티브 음성 처리, 효과 체인, MIDI 또는 수정이 있는 라이브 모니터링이 없습니다. After Effects는 오디오 제작 작업을 형제 응용 프로그램인 Adobe Audition으로 연기합니다.
이는 AE 나레이션 워크플로우가 정의상 최소한 두 개의 애플리케이션을 포함한다는 의미입니다. 시각적 구성을 위한 AE 및 음성 제작을 위한 Audition (또는 다른 오디오 편집기).
Adobe Audition 라운드트립: 단계별
Adobe Audition 라운드트립은 After Effects 타임라인에 이미 배치된 오디오 자산을 편집하기 위한 공식 방법입니다. 다음과 같이 작동합니다.
단계 1: AE에 오디오 레이어 배치. 나레이션 .wav를 가져오고 구성에 배치합니다. 귀로 대략적으로 동기화합니다. 핸들을 자르고 단어를 시각적 비트와 정렬합니다.
단계 2: AE에서 Audition에서 엽니다. 오디오 레이어를 마우스 오른쪽 버튼으로 클릭하여 Adobe Audition에서 편집하십시오. Audition은 파일이 로드된 상태로 열리고 AE 타임라인은 뒤에 보입니다. Audition이 열려 있는 동안 AE를 스크럽하여 동기화를 확인할 수 있습니다.
단계 3: Audition에서 처리를 적용합니다. 노이즈 플로어를 정소합니다. 필요한 경우 EQ를 적용합니다. 볼륨 자동화를 조정합니다. 음성이 수정된 음성을 통해 녹음된 경우 이러한 처리 단계는 최소화됩니다. 음성 특성은 녹음 시간에 설정되었습니다.
단계 4: Audition에서 저장합니다. 파일을 저장합니다 (Ctrl+S). 변경은 자동으로 AE 구성으로 다시 전파됩니다. 재가져오기가 필요하지 않습니다. AE의 RAM 미리보기는 즉시 업데이트된 오디오를 반영합니다.
단계 5: 동기화 확인. AE에서 전체 RAM 미리보기를 실행합니다. 구문이 이제 시각적 비트에 약간 앞서거나 뒤처지면 Audition으로 돌아가서 해당 영역을 이동하고 다시 저장합니다.
라운드트립은 수동 가져오기 사이클의 마찰을 제거합니다. 나레이션 타이밍이 애니메이션에 대해 다듬어지는 모션 그래픽 프로젝트의 경우 이것이 올바른 워크플로우입니다. 오디오 내보내기 및 수동 재가져오기는 아닙니다.
저지연 오디오 캡처를 통해 Audition에 수정된 나레이션 녹음
Audition에 수정된 음성으로 나레이션을 녹음하려면 신호 체인은 다음과 같습니다.
마이크 → 음성 처리 (저지연 오디오 캡처) → Windows 오디오 장치 → Audition 입력
저지연 오디오 캡처 (Windows Audio Session API)는 소프트웨어가 최소 지연으로 오디오 하드웨어에 액세스할 수 있게 해주는 Windows 저수준 오디오 서브시스템입니다. 이전 Windows 오디오 경로와 달리 배타 모드의 저지연 오디오 캡처는 오디오 응용 프로그램에 Windows 오디오 믹서를 우회하는 직접 하드웨어 액세스를 제공합니다.
나레이션 녹음의 경우, 저지연 오디오 캡처 배타 모드는 대부분의 Windows 10/11 시스템에서 30ms 미만의 모니터링 지연을 달성합니다. 이는 높은 지연 (80ms 이상)으로 자신을 듣는 나레이터가 무의식적으로 속도를 늦추거나 음절 타이밍을 잃기 때문에 중요합니다. 30ms 이하는 기본적으로 실시간처럼 느껴집니다. 자연스럽게 말합니다.
실용적인 설정:
- VoxBooster의 출력 장치를 표준 Windows 재생 장치 (헤드폰 또는 Audition에 표시되는 가상 장치)로 설정합니다.
- Audition에서 입력 소스를 해당 장치로 설정합니다.
- 트랙을 준비하고 입력 모니터링을 활성화합니다.
- 나레이션을 녹음합니다. 말하는 동안 헤드폰에서 수정된 음성을 들립니다.
결과 녹음에는 이미 처리된 음성이 포함되어 있습니다. Audition에서 후반 작업 음성 수정 처리가 필요하지 않습니다. 여기서 Audition의 역할은 캡처, 편집 및 노이즈 처리이지 음성 변환이 아닙니다.
애니메이션 타이밍이 변경될 때 AI 재나레이션
여기서 현대 음성 워크플로우는 전통적인 나레이션 제작에서 벗어납니다.
전통적 모델: 클라이언트가 최종 애니메이션 컷을 승인하고 성우가 화면에 맞게 녹음하며 녹음이 잠깁니다. 그 이후의 변경 사항에는 세션 재예약이 필요합니다.
문제: 클라이언트가 나레이션 전에 진정한 최종 컷을 승인하는 경우는 드뭅니다. 재타이밍 요청이 녹음 후에 도착합니다. 때로는 클라이언트가 스크립트 자체를 변경합니다. 영어가 제공된 지 3주 후에 두 번째 언어 버전이 추가됩니다.
AI 음성 복제는 다른 모델을 허용합니다. 나레이터 음성이 복제되면(원본 성우 녹음 세션에서) 세션을 다시 예약하지 않고도 새로운 구문, 수정된 스크립트 또는 완전히 새로운 스크립트를 생성할 수 있습니다. 출력은 동일한 음성 음색과 특성을 사용합니다.
모션 그래픽 스튜디오의 경우 이것은 다음을 의미합니다.
재타이밍된 버전: 영향을 받은 구문만 다시 생성하고, Audition에서 이들 세그먼트를 바꾸고, AE에서 다시 동기화합니다.
스크립트 변경: 변경된 라인을 다시 생성합니다. 구성의 다른 모든 것이 유지됩니다.
다국어 버전: 동일한 나레이터 음성으로 번역된 스크립트를 생성합니다. 음성 특성은 성우가 그 언어를 말하지 않더라도 모든 언어에서 일관성이 있습니다.
일괄 재나레이션 (다양한 시장을 위한 동일한 모션 그래픽의 여러 버전)의 경우 이 워크플로우는 기존 녹음이 하지 않는 방식으로 확장됩니다.
다국어 모션 그래픽: 오디오 현지화 문제
국제 클라이언트를 위한 모션 디자인은 점점 더 동일한 자산의 언어 현지화 버전을 요구합니다. SaaS 회사의 제품 설명자는 동일한 60초 애니메이션의 영어, 스페인어, 포르투갈어, 독일어 및 일본어 버전이 필요할 수 있습니다.
기존 방식은 언어별로 별도의 성우를 고용하고 각 버전을 다시 녹음하며 텍스트 레이어를 개별적으로 조정하는 것입니다. 이는 일관성 문제를 만듭니다. 각 언어 버전은 다른 제작처럼 들립니다. 왜냐하면 그렇기 때문입니다.
일관된 나레이터 방식은 AI 음성 복제를 사용하여 단일 나레이터 신원에서 모든 언어 버전을 생성합니다. 음성 특성(속도, 음색, 음조)은 모든 버전에서 동일합니다. 언어만 변경됩니다.
AE 워크플로우 관점에서:
- 최종 영어 나레이션 오디오를 내보내고 구성에 대해 검증합니다.
- 각 번역된 스크립트를 동일한 나레이터 음성으로 생성합니다.
- AE에서 언어당 한 번 영어 구성을 복제합니다.
- 각 복제의 오디오 레이어를 현지화 버전으로 교체합니다.
- 현지화된 오디오의 구문 길이와 일치하도록 텍스트 레이어 타이밍을 조정합니다 (번역된 텍스트는 원본과 동일한 음절 수를 거의 갖지 않음).
5단계는 다국어 모션 그래픽의 실제 작업입니다. 번역된 구문은 종종 소스보다 길거나 짧습니다. 애니메이션의 텍스트 공개, 아래쪽 세 번째 및 운동 유형이 조정되어야 합니다. 일관된 나레이터 음성을 갖는 것은 그렇지 않으면 복잡한 현지화 작업에서 최소한 하나의 변수를 제거합니다.
참고: 다국어 AI 음성 생성기 워크플로우 및 다국어 뉴스룸 전달을 위한 음성 복제.
AE 나레이션 레이어를 위한 오디오 형식 표준
불필요한 문제를 생성하는 워크플로우 세부사항: AE로 가져오기 전에 오디오를 잘못된 형식으로 내보내기.
After Effects 나레이션 레이어의 신뢰할 수 있는 표준은 48kHz, 24비트, WAV입니다. 각 매개변수가 중요한 이유는 다음과 같습니다.
48kHz 샘플링 레이트: AE의 대부분의 비디오 프로젝트는 구성 오디오 설정에서 48kHz로 설정됩니다. 48kHz 구성으로 가져온 44.1kHz 파일은 AE가 렌더링 시간에 리샘플링하도록 강제합니다. 결과는 일반적으로 문제가 없지만 처리를 추가하며 때로는 미묘한 음높이 아티팩트를 생성합니다. 일치하도록 48kHz에서 기록 및 내보내기.
24비트 깊이: 16비트는 제공에 충분하지만 24비트로 작업하면 음악과 효과음이 나중에 혼합될 때 더 많은 여유가 제공됩니다. 나레이션 레벨은 낮은 볼륨에서 양자화 노이즈 없이 조정할 수 있습니다.
WAV, MP3 아님: MP3는 손실 압축을 도입합니다. AE 오디오 믹스에 음악, 사운드 디자인 및 추가 처리와 함께 앉을 나레이션 레이어의 경우 MP3의 압축 아티팩트가 청취할 수 있게 될 수 있습니다. 특히 조용한 숨결과 자음에서요. WAV는 무손실이며 나레이션 길이 파일에 대해 무시할 수 있는 파일 크기를 추가합니다.
비교: 모션 디자이너를 위한 나레이션 워크플로우 옵션
| 방법 | 재타이밍 시 재녹음? | 언어 규모 | AE 통합 | 성우 재예약 필요 |
|---|---|---|---|---|
| 전통적 VO 세션 | 예 | 언어당 | 수동 가져오기 | 예 |
| 자체 녹음, 수정 없음 | 예 | 언어당 | 수동 가져오기 | N/A |
| 저지연 오디오 캡처 + Audition 라운드트립 | 예 | 언어당 | 자동 라운드트립 | N/A |
| AI 클론 + 저지연 오디오 캡처 | 아니요 | 모두 한 번에 | 자동 라운드트립 | 아니요 |
| AI 클론만 (저지연 오디오 캡처 없음) | 아니요 | 모두 한 번에 | 수동 가져오기 | 아니요 |
저지연 오디오 캡처 + Audition 라운드트립 열은 저지연 오디오 캡처 자체가 재타이밍 문제를 해결하지 않음을 보여줍니다. 지연 및 라우팅 문제를 해결합니다. 재타이밍 솔루션은 AI 복제입니다. 두 가지 기능은 완전한 현대 나레이션 워크플로우에서 상호 보완적입니다.
After Effects의 실용적인 타이밍 동기화 기술
완벽하게 녹음된 나레이션도 AE의 시각적 동기화에는 의도적인 기술이 필요합니다.
마커를 사용하세요. AE에서 구성 타임라인과 오디오 레이어의 마커는 동기화 앵커로 사용됩니다. 특정 키프레임에 도달해야 하는 단어에 마커를 배치한 다음 오디오 레이어를 해당 마커가 정렬될 때까지 슬라이드합니다.
오디오로 스크럽하세요. AE에서 플레이헤드를 드래그할 때 Ctrl을 누릅니다. 특정 단어가 특정 프레임에 도달하는지 확인하기 위해 RAM 미리보기보다 빠릅니다.
Audition에서 개별 구문을 시간 늘리기. Audition의 시간 늘리기 도구는 눈에 띄는 음높이 아티팩트 없이 구문을 5~15% 단축하거나 연장할 수 있습니다. 작은 타이밍 불일치의 경우 (재녹음보다 2초 단축해야 하는 구문) Audition의 시간 늘리기가 더 빠르고 음성 특성을 유지합니다.
사전 제거 침묵. 나레이션 녹음은 일반적으로 라운드트립 전에 Audition에서 자를 수 있는 문장 간 침묵을 포함합니다. 더 단단한 나레이션 타이밍은 일반적으로 애니메이션 동기화를 개선합니다.
Windows 10/11에서 신호 체인 설정
전체 워크플로우를 위한 깔끔한 설정:
- 마이크를 시스템에 연결합니다 (USB 마이크 또는 인터페이스 - 둘 다 저지연 오디오 캡처에서 작동함).
- VoxBooster를 설치하고 입력 장치를 마이크로 구성합니다. 출력을 헤드폰 또는 가상 장치로 설정합니다.
- Adobe Audition에서 편집 → 환경설정 → 오디오 하드웨어로 이동합니다. 입력을 VoxBooster가 출력하는 장치로 설정합니다.
- Audition 트랙에서 입력 모니터링을 활성화합니다.
- After Effects에서 구성의 오디오 샘플링 속도가 녹음 대상 (48kHz)과 일치하는지 확인합니다.
- Audition에서 나레이션이 승인되면 파일 → 저장을 사용하여 AE로 자동 전파합니다.
커널 드라이버 설치가 필요하지 않습니다. Win10/11의 VoxBooster는 시스템 오디오 드라이버를 수정하지 않고 저지연 오디오 캡처를 통해 오디오를 라우팅합니다. 즉, 설정이 관리자 수준 시스템 변경 없이 작동하고 동일한 컴퓨터의 다른 오디오 소프트웨어와 충돌하지 않습니다.
관련 워크플로우는 팟캐스팅을 위한 음성 변조기 및 콘텐츠 크리에이터를 위한 음성 변조기를 참조하세요. Audition 특정 처리 체인은 Adobe Audition 음성 변조기 가이드를 참조하세요.
여러 나레이션 버전이 있는 AE 프로젝트 명명 및 구성
프로젝트에 원본 나레이션, 재타이밍된 버전 및 3개의 언어 버전이 있을 때 AE의 조직은 오류를 방지합니다.
- 버전 및 언어로 구성 명명:
Hero_60s_EN_v3,Hero_60s_ES_v1. - AE 프로젝트 구조의 전용
audio/narration/폴더에 나레이션 오디오 파일을 유지합니다. - 날짜 또는 버전 번호로 오디오 파일 버전:
hero_narration_EN_48k_v3.wav. - 비교를 위해 한 곳에서 모든 언어 버전을 유지하는 Audition의 다중 트랙 세션을 사용합니다.
이 구조는 클라이언트가 6개월 후에 수정된 스페인어 버전을 요청할 때 올바른 AE 구성 및 오디오 소스를 이름 없는 레이어를 통해 찾지 않고도 찾을 수 있도록 합니다.
모션 그래픽의 나레이션은 사후 생각이 아닙니다. 구성의 다른 모든 요소처럼 시간에 민감합니다. Audition 라운드트립, 저지연 오디오 캡처 기반 녹음 및 AI 재나레이션은 함께 첫 번째 녹음 세션 후 프로젝트가 불가피하게 변경될 때 반응성을 유지하는 워크플로우를 형성합니다.
여러 버전, 여러 언어 또는 둘 다를 제공하는 모션 디자이너의 경우 이들 도구는 재나레이션 비용을 전체 제작 세션에서 렌더링 및 동기화 조정의 오후로 이동시킵니다.
VoxBooster를 3일 동안 무료로 시도하세요. 저지연 오디오 캡처 라우팅, AI 음성 복제 및 Windows 10/11에서 300ms 미만의 지연. 커널 드라이버 없음, 가상 케이블 소프트웨어 없음, 관리자 문제 없음.