Trình tạo giọng AI Anime: Mỗi nguyên mẫu

Trình tạo giọng AI anime tạo bất kỳ giọng nói nhân vật nào - anh hùng shonen, cố vấn khàn khàn, mascot, kẻ ác. Tìm hiểu hai con đường AI và cách tạo của bạn.

Trình tạo giọng AI anime cho phép bạn xây dựng giọng nói nhân vật - không chỉ một mẫu tăng tốc độ - bằng cách kết hợp một timbre mục tiêu với các dòng được gõ hoặc hiệu suất diễn viên của riêng bạn. Vấn đề mà hầu hết các nhà sáng tạo gặp phải là “giọng anime” được coi là một âm thanh duy nhất, thường là nguyên mẫu cô gái sáng sủa và tràn đầy năng lượng, trong khi palet anime thực tế bao gồm từ một bậc thầy kiếm khàn khàn cũ đến một sinh vật mascot quỳu đến một kẻ ác nhẫn nhủi nhẫn. Bài viết này bao gồm toàn bộ phổ: cách mỗi nguyên mẫu nghe âm học, hai con đường AI để tạo ra chúng, cách giữ cho giọng nói nhất quán trên một chuỗi và các mẫu cách thực hiện phân biệt một bài đọc thuyết phục từ một hiệu ứng bộ lọc.


TL;DR

  • Trình tạo giọng AI anime tạo ra giọng nói nhân vật theo hai cách: tạo văn bản thành giọng nói hoặc chuyển đổi giọng AI từ hiệu suất diễn viên của riêng bạn.
  • Palet anime lớn hơn giọng nói cô gái: anh hùng shonen, cố vấn khàn khàn, sinh vật mascot và purr kẻ ác mỗi cái có một dấu vân tay âm học riêng biệt.
  • Chuyển đổi thường thắng cho phạm vi cảm xúc vì nó bảo tồn thời gian, hơi thở và nhấn mạnh của bạn trong khi trao đổi timber.
  • Tính nhất quán cho một chuỗi hoặc VTuber xuất phát từ khóa một bộ cài sẵn cộng với một kiểu hiệu suất và ghi lại các cài đặt chính xác.
  • Hiệu suất anime tiếng Nhật và tiếng Anh khác nhau chủ yếu trong đường cong tonal và cách diễn đạt, không phải liệu bạn có cần nói ngôn ngữ hay không.
  • Viết các kịch bản gốc và tôn trọng hướng dẫn nhà xuất bản - không sao chép đối thoại được cấp phép hoặc sao chép một diễn viên thực tế mà không có sự đồng ý.

Điều gì làm cho giọng anime nghe như anime?

Giọng nói anime được tạo kiểu, không tự nhiên. So với lời nói hàng ngày, chúng đẩy một vài đặc điểm âm học xa vượt quá các phạm vi thực tế: một rung lắc tonal rộng hơn trên một dòng duy nhất, năng lượng tần số cao sáng sủa hơn, các cuộc tấn công phụ âm sắc nét hơn và một đường cong cảm xúc phóng đại sao cho cảm xúc đọc ngay lập tức. Một tiếng kêu rất to và rất cao; một tiếng thi thầm hạ thấp các formant và thêm hơi thở. Sự phóng đại cố ý này là lý do tại sao một giọng anime ai tốt cảm thấy được thực hiện hơn là chỉ được lọc.

Ba nút thực hiện phần lớn công việc nặng. Cao độ đặt dãy cơ bản. Formant (cộng hưởng của các kênh giọng nói) bán kích thước và tuổi có vẻ của người nói - nâng nó lên và nhân vật co lại và trẻ tuổi hơn, hạ thấp nó và họ phát triển và lớn hơn. Cộng hưởng và EQ hình dạng độ sáng và “tia anime” ở các giữa cao. Nhận ba điều đó chuyển động với nhau và bạn đã ở hầu hết của đường bộ nguyên mẫu bất kỳ, trước khi thậm chí chọn một bộ cài sẵn.

Trình tạo giọng AI anime là gì?

Trình tạo giọng AI anime là phần mềm biến đầu vào - văn bản được gõ hoặc lời nói trực tiếp của bạn - thành giọng nói nhân vật anime kiểu cách sử dụng mô hình AI. Các phiên bản văn bản thành giọng nói tổng hợp âm thanh được nói từ một kịch bản, trong khi các phiên bản chuyển đổi thay đổi timber hiệu suất của riêng bạn thành một nhân vật được chọn. Cả hai tạo ra một giọng nói mà bạn có thể đặt vào video, trò chơi hoặc luồng.

Thể loại này trùng lặp với những thay đổi giọng chung, nhưng các công cụ anime dựa vào các bộ cài sẵn nhân vật được curated và hình thành cao độ formant mạnh hơn. Nếu bạn muốn một primer rộng trên phía nhấn mạnh cô gái cụ thể, hướng dẫn anime voice generator của chúng tôi đi sâu vào nguyên mẫu đó; ở đây tiêu điểm là toàn bộ dàn diễn viên.

Palet giọng nói anime vượt quá nguyên mẫu cô gái

Giọng cô gái sáng và tràn năng lượng được bao phủ tốt ở nơi khác - xem hướng dẫn anime girl voice chuyên dụng của chúng tôi. Phần này là về tất cả mọi người khác trong đội ngũ. Mỗi nguyên mẫu có một dấu vân tay âm học mà bạn có thể nhắm vào với trình tạo giọng nói nhân vật anime.

Năng lượng nhân vật chính shonen

Anh hùng máu nóng kinh điển. Dãy giữa với một rung lắc cao độ lên trên nhấn mạnh, phía trước và sáng, rất nhiều cuộc tấn công phụ âm mạnh mẽ, và xu hướng nứt lớn hơn ở cuối một dòng được xác định. Đặc điểm xác định là momentum - giọng nói cảm thấy như nó luôn nghiêng vào từ tiếp theo. Giữ các formant gần trung tính hoặc hơi nâng, thêm sự hiện diện giữa cao, và chơi với lực thực sự.

Cố vấn khàn khàn hoặc bậc thầy cũ

Cao độ cơ bản thấp, các formant hạ thấp cho một cơ thể lớn và lớn tuổi hơn, và kích ứng cố ý hoặc vocal fry trên các ký âm kéo dài. Cách thực hiện chậm và nặng nề, với những tạm dừng dài ngụ ý sự khôn ngoan. Mẹo là khàn khàn xuất phát từ kết cấu hiệu suất của riêng bạn nhiều như từ cài đặt - một sự greriness nhẹ nhàng trong cách đọc của riêng bạn cho mô hình một cái gì đó thực tế để hình dạng.

Sinh vật mascot

Bên cạnh cầu quỳu. Cao độ rất cao, các formant nâng cao mạnh mẽ để co lại cơ thể xuất hiện, cụm từ ngắn và cứng, và thường là một tích lũy tương tự. Cái này được hưởng lợi từ sự tự chế: overdrive sự nâng formant và nó biến thành tiếng ồn hề khó hiểu, vì vậy lùi lại cho đến khi các từ sống sót.

Ronronné kẻ ác

Mịn, kiểm soát và thấp. Cao độ hạ thấp nhẹ, giữa ấm áp, biến đổi cao độ tối thiểu, và nhịp điệu chậm cố ý nghe như nhân vật luôn biết nhiều hơn bạn. Kiểm soát hơi thở quan trọng hơn âm lượng ở đây - sự đe dọa là trong sự yên tĩnh.

Hai con đường AI cho mỗi nguyên mẫu

Dù nguyên mẫu nào bạn muốn, trình tạo giọng ai anime cho bạn hai con đường sản xuất hoàn toàn khác nhau. Hiểu được sự đánh đổi tiết kiệm rất nhiều lần chụp lãng phí.

Yếu tốTạo TTSChuyển đổi hiệu suất được thực hiện
Đầu vàoKịch bản được gõGiọng nói trực tiếp hoặc ghi âm của bạn
Phạm vi cảm xúcGiới hạn ở các bộ cài sẵn tổng hợpĐầy đủ - mang lại thời gian và cảm giác của bạn
Tốt nhất choDòng giữ chỗ, bản nháp nhanh, không người nóiHiệu suất trong nhân vật, luồng, lồng tiếng
Đường cong học tậpRất thấpThấp, nhưng bạn phải chơi phần
Sử dụng thời gian thựcThường khôngCó, với micrô ảo
Tính nhất quánCao theo mặc địnhCao nếu bạn khóa cài đặt

Tạo TTS

Bạn gõ một dòng và trình tạo nói nó bằng giọng anime. Đó là con đường nhanh nhất, không cần diễn xuất, và lý tưởng cho hội thoại redup, các bài kiểm tra thời gian, hoặc những người sáng tạo không muốn thực hiện. Hạn chế là biểu hiện - bài đọc tổng hợp có xu hướng làm phẳng các đỉnh cảm xúc làm cho anime sống động, và nhấn mạnh tinh tế khó để quay số từ dấu chấm câu một mình.

Chuyển đổi hiệu suất được thực hiện

Ở đây bạn nói hoặc ghi lại dòng của riêng bạn, và chuyển đổi giọng AI thay đổi timber nó thành nhân vật mục tiêu trong khi vẫn giữ nhịp độ, hơi thở và nhấn mạnh của bạn. Bạn chơi sự quyết tâm của anh hùng shonen hoặc sự yên tĩnh của kẻ ác, và mô hình xử lý timber. Đây là con đường mà hầu hết các nhà sáng tạo anime nghiêm túc và VTuber sử dụng vì hiệu suất là điểm.

Tại sao chuyển đổi chiến thắng cho phạm vi cảm xúc

Cảm xúc trong lời nói sống trong micro-timing: nơi bạn tạm dừng, cao độ tăng nhanh như thế nào, khi giọng nói của bạn siết hoặc gãy. TTS phải đoán tất cả từ văn bản. Chuyển đổi không đoán - nó kế thừa những manh mối đó trực tiếp từ hiệu suất của bạn, sau đó chỉ thay đổi nhận dạng giọng nói. Trình tạo giọng nói nhân vật anime thuyết phục được xây dựng trên chuyển đổi bảo tồn hiệu suất con người và trao đổi mặt nạ.

Đó chính xác là lý do tại sao cách tiếp cận hiệu suất được thực hiện với các bộ cài sẵn nhân vật có xu hướng tạo ra kết quả thực tin hơn so với tổng hợp thuần túy. VoxBooster dựa vào cái này: bạn thực hiện dòng, mô hình cục bộ on-device chuyển đổi timber của bạn theo thời gian thực, và bộ cài sẵn cho bạn một điểm bắt đầu mỗi nguyên mẫu. Đối với các tình huống trực tiếp, điều đó cũng có nghĩa là giọng nói được chuyển đổi có thể chảy trực tiếp vào một cuộc gọi hoặc luồng qua micrô ảo thay vì được kết xuất tệp theo tệp. Nếu quy trình công việc được gõ hoàn toàn là tất cả những gì bạn cần, TTS vẫn có chỗ của nó cho các bản nháp - nhưng đối với bất cứ điều gì mà khán giả sẽ cảm thấy, thực hiện nó.

Xây dựng giọng nói nhân vật nhất quán cho một chuỗi hoặc VTuber

Phần khó nhất của một nhân vật tái phát không phải là tạo giọng nói một lần - đó là tạo giọng nói chính xác tương tự hai mươi luồng sau. Trình tạo giọng anime ai chỉ giúp nếu bạn có thể sao chép cài đặt của mình.

  1. Chọn một nguyên mẫu và một bộ cài sẵn. Không chuyển giữa ba bộ cài sẵn “đủ gần”. Chọn cái phù hợp với nhân vật của bạn và cam kết.
  2. Ghi một dòng tham chiếu. Đọc một cụm từ chữ ký trong nhân vật và lưu clip. Nó trở thành kiểm tra tai của bạn cho mỗi phiên tương lai.
  3. Ghi lại các con số. Viết ra các giá trị cao độ, formant, cộng hưởng và EQ của bạn. Ảnh chụp màn hình bảng điều khiển. Đây là bảng giọng nói của nhân vật của bạn.
  4. Khóa kiểu hiệu suất của bạn. Tính nhất quán là bao nhiêu bạn chơi - năng lượng của bạn, tốc độ nói của bạn - như trên các thanh trượt. Tìm kiếm clip tham chiếu, không chỉ cài đặt.
  5. Làm nóng trước khi bạn trực tiếp. Mười giây chống lại dòng tham chiếu bắt được sự trôi dạt trước khi khán giả của bạn làm.

Đối với thiết lập cụ thể VTuber, sự tương tác giữa mô hình, nhân cách và giọng nói của bạn quan trọng - hướng dẫn Twitch VTuber của chúng tôi bao gồm luồng toàn bộ gói. Hãy xử lý giọng nói như lore chính tắc: khi khán giả của bạn biết nhân vật của bạn nghe như thế nào, thay đổi nó ở giữa chuỗi là khó chịu, vì vậy hãy đông lạnh nó sớm.

Các mẫu cách thực hiện anime tiếng Nhật vs tiếng Anh

Bạn không cần tiếng Nhật để tạo giọng anime, nhưng biết cách hai ngôn ngữ mang lại kiểu cách giúp bạn chơi phần. Đây là ngôn ngữ học-lite, không phải là một khóa học ngôn ngữ.

Tiếng Nhật là một ngôn ngữ với tono: ý nghĩa có thể thay đổi với cao độ trên một âm tiết, và hiệu suất anime phóng đại những đường cong đó thành những rung lắc biểu cảm lớn. Các âm tiết được ghi chép đồng đều trong thời gian (mora-timing), mang lại cho đối thoại một bước ngoặc sắc nét và nhịp điệu. Tiếng Anh được ghi chép bằng stress - chúng ta nén các âm tiết không được nhấn mạnh và kéo dài những âm tiết được nhấn mạnh - vì vậy một bài đọc anime tiếng Anh dựa vào âm lượng và chiều dài ký âm để nhấn mạnh hơn là cao độ một mình. Bạn có thể đọc thêm về nhịp điệu tiếng Nhật tại Japanese pitch accent và về nghề nó tại seiyu voice acting.

Thực tế: nếu bạn muốn cảm nhận kiểu seiyuu xác thực trong tiếng Anh, hãy mượn rung lắc cao độ rộng và các cuộc tấn công âm tiết sạch sẽ, nhưng giữ các mẫu stress tự nhiên của bạn để các từ vẫn có thể hiểu được. Buộc mora-timing vào tiếng Anh thường nghe có vẻ giống như máy móc. Hãy để nguyên mẫu hướng dẫn năng lượng và để trình tạo xử lý timber.

Quy trình làm việc của trình tạo giọng AI anime, từ đầu đến cuối

Đây là một lần được lặp lại hoạt động đối với cả dòng video và phát trực tiếp với trình tạo giọng AI anime.

  1. Chọn nguyên mẫu. Anh hùng, cố vấn, mascot, hoặc kẻ ác - quyết định trước khi chạm vào một thanh trượt để diễn xuất của bạn có mục tiêu.
  2. Tải một bộ cài sẵn khớp. Bắt đầu từ bộ cài sẵn nhân vật gần nhất thay vì xây dựng từ một giọng nói phẳng.
  3. Đặt ba nút cốt lõi. Điều chỉnh cao độ để dãy, formant cho kích thước và tuổi có vẻ, cộng hưởng và EQ cho độ sáng. Di chuyển nhỏ; kiểm tra sau mỗi cái.
  4. Thực hiện một bài đọc tham chiếu. Chơi dòng chữ ký của bạn và nghe. Nó cảm thấy như nguyên mẫu, không chỉ là một bộ lọc?
  5. Điều chỉnh để hiệu suất. Nhấn các cài đặt để khen chiếc tay thực hiện của bạn thay vì chống lại nó.
  6. Thêm sự triệt tiêu tiếng ồn. Một đầu vào sạch chuyển đổi tốt hơn nhiều so với một âm thanh hiss; làm sạch nguồn trước khi mô hình thấy nó.
  7. Tuyến hoặc kết xuất. Để sử dụng trực tiếp, gửi đầu ra qua micrô ảo đến Discord, OBS, hoặc trò chơi của bạn. Đối với video, ghi lại các lần chuyển đổi và buông vào dòng thời gian.
  8. Lưu tất cả mọi thứ. Lưu trữ bộ cài sẵn và các con số bảng giọng nói của bạn để lần tới là thiết lập ba mươi giây, không xây dựng lại.

Nếu bạn muốn định tuyến vào một cuộc gọi giọng nói cụ thể, hãy đặt đầu ra ảo của công cụ làm thiết bị đầu vào bên trong ứng dụng đích - bước duy nhất đó là những gì làm cho giọng nói được chuyển đổi có thể nghe được cho tất cả mọi người khác trong cuộc gọi.

Nhờn lồng tiếng: kịch bản gốc, không có đối thoại được cấp phép

Anime là một phương tiện được yêu thích với chủ sở hữu quyền thực tế, vì vậy một vài quy tắc cơ bản giữ cho công việc của bạn sạch sẽ. Viết những dòng của riêng bạn. Các dự án của người hâm mộ, nhân vật gốc và parody phong phú sáng tạo mà không sao chép đối thoại của một chương trình được cấp phép từng từ từng từ hoặc phát lại các cảnh với giọng nói được trao đổi. Sao chép nhận dạng diễn viên giọng cụ thể mà không có sự đồng ý là một vấn đề riêng biệt từ parody nhân vật - giữ xa khỏi nó, và không bao giờ ngụ ý rằng một studio hoặc diễn viên xác nhận nội dung của bạn.

Giữ parody rõ ràng parody, tín dụng cảm hứng một cách trung thực, và kiểm tra các hướng dẫn sử dụng được nêu của mỗi nhà xuất bản trước khi bạn đăng công việc phái sinh. Vùng an toàn là khổng lồ: nhân vật gốc, kịch bản của riêng bạn, và giọng nói kiểu nguyên mẫu gợi lên một thể loại mà không mô phỏng một người thực tế. Đó chính xác là những gì mà trình tạo giọng nói nhân vật anime giỏi nhất - phát minh ra một dàn diễn viên mới, không phải photocopy một dàn cũ.

FAQ

Trình tạo giọng AI anime tốt nhất là gì?

Công cụ tốt nhất tùy thuộc vào mục tiêu của bạn. Trình tạo văn bản thành giọng nói là nhanh nhất cho các dòng giữ chỗ, trong khi chuyển đổi hiệu suất được thực hiện cho bạn phạm vi cảm xúc rộng hơn vì nó ánh xạ thời gian và hơi thở của riêng bạn vào một bộ cài sẵn nhân vật. Nhiều người sáng tạo sử dụng cả hai trên toàn bộ một dự án duy nhất.

Tôi có thể tạo giọng nói nhân vật anime miễn phí không?

Có. Một số trình tạo web miễn phí tạo ra các đoạn anime ngắn, và các công cụ máy tính để bàn cung cấp các giai đoạn dùng thử. VoxBooster cung cấp dùng thử đầy đủ ba ngày mà không cần thẻ tín dụng để bạn có thể kiểm tra chuyển đổi thời gian thực, bộ cài sẵn và định tuyến micrô ảo trước khi quyết định xem nó có phù hợp với quy trình công việc của bạn không.

Tôi có cần nói tiếng Nhật để tạo giọng anime không?

Không. Hiệu suất anime chủ yếu là về đường cong tonal, năng lượng và cách diễn đạt, không phải ngôn ngữ. Bạn có thể thực hiện hiệu suất anime bằng tiếng Anh và vẫn đạt được nguyên mẫu. Biết một vài mẫu nhịp điệu tiếng Nhật sẽ giúp ích nếu bạn muốn đọc theo kiểu seiyuu xác thực hơn, nhưng đó là tùy chọn.

Làm cách nào tôi có thể tạo giọng anime nhất quán cho VTuber?

Khóa một bộ cài sẵn và một kiểu hiệu suất, sau đó ghi lại. Lưu cài đặt cao độ, formant và cộng hưởng của bạn, ghi một dòng tham chiếu ngắn và sử dụng lại các giá trị chính xác đó mỗi lần phát trực tiếp. Tính nhất quán xuất phát từ việc lặp lại cùng một cách thực hiện được thực hiện, không phải từ việc điều chỉnh lại trình tạo mỗi phiên.

Có hợp pháp không sử dụng trình tạo giọng AI anime?

Tạo giọng nói nhân vật gốc cho các kịch bản của riêng bạn nói chung là được. Những vấn đề bắt đầu khi bạn sao chép đối thoại của một chương trình được cấp phép, sao chép giọng của một diễn viên cụ thể mà không có sự đồng ý, hoặc ngụ ý sự chấp thuận chính thức. Viết những dòng của riêng bạn, giữ parody rõ ràng là parody, và tôn trọng hướng dẫn sử dụng của từng nhà xuất bản.

Sự khác biệt giữa anime TTS và chuyển đổi giọng là gì?

Văn bản thành giọng nói đọc các từ được gõ bằng một giọng nói anime tổng hợp mà không cần diễn xuất trực tiếp. Chuyển đổi giọng nói lấy hiệu suất nói của bạn và thay đổi timber thành một nhân vật trong khi vẫn giữ nhịp độ, nhấn mạnh và cảm xúc của bạn. TTS nhanh hơn cho các bản nháp; chuyển đổi mạnh hơn cho các cách thực hiện biểu cảm và trong nhân vật.

Tôi có thể sử dụng trình tạo giọng AI anime theo thời gian thực trên Discord không?

Có, nếu công cụ công khai một micrô ảo. Trình tạo giọng AI anime theo thời gian thực xử lý micrô của bạn và định tuyến âm thanh được chuyển đổi vào Discord, OBS hoặc các trò chơi làm thiết bị đầu vào. VoxBooster làm điều này trên Windows với độ trễ thấp và không có trình điều khiển hạt nhân.

Kết luận

Trình tạo giọng AI anime ở đỉnh điểm khi bạn ngừng suy nghĩ về một “giọng anime” duy nhất và bắt đầu truyền một dàn diễn viên hoàn chỉnh - anh hùng shonen được thúc đẩy, cố vấn khàn khàn, mascot quỳu, kẻ ác nhẫn - mỗi cái có cao độ, formant và cách thực hiện của riêng nó. Tạo văn bản thành giọng nói cho bạn bản nháp nhanh, nhưng chuyển đổi hiệu suất được thực hiện là những gì mang lại cảm xúc thực tế, vì nó bảo tồn thời gian của bạn và chỉ trao đổi timber. Khóa cài đặt của bạn, ghi lại chúng, chơi phần, và viết kịch bản của riêng bạn, và bạn sẽ có một giọng nhân vật đáng để xây dựng một chuỗi xung quanh.

Nếu bạn đang trên Windows và muốn thực hiện các nhân vật anime trực tiếp - chuyển đổi thời gian thực, bộ cài sẵn mỗi nguyên mẫu, sự triệt tiêu tiếng ồn và một micrô ảo định tuyến đến Discord, OBS hoặc trò chơi của bạn - VoxBooster chạy hoàn toàn on-device mà không có bất cứ điều gì rời khỏi PC của bạn. Những người sáng tạo anime trên Mac hoặc di động nên tìm kiếm ở nơi khác hiện tại, nhưng nếu bạn cũng giữ một máy Windows xung quanh, dùng thử ba ngày (xem pricing) là cách dễ dàng để nghe thấy sự khác biệt. Tải xuống VoxBooster và bắt đầu phát giọng của bạn.

Dùng thử VoxBooster — 3 ngày dùng thử miễn phí.

Nhân bản giọng thời gian thực, soundboard và hiệu ứng — ở mọi nơi bạn đã nói chuyện.

  • Không cần thẻ tín dụng
  • ~30ms độ trễ
  • Discord · Teams · OBS
Dùng thử miễn phí 3 ngày