Phần mềm nhân bản giọng nói AI đã phát triển từ một bản demo nghiên cứu thành thứ gì đó bạn cài đặt vào thứ Sáu và sử dụng trên phát sóng trực tiếp vào Chủ nhật, chính xác là lý do tại sao việc chọn một cái trong số đó bây giờ lại gây nhầm lẫn. Hàng chục công cụ đều hứa sẽ tạo ra một bản sao giọng nói của bạn thuyết phục, và hầu như không ai trong số họ giải thích những sự đánh đổi thực tế quyết định xem phần mềm có phù hợp với máy của bạn, ranh giới quyền riêng tư của bạn và quy trình làm việc của bạn hay không. Hướng dẫn này không phải là một lời giải thích khác về cách công nghệ học giọng nói. Thay vào đó, nó cung cấp cho bạn một cách lặp lại để đánh giá bất kỳ phần mềm nhân bản giọng nói nào dựa trên bảy tiêu chí cụ thể, một so sánh từng danh mục, một lịch trình thiết lập thực tế và các cờ đỏ tách biệt một chương trình nhân bản giọng nói nghiêm túc khỏi một đồ chơi thu thập dữ liệu.
Tóm tắt nhanh
- Phần mềm nhân bản giọng nói AI phù hợp phụ thuộc vào bảy tiêu chí, không phải các tuyên bố tiếp thị: vị trí huấn luyện, độ trễ, nhu cầu dữ liệu, giới hạn chất lượng, định tuyến, sự đồng ý và mô hình định giá.
- Huấn luyện cục bộ giữ giọng nói của bạn trên PC của bạn; huấn luyện đám mây tải lên nó, nhanh hơn để bắt đầu nhưng yếu hơn về quyền riêng tư.
- Chuyển đổi thời gian thực cần độ trễ thấp được đo bằng hàng chục miligiây; nhân bản văn bản được gõ có thể mất thời gian.
- Ba loại rộng lớn tồn tại: các bộ dịch vụ đám mây, các đường ống cục bộ nguồn mở và các ứng dụng máy tính để bàn của người tiêu dùng, mỗi loại có một điểm ngọt khác.
- Một micrô ảo định tuyến âm thanh nhân bản vào Discord, OBS hoặc các trò chơi là những gì làm cho phần mềm có thể sử dụng được trực tiếp.
- Biện pháp bảo vệ sự đồng ý và mô hình định giá minh bạch không thể đàm phán được; coi các điều khoản bị thiếu là một cờ đỏ.
Điều gì phân biệt phần mềm nhân bản giọng nói AI với một bộ thay đổi giọng nói thông thường?
Phần mềm nhân bản giọng nói AI huấn luyện một mô hình dựa trên các bản ghi âm của một giọng nói cụ thể và sau đó tạo ra lời nói mới bằng giọng nói đó, từ văn bản được gõ hoặc từ micrô trực tiếp của bạn. Một bộ thay đổi giọng nói thông thường chỉ uốn cong giọng nói bạn đã có với các thay đổi cao độ và formant. Nhân bản học giọng nói; một bộ thay đổi chỉ định hình lại của bạn.
Sự phân biệt này quan trọng hơn những gì tiếp thị gợi ý. Rất nhiều sản phẩm được bán dưới dạng phần mềm nhân bản giọng nói thực sự là những bộ thay đổi dịch chuyển cao độ có thư viện cài sẵn, và một số công cụ nhân bản ghim một bộ thay đổi để trông hoàn chỉnh. Biết được cái nào bạn thực sự đang mua là bộ lọc đầu tiên trước khi bạn so sánh bất cứ điều gì khác.
Nếu bạn muốn cơ học đầy đủ về cách một mô hình hấp thụ timbre và prosody, giải thích nhân bản giọng nói AI bao gồm từ đầu đến cuối, và tổng quan tổng hợp lời nói là một hướng dẫn vững chắc. Bài viết này giả định bạn đã hiểu khái niệm và hiện đang cố gắng chọn một công cụ.
Bảy tiêu chí để đánh giá phần mềm nhân bản giọng nói AI
Mọi so sánh nghiêm túc về phần mềm nhân bản giọng nói AI đều xuất phát từ bảy câu hỏi giống nhau. Điểm mỗi công cụ trên cả bảy và người chiến thắng cho trường hợp sử dụng của bạn thường trở nên rõ ràng. Tính trọng số của chúng khác nhau tùy thuộc vào liệu bạn phát sóng trực tiếp, kể chuyện video hay chỉ thử nghiệm.
1. Huấn luyện xảy ra ở đâu: cục bộ so với đám mây
Đây là ngã tư của quyền riêng tư. Các bộ dịch vụ đám mây tải giọng nói của bạn lên máy chủ của họ, huấn luyện mô hình từ xa và phát trực tiếp âm thanh được tạo lại. Điều đó giảm bớt tính toán từ PC của bạn, nhưng bản ghi giọng nói của bạn bây giờ sống trên phần cứng của người khác theo chính sách lưu giữ của họ. Phần mềm cục bộ huấn luyện và chuyển đổi cục bộ, vì vậy giọng nói của bạn không bao giờ rời khỏi máy. Đối với bất cứ điều gì nhạy cảm, hoặc bất cứ điều gì bạn không muốn lưu giữ, cục bộ là mặc định an toàn hơn, và nó loại bỏ toàn bộ một loại rủi ro vi phạm dữ liệu.
2. Độ trễ cho chuyển đổi thời gian thực
Độ trễ là khoảng cách giữa nói và nghe được đầu ra được chuyển đổi. Để kể chuyện hoặc nhân bản văn bản được gõ, độ trễ không phù hợp vì bạn đợi một bản dựng lại. Để sử dụng trực tiếp trên Discord, một luồng hoặc một trò chơi, nó là con số quan trọng nhất. Các công cụ đám mây thêm thời gian chuyến đi khứ hồi mạng ngoài xử lý mô hình, điều này thường đẩy chúng ra ngoài phạm vi thời gian thực thoải mái. Xử lý cục bộ có thể đạt hàng chục miligiây thấp. Nếu một công cụ tuyên bố thời gian thực nhưng không công bố con số độ trễ, hãy coi đó là một khoảng cách đáng để tự kiểm tra.
3. Yêu cầu dữ liệu
Phần mềm cần bao nhiêu âm thanh để xây dựng một bản sao có thể sử dụng được? Đầu vào sạch hơn hầu như luôn luôn thắng đầu vào dài hơn. Một vài phút lời nói yên tĩnh và nhất quán nhận được sự giống nhau gần đúng; khoảng mười đến ba mươi phút âm thanh đa dạng bao quát phạm vi cao độ hoàn chỉnh của bạn và thói quen cách phát âm. Cẩn thận hai quá cực: công cụ hứa một bản sao hoàn hảo từ ba giây quá bán, và công cụ yêu cầu hàng giờ âm thanh studio không thực tế cho hầu hết người dùng. Một giữa hợp lý là dấu hiệu của một đường ống thành thật.
4. Giới hạn chất lượng giọng nói
Giới hạn chất lượng là đầu ra tốt nhất mà một công cụ có thể tạo ra với đầu vào lý tưởng, không phải bản demo bạn thấy. Nghe phạm vi cảm xúc phẳng, phụ âm bị xáo trộn, hô hấp máy móc hoặc lấp loáng kim loại trên các nguyên âm được giữ. Các bộ dịch vụ đám mây và các đường ống nguồn mở trưởng thành có xu hướng có những giới hạn cao nhất; các ứng dụng của người tiêu dùng trao đổi một chút chất lượng hàng đầu để có tốc độ và dễ sử dụng. Bài kiểm tra thực tế là giọng nói của riêng bạn trên phần cứng của riêng bạn, không phải một đoạn tiếp thị được chọn lọc, vì micrô và phòng của bạn đặt một giới hạn trước khi phần mềm chạm vào bất cứ điều gì.
5. Định tuyến và micrô ảo
Một bản sao mà bạn không thể đưa vào các ứng dụng của mình là một đồ chơi. Tính năng làm cho phần mềm nhân bản giọng nói có thể sử dụng được là micrô ảo: một thiết bị âm thanh phần mềm mang lại đầu ra được chuyển đổi để Discord, OBS, một trò chơi hoặc một ứng dụng cuộc gọi có thể chọn nó làm thiết bị đầu vào. Không có định tuyến, bạn bị mắc kẹt ghi lại các tập tin và phát lại chúng. Phần mềm máy tính để bàn tốt cài đặt micrô ảo cho bạn và lý tưởng nhất là không cần trình điều khiển kernel. Đối với quy trình làm việc trực tiếp, kiểm tra cơ sở kiến thức OBS để xác nhận công cụ hiển thị một thiết bị âm thanh sạch mà cảnh của bạn có thể chụp.
6. Biện pháp bảo vệ sự đồng ý
Tiêu chí bị bỏ qua nhiều nhất là liệu phần mềm có khuyến khích sử dụng có trách nhiệm hay không. Phần mềm nhân bản giọng nói AI có uy tín làm dễ dàng việc nhân bản giọng nói của riêng bạn và khó khăn để giả mạo một người lạ, và nó tiết lộ rằng âm thanh tổng hợp là tổng hợp. Nhân bản một người thực tế mà không có sự cho phép có thể vi phạm quyền tính cách, cộng với luật gian lận và quấy rối. Một công cụ mà cả sân khấu của nó nhân bản một người nổi tiếng nhất định hoặc chính trị gia đang báo hiệu cách nó mong bạn sử dụng nó. Đó là một kiểm tra giá trị cũng như một kiểm tra tính năng.
7. Mô hình định giá
Định giá là một tiêu chí, không phải chú thích cuối trang, bởi vì mô hình định hình cách bạn có thể sử dụng công cụ. Các dịch vụ đám mây thường tính phí theo giây được tạo hoặc tín dụng, vì vậy sử dụng nặng nhanh chóng trở nên đắt tiền. Phần mềm nguồn mở miễn phí cấp phép nhưng bạn trả tiền bằng phần cứng và thời gian. Các ứng dụng máy tính để bàn thường chạy một bản dùng thử sau đó một kế hoạch bằng phẳng. Điều quan trọng là tính minh bạch: bạn phải có thể thấy các điều khoản trước khi cam kết. So sánh những tradeoff trên trang định giá thay vì đoán từ một màn hình bắt đầu. Đối với các tuyến hoàn toàn miễn phí, sự phân chia miễn phí nhân bản giọng nói AI ánh xạ những gì mà mỗi tùy chọn không có chi phí thực sự cung cấp.
So sánh phần mềm nhân bản giọng nói AI theo danh mục
Hầu hết các công cụ rơi vào ba danh mục, và mỗi danh mục có một hồ sơ đặc trưng trên bảy tiêu chí. Phù hợp danh mục với các ưu tiên của bạn sẽ giúp bạn đi phần lớn con đường đến một quyết định. Phần mềm nhân bản giọng nói máy tính để bàn tốt nhất để sử dụng trực tiếp trông rất khác với đường ống tốt nhất cho việc kể chuyện ngoại tuyến.
| Tiêu chí | Bộ dịch vụ đám mây | Nguồn mở cục bộ | Ứng dụng máy tính để bàn của người tiêu dùng |
|---|---|---|---|
| Vị trí huấn luyện | Máy chủ của họ | GPU của bạn | PC của bạn |
| Quyền riêng tư | Giọng nói được tải lên | Hoàn toàn cục bộ | Hoàn toàn cục bộ (khác nhau) |
| Độ trễ thời gian thực | Bị ràng buộc bởi mạng | Phụ thuộc vào GPU | Được điều chỉnh để độ trễ thấp |
| Nỗ lực thiết lập | Thấp | Cao (dòng lệnh) | Thấp |
| Giới hạn chất lượng | Rất cao | Rất cao | Cao |
| Định tuyến / micrô ảo | Hiếm | Tự làm | Thường được tích hợp |
| Yêu cầu dữ liệu | Mẫu ngắn | Linh hoạt | Ngắn đến trung bình |
| Mô hình chi phí | Đăng ký hoặc tín dụng | Phần mềm miễn phí, phần cứng trả tiền | Dùng thử sau đó kế hoạch bằng phẳng |
Các bộ dịch vụ đám mây giành được sự thoải mái và chất lượng hàng đầu nhưng mất quyền riêng tư và độ trễ trực tiếp. Các đường ống cục bộ nguồn mở thắng về kiểm soát, quyền riêng tư và giới hạn chất lượng, nhưng chúng yêu cầu một GPU có khả năng và sự thoải mái về dòng lệnh. Các ứng dụng máy tính để bàn của người tiêu dùng ngồi ở giữa: thiết lập dễ dàng, quyền riêng tư trên thiết bị, định tuyến tích hợp và độ trễ được điều chỉnh cho thời gian thực, với chi phí của một giới hạn chất lượng hơi thấp hơn so với một đường ống nghiên cứu được điều chỉnh bằng tay.
Phần mềm nhân bản giọng nói tốt nhất cho sử dụng thời gian thực là gì?
Phần mềm nhân bản giọng nói tốt nhất cho sử dụng thời gian thực là bất cứ điều gì tính điểm cao nhất trên độ trễ và định tuyến trong khi giữ huấn luyện cục bộ. Đối với một streamer hoặc người chơi trực tiếp, ba tiêu chí đó vượt quá chất lượng thô, vì một bản sao không có khiếm khuyết đến 400 miligiây trễ là vô dụng trong một cuộc trò chuyện.
Đó là lý do tại sao các bộ dịch vụ đám mây, mặc dù có đầu ra xuất sắc, hiếm khi giành chiến thắng trong các so sánh trực tiếp. Chuyến đi khứ hồi mạng một mình có thể vượt quá toàn bộ ngân sách độ trễ của bạn. Các ứng dụng máy tính để bàn cục bộ và các đường ống nguồn mở là những đối thủ thực tế, và trong hai người, ứng dụng máy tính để bàn thường thắng trong nỗ lực: cài đặt micrô ảo, hiển thị một thiết bị âm thanh sạch sẽ và không cần trình điều khiển kernel. Nguồn mở giành chiến thắng nếu bạn đã có GPU và kiên nhẫn để điều chỉnh một đường ống. Để làm việc ngoại tuyến như kể chuyện, lật cân nặng: giới hạn chất lượng và tính linh hoạt chỉnh sửa là quan trọng nhất, và độ trễ berhenti không phải là một yếu tố cả.
Kỳ vọng thiết lập: Lịch trình thực tế
Thiết lập phần mềm nhân bản giọng nói là một phiên tập trung duy nhất cho hầu hết mọi người, không phải là một dự án cuối tuần, với điều kiện là bạn chọn một ứng dụng máy tính để bàn thay vì một đường ống nguồn mở. Đây là trình tự thực tế và thời gian cần thiết cho mỗi bước.
- Cài đặt và cấp quyền (vài phút). Tải xuống, cài đặt và cho phép truy cập micrô và thiết bị âm thanh để micrô ảo có thể được tạo.
- Ghi âm các mẫu sạch sẽ (mười đến ba mươi phút). Tìm một căn phòng yên tĩnh, giữ khoảng cách ổn định từ micrô và đọc các câu khác nhau để mô hình nghe thấy phạm vi đầy đủ của bạn. Bước này quyết định giới hạn chất lượng của bạn hơn phần mềm.
- Huấn luyện mô hình (phút đến giờ). Các ứng dụng máy tính để bàn huấn luyện cục bộ trong vài phút; các đường ống nguồn mở có thể chạy hàng giờ trên GPU; các bộ dịch vụ đám mây huấn luyện từ xa trong khi bạn chờ đợi.
- Định tuyến micrô ảo (vài phút). Trong Discord, OBS hoặc trò chơi của bạn, chọn micrô ảo của công cụ làm thiết bị đầu vào.
- Kiểm tra và điều chỉnh độ trễ (vài phút). Nói chuyện, nghe đầu ra được chuyển đổi và điều chỉnh bộ đệm hoặc cài đặt chất lượng cho đến khi độ trễ cảm thấy tự nhiên.
- Lưu các cài sẵn (tùy chọn). Lưu trữ bản sao của bạn và bất kỳ cài đặt bộ thay đổi giọng nói nào để bạn có thể chuyển đổi tức thì lần tới.
Nếu một công cụ không thể đưa bạn từ cài đặt đến một bản sao công việc được định tuyến trong một phiên duy nhất, sự ma sát này sẽ tăng lên mỗi lần bạn sử dụng nó.
Các cờ đỏ để tránh khi chọn chương trình nhân bản giọng nói
Một chương trình nhân bản giọng nói có thể trông bóng bẩy và vẫn là lựa chọn sai. Những tín hiệu này xứng đáng được dừng lại một cách vững chắc trước khi bạn cài đặt hoặc thanh toán.
- Không có tuyên bố rõ ràng về nơi xảy ra huấn luyện. Nếu trang web sẽ không nói giọng nói của bạn có được tải lên hay không, hãy giả sử có, và giả sử nó được lưu giữ.
- Tuyên bố thời gian thực mà không có con số độ trễ. Lời hứa tốc độ mơ hồ thường có nghĩa là con số không tốt. Kiểm tra nó tự mình bằng đồng hồ bấm giờ trên một cuộc gọi trực tiếp.
- Tiếp thị xây dựng xung quanh việc chỉnh sửa người thực tế. Một công cụ dẫn đầu bằng cách nhân bản một người nổi tiếng nhất định hoặc chính trị gia đang báo hiệu cách nó mong bạn sử dụng nó, và hướng bạn đến rủi ro pháp lý.
- Trình điều khiển kernel bắt buộc không có lời giải thích. Các trình điều khiển âm thanh ở cấp hạt nhân có thể làm mất ổn định hệ thống; phần mềm định tuyến qua một thiết bị ảo bình thường an toàn hơn.
- Không có chế độ ngoại tuyến và không có tùy chọn để từ chối tải lên đám mây. Đối với công việc nhạy cảm, tải lên bắt buộc là một lý do từ chối.
- Định giá ẩn hoặc thay đổi. Nếu bạn không thể tìm thấy các điều khoản rõ ràng trước khi cam kết, sự không minh bạch đó hiếm khi cải thiện sau khi bạn thanh toán. Nhất quyết yêu cầu các điều khoản được công bố công khai trước khi bạn đưa ra một thẻ.
- Khung gần các trò gian lận. Bất kỳ công cụ nào quảng cáo để chỉnh sửa các thành viên gia đình hoặc vượt qua xác minh giọng nói đều là một không tuyệt đối. FTC đã cảnh báo rằng các trò gian lận giọng nói nhân bản đang tăng lên, và bạn không muốn công cụ của mình ở phía đó của ranh giới.
Chấm điểm một ứng dụng máy tính để bàn thực tế trên bảy tiêu chí
Để làm cho các tiêu chí cụ thể, đây là cách VoxBooster đo lường dựa trên bảy câu hỏi giống nhau, tính điểm theo cách tương tự như bạn sẽ tính điểm bất cứ điều gì khác. Nó là phần mềm máy tính để bàn Windows 10 và 11, vì vậy hãy coi đây là một ví dụ công việc thay vì một xác nhận.
- Vị trí huấn luyện: cục bộ. Nó huấn luyện một bản sao giọng nói AI trên giọng nói của riêng bạn cục bộ, vì vậy không có gì được tải lên.
- Độ trễ: được điều chỉnh để chuyển đổi thời gian thực, vì xử lý vẫn trên máy của bạn và bỏ qua chuyến đi khứ hồi mạng.
- Yêu cầu dữ liệu: một phiên ghi âm thông thường các mẫu sạch sẽ, trong phạm vi giữa hợp lý chứ không phải một trò may mắn ba giây.
- Giới hạn chất lượng: cao cho một ứng dụng người tiêu dùng, bị giới hạn, như mọi khi, bởi micrô và phòng của bạn.
- Định tuyến: một micrô ảo tích hợp định tuyến âm thanh được chuyển đổi vào Discord, OBS, các trò chơi hoặc bất kỳ ứng dụng nào, không cần trình điều khiển kernel.
- Biện pháp bảo vệ sự đồng ý: con đường dự định là nhân bản giọng nói của riêng bạn cho nội dung của riêng bạn.
- Mô hình định giá: một bản dùng thử hoàn chỉnh ba ngày mà không có thẻ tín dụng, sau đó một kế hoạch bằng phẳng có các điều khoản được công bố công khai.
Nó không phải là công cụ duy nhất tính điểm tốt trên cả bảy, và một đường ống nguồn mở có thể vượt trội nó trên giới hạn chất lượng nếu bạn có phần cứng và kiên nhẫn. Điểm là phương pháp: chạy bất kỳ ứng cử viên nào qua bảy câu hỏi giống nhau và những tradeoff berhenti được ẩn.
Câu hỏi thường gặp
Phần mềm nhân bản giọng nói AI là gì?
Phần mềm nhân bản giọng nói AI huấn luyện một mô hình dựa trên các bản ghi âm của một giọng nói cụ thể, sau đó tạo ra lời nói mới bằng giọng nói đó từ văn bản được gõ hoặc micrô trực tiếp của bạn. Không giống như một bộ thay đổi giọng nói thông thường chỉ thay đổi cao độ và formant, nó học giọng nói và có thể nói những từ chưa bao giờ được ghi âm.
Phần mềm nhân bản giọng nói tốt nhất là gì?
Không có một phần mềm nhân bản giọng nói tốt nhất duy nhất, chỉ có cái phù hợp nhất với tiêu chí của bạn. Xếp hạng các công cụ theo vị trí xảy ra huấn luyện, độ trễ thời gian thực, nhu cầu dữ liệu, giới hạn chất lượng, định tuyến, biện pháp bảo vệ sự đồng ý và mô hình định giá. Một streamer trực tiếp ưu tiên độ trễ và định tuyến nhất; một người kể chuyện ưu tiên chất lượng và chỉnh sửa.
Phần mềm nhân bản giọng nói AI chạy cục bộ hay trên đám mây?
Cả hai mô hình đều tồn tại. Các bộ dịch vụ đám mây tải giọng nói của bạn lên các máy chủ của họ và huấn luyện từ xa, điều này nhanh để bắt đầu nhưng yếu hơn về quyền riêng tư. Phần mềm cục bộ huấn luyện và chuyển đổi cục bộ, vì vậy không có gì rời khỏi PC của bạn. Cục bộ cũng giảm độ trễ mạng, điều này rất quan trọng để sử dụng thời gian thực.
Chương trình nhân bản giọng nói cần bao nhiêu âm thanh?
Hầu hết các công cụ muốn lời nói sạch sẽ và nhất quán. Một vài phút sẽ tạo ra sự giống nhau gần đúng, trong khi khoảng mười đến ba mươi phút âm thanh đa dạng, không có tiếng ồn sẽ bao quát tốt hơn phạm vi cao độ của bạn và những điều lạ lẫm về cách phát âm. Chất lượng ghi âm quan trọng hơn độ dài thô; một căn phòng yên tĩnh vượt quá một giờ các clip ồn ào.
Có ứng dụng nhân bản giọng nói tốt cho PC không?
Vâng. Một ứng dụng máy tính để bàn dành cho người tiêu dùng thường là ứng dụng nhân bản giọng nói dễ nhất cho người dùng PC muốn nỗ lực thiết lập thấp với micrô ảo tích hợp. VoxBooster là một tùy chọn trên Windows 10 và 11 huấn luyện giọng nói của riêng bạn cục bộ và định tuyến âm thanh được chuyển đổi vào bất kỳ ứng dụng nào.
Mất bao lâu để thiết lập phần mềm nhân bản giọng nói?
Lên kế hoạch cho một phiên tập trung. Cài đặt và quyền mất một vài phút, ghi âm các mẫu sạch sẽ mất mười đến ba mươi phút, và huấn luyện có thể từ vài phút trên các ứng dụng máy tính để bàn đến hàng giờ trên các đường ống nguồn mở. Định tuyến micrô ảo và điều chỉnh độ trễ thêm một vài phút nữa.
Có hợp pháp khi sử dụng phần mềm nhân bản giọng nói AI không?
Nhân bản giọng nói của riêng bạn, hoặc giọng nói mà bạn có sự cho phép bằng văn bản để sử dụng, nói chung là được. Chỉnh sửa một người thực tế mà không có sự đồng ý để lừa dối, gian lận hoặc phỉ báng có thể vi phạm quyền cá nhân và luật gian lận và quấy rối. Có được sự đồng ý, tiết lộ âm thanh tổng hợp khi có thể gây hiểu lầm, và tránh những công cụ bỏ qua các biện pháp bảo vệ này.
Phần kết luận
Chọn phần mềm nhân bản giọng nói AI trở nên dễ dàng khi bạn ngừng đọc danh sách tính năng và bắt đầu tính điểm bảy tiêu chí thực sự quyết định sự phù hợp: nơi xảy ra huấn luyện, độ trễ, nhu cầu dữ liệu, giới hạn chất lượng, định tuyến, biện pháp bảo vệ sự đồng ý và mô hình định giá. Tính trọng số cho trường hợp sử dụng của bạn, chạy từng ứng cử viên qua so sánh danh mục, cảnh báo các cờ đỏ và công cụ thích hợp có xu hướng chọn chính nó. Nếu bạn muốn một tùy chọn máy tính để bàn cục bộ huấn luyện giọng nói của riêng bạn, định tuyến qua micrô ảo tích hợp không cần trình điều khiển kernel, và cho phép bạn kiểm tra bảy tiêu chí trên phần cứng của riêng bạn trước, một công cụ phù hợp với hồ sơ đó bắt đầu với một bản dùng thử không có thẻ. Tải VoxBooster.