Mortal Kombat Text to Speech: Hướng Dẫn Giọng Nói Người Dẫn

Tái tạo giọng nói người dẫn Mortal Kombat sâu và gầm gừ với text to speech cộng với pitch, reverb và EQ. Hướng dẫn đầy đủ với bảng cài đặt và ghi chú về quyền sở hữu trí tuệ.

Hiệu ứng mortal kombat text to speech là một trong những giọng nói meme được yêu cầu nhiều nhất trong trò chơi, và nó dễ xây dựng hơn nó trông. Người dẫn sâu và gầm gừ đó gầm lên “Fatality” và “Finish Him” không phải là một preset thần kỳ duy nhất - nó là một giọng nói cơ sở sâu chạy qua một chuỗi pitch, reverb và EQ cụ thể. Hướng dẫn này phân tích chính xác những gì định nghĩa giọng nói đó, sau đó hướng dẫn bạn tái tạo nó từ văn bản được gõ bằng cách sử dụng text to speech chung cộng với một vài hiệu ứng, với một bảng cài đặt mà bạn có thể sao chép. Nó cũng bao gồm nơi mà đường đứng trên tài sản trí tuệ, vì Mortal Kombat được sở hữu bởi NetherRealm Studios và Warner Bros.

Nếu bạn chỉ muốn công thức, TL;DR có nó. Nếu bạn muốn hiểu tại sao hiệu ứng hoạt động để bạn có thể điều chỉnh nó theo giọng nói hoặc clip của riêng bạn, hãy đọc tất cả.


TL;DR

  • Giọng nói người dẫn Mortal Kombat là một cách trình bày sâu, chậm, có reverb nặng với các tần số thấp được tăng cường và nhấn mạnh sân khấu - không phải là một preset duy nhất mà là một chuỗi hiệu ứng xếp chồng.
  • Để tạo mk announcer tts: chọn giọng nói TTS nam sâu nhất có sẵn, hạ thấp pitch vài bán tones với các formants được bảo quản, thêm một reverb hall dài và tăng cường 120 đến 250 Hz.
  • Các dòng ngắn như “Finish Him” và “Flawless Victory” hạ cánh tốt nhất vì phần đuôi reverb có chỗ để vang ra.
  • Bạn có thể tạo nó từ văn bản và bắn nó trên một hotkey với một soundboard, hoặc áp dụng cùng một chuỗi trực tiếp lên micrô của riêng bạn với một trình thay đổi giọng nói thời gian thực.
  • Mortal Kombat là IP của NetherRealm và Warner Bros - giữ nó cho parody và sử dụng cá nhân, tạo âm thanh của riêng bạn và không bao giờ sử dụng âm thanh trò chơi bị đánh cắp. Xem mục Mortal Kombat trên Wikipedia để tìm nền tảng.

Cái Gì Định Nghĩa Giọng Nói Người Dẫn Mortal Kombat?

Giọng nói người dẫn Mortal Kombat là một cách trình bày nam sâu, chậm, có tiếng vang nặng nề nhấn mạnh mỗi âm tiết để có tác động tối đa, vì vậy các lệnh ngắn như “Fatality” cảm thấy như vang vọng khắp một sân vận động khổng lồ. Nó nằm thấp trong phạm vi tần số với sự cộng hưởng lồng ngực mạnh, các tần số thấp được tăng cường, một điểm cao được kiểm soát và một phần đuôi reverb dài mang lại cho giọng nói trọng lượng không thể phủ nhận và mối đe dọa sân khấu.

Định nghĩa đó đã chứa toàn bộ công thức, nhưng nó giúp tách biệt các lớp, vì sao chép một lớp mà không có các lớp khác là lý do phổ biến nhất tại sao một phiên bản tự chế không nghe đúng. Bốn thành phần là pitch, sự cộng hưởng, tốc độ và không gian.

Bốn Lớp Xây Dựng Âm Thanh

Pitch và độ sâu. Người dẫn nằm ở dưới rất nhiều so với một giọng nói hội thoại bình thường. Tần số cơ bản nằm trong khoảng nam thấp, và trọng lượng được nhận thức xuất phát từ tần số cơ bản thấp này cộng với các tần số thấp được tăng cường cố ý. Nếu bạn bắt đầu từ một giọng nói đã rất sâu, bạn cần ít pitch shift hơn sau này, điều này giữ kết quả tự nhiên chứ không phải cơ khí.

Sự cộng hưởng và cơ thể. Giọng nói nghe giống như nó đến từ một cái lồng ngực khổng lồ và một căn phòng khổng lồ cùng một lúc. Đó là quyết định EQ: một sự thúc đẩy trong khu vực 120 đến 250 Hz thêm trọng lượng lồng ngực, trong khi một roll-off nhẹ nhàng của các tần số cao cực đoan loại bỏ chất “không khí” micrô gần gũi sẽ phá vỡ ảo tưởng. Mục tiêu là một giọng nói cảm thấy lớn về mặt vật lý.

Tốc độ và nhấn mạnh. Người dẫn không bao giờ vội vàng. Mỗi từ được cấp không gian, và các từ khóa bị đánh bại bằng lực. Khi bạn tạo giọng nói từ văn bản, bạn kiểm soát điều này một phần thông qua giọng nói cơ sở bạn chọn và một phần thông qua dấu chấm câu và ngắt dòng. Các cụm từ ngắn với các tạm dừng nghe có vẻ kịch tích hơn một câu nhanh và đều đặn.

Không gian và tiếng vang. Tiếng vang đặc trưng là reverb, không phải độ trễ. Một reverb hall hoặc plate lớn với decay dài đặt giọng nói trong một sân vận động. Nhận được cái này sai theo cả hai cách và hiệu ứng sụp đổ: quá ít và nó nghe giống như một người trong một căn phòng nhỏ, quá nhiều và các từ hòa lẫn thành một lượng không thể hiểu được. Reverb là lớp dễ nhận biết nhất của toàn bộ hiệu ứng.

Text to Speech vs. Thời Gian Thực: Bạn Nên Sử Dụng Cái Nào?

Có hai cách để tạo ra kết quả text to speech người dẫn sâu, và chúng phù hợp với các trường hợp sử dụng khác nhau. Không có cái nào “tốt hơn” một cách trừu tượng - nó phụ thuộc vào việc bạn gõ một dòng hay nói một dòng.

Text to speech (dòng được gõ). Bạn gõ các từ, một giọng nói tổng hợp đọc chúng, và bạn xử lý clip đó. Điều này lý tưởng cho các intro được làm sẵn, video meme, cảnh báo phát sóng và bất cứ thứ gì nơi bạn muốn cùng một cách trình bày chính xác mỗi lần. Speech Synthesis Markup Language của W3C là tiêu chuẩn cơ bản mà nhiều công cụ sử dụng để kiểm soát pitch, tốc độ và nhấn mạnh khi đọc văn bản, đó là lý do tại sao một số công cụ cho phép bạn tinh chỉnh cách một dòng được phát biểu.

Trình thay đổi giọng nói thời gian thực (dòng được phát biểu). Bạn nói vào một micrô và phần mềm chuyển đổi giọng nói của bạn trực tiếp bằng cùng một chuỗi pitch sâu và reverb. Đây là sự lựa chọn đúng khi bạn muốn phản ứng ngay lập tức trên một phát sóng, trong cuộc gọi Discord hoặc trong một trò chơi, công bố “Flawless Victory” vào lúc đồng đội của bạn thắng một vòng. Độ trễ quan trọng ở đây, đó là lý do tại sao xử lý cục bộ có độ trễ thấp đánh bại các công cụ trình duyệt để sử dụng trực tiếp.

Nhiều người sử dụng cả hai: một trình thay đổi thời gian thực cho các phản ứng trực tiếp và một soundboard được tải với các clip text to speech được tạo sẵn cho các dòng chính tắc mà họ muốn bắn chính xác kịp thời.

Cách Tạo Giọng Nói Người Dẫn Mortal Kombat: Từng Bước

Đây là hướng dẫn lõi. Nó kết hợp text to speech chung với một chuỗi hiệu ứng pitch sâu và reverb. Các bước giống nhau hoạt động cho dù nguồn của bạn là một dòng được gõ hay giọng nói trực tiếp của riêng bạn.

  1. Chọn giọng nói cơ sở sâu nhất có sẵn. Trong công cụ text to speech của bạn, chọn giọng nói nam sâu nhất và có tiếng vang nhất có sẵn, hoặc trong một trình thay đổi thời gian thực hãy bắt đầu từ giọng nói tự nhiên của bạn. Bắt đầu sâu có nghĩa là ít pitch shift hơn sau, điều này bảo tồn độ rõ. Lựa chọn duy nhất này làm được nhiều cho tính chân thực hơn bất kỳ hiệu ứng nào.

  2. Gõ hoặc nói dòng đó. Giữ các dòng ngắn và biểu tượng - “Fatality,” “Finish Him,” “Flawless Victory,” tên của một chiến binh. Các dòng ngắn để lại chỗ cho phần đuôi reverb vang ra. Nếu bạn cần một thông điệp dài hơn, hãy chia nó thành các cụm từ ngắn được phân tách bằng các tạm dừng để mỗi cái có không gian kịch tính riêng của nó.

  3. Hạ thấp pitch với các formants được bảo quản. Hạ thấp pitch khoảng 2 đến 5 bán tones. Rất quan trọng, kích hoạt sự bảo quản formant (đôi khi được gắn nhãn “bảo quản formants” hoặc “hiệu chỉnh formant”). Một pitch drop ngây thơ cũng di chuyển các formants tạo ra một âm thanh chậm và không tự nhiên thay vì một giọng nói thực sự sâu hơn. Nếu giọng nói của bạn đã rất sâu, sử dụng điểm cuối dưới của phạm vi đó.

  4. Tăng cường các tần số thấp bằng EQ. Thêm khoảng 3 đến 5 dB xung quanh 120 đến 250 Hz để xây dựng trọng lượng lồng ngực. Sau đó áp dụng roll-off tần số cao nhẹ nhàng ở trên khoảng 8 đến 10 kHz để loại bỏ “không khí” micrô gần gũi mịn sẽ khiến giọng nói cảm thấy nhỏ. Giọng nói bây giờ sẽ cảm thấy lớn về mặt vật lý trước khi bạn thêm bất kỳ không gian nào.

  5. Thêm reverb dài cho tiếng vang sân vận động. Chèn reverb hall hoặc plate. Đặt decay thành khoảng 1,5 đến 2,5 giây, pre-delay gần 20 đến 40 mili-giây, và một hỗn hợp ướt khoảng 25 đến 40 phần trăm. Giữ giọng nói khô rõ ràng dưới - reverb nên bao quanh các từ, không phải chặn chúng. Đây là lớp biến một giọng nói sâu thành người dẫn.

  6. Giảm tốc độ và thêm nhấn mạnh. Nếu công cụ của bạn hỗ trợ nó, hãy giảm tốc độ phát biểu một chút và thêm nhấn mạnh hoặc tạm dừng trên các từ khóa. Trong text to speech, dấu chấm câu và ngắt dòng kiểm soát điều này; trong một trình thay đổi thời gian thực, bạn kiểm soát nó bằng cách phát biểu của riêng bạn. Cố ý, chậm, nặng - không bao giờ vội vàng.

  7. Định tuyến nó đến nơi bạn cần. Đối với một clip được làm sẵn, xuất âm thanh được xử lý và tải nó vào một soundboard được ràng buộc với một hotkey để bạn có thể kích hoạt “Finish Him” đúng lúc. Để sử dụng trực tiếp, trỏ đầu ra của trình thay đổi giọng nói thời gian thực tới một micrô ảo để Discord, OBS và trò chơi của bạn đều nghe giọng nói được chuyển đổi một cách tự động.

  8. Kiểm tra A/B phiên bản của bạn dựa trên một tham chiếu trong đầu của bạn. Phát phiên bản của bạn và so sánh tinh thần với cách trình bày biểu tượng. Nếu nghe giống như hoạt hình, bạn đã pitch quá xa hoặc di chuyển các formants; nếu nghe nhỏ, hãy thêm EQ các tần số thấp và reverb thêm; nếu nó buồn, hãy cắt hỗn hợp ướt. Điều chỉnh một biến tại một thời điểm.

Bảng Cài Đặt: Chuỗi Giọng Nói Người Dẫn

Sử dụng các cái này làm điểm bắt đầu và điều chỉnh theo giọng nói cơ sở của bạn. Chiếc vạy quan trọng nhất là reverb - đó là cái khiến hiệu ứng có thể nhận biết được.

Tham sốCài đặtGhi chú
Giọng nói cơ sởGiọng nói TTS nam sâu nhấtBắt đầu sâu có nghĩa là ít pitch shift hơn, độ rõ cao hơn
Pitch shift-2 đến -5 bán tonesKích hoạt sự bảo quản formant; ít hơn nếu đã sâu
EQ các tần số thấp+3 đến +5 dB ở 120-250 HzThêm trọng lượng lồng ngực và cơ thể
EQ tần số caoRoll-off nhẹ nhàng ở trên 8-10 kHzLoại bỏ “không khí” micrô gần gũi mịn
Loại reverbHall hoặc plateMô phỏng một không gian sân vận động lớn
Decay reverb1,5 đến 2,5 giâyLâu hơn cho các dòng một từ
Pre-delay reverb20 đến 40 msGiữ các từ khô có thể hiểu được
Hỗn hợp ướt reverb25 đến 40 phần trămGiọng nói khô phải giữ được nghe rõ
Tốc độ phát biểuHơi chậm hơn bình thườngTốc độ cố ý và nặng
Độ dài dòngCác cụm từ ngắnĐể lại không gian cho phần đuôi reverb

Trường Hợp Sử Dụng: Giọng Nói Người Dẫn Hạ Cánh Ở Đâu

Intro phát sóng và video. Một clip người dẫn được tạo sẵn tạo ra một lời mở tuyệt vời. Gõ tên kênh của bạn hoặc một cụm từ bắt lấy, chạy nó qua chuỗi, và bỏ nó trên một hotkey để bắn từ đầu một cuộc phát sóng hoặc qua một montage điểm nổi bật. Vì nó là text to speech, bạn có thể tạo lại các biến thể mà không cần ghi lại.

Meme và nội dung dạng ngắn. Giọng nói người dẫn là viết tắt meme cho những kịch tính cao áp dụng cho một cái gì đó tầm thường. Đọc một danh sách tạp hóa, tin nhắn trò chuyện hoặc một thông báo tầm thường trong phong cách gầm gừ là trò đùa. Các clip ngắn được xây dựng từ văn bản được gõ là hoàn hảo cho video dạng ngắn nơi thời gian là mọi thứ.

Phản ứng trò chơi trực tiếp. Với một trình thay đổi giọng nói thời gian thực, bạn có thể công bố các khoảnh khắc khi chúng xảy ra - một “Flawless Victory” tại thời điểm bạn cứu một vòng, “Finish Him” khi đồng đội của bạn sắp kết thúc một trận đấu. Ngay lập tức là phần thưởng, đó là lý do tại sao xử lý cục bộ có độ trễ thấp quan trọng hơn độ trung thực thô ở đây.

Công bố soundboard. Tải một bộ các dòng người dẫn được tạo sẵn vào một soundboard được ràng buộc với các hotkey, và bạn có các công bố kịch tính tức thì cho bất kỳ cuộc gọi hoặc phát sóng nào. Điều này kết hợp tốt với cách tiếp cận thời gian thực: các dòng chính tắc từ soundboard, những cái tự phát biểu từ micrô trực tiếp của bạn.

Tại Sao Reverb Là Thành Phần Bí Mật

Nếu bạn khắc phục hiệu ứng xuống một quyết định, đó là reverb. Một giọng nói sâu của riêng nó nghe giống như một người có giọng nói sâu. Tiếng vang sân vận động là cái mà não của bạn liên kết với người dẫn, vì cách trình bày ban đầu sống trong một không gian kịch tích to lớn. Đó là một tín hiệu không gian, và reverb là cách bạn tái tạo nó.

Bẫy là quá mức. Vì reverb có thể nhận biết được rất nhiều, mọi người xoay hỗn hợp ướt và decay cho đến khi các từ biến thành bùn. Sửa chữa là cách đối xử reverb như một gia vị: đủ để các từ ngắn vang ra và cảm thấy khổng lồ, không quá nhiều để các câu hoàn chỉnh trở nên không thể hiểu được. Decay dài hơn hoạt động tuyệt vời trên một từ duy nhất như “Fatality” và khủng khiếp trên một đoạn đầy đủ, chính xác là lý do tại sao các dòng ngắn là truyền thống. Khi bạn muốn đọc một cái gì đó dài hơn, hãy rút ngắn decay hoặc chia văn bản thành các cụm từ ngắn để mỗi cái có đuôi sạch riêng của nó.

Tái Tạo Nó Mà Không Đặt Tên Bất Kỳ Stack Nào

Tất cả những gì ở trên sử dụng text to speech chung và các hiệu ứng âm thanh tiêu chuẩn - một giọng nói cơ sở sâu, một máy chuyển đổi pitch, một EQ và reverb. Bạn không cần bất kỳ mô hình cụ thể nào hoặc bất kỳ công cụ có tên duy nhất nào. Bất kỳ công cụ nào cung cấp cho bạn một giọng nói nam sâu cộng với kiểm soát pitch, EQ và reverb có thể tạo ra kết quả. Một ứng dụng Windows duy nhất kết hợp text to speech, trình thay đổi giọng nói thời gian thực, soundboard với hotkey và các hiệu ứng như pitch sâu và reverb cho phép bạn xây dựng toàn bộ chuỗi ở một nơi, tạo các clip và bắn chúng trực tiếp - đây là quy trình làm việc hướng dẫn này được xây dựng xung quanh. Nếu bạn muốn thử từ đầu đến cuối, VoxBooster chạy toàn bộ chuỗi cục bộ trên Windows 10 và 11, và trang giá cả bao gồm bản dùng thử và giấy phép suốt đời.

Ghi Chú Về Quyền Sở Hữu Trí Tuệ Mortal Kombat

Mortal Kombat, người dẫn của nó và các dòng như “Finish Him” là tài sản trí tuệ của NetherRealm Studios và Warner Bros. Tái tạo phong cách người dẫn để giải trí cá nhân, meme, bình luận hoặc parody thường nằm trong các nguyên tắc sử dụng công bằng, và tạo âm thanh của riêng bạn giữ bạn xa khỏi rủi ro lớn nhất. Hai quy tắc giữ nó sạch sẽ.

Đầu tiên, hãy tạo âm thanh chứ không phải trích xuất nó. Trích xuất và phân phối lại âm thanh trò chơi được bảo vệ bản quyền là một vấn đề pháp lý riêng biệt từ parody và nó mang theo rủi ro thực tế. Tất cả mọi thứ trong hướng dẫn này được sản xuất từ đầu bằng một giọng nói text to speech sâu cộng với các hiệu ứng của riêng bạn, vì vậy không cần phải chạm vào các tệp trò chơi.

Thứ hai, giữ nó không thương mại và không chính thức. Đừng bán sản phẩm được xây dựng trên sự giống nhau, đừng ngụ ý sự chứng thực và gắn nhãn parody là parody. Khi sử dụng của bạn rõ ràng là một sự tái tạo do người hâm mộ tạo hoặc hài hước và âm thanh được tạo mới, bạn đang ở trên mặt đất vững chắc. Nếu bạn không chắc về một dự án thương mại, hãy xóa các quyền với chủ sở hữu tài sản trí tuệ. Mục Mortal Kombat trên Wikipedia là một tài liệu tham khảo trung lập cho nền tảng nhân vật.

FAQ

Cái gì khiến giọng nói người dẫn Mortal Kombat nghe như vậy? Giọng nói người dẫn được xác định bởi một pitch rất thấp, sự cộng hưởng lồng ngực nặng, tốc độ phát biểu chậm cố ý và một phần đuôi reverb dài khiến các dòng ngắn như Fatality cảm thấy như vang vọng khắp một sân vận động. Nó nằm thấp trong phạm vi tần số với các tần số thấp được tăng cường và một điểm cao được kiểm soát, được trình bày với nhấn mạnh sân khấu trên mỗi âm tiết.

Làm cách nào để text to speech nghe giống như người dẫn MK? Bắt đầu với giọng nói TTS nam sâu nhất có sẵn, sau đó xử lý đầu ra: hạ thấp pitch vài bán tones với bảo quản formant, thêm một reverb plate hoặc hall dài, tăng các tần số thấp xung quanh 120 đến 250 Hz, và giảm tốc độ phát biểu một chút. Sự kết hợp của một giọng nói cơ sở sâu cộng với pitch, reverb và EQ là cái khiến cảm thấy như người dẫn.

Tôi có thể làm điều này trong thời gian thực hay chỉ từ một tệp văn bản? Cả hai. Text to speech tạo ra một clip từ văn bản được gõ, mà sau đó bạn có thể phát qua một soundboard trên một hotkey trong quá trình phát sóng hoặc cuộc gọi. Nếu bạn muốn nói trực tiếp và được chuyển đổi, một trình thay đổi giọng nói thời gian thực áp dụng cùng một chuỗi pitch sâu và reverb cho micrô của bạn với độ trễ thấp.

Cài đặt reverb nào cung cấp tiếng vang của người dẫn? Sử dụng reverb hall hoặc plate với decay khoảng 1,5 đến 2,5 giây, pre-delay ngắn gần 20 đến 40 mili-giây, và một hỗn hợp ướt khoảng 25 đến 40 phần trăm. Quá nhiều hỗn hợp ướt chuyển tiếng nói thành bùn, vì vậy hãy giữ giọng nói khô có thể nghe rõ dưới phần đuôi. Các dòng ngắn được hưởng lợi từ một phần đuôi dài hơn so với các câu hoàn chỉnh.

Có hợp pháp khi tạo một giọng nói người dẫn Mortal Kombat? Mortal Kombat là tài sản trí tuệ của NetherRealm Studios và Warner Bros. Tái tạo phong cách người dẫn để giải trí cá nhân, meme hoặc parody thường nằm trong sử dụng công bằng, đặc biệt là khi âm thanh được tạo ra gần đây chứ không phải từ trò chơi. Tránh sử dụng thương mại, các khẳng định chứng thực chính thức và bất kỳ âm thanh trò chơi lậu nào.

Tôi có cần trích xuất âm thanh từ trò chơi không? Không, và bạn không nên. Tất cả mọi thứ trong hướng dẫn này được tạo từ đầu: một giọng nói text to speech sâu cộng với chuỗi hiệu ứng của riêng bạn. Trích xuất và phân phối lại âm thanh trò chơi được bảo vệ bản quyền là một vấn đề pháp lý riêng biệt từ parody và mang theo rủi ro pháp lý thực tế, vì vậy tạo âm thanh chứ không phải trích xuất nó từ các tệp trò chơi.

Những dòng nào hoạt động tốt nhất cho hiệu ứng người dẫn? Các dòng ngắn và ấn tượng hạ cánh mạnh nhất vì phần đuôi reverb dài có chỗ để thở. “Fatality,” “Finish Him,” “Flawless Victory,” và các tên hoặc danh từ riêng lẻ hoạt động tốt hơn rất nhiều so với các câu dài. Nếu bạn muốn đọc một đoạn đầy đủ trong phong cách, hãy chia nó thành các cụm từ ngắn với các tạm dừng để mỗi cái có tiếng vang kịch tính riêng của nó.

Kết Luận

Giọng nói người dẫn Mortal Kombat không phải là một preset bí ẩn - nó là một giọng nói cơ sở sâu xếp chồng lên nhau với pitch, EQ các tần số thấp và reverb sân vận động dài, được trình bày chậm và nặng trên các dòng ngắn và ấn tượng. Xây dựng chuỗi đó một lần và bạn có thể tạo “Finish Him” từ văn bản được gõ cho các intro và meme của bạn, hoặc áp dụng nó trực tiếp lên micrô của riêng bạn cho các phản ứng trò chơi ngay lập tức. Giữ âm thanh tự tạo, giữ sử dụng parody và cá nhân, và tôn trọng tài sản trí tuệ của NetherRealm và Warner Bros. Nếu bạn muốn toàn bộ quy trình làm việc - text to speech, trình thay đổi giọng nói thời gian thực, hotkey soundboard và các hiệu ứng pitch sâu và reverb - trong một ứng dụng Windows duy nhất, hãy bắt đầu với bản dùng thử miễn phí và điều chỉnh người dẫn riêng của bạn.

Dùng thử VoxBooster — 3 ngày dùng thử miễn phí.

Nhân bản giọng thời gian thực, soundboard và hiệu ứng — ở mọi nơi bạn đã nói chuyện.

  • Không cần thẻ tín dụng
  • ~30ms độ trễ
  • Discord · Teams · OBS
Dùng thử miễn phí 3 ngày