การสังเคราะห์เสียงพูดแบบเสียงลึกแปลงคำที่พิมพ์ให้กลายเป็นเสียงอ่านที่ต่ำ อุดมสมบูรณ์ และน่าเชื่อถือ - ประเภทเสียงที่เปิดตัวอย่างหนัง บรรยายสารคดี หรือประกาศช่วงถัดไปด้วยความหนักแน่น แทนที่จะเป็นเสียงแบนเรียบและเป็นกลางที่เครื่องมือ TTS ส่วนใหญ่สร้างขึ้น คุณจะได้เสียงผู้บรรยายลึกที่เต็มไปทั้งห้อง คู่มือนี้อธิบายว่าเสียง TTS ลึกคืออะไร ทำไมนักสร้างเนื้อหาถึงต้องการ และวิธีสร้างมันบน Windows โดยใช้เสียงพื้นฐานลึกบวกกับเอฟเฟกต์หลายอย่าง
TL;DR
- เสียง TTS ลึกอ่านข้อความของคุณด้วยน้ำเสียงผู้บรรยายหรือผู้ประกาศที่ต่ำและกังวาน
- นักสร้างเนื้อหาต้องการมันสำหรับตัวอย่างหนัง บทนำวิดีโอ การบรรยาย หนังสือเสียง และ YouTube
- สูตร: เสียงพื้นฐานลึก + ลดระดับเสียง + เลื่อนฟอร์แมนต์ + EQ ความอบอุ่น + เรเวิร์บเบาๆ
- จังหวะสำคัญพอๆ กับการประมวลผล - การส่งมอบที่ช้าและช่วงหยุดสร้างความหนักแน่น
- VoxBooster สร้างเสียงและใช้เชนเอฟเฟกต์เสียงลึกในเครื่อง ความหน่วงต่ำ
- ส่งออกผลลัพธ์เป็นไฟล์หรือกำหนดเส้นทางไปยังไมโครโฟนเสมือนสำหรับใช้งานสด
- มีช่วงทดลองใช้ 3 วันแบบเต็มและใบอนุญาตตลอดชีพแบบครั้งเดียว
เสียง TTS แบบเสียงลึกคืออะไร?
เสียงการสังเคราะห์เสียงพูดแบบเสียงลึกคือเอาต์พุต TTS ที่ปรับแต่งให้ฟังดูต่ำ อบอุ่น และน่าเชื่อถือ แทนที่จะเป็นกลางหรือสว่าง มันเริ่มต้นจากเสียงพื้นฐานลึกและเพิ่มการปรับระดับเสียง ฟอร์แมนต์ EQ และเรเวิร์บ เพื่อให้การอ่านมีน้ำหนักและสภาพ ผลลัพธ์คือการอ่านสคริปต์ที่พิมพ์ใดก็ได้ในสไตล์ผู้บรรยายภาพยนตร์ ผู้ประกาศตัวอย่างหนัง หรือเสียงพากย์สารคดี
คำสำคัญคือ ปรับแต่ง เครื่องจำลอง TTS ดิบให้เสียงอ่านที่เข้าใจได้แต่ไร้บุคลิก การเปลี่ยนสิ่งนั้นให้กลายเป็นเสียงผู้บรรยายลึกคือกระบวนการที่ตั้งใจ ในการหล่อเสียงพื้นฐาน ลดมันลงอย่างถูกต้อง และเพิ่มสัญญาณอะคูสติกที่หูเชื่อมโยงกับขนาด การสั่นสะเทือนในอก และห้องขนาดใหญ่ เมื่อทำได้ดี ผู้ฟังจะหยุดได้ยิน “เสียงพูดสังเคราะห์” และเริ่มได้ยินผู้นำเสนอแทน
ทำไมผู้คนถึงต้องการเสียง TTS ลึก
เสียงลึกแสดงถึงความน่าเชื่อถือ การเชื่อมโยงนั้นฝังลึกอยู่ในวิธีที่มนุษย์รับรู้เสียงพูด - น้ำเสียงต่ำและกังวานอ่านเป็นความสงบ น่าเชื่อถือ และสำคัญ นั่นจึงเป็นเหตุผลว่าทำไมงานพากย์เสียงแบบมืออาชีพจำนวนมากจึงอยู่ในช่วงเสียงต่ำ เมื่อคุณต้องการให้สคริปต์อ่านด้วยความหนักแน่นแต่ไม่มีนักพากย์เสียงพร้อม ตัวสร้างเสียงลึกสำหรับการสังเคราะห์เสียงพูดจะเติมเต็มช่องว่างนั้น
ความต้องการรวมกลุ่มอยู่รอบความต้องการที่เกิดซ้ำหลายอย่าง นักสร้างเนื้อหาต้องการ เสียง TTS สไตล์ตัวอย่างหนัง สำหรับบทนำและการตัดต่อดราม่า ครูและผู้สร้างวิดีโออธิบายต้องการ เสียงผู้บรรยายลึกที่มั่นคง ซึ่งรักษาความสนใจตลอดเนื้อหารูปแบบยาว พอดแคสต์ต้องการผู้ประกาศที่สม่ำเสมอสำหรับช่วงพัก และใครก็ตามที่สร้างเสียงในปริมาณมากต้องการพิมพ์บทพูด สร้างเสียง และได้การอ่านแบบออกอากาศโดยไม่ต้องบันทึกซ้ำ เสียง TTS ลึกทำซ้ำได้ แก้ไขได้ง่าย และสอดคล้องกับแบรนด์เสมอ
สิ่งที่ทำให้เสียงฟังดูลึก
ก่อนแตะสไลเดอร์แม้แต่ตัวเดียว มีประโยชน์ที่จะรู้ว่าหูของคุณตอบสนองต่ออะไรจริงๆ “ลึก” ไม่ใช่การตั้งค่าเดียว - มันคือกองสัญญาณอะคูสติกที่ทำงานร่วมกัน
ความถี่พื้นฐาน (ระดับเสียง). อัตราการสั่นสะเทือนพื้นฐาน ระดับเสียงต่ำอ่านเป็นเสียงลึกกว่า แต่ระดับเสียงเพียงอย่างเดียวไม่ใช่ทั้งหมด - ดันมันลงมากเกินไปและเสียงจะฟังดูเทียม
ฟอร์แมนต์. นี่คือความถี่เรโซแนนซ์ที่ถูกหล่อขึ้นโดยขนาดของท่อเสียง ท่อขนาดใหญ่ผลิตฟอร์แมนต์ต่ำกว่า นั่นจึงเป็นเหตุผลว่าทำไมเสียงลึกแท้จึงฟังแตกต่างใน คุณภาพ ไม่ใช่แค่ระดับเสียง สำหรับอะคูสติกพื้นฐาน บทความวิกิพีเดียเกี่ยวกับฟอร์แมนต์ เป็นข้อมูลอ้างอิงที่ดี
ความหนักแน่นที่ความถี่ต่ำ. พลังงานต่ำกว่า 200 Hz ให้เสียงในอกและน้ำหนัก นี่คือความแตกต่างระหว่าง “ต่ำ” กับ “ทรงพลัง”
ความอบอุ่นเทียบกับความแข็งกร้าว. การลดช่วงกลางสูงที่แข็งกร้าวทำให้เสียงลึกเรียบเนียนแทนที่จะกระด้าง ทำให้รู้สึกอุดมสมบูรณ์แทนที่จะบาง
พื้นที่. เรเวิร์บเล็กน้อยบอกหูว่าเสียงอยู่ในห้องขนาดใหญ่ - ห้องประชุม ห้องโถง - ซึ่งอ่านเป็นแบบภาพยนตร์และสำคัญ
วิธีสร้างเสียง TTS ลึก
การได้การอ่าน TTS ชายลึกที่น่าเชื่อถือคือเชน ไม่ใช่ปุ่มเดียว แต่ละขั้นตอนจัดการกับสัญญาณหนึ่งจากด้านบน VoxBooster ใช้เชนทั้งหมดในเครื่องบน Windows เพื่อให้คุณสร้างบทพูดและปรับแต่งได้ในที่เดียว
1. เลือกเสียงพื้นฐานลึก. เริ่มต้นจากเสียงที่ลึกอยู่แล้ว การเริ่มต้นจากพื้นฐานสว่างและเป็นกลาง แล้วดึงระดับเสียงลงผลิตเสียงเทียมแบบคลาสสิก เพราะฟอร์แมนต์ไม่ตรงกับระดับเสียงอีกต่อไป เสียงพื้นฐานลึกทำให้ฟอร์แมนต์อยู่ในตำแหน่งที่หูคาดหวัง
2. ลดระดับเสียง. ลดระดับเสียงลงสองสามเซมิโทนเพื่อเพิ่มความลึก การเคลื่อนไหวเล็กๆ ฟังดูดีกว่าการเคลื่อนไหวใหญ่ - การลดระดับเสียงมากเกินไปสร้างสิ่งที่ผิดปกติที่ทำให้เห็นกลเม็ด
3. เลื่อนฟอร์แมนต์ลง. ผลักฟอร์แมนต์ลงต่ำพร้อมกับระดับเสียงเพื่อให้เสียงอ่านเป็นท่อเสียงขนาดใหญ่ การเคลื่อนระดับเสียงและฟอร์แมนต์ร่วมกันคือขั้นตอนสำคัญที่สุดสำหรับโทนลึกที่เป็นธรรมชาติ การข้ามขั้นตอนนี้คือสาเหตุอันดับหนึ่งที่ TTS ลึกฟังดูเทียม
4. เพิ่มความอบอุ่นด้วย EQ. การเพิ่มเบาๆ รอบ 100 ถึง 150 Hz สร้างเสียงในอกและร่างกาย การตัดเบาๆ ในช่วงกลางสูงที่แข็งกร้าว (รอบ 3 ถึง 5 kHz) ทำให้การอ่านเรียบเนียนเพื่อให้รู้สึกอุดมสมบูรณ์แทนที่จะคมกริบ
5. ควบคุมระดับ. การคอมเพรสเบาๆ ปรับระดับส่วนดังและเงียบให้เท่ากัน เพื่อให้การส่งมอบยังคงมั่นคงและปรากฏชัด - วิธีที่งานพากย์เสียงมืออาชีพรักษาระดับที่สม่ำเสมอ
6. เพิ่มเรเวิร์บเบาๆ. เรเวิร์บห้องขนาดใหญ่หรือห้องโถงสั้นที่ mix ต่ำให้เสียงน้ำหนักแบบภาพยนตร์โดยไม่เปลี่ยนเป็นเสียงสะท้อน นี่คือการเคลื่อนไหวสุดท้ายที่ทำให้เสียงผู้บรรยายลึกรู้สึกเหมือนอยู่ในตัวอย่างหนัง
การสังเคราะห์เสียงพูดแบบเสียงลึก: ทีละขั้นตอน
นี่คือขั้นตอนการทำงานทั้งหมด จากสคริปต์ที่พิมพ์ไปยังเสียงที่เสร็จสมบูรณ์ โดยใช้ VoxBooster บน Windows 10 หรือ 11
-
ดาวน์โหลดและติดตั้ง VoxBooster จาก voxbooster.com/download การตั้งค่าจะเรียกใช้ตัวช่วยกำหนดเส้นทางเสียงโดยอัตโนมัติ - ไม่ต้องกำหนดค่าสายเคเบิลเสมือน
-
เปิดแท็บ TTS และพิมพ์สคริปต์ของคุณ. เก็บประโยคให้สั้นและกระชับสำหรับการบรรยาย เพิ่มการขึ้นบรรทัดและช่วงหยุดในจุดที่ต้องการให้เสียงช้าลง สำหรับการอ่านแบบตัวอย่างหนัง เขียนเป็นประโยคสั้น: “เมืองหนึ่ง โอกาสเดียว เสียงเดียว”
-
เลือกเสียงพื้นฐานลึก. ในตัวเลือกเสียง เลือกตัวเลือกต่ำและกังวานจากหมวดหมู่ผู้บรรยายหรือผู้ออกอากาศ การเริ่มต้นลึกหมายความว่าการปรับแต่งในภายหลังแต่ละครั้งจะเล็กน้อยและสะอาดกว่า
-
สร้างบทพูดและฟัง. เล่นครั้งเดียวโดยไม่มีเอฟเฟกต์เพื่อได้ยินการอ่านดิบ นี่คือจุดอ้างอิงของคุณ
-
ใช้เชนเอฟเฟกต์เสียงลึก. เปิดแผงเอฟเฟกต์และตั้งค่าระดับเสียงลงสองสามเซมิโทน เลื่อนฟอร์แมนต์ลงให้ตรงกัน จากนั้นเพิ่ม EQ ความอบอุ่น (เพิ่มรอบ 120 Hz ตัดเบาๆ รอบ 4 kHz) ใช้ตารางสูตรด้านล่างเป็นจุดเริ่มต้น
-
เพิ่มการคอมเพรสเบาๆ และเรเวิร์บ. ตั้งค่าการคอมเพรสปานกลางสำหรับระดับที่มั่นคง จากนั้นเพิ่มเรเวิร์บห้องสั้นที่ mix ต่ำ ดูตัวอย่างหลังจากการเปลี่ยนแปลงแต่ละครั้ง - เพิ่มเอฟเฟกต์ทีละน้อยแทนที่จะทำพร้อมกันทั้งหมด
-
ปรับแต่งให้เหมาะกับสคริปต์. บทพูดตัวอย่างหนังดราม่าต้องการเรเวิร์บมากขึ้นและความรู้สึกช้าลง การบรรยายสารคดีต้องการพื้นที่น้อยลงและความชัดเจนมากขึ้น ปรับแต่งตามรสนิยม
-
ส่งออกหรือกำหนดเส้นทางเสียง. บันทึกการอ่านที่เสร็จสิ้นเป็นไฟล์สำหรับแก้ไขในโปรแกรมตัดต่อวิดีโอ หรือกำหนดเส้นทางไปยังไมโครโฟนเสมือนเพื่อให้แอปอย่าง OBS, Discord หรือเบราว์เซอร์ถือเสียงลึกที่สร้างขึ้นเป็นอินพุตสด ช่วยให้คุณเรียกใช้บทพูดผู้บรรยายระหว่างสตรีมหรือวางบทพูดผู้ประกาศในสายโทรแบบเรียลไทม์
-
บันทึกเป็นพรีเซ็ต. เมื่อการตั้งค่าฟังดูถูกต้อง ให้บันทึกเชนทั้งหมดเป็นพรีเซ็ตที่มีชื่อ - “ผู้บรรยายตัวอย่างหนัง” “ผู้ประกาศวิทยุ” - และเรียกคืนได้ด้วยคลิกเดียวในครั้งต่อไป
สูตร TTS เสียงลึก: ตารางการตั้งค่า
นี่คือจุดเริ่มต้น ไม่ใช่กฎตายตัว - เสียงพื้นฐานแต่ละเสียงต้องการการสอบเทียบที่แตกต่างกันเล็กน้อย ดังนั้นดูตัวอย่างและปรับแต่ง คิดว่าแต่ละแถวคือบุคลิกที่คุณสามารถปรับและบันทึกเป็นพรีเซ็ต
| สูตร | ระดับเสียง | ฟอร์แมนต์ | EQ (ความอบอุ่น) | การคอมเพรส | เรเวิร์บ | ความรู้สึก |
|---|---|---|---|---|---|---|
| ผู้บรรยาย | -2 ถึง -3 st | -10% | +3 dB ที่ 120 Hz, -2 dB ที่ 4 kHz | 3:1 เบา | ห้องโถง 10% mix, ~1.8s decay | มั่นคง สารคดี ชัดเจน |
| ตัวอย่างหนัง | -3 ถึง -4 st | -15% | +4 dB ที่ 110 Hz, -3 dB ที่ 4 kHz | 4:1 ปานกลาง | ห้องโถง 20% mix, ~2.2s decay | ดราม่า ช้า แบบภาพยนตร์ |
| ผู้ประกาศ | -2 st | -8% | +3 dB ที่ 130 Hz, -2 dB ที่ 3.5 kHz | 4:1 ปานกลาง | ห้อง 12% mix, ~1.2s decay | หนักแน่น มั่นใจ ชัดเจน |
| วิทยุ | -1 ถึง -2 st | -5% | +2 dB ที่ 100 Hz, -1 dB ที่ 5 kHz | 5:1 แน่น | ห้อง 8% mix, ~0.8s decay | เรียบ อบอุ่น ออกอากาศ |
สูตรตัวอย่างหนังพึ่งพาเรเวิร์บและจังหวะมากที่สุด สูตรวิทยุพึ่งพาการคอมเพรสแน่นและความอบอุ่นด้วยพื้นที่น้อยมาก ใช้แถวผู้บรรยายเป็นพื้นฐานกลางแล้วเคลื่อนไปยังตัวอย่างหนังหรือวิทยุจากที่นั่น
กรณีการใช้งานสำหรับเสียงผู้บรรยายลึก
บทนำวิดีโอ. เสียงลึกห้าวินาทีก่อนเนื้อหาของคุณตั้งโทนทันทีและกลายเป็นเอกลักษณ์ช่อง
ตัวอย่างหนังและการตัดต่อดราม่า. การอ่านแบบตัวอย่างหนังคลาสสิก - ลึก ช้า กังวาน - เหนือเกมเพลย์ คลิปกีฬา หรือการตัดต่อแฟน นี่คือเสียงมีมที่อยู่ในหัวของผู้ชมทุกคน
การบรรยายและวิดีโออธิบาย. เสียงผู้บรรยายลึกที่มั่นคงนำเสนอเนื้อหาการศึกษารูปแบบยาวโดยไม่ทำให้ผู้ฟังเหนื่อยล้า รักษาความสนใจตลอดสคริปต์
หนังสือเสียงและการอ่านรูปแบบยาว. การพิมพ์บทและสร้างการอ่านลึกที่สม่ำเสมอเร็วกว่าการบันทึกซ้ำมาก และโทนเสียงยังคงเหมือนกันจากหน้าแรกถึงหน้าสุดท้าย
YouTube และรูปแบบสั้น. บทนำส่วน การเปิดเผยอันดับ การนับถอยหลัง “10 อันดับแรก” - การอ่านผู้ประกาศลึกให้โครงสร้างและดราม่ากับรูปแบบใดก็ได้
ส่วนพอดแคสต์. ผู้ประกาศที่เกิดซ้ำสำหรับบทนำ ช่วงโฆษณา และบทส่งท้ายให้รายการสมัครเล่นกรอบแบบมืออาชีพ แม้ว่าเสียงโฮสต์จะเป็นกันเอง
การส่งมอบ: สิ่งที่ไม่มีการตั้งค่าใดทดแทนได้
เชนเอฟเฟกต์พาคุณไปได้ส่วนใหญ่ แต่จังหวะและการเรียบเรียงรับส่วนที่เหลือ ส่วนนี้อยู่ในวิธีที่คุณเขียนและกำหนดเวลาสคริปต์ ไม่ใช่ในสไลเดอร์
เขียนเป็นประโยคสั้น. การบรรยายลึกต้องหายใจ ประโยคยาวๆ ที่ต่อเนื่องทำให้ดราม่าแบนราบ แบ่งบรรทัดเพื่อให้เสียงสามารถลงจอดแต่ละวลี
เพิ่มช่วงหยุดในข้อความ. แทรกการขึ้นบรรทัดหรือเว้นวรรคในจุดที่ต้องการให้เรเวิร์บดังก้อง “ในโลกหนึ่ง… ที่เสียงหนึ่ง… เปลี่ยนทุกสิ่ง” ความเงียบคือที่ที่น้ำหนักอาศัยอยู่
ชะลอจังหวะ. การอ่านลึกที่รีบเร่งสูญเสียความหนักแน่น หาก TTS ของคุณรองรับแท็กการกำหนดจังหวะ ให้ใช้เพื่อยืดบรรทัดสำคัญ สำหรับวิธีมาตรฐานในการควบคุมจังหวะและการเน้นเสียงพูด สเปก W3C Speech Synthesis Markup Language (SSML) คือข้อมูลอ้างอิง
รักษาความสม่ำเสมอ. เมื่อพรีเซ็ตใช้งานได้ดี ให้ใช้ซ้ำตลอดโครงการเพื่อให้ทุกส่วนฟังดูเหมือนผู้บรรยายคนเดียวกัน ความสม่ำเสมอคือสิ่งที่ทำให้เสียงสังเคราะห์รู้สึกเหมือนผู้นำเสนอจริงๆ เมื่อเวลาผ่านไป
ส่งออกหรือกำหนดเส้นทาง: สองวิธีในการใช้งาน
เมื่อการอ่านลึกฟังดูถูกต้อง คุณมีสองเส้นทางขึ้นอยู่กับว่าเสียงนั้นสำหรับการผลิตหรือการใช้งานสด
ส่งออกเป็นไฟล์ เมื่อคุณกำลังสร้างวิดีโอ หนังสือเสียง หรือพอดแคสต์ บันทึกบทพูดที่เสร็จสิ้นและวางลงในไทม์ไลน์ของโปรแกรมตัดต่อ เนื่องจากเอฟเฟกต์ถูกอบรวมไว้แล้ว จึงไม่จำเป็นต้องประมวลผลเพิ่มเติม - โทนผู้บรรยายลึกเดินทางไปกับไฟล์
กำหนดเส้นทางไปยังไมโครโฟนเสมือน เมื่อต้องการเสียงลึกแบบสด VoxBooster สามารถส่งเสียงที่สร้างขึ้นไปยังไมโครโฟนเสมือนเพื่อให้แอปใดก็ได้ - OBS, Discord, เบราว์เซอร์ของคุณ - ถือว่าเป็นอินพุตจริง นี่คือวิธีที่คุณเรียกใช้บทนำเสียงตัวอย่างหนังกลางสตรีม หรือวางบทพูดผู้ประกาศลงในสายโทรแบบเรียลไทม์ โดยไม่ต้องแก้ไขล่วงหน้า
นักสร้างเนื้อหาจำนวนมากใช้ทั้งสอง: ส่งออกไฟล์สำหรับเนื้อหาที่ขัดเกลา กำหนดเส้นทางไมโครโฟนเสมือนสำหรับช่วงเวลาสด พรีเซ็ตเดียวกันใช้ได้กับทั้งสอง ดังนั้นคุณสร้างเสียงลึกครั้งเดียวและใช้มันได้ทุกที่ที่ต้องการ
FAQ
การสังเคราะห์เสียงพูดแบบเสียงลึกคืออะไร? การสังเคราะห์เสียงพูดแบบเสียงลึกคือซอฟต์แวร์ TTS ที่อ่านข้อความที่พิมพ์ออกเสียงด้วยน้ำเสียงต่ำ อุดมสมบูรณ์ และน่าเชื่อถือ แทนที่จะเป็นเสียงเริ่มต้นที่เป็นกลาง โดยผสานเสียงพื้นฐานที่ลึกกับการปรับระดับเสียง ฟอร์แมนต์ ความอบอุ่น และเรเวิร์บเบาๆ เพื่อสร้างเสียงผู้บรรยาย ตัวอย่างหนัง หรือผู้ประกาศจากสคริปต์ใดก็ได้ที่คุณพิมพ์
ฉันจะทำให้เสียง TTS ฟังดูลึกขึ้นได้อย่างไร? เริ่มต้นด้วยเสียงพื้นฐานที่ลึก จากนั้นลดระดับเสียงลงสองสามเซมิโทนและเลื่อนฟอร์แมนต์ลงเล็กน้อยเพื่อให้โทนเสียงยังคงเป็นธรรมชาติ เพิ่มความอบอุ่นที่ความถี่ต่ำด้วย EQ รอบ 100 ถึง 150 Hz ควบคุมระดับด้วยการคอมเพรสเบาๆ และปิดท้ายด้วยเรเวิร์บห้องขนาดใหญ่เบาๆ เพื่อความหนักแน่นแบบภาพยนตร์
ฉันสามารถใช้เสียง TTS ลึกเป็นเสียงตัวอย่างหนังได้ไหม? ได้ เอฟเฟกต์ TTS สไตล์ตัวอย่างหนังผสานเสียงผู้บรรยายพื้นฐานที่ลึก จังหวะที่ช้าและจงใจ ความหนักแน่นที่ความถี่ต่ำจาก EQ และเรเวิร์บห้องสั้น พิมพ์บทพูดของคุณ สร้างเสียง จากนั้นใช้สูตรตัวอย่างหนังในตารางการตั้งค่าด้านบน เพิ่มช่วงหยุดในข้อความเพื่อให้เรเวิร์บมีพื้นที่หายใจ
TTS เสียงชายลึกดีกว่าการลดระดับเสียงปกติลงไหม? การเริ่มต้นจากเสียงชายพื้นฐานที่ลึกฟังดูเป็นธรรมชาติกว่า เพราะฟอร์แมนต์ตรงกับท่อเสียงขนาดใหญ่อยู่แล้ว การลดระดับเสียงปกติโดยไม่เลื่อนฟอร์แมนต์มักฟังดูเทียม ผสานเสียงพื้นฐานที่ลึกกับการลดระดับเสียงเล็กน้อยและการเลื่อนฟอร์แมนต์เพื่อผลลัพธ์ที่น่าเชื่อถือที่สุด
ฉันสามารถส่งเสียง TTS ลึกไปยังไมโครโฟนเสมือนได้ไหม? ได้ VoxBooster สามารถส่งเสียงลึกที่สร้างขึ้นไปยังไมโครโฟนเสมือน เพื่อให้แอปอย่าง Discord, OBS หรือเบราว์เซอร์ถือว่าเป็นอินพุตสด ช่วยให้คุณเรียกใช้บทพูดผู้บรรยายระหว่างสตรีมหรือการโทรได้ คุณยังสามารถส่งออกเสียงเป็นไฟล์เพื่อแก้ไขในภายหลังได้ด้วย
ฉันต้องมีพีซีที่ทรงพลังสำหรับการสังเคราะห์เสียงพูดแบบเสียงลึกไหม? ไม่จำเป็น VoxBooster ประมวลผลเสียงและเอฟเฟกต์ในเครื่องบน Windows 10 และ 11 ด้วยความหน่วงต่ำและไม่ต้องใช้ไดรเวอร์เคอร์เนล CPU ระดับกลางสามารถจัดการ TTS และเชนเอฟเฟกต์เสียงลึกได้อย่างสบาย GPU ช่วยได้กับโมเดลเสียงขนาดใหญ่แต่ไม่จำเป็นสำหรับสูตรผู้บรรยายลึกที่นี่
ฉันสามารถลองการสังเคราะห์เสียงพูดแบบเสียงลึกได้ฟรีไหม? ได้ VoxBooster มีช่วงทดลองใช้ฟรี 3 วันแบบเต็มโดยไม่มีข้อจำกัดด้านฟีเจอร์ คุณสามารถสร้างบทพูด TTS แบบลึก ใช้สูตรผู้บรรยายและตัวอย่างหนัง และส่งออกหรือกำหนดเส้นทางเสียงก่อนตัดสินใจ มีใบอนุญาตตลอดชีพแบบครั้งเดียวหากต้องการเก็บไว้หลังจากสิ้นสุดช่วงทดลอง
รับการอ่านข้อความด้วยเสียงลึกของคุณ
การอ่านการสังเคราะห์เสียงพูดแบบเสียงลึกที่น่าเชื่อถือคือเชน ไม่ใช่การตั้งค่าเดียว: เสียงพื้นฐานลึก การลดระดับเสียงเล็กน้อย ฟอร์แมนต์ที่ตรงกัน ความอบอุ่นที่ความถี่ต่ำ ระดับที่มั่นคง และพื้นที่เล็กน้อย เพิ่มการเรียบเรียงที่ช้าและจงใจ และคุณมีเสียงผู้บรรยาย ตัวอย่างหนัง หรือผู้ประกาศที่อ่านสคริปต์ใดก็ได้ด้วยความหนักแน่นแท้จริง - และเมื่อบันทึกเป็นพรีเซ็ตแล้ว คุณสามารถเรียกคืนได้ด้วยคลิกเดียว
VoxBooster สร้างขั้นตอนการทำงานทั้งหมดลงในแอป Windows เดียว: พิมพ์ข้อความของคุณ เลือกเสียงพื้นฐานลึก ใช้สูตรจากตารางด้านบน และส่งออกเสียงหรือกำหนดเส้นทางไปยังไมโครโฟนเสมือน ทุกอย่างทำงานในเครื่อง ความหน่วงต่ำ ไม่มีไดรเวอร์เคอร์เนล
ดาวน์โหลด VoxBooster และลองสูตรผู้บรรยายลึกด้วยช่วงทดลองใช้ 3 วันแบบเต็ม - ไม่มีข้อจำกัด ดู หน้าราคา สำหรับใบอนุญาตตลอดชีพแบบครั้งเดียว หรือเรียกดู คู่มือเสียงเพิ่มเติมในบล็อก สำหรับการนำเสนอตัวอย่างหนัง ผู้ประกาศ และเอฟเฟกต์