การสังเคราะห์เสียงพูดแบบเสียงลึก: TTS ผู้บรรยายน้ำเสียงอุดมสมบูรณ์

สร้างการสังเคราะห์เสียงพูดแบบเสียงลึกที่อ่านสคริปต์ของคุณด้วยน้ำเสียงผู้บรรยายที่อุดมสมบูรณ์ สไตล์ตัวอย่างหนัง หรือผู้ประกาศ พร้อมสูตรสำหรับระดับเสียง ฟอร์แมนต์ ความอบอุ่น และเรเวิร์บ

การสังเคราะห์เสียงพูดแบบเสียงลึกแปลงคำที่พิมพ์ให้กลายเป็นเสียงอ่านที่ต่ำ อุดมสมบูรณ์ และน่าเชื่อถือ - ประเภทเสียงที่เปิดตัวอย่างหนัง บรรยายสารคดี หรือประกาศช่วงถัดไปด้วยความหนักแน่น แทนที่จะเป็นเสียงแบนเรียบและเป็นกลางที่เครื่องมือ TTS ส่วนใหญ่สร้างขึ้น คุณจะได้เสียงผู้บรรยายลึกที่เต็มไปทั้งห้อง คู่มือนี้อธิบายว่าเสียง TTS ลึกคืออะไร ทำไมนักสร้างเนื้อหาถึงต้องการ และวิธีสร้างมันบน Windows โดยใช้เสียงพื้นฐานลึกบวกกับเอฟเฟกต์หลายอย่าง


TL;DR

  • เสียง TTS ลึกอ่านข้อความของคุณด้วยน้ำเสียงผู้บรรยายหรือผู้ประกาศที่ต่ำและกังวาน
  • นักสร้างเนื้อหาต้องการมันสำหรับตัวอย่างหนัง บทนำวิดีโอ การบรรยาย หนังสือเสียง และ YouTube
  • สูตร: เสียงพื้นฐานลึก + ลดระดับเสียง + เลื่อนฟอร์แมนต์ + EQ ความอบอุ่น + เรเวิร์บเบาๆ
  • จังหวะสำคัญพอๆ กับการประมวลผล - การส่งมอบที่ช้าและช่วงหยุดสร้างความหนักแน่น
  • VoxBooster สร้างเสียงและใช้เชนเอฟเฟกต์เสียงลึกในเครื่อง ความหน่วงต่ำ
  • ส่งออกผลลัพธ์เป็นไฟล์หรือกำหนดเส้นทางไปยังไมโครโฟนเสมือนสำหรับใช้งานสด
  • มีช่วงทดลองใช้ 3 วันแบบเต็มและใบอนุญาตตลอดชีพแบบครั้งเดียว

เสียง TTS แบบเสียงลึกคืออะไร?

เสียงการสังเคราะห์เสียงพูดแบบเสียงลึกคือเอาต์พุต TTS ที่ปรับแต่งให้ฟังดูต่ำ อบอุ่น และน่าเชื่อถือ แทนที่จะเป็นกลางหรือสว่าง มันเริ่มต้นจากเสียงพื้นฐานลึกและเพิ่มการปรับระดับเสียง ฟอร์แมนต์ EQ และเรเวิร์บ เพื่อให้การอ่านมีน้ำหนักและสภาพ ผลลัพธ์คือการอ่านสคริปต์ที่พิมพ์ใดก็ได้ในสไตล์ผู้บรรยายภาพยนตร์ ผู้ประกาศตัวอย่างหนัง หรือเสียงพากย์สารคดี

คำสำคัญคือ ปรับแต่ง เครื่องจำลอง TTS ดิบให้เสียงอ่านที่เข้าใจได้แต่ไร้บุคลิก การเปลี่ยนสิ่งนั้นให้กลายเป็นเสียงผู้บรรยายลึกคือกระบวนการที่ตั้งใจ ในการหล่อเสียงพื้นฐาน ลดมันลงอย่างถูกต้อง และเพิ่มสัญญาณอะคูสติกที่หูเชื่อมโยงกับขนาด การสั่นสะเทือนในอก และห้องขนาดใหญ่ เมื่อทำได้ดี ผู้ฟังจะหยุดได้ยิน “เสียงพูดสังเคราะห์” และเริ่มได้ยินผู้นำเสนอแทน

ทำไมผู้คนถึงต้องการเสียง TTS ลึก

เสียงลึกแสดงถึงความน่าเชื่อถือ การเชื่อมโยงนั้นฝังลึกอยู่ในวิธีที่มนุษย์รับรู้เสียงพูด - น้ำเสียงต่ำและกังวานอ่านเป็นความสงบ น่าเชื่อถือ และสำคัญ นั่นจึงเป็นเหตุผลว่าทำไมงานพากย์เสียงแบบมืออาชีพจำนวนมากจึงอยู่ในช่วงเสียงต่ำ เมื่อคุณต้องการให้สคริปต์อ่านด้วยความหนักแน่นแต่ไม่มีนักพากย์เสียงพร้อม ตัวสร้างเสียงลึกสำหรับการสังเคราะห์เสียงพูดจะเติมเต็มช่องว่างนั้น

ความต้องการรวมกลุ่มอยู่รอบความต้องการที่เกิดซ้ำหลายอย่าง นักสร้างเนื้อหาต้องการ เสียง TTS สไตล์ตัวอย่างหนัง สำหรับบทนำและการตัดต่อดราม่า ครูและผู้สร้างวิดีโออธิบายต้องการ เสียงผู้บรรยายลึกที่มั่นคง ซึ่งรักษาความสนใจตลอดเนื้อหารูปแบบยาว พอดแคสต์ต้องการผู้ประกาศที่สม่ำเสมอสำหรับช่วงพัก และใครก็ตามที่สร้างเสียงในปริมาณมากต้องการพิมพ์บทพูด สร้างเสียง และได้การอ่านแบบออกอากาศโดยไม่ต้องบันทึกซ้ำ เสียง TTS ลึกทำซ้ำได้ แก้ไขได้ง่าย และสอดคล้องกับแบรนด์เสมอ

สิ่งที่ทำให้เสียงฟังดูลึก

ก่อนแตะสไลเดอร์แม้แต่ตัวเดียว มีประโยชน์ที่จะรู้ว่าหูของคุณตอบสนองต่ออะไรจริงๆ “ลึก” ไม่ใช่การตั้งค่าเดียว - มันคือกองสัญญาณอะคูสติกที่ทำงานร่วมกัน

ความถี่พื้นฐาน (ระดับเสียง). อัตราการสั่นสะเทือนพื้นฐาน ระดับเสียงต่ำอ่านเป็นเสียงลึกกว่า แต่ระดับเสียงเพียงอย่างเดียวไม่ใช่ทั้งหมด - ดันมันลงมากเกินไปและเสียงจะฟังดูเทียม

ฟอร์แมนต์. นี่คือความถี่เรโซแนนซ์ที่ถูกหล่อขึ้นโดยขนาดของท่อเสียง ท่อขนาดใหญ่ผลิตฟอร์แมนต์ต่ำกว่า นั่นจึงเป็นเหตุผลว่าทำไมเสียงลึกแท้จึงฟังแตกต่างใน คุณภาพ ไม่ใช่แค่ระดับเสียง สำหรับอะคูสติกพื้นฐาน บทความวิกิพีเดียเกี่ยวกับฟอร์แมนต์ เป็นข้อมูลอ้างอิงที่ดี

ความหนักแน่นที่ความถี่ต่ำ. พลังงานต่ำกว่า 200 Hz ให้เสียงในอกและน้ำหนัก นี่คือความแตกต่างระหว่าง “ต่ำ” กับ “ทรงพลัง”

ความอบอุ่นเทียบกับความแข็งกร้าว. การลดช่วงกลางสูงที่แข็งกร้าวทำให้เสียงลึกเรียบเนียนแทนที่จะกระด้าง ทำให้รู้สึกอุดมสมบูรณ์แทนที่จะบาง

พื้นที่. เรเวิร์บเล็กน้อยบอกหูว่าเสียงอยู่ในห้องขนาดใหญ่ - ห้องประชุม ห้องโถง - ซึ่งอ่านเป็นแบบภาพยนตร์และสำคัญ

วิธีสร้างเสียง TTS ลึก

การได้การอ่าน TTS ชายลึกที่น่าเชื่อถือคือเชน ไม่ใช่ปุ่มเดียว แต่ละขั้นตอนจัดการกับสัญญาณหนึ่งจากด้านบน VoxBooster ใช้เชนทั้งหมดในเครื่องบน Windows เพื่อให้คุณสร้างบทพูดและปรับแต่งได้ในที่เดียว

1. เลือกเสียงพื้นฐานลึก. เริ่มต้นจากเสียงที่ลึกอยู่แล้ว การเริ่มต้นจากพื้นฐานสว่างและเป็นกลาง แล้วดึงระดับเสียงลงผลิตเสียงเทียมแบบคลาสสิก เพราะฟอร์แมนต์ไม่ตรงกับระดับเสียงอีกต่อไป เสียงพื้นฐานลึกทำให้ฟอร์แมนต์อยู่ในตำแหน่งที่หูคาดหวัง

2. ลดระดับเสียง. ลดระดับเสียงลงสองสามเซมิโทนเพื่อเพิ่มความลึก การเคลื่อนไหวเล็กๆ ฟังดูดีกว่าการเคลื่อนไหวใหญ่ - การลดระดับเสียงมากเกินไปสร้างสิ่งที่ผิดปกติที่ทำให้เห็นกลเม็ด

3. เลื่อนฟอร์แมนต์ลง. ผลักฟอร์แมนต์ลงต่ำพร้อมกับระดับเสียงเพื่อให้เสียงอ่านเป็นท่อเสียงขนาดใหญ่ การเคลื่อนระดับเสียงและฟอร์แมนต์ร่วมกันคือขั้นตอนสำคัญที่สุดสำหรับโทนลึกที่เป็นธรรมชาติ การข้ามขั้นตอนนี้คือสาเหตุอันดับหนึ่งที่ TTS ลึกฟังดูเทียม

4. เพิ่มความอบอุ่นด้วย EQ. การเพิ่มเบาๆ รอบ 100 ถึง 150 Hz สร้างเสียงในอกและร่างกาย การตัดเบาๆ ในช่วงกลางสูงที่แข็งกร้าว (รอบ 3 ถึง 5 kHz) ทำให้การอ่านเรียบเนียนเพื่อให้รู้สึกอุดมสมบูรณ์แทนที่จะคมกริบ

5. ควบคุมระดับ. การคอมเพรสเบาๆ ปรับระดับส่วนดังและเงียบให้เท่ากัน เพื่อให้การส่งมอบยังคงมั่นคงและปรากฏชัด - วิธีที่งานพากย์เสียงมืออาชีพรักษาระดับที่สม่ำเสมอ

6. เพิ่มเรเวิร์บเบาๆ. เรเวิร์บห้องขนาดใหญ่หรือห้องโถงสั้นที่ mix ต่ำให้เสียงน้ำหนักแบบภาพยนตร์โดยไม่เปลี่ยนเป็นเสียงสะท้อน นี่คือการเคลื่อนไหวสุดท้ายที่ทำให้เสียงผู้บรรยายลึกรู้สึกเหมือนอยู่ในตัวอย่างหนัง

การสังเคราะห์เสียงพูดแบบเสียงลึก: ทีละขั้นตอน

นี่คือขั้นตอนการทำงานทั้งหมด จากสคริปต์ที่พิมพ์ไปยังเสียงที่เสร็จสมบูรณ์ โดยใช้ VoxBooster บน Windows 10 หรือ 11

  1. ดาวน์โหลดและติดตั้ง VoxBooster จาก voxbooster.com/download การตั้งค่าจะเรียกใช้ตัวช่วยกำหนดเส้นทางเสียงโดยอัตโนมัติ - ไม่ต้องกำหนดค่าสายเคเบิลเสมือน

  2. เปิดแท็บ TTS และพิมพ์สคริปต์ของคุณ. เก็บประโยคให้สั้นและกระชับสำหรับการบรรยาย เพิ่มการขึ้นบรรทัดและช่วงหยุดในจุดที่ต้องการให้เสียงช้าลง สำหรับการอ่านแบบตัวอย่างหนัง เขียนเป็นประโยคสั้น: “เมืองหนึ่ง โอกาสเดียว เสียงเดียว”

  3. เลือกเสียงพื้นฐานลึก. ในตัวเลือกเสียง เลือกตัวเลือกต่ำและกังวานจากหมวดหมู่ผู้บรรยายหรือผู้ออกอากาศ การเริ่มต้นลึกหมายความว่าการปรับแต่งในภายหลังแต่ละครั้งจะเล็กน้อยและสะอาดกว่า

  4. สร้างบทพูดและฟัง. เล่นครั้งเดียวโดยไม่มีเอฟเฟกต์เพื่อได้ยินการอ่านดิบ นี่คือจุดอ้างอิงของคุณ

  5. ใช้เชนเอฟเฟกต์เสียงลึก. เปิดแผงเอฟเฟกต์และตั้งค่าระดับเสียงลงสองสามเซมิโทน เลื่อนฟอร์แมนต์ลงให้ตรงกัน จากนั้นเพิ่ม EQ ความอบอุ่น (เพิ่มรอบ 120 Hz ตัดเบาๆ รอบ 4 kHz) ใช้ตารางสูตรด้านล่างเป็นจุดเริ่มต้น

  6. เพิ่มการคอมเพรสเบาๆ และเรเวิร์บ. ตั้งค่าการคอมเพรสปานกลางสำหรับระดับที่มั่นคง จากนั้นเพิ่มเรเวิร์บห้องสั้นที่ mix ต่ำ ดูตัวอย่างหลังจากการเปลี่ยนแปลงแต่ละครั้ง - เพิ่มเอฟเฟกต์ทีละน้อยแทนที่จะทำพร้อมกันทั้งหมด

  7. ปรับแต่งให้เหมาะกับสคริปต์. บทพูดตัวอย่างหนังดราม่าต้องการเรเวิร์บมากขึ้นและความรู้สึกช้าลง การบรรยายสารคดีต้องการพื้นที่น้อยลงและความชัดเจนมากขึ้น ปรับแต่งตามรสนิยม

  8. ส่งออกหรือกำหนดเส้นทางเสียง. บันทึกการอ่านที่เสร็จสิ้นเป็นไฟล์สำหรับแก้ไขในโปรแกรมตัดต่อวิดีโอ หรือกำหนดเส้นทางไปยังไมโครโฟนเสมือนเพื่อให้แอปอย่าง OBS, Discord หรือเบราว์เซอร์ถือเสียงลึกที่สร้างขึ้นเป็นอินพุตสด ช่วยให้คุณเรียกใช้บทพูดผู้บรรยายระหว่างสตรีมหรือวางบทพูดผู้ประกาศในสายโทรแบบเรียลไทม์

  9. บันทึกเป็นพรีเซ็ต. เมื่อการตั้งค่าฟังดูถูกต้อง ให้บันทึกเชนทั้งหมดเป็นพรีเซ็ตที่มีชื่อ - “ผู้บรรยายตัวอย่างหนัง” “ผู้ประกาศวิทยุ” - และเรียกคืนได้ด้วยคลิกเดียวในครั้งต่อไป

สูตร TTS เสียงลึก: ตารางการตั้งค่า

นี่คือจุดเริ่มต้น ไม่ใช่กฎตายตัว - เสียงพื้นฐานแต่ละเสียงต้องการการสอบเทียบที่แตกต่างกันเล็กน้อย ดังนั้นดูตัวอย่างและปรับแต่ง คิดว่าแต่ละแถวคือบุคลิกที่คุณสามารถปรับและบันทึกเป็นพรีเซ็ต

สูตรระดับเสียงฟอร์แมนต์EQ (ความอบอุ่น)การคอมเพรสเรเวิร์บความรู้สึก
ผู้บรรยาย-2 ถึง -3 st-10%+3 dB ที่ 120 Hz, -2 dB ที่ 4 kHz3:1 เบาห้องโถง 10% mix, ~1.8s decayมั่นคง สารคดี ชัดเจน
ตัวอย่างหนัง-3 ถึง -4 st-15%+4 dB ที่ 110 Hz, -3 dB ที่ 4 kHz4:1 ปานกลางห้องโถง 20% mix, ~2.2s decayดราม่า ช้า แบบภาพยนตร์
ผู้ประกาศ-2 st-8%+3 dB ที่ 130 Hz, -2 dB ที่ 3.5 kHz4:1 ปานกลางห้อง 12% mix, ~1.2s decayหนักแน่น มั่นใจ ชัดเจน
วิทยุ-1 ถึง -2 st-5%+2 dB ที่ 100 Hz, -1 dB ที่ 5 kHz5:1 แน่นห้อง 8% mix, ~0.8s decayเรียบ อบอุ่น ออกอากาศ

สูตรตัวอย่างหนังพึ่งพาเรเวิร์บและจังหวะมากที่สุด สูตรวิทยุพึ่งพาการคอมเพรสแน่นและความอบอุ่นด้วยพื้นที่น้อยมาก ใช้แถวผู้บรรยายเป็นพื้นฐานกลางแล้วเคลื่อนไปยังตัวอย่างหนังหรือวิทยุจากที่นั่น

กรณีการใช้งานสำหรับเสียงผู้บรรยายลึก

บทนำวิดีโอ. เสียงลึกห้าวินาทีก่อนเนื้อหาของคุณตั้งโทนทันทีและกลายเป็นเอกลักษณ์ช่อง

ตัวอย่างหนังและการตัดต่อดราม่า. การอ่านแบบตัวอย่างหนังคลาสสิก - ลึก ช้า กังวาน - เหนือเกมเพลย์ คลิปกีฬา หรือการตัดต่อแฟน นี่คือเสียงมีมที่อยู่ในหัวของผู้ชมทุกคน

การบรรยายและวิดีโออธิบาย. เสียงผู้บรรยายลึกที่มั่นคงนำเสนอเนื้อหาการศึกษารูปแบบยาวโดยไม่ทำให้ผู้ฟังเหนื่อยล้า รักษาความสนใจตลอดสคริปต์

หนังสือเสียงและการอ่านรูปแบบยาว. การพิมพ์บทและสร้างการอ่านลึกที่สม่ำเสมอเร็วกว่าการบันทึกซ้ำมาก และโทนเสียงยังคงเหมือนกันจากหน้าแรกถึงหน้าสุดท้าย

YouTube และรูปแบบสั้น. บทนำส่วน การเปิดเผยอันดับ การนับถอยหลัง “10 อันดับแรก” - การอ่านผู้ประกาศลึกให้โครงสร้างและดราม่ากับรูปแบบใดก็ได้

ส่วนพอดแคสต์. ผู้ประกาศที่เกิดซ้ำสำหรับบทนำ ช่วงโฆษณา และบทส่งท้ายให้รายการสมัครเล่นกรอบแบบมืออาชีพ แม้ว่าเสียงโฮสต์จะเป็นกันเอง

การส่งมอบ: สิ่งที่ไม่มีการตั้งค่าใดทดแทนได้

เชนเอฟเฟกต์พาคุณไปได้ส่วนใหญ่ แต่จังหวะและการเรียบเรียงรับส่วนที่เหลือ ส่วนนี้อยู่ในวิธีที่คุณเขียนและกำหนดเวลาสคริปต์ ไม่ใช่ในสไลเดอร์

เขียนเป็นประโยคสั้น. การบรรยายลึกต้องหายใจ ประโยคยาวๆ ที่ต่อเนื่องทำให้ดราม่าแบนราบ แบ่งบรรทัดเพื่อให้เสียงสามารถลงจอดแต่ละวลี

เพิ่มช่วงหยุดในข้อความ. แทรกการขึ้นบรรทัดหรือเว้นวรรคในจุดที่ต้องการให้เรเวิร์บดังก้อง “ในโลกหนึ่ง… ที่เสียงหนึ่ง… เปลี่ยนทุกสิ่ง” ความเงียบคือที่ที่น้ำหนักอาศัยอยู่

ชะลอจังหวะ. การอ่านลึกที่รีบเร่งสูญเสียความหนักแน่น หาก TTS ของคุณรองรับแท็กการกำหนดจังหวะ ให้ใช้เพื่อยืดบรรทัดสำคัญ สำหรับวิธีมาตรฐานในการควบคุมจังหวะและการเน้นเสียงพูด สเปก W3C Speech Synthesis Markup Language (SSML) คือข้อมูลอ้างอิง

รักษาความสม่ำเสมอ. เมื่อพรีเซ็ตใช้งานได้ดี ให้ใช้ซ้ำตลอดโครงการเพื่อให้ทุกส่วนฟังดูเหมือนผู้บรรยายคนเดียวกัน ความสม่ำเสมอคือสิ่งที่ทำให้เสียงสังเคราะห์รู้สึกเหมือนผู้นำเสนอจริงๆ เมื่อเวลาผ่านไป

ส่งออกหรือกำหนดเส้นทาง: สองวิธีในการใช้งาน

เมื่อการอ่านลึกฟังดูถูกต้อง คุณมีสองเส้นทางขึ้นอยู่กับว่าเสียงนั้นสำหรับการผลิตหรือการใช้งานสด

ส่งออกเป็นไฟล์ เมื่อคุณกำลังสร้างวิดีโอ หนังสือเสียง หรือพอดแคสต์ บันทึกบทพูดที่เสร็จสิ้นและวางลงในไทม์ไลน์ของโปรแกรมตัดต่อ เนื่องจากเอฟเฟกต์ถูกอบรวมไว้แล้ว จึงไม่จำเป็นต้องประมวลผลเพิ่มเติม - โทนผู้บรรยายลึกเดินทางไปกับไฟล์

กำหนดเส้นทางไปยังไมโครโฟนเสมือน เมื่อต้องการเสียงลึกแบบสด VoxBooster สามารถส่งเสียงที่สร้างขึ้นไปยังไมโครโฟนเสมือนเพื่อให้แอปใดก็ได้ - OBS, Discord, เบราว์เซอร์ของคุณ - ถือว่าเป็นอินพุตจริง นี่คือวิธีที่คุณเรียกใช้บทนำเสียงตัวอย่างหนังกลางสตรีม หรือวางบทพูดผู้ประกาศลงในสายโทรแบบเรียลไทม์ โดยไม่ต้องแก้ไขล่วงหน้า

นักสร้างเนื้อหาจำนวนมากใช้ทั้งสอง: ส่งออกไฟล์สำหรับเนื้อหาที่ขัดเกลา กำหนดเส้นทางไมโครโฟนเสมือนสำหรับช่วงเวลาสด พรีเซ็ตเดียวกันใช้ได้กับทั้งสอง ดังนั้นคุณสร้างเสียงลึกครั้งเดียวและใช้มันได้ทุกที่ที่ต้องการ

FAQ

การสังเคราะห์เสียงพูดแบบเสียงลึกคืออะไร? การสังเคราะห์เสียงพูดแบบเสียงลึกคือซอฟต์แวร์ TTS ที่อ่านข้อความที่พิมพ์ออกเสียงด้วยน้ำเสียงต่ำ อุดมสมบูรณ์ และน่าเชื่อถือ แทนที่จะเป็นเสียงเริ่มต้นที่เป็นกลาง โดยผสานเสียงพื้นฐานที่ลึกกับการปรับระดับเสียง ฟอร์แมนต์ ความอบอุ่น และเรเวิร์บเบาๆ เพื่อสร้างเสียงผู้บรรยาย ตัวอย่างหนัง หรือผู้ประกาศจากสคริปต์ใดก็ได้ที่คุณพิมพ์

ฉันจะทำให้เสียง TTS ฟังดูลึกขึ้นได้อย่างไร? เริ่มต้นด้วยเสียงพื้นฐานที่ลึก จากนั้นลดระดับเสียงลงสองสามเซมิโทนและเลื่อนฟอร์แมนต์ลงเล็กน้อยเพื่อให้โทนเสียงยังคงเป็นธรรมชาติ เพิ่มความอบอุ่นที่ความถี่ต่ำด้วย EQ รอบ 100 ถึง 150 Hz ควบคุมระดับด้วยการคอมเพรสเบาๆ และปิดท้ายด้วยเรเวิร์บห้องขนาดใหญ่เบาๆ เพื่อความหนักแน่นแบบภาพยนตร์

ฉันสามารถใช้เสียง TTS ลึกเป็นเสียงตัวอย่างหนังได้ไหม? ได้ เอฟเฟกต์ TTS สไตล์ตัวอย่างหนังผสานเสียงผู้บรรยายพื้นฐานที่ลึก จังหวะที่ช้าและจงใจ ความหนักแน่นที่ความถี่ต่ำจาก EQ และเรเวิร์บห้องสั้น พิมพ์บทพูดของคุณ สร้างเสียง จากนั้นใช้สูตรตัวอย่างหนังในตารางการตั้งค่าด้านบน เพิ่มช่วงหยุดในข้อความเพื่อให้เรเวิร์บมีพื้นที่หายใจ

TTS เสียงชายลึกดีกว่าการลดระดับเสียงปกติลงไหม? การเริ่มต้นจากเสียงชายพื้นฐานที่ลึกฟังดูเป็นธรรมชาติกว่า เพราะฟอร์แมนต์ตรงกับท่อเสียงขนาดใหญ่อยู่แล้ว การลดระดับเสียงปกติโดยไม่เลื่อนฟอร์แมนต์มักฟังดูเทียม ผสานเสียงพื้นฐานที่ลึกกับการลดระดับเสียงเล็กน้อยและการเลื่อนฟอร์แมนต์เพื่อผลลัพธ์ที่น่าเชื่อถือที่สุด

ฉันสามารถส่งเสียง TTS ลึกไปยังไมโครโฟนเสมือนได้ไหม? ได้ VoxBooster สามารถส่งเสียงลึกที่สร้างขึ้นไปยังไมโครโฟนเสมือน เพื่อให้แอปอย่าง Discord, OBS หรือเบราว์เซอร์ถือว่าเป็นอินพุตสด ช่วยให้คุณเรียกใช้บทพูดผู้บรรยายระหว่างสตรีมหรือการโทรได้ คุณยังสามารถส่งออกเสียงเป็นไฟล์เพื่อแก้ไขในภายหลังได้ด้วย

ฉันต้องมีพีซีที่ทรงพลังสำหรับการสังเคราะห์เสียงพูดแบบเสียงลึกไหม? ไม่จำเป็น VoxBooster ประมวลผลเสียงและเอฟเฟกต์ในเครื่องบน Windows 10 และ 11 ด้วยความหน่วงต่ำและไม่ต้องใช้ไดรเวอร์เคอร์เนล CPU ระดับกลางสามารถจัดการ TTS และเชนเอฟเฟกต์เสียงลึกได้อย่างสบาย GPU ช่วยได้กับโมเดลเสียงขนาดใหญ่แต่ไม่จำเป็นสำหรับสูตรผู้บรรยายลึกที่นี่

ฉันสามารถลองการสังเคราะห์เสียงพูดแบบเสียงลึกได้ฟรีไหม? ได้ VoxBooster มีช่วงทดลองใช้ฟรี 3 วันแบบเต็มโดยไม่มีข้อจำกัดด้านฟีเจอร์ คุณสามารถสร้างบทพูด TTS แบบลึก ใช้สูตรผู้บรรยายและตัวอย่างหนัง และส่งออกหรือกำหนดเส้นทางเสียงก่อนตัดสินใจ มีใบอนุญาตตลอดชีพแบบครั้งเดียวหากต้องการเก็บไว้หลังจากสิ้นสุดช่วงทดลอง

รับการอ่านข้อความด้วยเสียงลึกของคุณ

การอ่านการสังเคราะห์เสียงพูดแบบเสียงลึกที่น่าเชื่อถือคือเชน ไม่ใช่การตั้งค่าเดียว: เสียงพื้นฐานลึก การลดระดับเสียงเล็กน้อย ฟอร์แมนต์ที่ตรงกัน ความอบอุ่นที่ความถี่ต่ำ ระดับที่มั่นคง และพื้นที่เล็กน้อย เพิ่มการเรียบเรียงที่ช้าและจงใจ และคุณมีเสียงผู้บรรยาย ตัวอย่างหนัง หรือผู้ประกาศที่อ่านสคริปต์ใดก็ได้ด้วยความหนักแน่นแท้จริง - และเมื่อบันทึกเป็นพรีเซ็ตแล้ว คุณสามารถเรียกคืนได้ด้วยคลิกเดียว

VoxBooster สร้างขั้นตอนการทำงานทั้งหมดลงในแอป Windows เดียว: พิมพ์ข้อความของคุณ เลือกเสียงพื้นฐานลึก ใช้สูตรจากตารางด้านบน และส่งออกเสียงหรือกำหนดเส้นทางไปยังไมโครโฟนเสมือน ทุกอย่างทำงานในเครื่อง ความหน่วงต่ำ ไม่มีไดรเวอร์เคอร์เนล

ดาวน์โหลด VoxBooster และลองสูตรผู้บรรยายลึกด้วยช่วงทดลองใช้ 3 วันแบบเต็ม - ไม่มีข้อจำกัด ดู หน้าราคา สำหรับใบอนุญาตตลอดชีพแบบครั้งเดียว หรือเรียกดู คู่มือเสียงเพิ่มเติมในบล็อก สำหรับการนำเสนอตัวอย่างหนัง ผู้ประกาศ และเอฟเฟกต์

ลอง VoxBooster — ทดลองใช้ฟรี 3 วัน

โคลนเสียงเรียลไทม์ ซาวด์บอร์ด และเอฟเฟกต์ — ทุกที่ที่คุณคุย

  • ไม่ต้องใช้บัตรเครดิต
  • ความหน่วง ~30ms
  • Discord · Teams · OBS
ลองฟรี 3 วัน