พิธีกร A: ยินดีต้อนรับกลับสู่ Launch Notes ที่ที่เราย่อยเครื่องมือ AI ใหม่ๆ แบบไม่ขายฝัน พิธีกร B: และที่ที่เราเปลี่ยนการเปิดตัวเหล่านั้นให้เป็นเวิร์กโฟลว์ที่คุณใช้ได้จริงในสัปดาห์นี้
ElevenLabs Dialogue V3 คือเครื่องมือสร้างเสียง AI หลายผู้พูดของ Rivya สำหรับพอดแคสต์ บทสัมภาษณ์ ฉากสวมบทบาท และบทสนทนาตามสคริปต์ ใช้เมื่อจังหวะระหว่างผู้พูดสำคัญกว่า TTS ผู้บรรยายเดี่ยว
ตัวอย่างผลลัพธ์
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ช่วงเปิดสองเสียงพร้อมคำต้อนรับมั่นใจและการส่งต่อที่รวดเร็ว
บทสนทนาเป็นเสียง
ตัวอย่างผลลัพธ์
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ช่วงเปิดสองเสียงพร้อมคำต้อนรับมั่นใจและการส่งต่อที่รวดเร็ว
เหมาะที่สุดสำหรับ
รองรับ
ทดลองออนไลน์
ยังไม่มีผลลัพธ์ ส่งพรอมต์เพื่อเริ่มรัน
พรอมป์เริ่มต้น
หลักฐานของโมเดล
ใช้การทดลองออนไลน์ด้านบน แล้วเปรียบเทียบตัวอย่างผลลัพธ์เหล่านี้เพื่อประเมินความเรียบร้อย จังหวะ และความเหมาะกับงาน ก่อนใช้เครดิตเพิ่มเติมใน Studio
ตัวอย่างหลัก
คลื่นเสียงและปกภาพสำหรับตัวอย่างเสียงอินโทรพอดแคสต์สองพิธีกร
อินพุต
บรรทัดบทสนทนา + การตั้งค่าเสียง
สิ่งที่ควรสังเกต
คลื่นเสียงและปกภาพสำหรับตัวอย่างเสียงอินโทรพอดแคสต์สองพิธีกร
เครดิตต่อการใช้งาน
per_1000_characters · dialogue_text=14 · ⌈total⌉
ทำไมโมเดลนี้จึงใช้ได้ผล
สร้างบทสนทนาหลายผู้พูด
กำหนดเสียงแยกสำหรับแต่ละตัวละคร
ปรับความนิ่งได้เพื่อการถ่ายทอดที่สม่ำเสมอ
งานที่เหมาะที่สุด
หลักฐานของโมเดล
ความเหมาะสมสำหรับการตัดสินใจ
ความเหมาะสมสำหรับการตัดสินใจ
คำถามที่พบบ่อยเกี่ยวกับ ElevenLabs Dialogue V3
ElevenLabs Dialogue V3 แข็งแรงที่สุดเมื่อเสียงขึ้นอยู่กับจังหวะระหว่างผู้พูด มากกว่าผู้บรรยายคนเดียวที่อ่านทุกอย่างตรงไปจนจบ เหมาะกับบทสนทนาพอดแคสต์ สคริปต์สัมภาษณ์ ฉากตัวละคร ต้นแบบละครเสียง และงานเสียงตามบทบาทที่ต้องให้หลายคนฟังแตกต่างกันในรอบเรนเดอร์เดียว
บน Rivya ตอนนี้ ElevenLabs Dialogue V3 เป็นตัวเลือกแปลงบทสนทนาเป็นเสียง พร้อมการกำหนดเสียงรายตัวละครและคอนโทรลการถ่ายทอด ตอนนี้คิดตามมิเตอร์ที่ประมาณ 14 เครดิตต่อ 1,000 ตัวอักษรโดยปัดขึ้น และคอนโทรลสาธารณะหลักคือเสียงเริ่มต้น ความนิ่ง และรหัสภาษา จึงโฟกัสกับการตั้งค่าสคริปต์และการแสดงมากกว่างานหลังการผลิต
คำถามจริงคือการแยกนักแสดงชัดพอหรือไม่ การเลือกเสียงกำหนดตัวตนของผู้พูด ความนิ่งส่งผลว่าแต่ละเสียงอ่านนิ่งและคาดเดาได้แค่ไหน ส่วนรหัสภาษาสำคัญเมื่อสคริปต์ต้องส่งมอบหลายภาษา หากสามส่วนนี้ทำงานดี โมเดลมักบอกคุณได้แล้วว่าฉากนี้ยืนเป็นบทสนทนาได้หรือไม่ แทนที่จะเป็นคลิปเสียงเดี่ยวที่นำมาต่อกัน
เพราะตอนนี้คิดตามมิเตอร์ที่ประมาณ 14 เครดิตต่อ 1,000 ตัวอักษรโดยปัดขึ้น ต้นทุนนี้สมเหตุสมผลที่สุดเมื่อการเรนเดอร์หนึ่งครั้งต้องพิสูจน์เคมี จังหวะ และการแยกเสียงของบทสนทนา โดยเฉพาะกับอินโทรพอดแคสต์ การอ่านแบบสัมภาษณ์ และฉากเล่าเรื่องที่การฟังทั้งสองฝ่ายพร้อมกันสำคัญกว่าการเช็กทีละบรรทัด
เลือกตัวเลือก ElevenLabs แบบผู้พูดเดี่ยวเมื่อสคริปต์ต้องการผู้บรรยายคนเดียวหรือเสียงพากย์สะอาดหนึ่งเสียง เลือก Dialogue V3 เมื่อการแลกเปลี่ยนบทสนทนาเองคือชิ้นงาน และฉากต้องการผู้พูดหลายคนที่ฟังเหมือนบทสนทนาเดียว ไม่ใช่กองเสียงอ่านแยกกัน
เริ่มที่นี่เมื่อผลลัพธ์แรกต้องบอกคุณว่าฉากสนทนานั้นทำงานเป็นเสียงจริงหรือไม่ ใช้กับการหยอกล้อในพอดแคสต์ การอ่านบทสัมภาษณ์ บทสนทนาตัวละคร และการทดสอบอ่านบทรวมที่คำถามสำคัญคือเสียง จังหวะ และการผลัดกันพูดเข้ากันดีหรือไม่
หน้านี้เป็นตัวเลือกแปลงบทสนทนาเป็นเสียง ไม่ใช่หน้า TTS ทั่วไป ก่อนผลลัพธ์แรก การตั้งค่าสาธารณะคือการกำหนดเสียงเริ่มต้น ปรับความนิ่ง และตั้งรหัสภาษา เพื่อให้โฟกัสอยู่ที่การคัดเสียงและการถ่ายทอด แทนการนำไฟล์เสียงแยกมาต่อกันภายหลัง
ก่อนรัน ให้แน่ใจว่าเสียงผู้พูดแยกกันชัดเจน ใช้ความนิ่งเพื่อตัดสินว่าเสียงอ่านควรถูกควบคุมหรือมีอารมณ์มากแค่ไหน และตั้งรหัสภาษาเมื่อการออกเสียงหรือการส่งมอบหลายภาษาสำคัญ ตัวเลือกเหล่านี้มักช่วยผลลัพธ์แรกมากกว่าการขัดสคริปต์ไม่รู้จบก่อนจะได้ฟัง
หน้านี้เป็นสาธารณะ แต่การเรนเดอร์บทสนทนาจริงครั้งแรกยังต้องลงชื่อเข้าใช้ ตอนนี้คิดตามมิเตอร์ที่ประมาณ 14 เครดิตต่อ 1,000 ตัวอักษรโดยปัดขึ้น คุณจึงจัดสคริปต์ แยกผู้พูด และกำหนดทิศทางการถ่ายทอดให้เรียบร้อยก่อน แล้วค่อยลงชื่อเข้าใช้เมื่อพร้อมเรนเดอร์
อยู่บนหน้านี้ต่อเมื่อคุณกำลังทดสอบการอ่านบทสนทนารอบแรกและตรวจว่านักแสดงกับจังหวะทำงานดีหรือไม่ เปิด Studio แบบเต็มเมื่องานต้องการเทกที่บันทึกไว้ การแก้สคริปต์ซ้ำหลายรอบ คลิปหลายชุด หรือโปรเจกต์เสียงที่ยาวขึ้นรอบฉากหรือรายการเดียวกัน
เปรียบเทียบทางเลือกอื่น
Suno Music คือโมเดล text-to-music ของ Rivya สำหรับเปลี่ยนโจทย์สั้นหนึ่งชุดให้เป็นร่างเพลงแรกที่มีหรือไม่มีเสียงร้อง โดยคงจุดเริ่มต้นราคา `12` เครดิต และเปิด `Extend Music` เป็นขั้นตอนถัดไปหลังแทร็กสำเร็จ
ทำไมควรพิจารณา
พิจารณาเมื่อภารกิจถัดไปของคุณต้องใช้ พรอมป์เท่านั้น
Suno Sounds คือโมเดล text-to-sound แบบเบาของ Rivya สำหรับลูปบรรยากาศ เสียงพื้นหลัง และสเก็ตช์เสียงสั้น โดยคงราคาคงที่ที่บันทึกไว้คือ `2.5` เครดิตต่อการสร้าง และให้ผลลัพธ์ที่สำเร็จต่อไปยัง `Vocal Separation` ได้
ทำไมควรพิจารณา
พิจารณาเมื่อภารกิจถัดไปของคุณต้องใช้ พรอมป์เท่านั้น
Suno Lyrics คือโมเดลสร้างเนื้อเพลงของ Rivya สำหรับเปลี่ยนธีมหรืออารมณ์หนึ่งอย่างให้เป็นถ้อยคำเพลง ด้วยต้นทุนคงที่ `1` เครดิตต่อคำขอ
ทำไมควรพิจารณา
พิจารณาเมื่อภารกิจถัดไปของคุณต้องใช้ พรอมป์เท่านั้น
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ตัวอย่างบทสนทนาร่างที่เล่นได้สำหรับทรานซิชันพอดแคสต์เวิร์กโฟลว์ AI
พรีวิว waveform ของทรานซิชันช่วงพอดแคสต์สำหรับเทมเพลตพรอมป์เสียง
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ตัวอย่างร่างที่เล่นได้สำหรับบัมเปอร์พอดแคสต์สำหรับการปล่อยฟีเจอร์
ตัวอย่างรูปคลื่นสำหรับเทมเพลตพรอมต์เสียง Rivya บัมเปอร์พอดแคสต์สำหรับการปล่อยฟีเจอร์
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ตัวอย่างร่างที่เล่นได้สำหรับบทสนทนา case study สองผู้พูด
ตัวอย่าง waveform สำหรับเทมเพลตพรอมป์ต์เสียง Rivya เรื่องบทสนทนา case study สองผู้พูด
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ตัวอย่าง draft ที่เล่นได้สำหรับ Sales Call Practice Dialogue
พรีวิว waveform สำหรับเทมเพลต prompt เสียง Rivya ชื่อ Sales Call Practice Dialogue
ตัวอย่าง ยังไม่ได้ยืนยันโมเดลที่ใช้สร้าง · ตัวอย่างร่างที่เล่นได้สำหรับ roleplay ฝึกอบรมซัพพอร์ต
ตัวอย่าง waveform สำหรับเทมเพลตพรอมป์ต์เสียง Rivya เรื่อง roleplay ฝึกอบรมซัพพอร์ต
งานที่เหมาะที่สุด
ใช้เมื่อโจทย์มีลักษณะเช่นนี้
ข้อเท็จจริงแบบไม่ปรุงแต่ง
ผู้ให้บริการ
ElevenLabs
หมวดหมู่
เสียง
ความสามารถ
บทสนทนาเป็นเสียง
โมเดลเครดิต
per_1000_characters · dialogue_text=14 · ⌈total⌉
เส้นทางอินพุต
บรรทัดบทสนทนา + การตั้งค่าเสียง
การตั้งค่าพรอมป์
ขับเคลื่อนด้วยสคริปต์บทสนทนา
การเข้าถึงสำหรับนักพัฒนา
เรียกใช้ ElevenLabs Dialogue V3 จาก Public API v1 หลังจากตรวจฟิลด์ของโมเดล กฎของสื่ออ้างอิง และพฤติกรรมเครดิตแล้ว