Host A: Launch Notes में आपका फिर स्वागत है, जहां हम नए AI tools को hype के बिना समझते हैं। Host B: और उन launches को ऐसे workflows में बदलते हैं जिन्हें आप इस week सच में use कर सकें।
ElevenLabs Dialogue V3, पॉडकास्ट, इंटरव्यू, भूमिका-अभिनय दृश्यों और स्क्रिप्टेड बातचीत के लिए Rivya का बहु-वक्ता AI वॉइस जनरेटर है। इसे तब इस्तेमाल करें जब वक्ताओं के बीच लय, एकल-कथावाचक TTS से ज्यादा महत्वपूर्ण हो।
उदाहरण आउटपुट
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · confident welcome और quick handoff वाला two-speaker opener.
संवाद से ऑडियो
उदाहरण आउटपुट
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · confident welcome और quick handoff वाला two-speaker opener.
इनके लिए उपयोगी
समर्थित
ऑनलाइन परीक्षण
अभी कोई परिणाम नहीं है। रन शुरू करने के लिए प्रॉम्प्ट सबमिट करें।
प्रॉम्प्ट की शुरुआत
मॉडल प्रमाण
ऊपर ऑनलाइन परीक्षण इस्तेमाल करें, फिर Studio में ज्यादा क्रेडिट खर्च करने से पहले अंतिम रूप, लय और कार्य के लिए उपयुक्तता समझने के लिए इन उदाहरणों की तुलना करें।
मुख्य नमूना
dual-host podcast intro audio preview के लिए waveform और cover art.
इनपुट
संवाद पंक्तियाँ + वॉइस सेटिंग
किस पर ध्यान दें
dual-host podcast intro audio preview के लिए waveform और cover art.
प्रति उपयोग क्रेडिट
per_1000_characters · dialogue_text=14 · ⌈total⌉
यह मॉडल क्यों काम करता है
बहु-वक्ता संवाद जनरेशन
हर किरदार के लिए अलग आवाज आवंटन
सुसंगत प्रस्तुति के लिए समायोज्य स्थिरता
सबसे उपयुक्त कार्य
मॉडल प्रमाण
चुनाव के लिए उपयुक्तता
चुनाव के लिए उपयुक्तता
ElevenLabs Dialogue V3 के अक्सर पूछे जाने वाले सवाल
ElevenLabs Dialogue V3 तब सबसे मजबूत है जब ऑडियो एक ही कथावाचक के सब कुछ सीधे पढ़ने के बजाय वक्ताओं के बीच लय पर निर्भर हो। यह पॉडकास्ट बातचीत, इंटरव्यू-शैली स्क्रिप्ट, किरदार दृश्यों, ऑडियो ड्रामा प्रोटोटाइप और किसी भी भूमिका-आधारित वॉइस काम के लिए फिट है, जहां एक ही रेंडर पास में कई लोगों को अलग-अलग सुनाई देना चाहिए।
Rivya पर ElevenLabs Dialogue V3 हर पात्र के लिए आवाज आवंटन और प्रस्तुति नियंत्रण वाला संवाद-से-ऑडियो विकल्प है। यह फिलहाल लगभग 1,000 अक्षरों पर 14 क्रेडिट, ऊपर की ओर राउंड करके, मीटर्ड है, और मुख्य सार्वजनिक नियंत्रण डिफॉल्ट आवाज, स्थिरता और भाषा कोड हैं, जिससे यह पोस्ट-प्रोडक्शन के बजाय स्क्रिप्ट और परफॉर्मेंस सेटअप पर केंद्रित रहता है।
असल सवाल यह है कि कलाकारों की आवाजों का अलगाव काफी साफ है या नहीं। आवाज का चुनाव वक्ता की पहचान तय करता है, स्थिरता यह प्रभावित करती है कि हर वाचन कितना नियंत्रित और अनुमानित लगेगा, और भाषा कोड तब मायने रखता है जब स्क्रिप्ट को बहुभाषी प्रस्तुति चाहिए। अगर ये तीनों बातें काम कर रही हैं, तो मॉडल आम तौर पर बता देता है कि दृश्य अलग-अलग एकल-आवाज क्लिप जोड़ने के बजाय संवाद की तरह टिक सकता है या नहीं।
क्योंकि यह फिलहाल लगभग 1,000 अक्षरों पर 14 क्रेडिट, ऊपर की ओर राउंड करके, मीटर्ड है, लागत सही ठहराना सबसे आसान तब है जब एक रेंडर को बातचीत का तालमेल, लय और आवाजों का अलगाव साबित करना हो। यह पॉडकास्ट परिचय, इंटरव्यू वाचन और कहानी दृश्यों के लिए खास तौर पर सही है, जहां दोनों पक्षों को साथ सुनना पंक्तियों को एक-एक करके जांचने से ज्यादा महत्वपूर्ण होता है।
जब स्क्रिप्ट को सिर्फ एक कथावाचक या एक साफ वॉइसओवर चाहिए, तो एकल-वक्ता ElevenLabs विकल्प चुनें। Dialogue V3 तब चुनें जब बातचीत ही उत्पाद हो और दृश्य को अलग-अलग वाचन के ढेर के बजाय एक ही बातचीत जैसा महसूस होना चाहिए।
यहां तब शुरू करें जब पहले नतीजे से यह पता लगना हो कि बातचीत वाला दृश्य सच में ऑडियो की तरह काम करता है या नहीं। पॉडकास्ट की हल्की बातचीत, इंटरव्यू वाचन, किरदार संवाद और टेबल-रीड शैली के परीक्षणों के लिए इस्तेमाल करें, जहां मुख्य सवाल यह है कि आवाजें, लय और बारी-बारी बोलना साथ में सही लगते हैं या नहीं।
यह पेज संवाद-से-ऑडियो विकल्प है, सामान्य TTS पेज नहीं। पहले नतीजे से पहले सार्वजनिक सेटअप डिफॉल्ट आवाज असाइन करने, स्थिरता समायोजित करने और भाषा कोड सेट करने पर केंद्रित है, ताकि ध्यान बाद में अलग-अलग वॉइस फाइलें जोड़ने के बजाय कास्टिंग और प्रस्तुति पर रहे।
चलाने से पहले पक्का करें कि वक्ताओं की आवाजें साफ अलग हैं, स्थिरता से तय करें कि वाचन ज्यादा नियंत्रित लगे या ज्यादा अभिव्यंजक, और उच्चारण या बहुभाषी प्रस्तुति मायने रखती हो तो भाषा कोड सेट करें। ये चुनाव आम तौर पर स्क्रिप्ट को बार-बार चमकाने से ज्यादा पहले नतीजे को बेहतर बनाते हैं।
पेज सार्वजनिक है, लेकिन वास्तविक पहला संवाद रेंडर अभी भी साइन इन के पीछे है। यह फिलहाल लगभग 1,000 अक्षरों पर 14 क्रेडिट, ऊपर की ओर राउंड करके, मीटर्ड है, इसलिए आप पहले स्क्रिप्ट, वक्ताओं का अलगाव और प्रस्तुति दिशा तय कर सकते हैं, फिर रेंडर के लिए तैयार होने पर साइन इन करें।
जब आप बातचीत का पहला वाचन परख रहे हों और देख रहे हों कि पात्र-समूह और लय काम कर रहे हैं या नहीं, तब इस पेज पर रहें। जब काम को सेव किए गए टेक, बार-बार स्क्रिप्ट संशोधन, कई क्लिप या उसी दृश्य/शो पर लंबा वॉइस प्रोजेक्ट चाहिए, तब पूरा Studio खोलें।
विकल्पों की तुलना करें
Suno Music, Rivya का text-to-music model है, जो एक short brief को vocals के साथ या बिना vocals के first song draft में बदलता है। यह fixed `12` credit entry point बनाए रखता है और successful track के बाद `Extend Music` को next step के रूप में expose करता है।
इस पर क्यों विचार करें
जब आपके अगले कार्य में केवल प्रॉम्प्ट चाहिए हो, तो इस पर विचार करें।
Suno Sounds, Rivya का lightweight text-to-sound model है ambience loops, background sound और short sonic sketches के लिए। यह documented fixed price `2.5` credits per generation बनाए रखता है और successful results को `Vocal Separation` में continue करने देता है।
इस पर क्यों विचार करें
जब आपके अगले कार्य में केवल प्रॉम्प्ट चाहिए हो, तो इस पर विचार करें।
Suno Lyrics, Rivya का lyric-generation model है, जो एक theme या mood को song words में बदलता है और हर request पर fixed `1` credit खर्च करता है।
इस पर क्यों विचार करें
जब आपके अगले कार्य में केवल प्रॉम्प्ट चाहिए हो, तो इस पर विचार करें।
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · AI वर्कफ़्लो पॉडकास्ट ट्रांज़िशन के लिए चलाने योग्य ड्राफ्ट डायलॉग उदाहरण।
ऑडियो प्रॉम्प्ट टेम्पलेट के लिए पॉडकास्ट सेगमेंट ट्रांज़िशन वेवफ़ॉर्म प्रीव्यू।
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · Feature Release Podcast Bumper के लिए playable draft example.
Rivya audio prompt template Feature Release Podcast Bumper के लिए waveform preview.
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · दो-स्पीकर केस स्टडी संवाद के लिए चलाया जा सकने वाला ड्राफ़्ट उदाहरण।
Rivya ऑडियो प्रॉम्प्ट टेम्पलेट दो-स्पीकर केस स्टडी संवाद के लिए वेवफ़ॉर्म प्रीव्यू।
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · सेल्स कॉल प्रैक्टिस डायलॉग के लिए चलाया जा सकने वाला ड्राफ्ट उदाहरण।
Rivya ऑडियो प्रॉम्प्ट टेम्पलेट सेल्स कॉल प्रैक्टिस डायलॉग का वेवफ़ॉर्म पूर्वावलोकन।
उदाहरण; बनाने वाले मॉडल की पुष्टि नहीं हुई है · सपोर्ट प्रशिक्षण रोलप्ले के लिए चलाया जा सकने वाला ड्राफ़्ट उदाहरण।
Rivya ऑडियो प्रॉम्प्ट टेम्पलेट सपोर्ट प्रशिक्षण रोलप्ले के लिए वेवफ़ॉर्म प्रीव्यू।
सबसे उपयुक्त कार्य
कार्य ऐसा हो तो इसका उपयोग करें
स्पष्ट तथ्य
प्रदाता
ElevenLabs
श्रेणी
ऑडियो
क्षमताएँ
संवाद से ऑडियो
क्रेडिट मॉडल
per_1000_characters · dialogue_text=14 · ⌈total⌉
इनपुट रास्ता
संवाद पंक्तियाँ + वॉइस सेटिंग
प्रॉम्प्ट सेटअप
स्क्रिप्ट पर आधारित संवाद
डेवलपर एक्सेस
मॉडल फील्ड, संदर्भ मीडिया नियम और क्रेडिट व्यवहार जाँचने के बाद Public API v1 से ElevenLabs Dialogue V3 कॉल करें।