Input, output, credits এবং example result দেখে নিন, তারপর page থেকেই সরাসরি এই model try করুন। Saved history, asset বা দীর্ঘ iteration দরকার হলে Studio-তে যান।
উদাহরণ আউটপুট
Volcengine Video Lip Sync
যার জন্য সেরা
একজন উপস্থাপকের ক্লিপ নতুন ভয়েস ট্র্যাক দিয়ে পুনরায় ডাব করাবিদ্যমান এক-বক্তার ভিডিও স্থানীয়করণ করাঅনুমোদিত ফুটেজ রেখে সংলাপ সংশোধন করাক্যামেরার দিকে মুখ করা সামাজিক, টিউটোরিয়াল বা মুখপাত্রের ক্লিপ
সমর্থন করে
ভিডিও + অডিও থেকে ভিডিও
Online trial
Volcengine Video Lip Sync চেষ্টা করুন
একটি সমর্থিত উৎস ভিডিও ও একটি কণ্ঠ ট্র্যাক আপলোড করুন, এরপর Lite বা Basic প্রক্রিয়াকরণ এবং শুধু সেই মোডে পাওয়া নিয়ন্ত্রণগুলো বেছে নিন।
ফলাফল
Volcengine Video Lip Sync
VolcengineAI.generator.modes.video-audio-to-video
উৎস ফুটেজে ব্যক্তি, ফ্রেমিং ও গতি ঠিক আছে, কিন্তু মুখের নড়াচড়া অন্য ভয়েস রেকর্ডিং অনুসরণ করা দরকার হলে Volcengine Video Lip Sync ব্যবহার করুন।
Volcengine Video Lip Sync
এখনও কোনো ফলাফল নেই। রান শুরু করতে একটি প্রম্পট জমা দিন।
ভিডিও + অডিও থেকে ভিডিও
Decision fit
কখন এই model সঠিক পছন্দ
Decision fit
Fit signal
ঠিক একটি উৎস ভিডিও ও একটি লক্ষ্য অডিও ট্র্যাক
ক্যামেরার দিকে মুখ করা একজন ব্যক্তির ফুটেজের জন্য Lite মোড
আরও জটিল একজন-ব্যক্তির দৃশ্যের জন্য Basic মোড
ঐচ্ছিক কণ্ঠ পৃথকীকরণ ও মোডভিত্তিক সমন্বয় নিয়ন্ত্রণ
যাচাইকৃত অডিও ট্র্যাক অনুযায়ী ক্রেডিট ও আউটপুট মেয়াদ
Best-fit task
Task এমন হলে এটি ব্যবহার করুন
একজন উপস্থাপকের ক্লিপ নতুন ভয়েস ট্র্যাক দিয়ে পুনরায় ডাব করাবিদ্যমান এক-বক্তার ভিডিও স্থানীয়করণ করাঅনুমোদিত ফুটেজ রেখে সংলাপ সংশোধন করাক্যামেরার দিকে মুখ করা সামাজিক, টিউটোরিয়াল বা মুখপাত্রের ক্লিপ
Quiet facts
Input, output এবং credits নিশ্চিত করুন
Provider
Volcengine
Category
ভিডিও
Capabilities
ভিডিও + অডিও থেকে ভিডিও
Credit model
per_input_second · default=8 · ⌈total⌉
Input path
সর্বোচ্চ 2টি reference file
প্রম্পট সেটআপ
প্রম্পট-নির্দেশিত
FAQ
Volcengine Video Lip Sync FAQ
Volcengine Video Lip Sync কোন কাজে সবচেয়ে উপযোগী?
উৎস ভিডিওটি যখন আপনার ধরে রাখার মতো চূড়ান্ত ভিজ্যুয়াল এবং শুধু কথ্য অভিনয়কে ভিন্ন কণ্ঠ ট্র্যাক অনুসরণ করাতে হবে, তখন এটি ব্যবহার করুন। এটি ভিডিও-ও-অডিও লিপ-সিঙ্ক কর্মপ্রবাহ, প্রম্পটনির্ভর ভিডিও জেনারেটর বা পোর্ট্রেট অ্যানিমেশন মডেল নয়।
Rivya-তে কোন ফাইল আপলোড করা যায়?
সর্বোচ্চ 95 MB-এর ঠিক একটি MP4 বা MOV ভিডিও এবং সর্বোচ্চ 10 MB-এর একটি MP3, M4A, WAV, AAC বা OGG অডিও ফাইল আপলোড করুন। ভিডিওর জ্যামিতি সমর্থিত 360p থেকে 1080p, ফ্রেম রেট 24 থেকে 60 fps এবং বিটরেট 1 থেকে 30 Mbps-এর মধ্যে হতে হবে; দুটি ফাইলেরই যাচাইকৃত মেয়াদ শূন্যের বেশি হতে হবে।
Lite না Basic মোড বেছে নেব?
ক্যামেরার দিকে মুখ করা একজন ব্যক্তির ক্ষেত্রে দ্রুত প্রক্রিয়াকরণ ও অডিও-টু-ভিডিও সমন্বয় নিয়ন্ত্রণ দরকার হলে Lite বেছে নিন। আরও জটিল একজন-ব্যক্তির দৃশ্যের জন্য, বিশেষ করে দৃশ্য বিভাজন ও বক্তা শনাক্তকরণ দরকার হলে Basic বেছে নিন।
শুধু Lite-এর নিয়ন্ত্রণগুলো কীভাবে কাজ করে?
Lite মোডে লক্ষ্য অডিও দীর্ঘ হলে অডিও সমন্বয় ভিডিওকে লুপ করতে পারে। উল্টো লুপ শুধু সমন্বয় চালু থাকলে পাওয়া যায় এবং টেমপ্লেটের শুরু মান উৎস ক্রম কোথা থেকে শুরু হবে তা বেছে নেয়। Basic মোডে এসব নিয়ন্ত্রণ ব্যবহৃত হয় না।
ক্রেডিট কীভাবে হিসাব করা হয়?
Rivya যাচাইকৃত প্রতি অডিও সেকেন্ডে 8 ক্রেডিট হার ব্যবহার করে এবং আউটপুট মেয়াদ সেই অডিও অনুসরণ করে। দশমিক মেয়াদ সম্পূর্ণ হিসাবের অংশ থাকে এবং শুধু সংরক্ষণের মোটকে একটি পূর্ণ ক্রেডিটে ঊর্ধ্বমুখী করা হয়। বৈধ প্রকৃত ব্যবহার জানানো হলে এবং তা সংরক্ষিত পরিমাণের চেয়ে বেশি না হলে Rivya সেই পরিমাণে নিষ্পত্তি করে; প্রকৃত ব্যবহার অনুপস্থিত, অবৈধ বা সংরক্ষিত পরিমাণের বেশি হলে গোপনে অতিরিক্ত চার্জ না কেটে তা সমন্বয় প্রক্রিয়ায় রাখা হয়।
এই লিপ-সিঙ্ক পৃষ্ঠায় কী করতে পারি?
বিদ্যমান একজন-ব্যক্তির ভিডিওর সঙ্গে একটি লক্ষ্য কণ্ঠ ট্র্যাক জুড়ে দিন, যাতে দৃশ্যমান কথা নতুন অডিও অনুসরণ করে এবং উৎস ফুটেজ ভিজ্যুয়াল ভিত্তি হিসেবে থাকে।
আপলোডের আগে কী পরীক্ষা করব?
স্পষ্টভাবে দৃশ্যমান বক্তাসহ সমর্থিত MP4 বা MOV ফাইল ব্যবহার করুন, এরপর পরিষ্কার কণ্ঠ ট্র্যাক প্রস্তুত করুন। ভিডিওটি 95 MB-এর বেশি নয় এবং তার রেজোলিউশন, ফ্রেম রেট ও বিটরেট উল্লেখিত সীমার মধ্যে আছে কি না পরীক্ষা করুন।
কোন মোড দিয়ে শুরু করব?
ক্যামেরার দিকে মুখ করা সহজ ফুটেজের জন্য Lite দিয়ে শুরু করুন। দৃশ্যটি বেশি জটিল হলে বা দৃশ্য বিভাজন ও বক্তা শনাক্তকরণ উপযোগী হলে Basic ব্যবহার করুন।
সাইন ইন করতে হবে কি, এবং ক্রেডিট কীভাবে কাজ করে?
বিস্তারিত তথ্য সর্বসাধারণের জন্য উন্মুক্ত, তবে আপলোড ও জেনারেশনের জন্য সাইন ইন প্রয়োজন। যাচাইকৃত প্রতি অডিও সেকেন্ডে 8 ক্রেডিট লাগে, ফলাফল অডিওর মেয়াদ অনুসরণ করে এবং শুধু চূড়ান্ত হিসাব করা মোটকে ঊর্ধ্বমুখী পূর্ণসংখ্যায় নেওয়া হয়।
কখন পূর্ণ Studio খুলব?
একটি উৎস ভিডিও ও ভয়েস ট্র্যাক পরীক্ষা করতে এখানেই থাকুন। সংরক্ষিত ডাব, বারবার ভাষা বা টেক, তুলনামূলক কাজ বা দীর্ঘ স্থানীয়করণ কর্মপ্রবাহের জন্য Studio খুলুন।
Alternative তুলনা করুন
এরপর বিবেচনার মতো অন্য model
ভিডিও
Seedance 2.0
ByteDance-এর full Seedance 2.0 video model, prompt-only generation, frame-driven animation এবং multimodal reference generation-এর explicit support সহ। Rivya documented role split explicit রাখে, যাতে frame input এবং multimodal reference এক অস্পষ্ট upload bucket-এ collapse না করে mutually exclusive থাকে।
কেন বিবেচনা করবেন
আপনার পরের task-এ Prompt, frame, অথবা image/video/audio reference দরকার হলে এটি বিবেচনা করুন।
InputPrompt, frame, অথবা image/video/audio reference
ByteDance-এর faster Seedance 2.0 video model, prompt-only generation, frame-driven image animation এবং multimodal reference video generation-এর জন্য full scene routing সহ। Rivya documented scene split explicit রাখে, যাতে first/last-frame input reference image, video এবং audio role-এর সঙ্গে collide না করে।
কেন বিবেচনা করবেন
আপনার পরের task-এ Prompt, frame, অথবা image/video/audio reference দরকার হলে এটি বিবেচনা করুন।
InputPrompt, frame, অথবা image/video/audio reference
Best forprompt বা storyboard frame থেকে fast ad previs
ভিডিও
Seedance 1.5 Pro
Text-to-video ও image-to-video-এর জন্য native audio-visual sync-সহ Seedance video model। এটি 480p–1080p, 4–12s clip, 6টি aspect ratio, dynamic বা fixed lens control, optional audio generation এবং lip-sync support করে।
কেন বিবেচনা করবেন
আপনার পরের task-এ Prompt + optional image দরকার হলে এটি বিবেচনা করুন।