Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Drei Modi: Text-zu-Video + Bild-zu-Video + Video-zu-VideoEine schwere Wan-Option, die aus einem Quellvideo starten kann statt nur aus Text oder StandbildernVerwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei).
Video-zu-Video-Bearbeitungen aus einem bestehenden Quellclip
Beispiel-Output
Vorschau für Ölgemälde-Fahrt durch bewaldete Hügel mit Fokus auf Szenenaufbau, Kamerapfad, Bewegungskontinuität, editierbare Details und finalen Hero Frame.
Prüfe Eingabe, Ausgabe, Credits und Beispielergebnis und teste dieses Modell dann direkt auf der Seite. Wechsle ins Studio, wenn du gespeicherten Verlauf, Assets oder längere Iteration brauchst.
Beispiel-Output
Vorschau für Ölgemälde-Fahrt durch bewaldete Hügel mit Fokus auf Szenenaufbau, Kamerapfad, Bewegungskontinuität, editierbare Details und finalen Hero Frame.
Am besten für
Video-zu-Video-Bearbeitungen aus einem bestehenden QuellclipText- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.Standbilder mit einem flexiblen Wan-Projekt animierenIterative Bewegungstests über Text-, Bild- und Videoeingaben hinweg
Unterstützt
Text zu VideoBild zu VideoVideo zu Video
Online-Test
Wan 2.6 verwenden
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden. Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Ergebnisse
Wan 2.6
AlibabaText zu Video
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Wan 2.6
Noch kein Ergebnis. Sende einen Prompt, um einen Durchlauf zu starten.
Text zu VideoBild zu VideoVideo zu Video
Prompt-Starter
Wan 2.6 mit einem bewährten Prompt starten
Nutze ein bereits auf Wan 2.6 gemapptes Template, wenn du einen stärkeren ersten Lauf als mit einem leeren Prompt möchtest.
Nutze den Online-Test oben und vergleiche dann diese Beispielergebnisse, um Finish, Rhythmus und Aufgabenfit zu beurteilen, bevor du mehr Credits im Studio ausgibst.
Vorschau für Ölgemälde-Fahrt durch bewaldete Hügel mit Fokus auf Szenenaufbau, Kamerapfad, Bewegungskontinuität, editierbare Details und finalen Hero Frame.
Video-Vorschau einer Ölgemälde-Fahrt durch bewaldete Hügel mit Bewegungsrhythmus, Motivkontinuität, Kamerarichtung und finalem Hero Frame.
Eingabe
Bis zu 3 Referenzdateien
Worauf achten
Video-Vorschau einer Ölgemälde-Fahrt durch bewaldete Hügel mit Bewegungsrhythmus, Motivkontinuität, Kamerarichtung und finalem Hero Frame.
Drei Modi: Text-zu-Video + Bild-zu-Video + Video-zu-Video
Eine schwere Wan-Option, die aus einem Quellvideo starten kann statt nur aus Text oder Standbildern
Verwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei).
Best-Fit-Aufgaben
Best-Fit-Aufgaben
Video-zu-Video-Bearbeitungen aus einem bestehenden QuellclipText- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.Standbilder mit einem flexiblen Wan-Projekt animierenIterative Bewegungstests über Text-, Bild- und Videoeingaben hinweg
Modellbeleg
Vorschauclip für eine Orbital-Megastruktur im künstlichen Sonnenuntergang, fokussiert auf Horizontaufbau, Parallaxen-Enthüllung, lesbare Größe, editierbare Farbtemperatur und das finale Schlussbild.
Videovorschau einer Orbital-Megastruktur im künstlichen Sonnenuntergang mit ruhigem Horizont, gekrümmter Struktur-Enthüllung, weichem pink-blauem Licht, Kameradrift und finaler Weitaufnahme.
Preview mit Fokus auf Hochstraßen-Geometrie, Near-Pass-Bewegung, Verkehrstiefe, Fahrzeugmaßstab und lesbares Weitbild-Ende.
Sci-Fi-Video-Preview einer Zukunftsstadt, in der ein originaler Speeder durch gestaffelten Hochverkehr fährt.
Preview-Clip für ein Briefing zur Wanderfigur im Nebelwald um Mitternacht, fokussiert auf Nebeltiefe, Figurenbewegung, subtiles Licht und finale Reveal-Komposition.
Midnight-Fog-Forest-Video-Preview mit einer gewandeten Wanderfigur, die durch mondbeschienenen Dunst geht.
Vorschau eines handgezeichneten Pop-up-Bilderbuchs mit Fokus auf Seitenumschlag-Kontinuität, handgemachte Animation, Außenlicht und finale Buchkomposition.
Vorschau eines handgezeichneten Pop-up-Bilderbuchvideos mit animierten Papiertieren, die aus einem offenen Buch aufsteigen.
Preview-Clip für Raketenstartlauf auf Waldlichtung, fokussiert auf Pfadbewegung, Raketenmaßstab, Boarding-Kontinuität und vertikales Abheben.
Wald-Action-Video-Preview mit einem Läufer, der eine Lichtung betritt und in einer kompakten Rakete startet.
Vorschauclip für eine Orbital-Megastruktur im künstlichen Sonnenuntergang, fokussiert auf Horizontaufbau, Parallaxen-Enthüllung, lesbare Größe, editierbare Farbtemperatur und das finale Schlussbild.
Videovorschau einer Orbital-Megastruktur im künstlichen Sonnenuntergang mit ruhigem Horizont, gekrümmter Struktur-Enthüllung, weichem pink-blauem Licht, Kameradrift und finaler Weitaufnahme.
Preview mit Fokus auf Hochstraßen-Geometrie, Near-Pass-Bewegung, Verkehrstiefe, Fahrzeugmaßstab und lesbares Weitbild-Ende.
Sci-Fi-Video-Preview einer Zukunftsstadt, in der ein originaler Speeder durch gestaffelten Hochverkehr fährt.
Preview-Clip für ein Briefing zur Wanderfigur im Nebelwald um Mitternacht, fokussiert auf Nebeltiefe, Figurenbewegung, subtiles Licht und finale Reveal-Komposition.
Midnight-Fog-Forest-Video-Preview mit einer gewandeten Wanderfigur, die durch mondbeschienenen Dunst geht.
Vorschau eines handgezeichneten Pop-up-Bilderbuchs mit Fokus auf Seitenumschlag-Kontinuität, handgemachte Animation, Außenlicht und finale Buchkomposition.
Vorschau eines handgezeichneten Pop-up-Bilderbuchvideos mit animierten Papiertieren, die aus einem offenen Buch aufsteigen.
Preview-Clip für Raketenstartlauf auf Waldlichtung, fokussiert auf Pfadbewegung, Raketenmaßstab, Boarding-Kontinuität und vertikales Abheben.
Wald-Action-Video-Preview mit einem Läufer, der eine Lichtung betritt und in einer kompakten Rakete startet.
Entscheidungsfit
Wann dieses Modell die richtige Wahl ist
Entscheidungsfit
Fit-Signale
Drei Modi: Text-zu-Video + Bild-zu-Video + Video-zu-Video
Eine schwere Wan-Option, die aus einem Quellvideo starten kann statt nur aus Text oder Standbildern
Verwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei).
Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Best-Fit-Aufgaben
Nutze es, wenn die Aufgabe so aussieht
Video-zu-Video-Bearbeitungen aus einem bestehenden QuellclipText- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.Standbilder mit einem flexiblen Wan-Projekt animierenIterative Bewegungstests über Text-, Bild- und Videoeingaben hinwegTeams, die ein Modell für Generierung und Quellvideo-Überarbeitung brauchen
Wan 2.6 hat aufrufbare Public API-Modi, aber Referenzmedien-Modi benötigen weiterhin Files API-Upload-Unterstützung. Prüfe vor dem Einreichen die Modellreferenz.
Für welche Art von Videoarbeit passt Wan 2.6 wirklich am besten?
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Was ist der tatsächliche Umfang von Wan 2.6 auf Rivya?
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Verwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei). Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden. Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Wann ist Wan 2.6s Quellvideo-Pfad der echte Grund, es zu wählen?
Der Quellvideo-Pfad ist der Hauptgrund, zu Wan 2.6 aufzusteigen, wenn der bestehende Clip bereits Bewegung, Timing oder Blocking enthält, das erhaltenswert ist. Wenn das starkste Asset, das du hast, der Clip selbst ist und nicht nur eine geschriebene Shot-Beschreibung, wird Wan 2.6 deutlich leichter zu rechtfertigen, weil du aus vorhandenem Material steuerst, statt die Szene von Grund auf neu zu bauen.
Wann lohnt sich Wan 2.6 in seiner aktuellen Credit-Stufe?
Wan 2.6 kostet derzeit `720p 5s = 70`, `720p 10s = 140`, `720p 15s = 210`, `1080p 5s = 105`, `1080p 10s = 210` und `1080p 15s = 315` Credits. Diese Stufe ergibt Sinn, wenn die Flexibilität selbst Arbeit spart, besonders wenn dasselbe Modell Erstgenerierung, standbildgefuhrte Bewegung und Quellvideo-Überarbeitung in einer Option abdeckt. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Wann sollte ich Wan 2.6 statt Wan 2.7 oder einer engeren Option wählen?
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Was kann ich zuerst auf dieser Seite testen?
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Verwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei).
Was kann ich auf dieser Seite einrichten?
Wan 2.6 unterstützt Text-zu-Video ohne Medien, Bild-zu-Video mit genau einem Bild und Videobearbeitung mit einem bis drei Videos; Bilder und Videos dürfen nicht gemischt werden. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden. Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt.
Welche Prüfungen lohnen sich, bevor ich den Lauf starte?
Standard sind 1080p, 5 Sekunden, Shot-Modus Aus und Inhaltsfilter Ein. Beide Optionen werden ausdrücklich gesendet; eine Audiospur wird nicht erzeugt. Verwende genau 1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei).
Muss ich mich anmelden, bevor ich hier etwas ausführe, und wie funktionieren Credits?
Die Seite ist öffentlich, aber der eigentliche Videolauf erfordert weiterhin eine Anmeldung. Die Preise folgen derzeit der sichtbaren Leiter: `720p 5s = 70`, `720p 10s = 140`, `720p 15s = 210`, `1080p 5s = 105`, `1080p 10s = 210` und `1080p 15s = 315` Credits. Du kannst den richtigen Quellpfad, die Dauer und die Auflösung zuerst wählen und dich dann anmelden, wenn du bereit bist. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Wann sollte ich auf dieser Seite bleiben und wann ins vollständige Studio wechseln?
Bleibe hier, solange du den ersten Quellpfad und die erste Kostenstufe auf Wan 2.6 validierst. Öffne das vollständige Studio, sobald die Arbeit gespeicherte Versionen, wiederholte Clip-Iterationen, mehrere koordinierte Assets oder ein längeres verwaltetes Projekt rund um dasselbe Material oder dieselbe Szenengruppe braucht.
Alternativen vergleichen
Andere Modelle, die du als Nächstes prüfen kannst
Video
Seedance 2.0
ByteDances vollständiges Seedance-2.0-Videomodell mit expliziter Unterstützung für prompt-only Generierung, framegesteuerte Animation und multimodale Referenzgenerierung. Rivya halt die dokumentierte Rollentrennung explizit, damit Frame-Eingaben und multimodale Referenzen getrennt bleiben, statt in einem mehrdeutigen Upload-Bucket zu verschwimmen.
Warum in Betracht ziehen
Ziehe es in Betracht, wenn deine nächste Aufgabe Prompt, Frames oder Bild-/Video-/Audio-Referenzen benötigt.
EingabePrompt, Frames oder Bild-/Video-/Audio-Referenzen
ByteDances schnelleres Seedance-2.0-Videomodell mit vollständigem Scene Routing für prompt-only Generierung, framegesteuerte Bildanimation und multimodale Referenzvideo-Generierung. Rivya halt die dokumentierte Szenenaufteilung explizit, damit First-/Last-Frame-Eingaben nicht mit den Rollen von Referenzbild, Video und Audio kollidieren.
Warum in Betracht ziehen
Ziehe es in Betracht, wenn deine nächste Aufgabe Prompt, Frames oder Bild-/Video-/Audio-Referenzen benötigt.
EingabePrompt, Frames oder Bild-/Video-/Audio-Referenzen
Ein Seedance-Videomodell für Text-zu-Video und Bild-zu-Video mit nativer Bild-Ton-Synchronisierung. Es unterstützt 480p bis 1080p, Clips von 4 bis 12 Sekunden, 6 Seitenverhältnisse, dynamische oder feste Kameraführung, optionale Audiogenerierung und Lippensynchronisation.
Warum in Betracht ziehen
Ziehe es in Betracht, wenn deine nächste Aufgabe Prompt + optionale Bilder benötigt.