Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Trzy tryby: tekst-na-wideo + obraz-na-wideo + wideo-na-wideoJedna cięższa opcja Wan, która może startować od wideo źródłowego, a nie tylko od tekstu lub nieruchomych obrazów
Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik).
Edycje wideo-na-wideo z istniejącego klipu źródłowego
Przykładowy wynik
Przykład; model generujący niezweryfikowany · Podgląd Przejazdu przez zalesione wzgórza w stylu obrazu olejnego, skupiony na ustawieniu sceny, ścieżce kamery, ciągłości ruchu, edytowalnych detalach i końcowym hero kadrze.
Najpierw sprawdź bieżącą dostępność, dane wejściowe i wyjściowe, kredyty oraz dowody. Jeśli test online jest dostępny, wypróbuj model na stronie; użyj Studio do zapisanej historii, zasobów i dłuższych iteracji.
Przykładowy wynik
Przykład; model generujący niezweryfikowany · Podgląd Przejazdu przez zalesione wzgórza w stylu obrazu olejnego, skupiony na ustawieniu sceny, ścieżce kamery, ciągłości ruchu, edytowalnych detalach i końcowym hero kadrze.
Najlepsze do
Edycje wideo-na-wideo z istniejącego klipu źródłowegoDane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.Animowanie kadrów nieruchomych w elastycznym projekcie WanIteracyjne testy ruchu na wejściach tekstowych, obrazowych i wideo
Obsługuje
Tekst na wideoObraz na wideoWideo na wideo
Próba online
Użyj Wan 2.6
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund. Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Wyniki
Wan 2.6
AlibabaTekst na wideo
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Wan 2.6
Brak wyniku. Prześlij prompt, aby rozpocząć uruchomienie.
Tekst na wideoObraz na wideoWideo na wideo
Prompty startowe
Zacznij Wan 2.6 od sprawdzonego promptu
Użyj szablonu już przypisanego do Wan 2.6, gdy chcesz mocniejsze pierwsze uruchomienie niż pusty prompt.
Użyj próby online powyżej, a potem porównaj te przykładowe wyniki, aby ocenić wykończenie, rytm i dopasowanie do zadania, zanim wydasz więcej kredytów w Studio.
Przykład; model generujący niezweryfikowany · Podgląd Przejazdu przez zalesione wzgórza w stylu obrazu olejnego, skupiony na ustawieniu sceny, ścieżce kamery, ciągłości ruchu, edytowalnych detalach i końcowym hero kadrze.
Podgląd wideo Przejazd przez zalesione wzgórza w stylu obrazu olejnego, pokazujący rytm ruchu, ciągłość tematu, kierunek kamery i końcowy hero kadr.
Wejście
Do 3 plików referencyjnych
Na co zwrócić uwagę
Podgląd wideo Przejazd przez zalesione wzgórza w stylu obrazu olejnego, pokazujący rytm ruchu, ciągłość tematu, kierunek kamery i końcowy hero kadr.
Trzy tryby: tekst-na-wideo + obraz-na-wideo + wideo-na-wideo
Jedna cięższa opcja Wan, która może startować od wideo źródłowego, a nie tylko od tekstu lub nieruchomych obrazów
Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik).
Najlepiej dopasowane zadania
Najlepiej dopasowane zadania
Edycje wideo-na-wideo z istniejącego klipu źródłowegoDane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.Animowanie kadrów nieruchomych w elastycznym projekcie WanIteracyjne testy ruchu na wejściach tekstowych, obrazowych i wideo
Przykład modelu
Przykład; model generujący niezweryfikowany · Klip podglądu ujęcia megastruktury orbitalnej o zachodzie słońca, skupiony na ustawieniu horyzontu, ujawnieniu przez paralaksę, czytelnej skali, edytowalnej temperaturze barwowej i końcowym kadrze głównym.
Podgląd wideo megastruktury orbitalnej o zachodzie słońca pokazujący spokojny horyzont, ujawnienie zakrzywionej struktury, miękkie różowo-niebieskie światło, dryf kamery i końcowy szeroki kadr główny.
Przykład; model generujący niezweryfikowany · Podgląd skupiony na geometrii podniesionych dróg, ruchu bliskiego przelotu, głębi ruchu, skali pojazdu i czytelnym szerokim zakończeniu.
Podgląd wideo miasta przyszłości sci-fi, pokazujący oryginalny speeder poruszający się przez warstwowy ruch na podniesionych drogach.
Dopasowanie decyzyjne
Kiedy ten model jest właściwym wyborem
Dopasowanie decyzyjne
Sygnały dopasowania
Trzy tryby: tekst-na-wideo + obraz-na-wideo + wideo-na-wideo
Jedna cięższa opcja Wan, która może startować od wideo źródłowego, a nie tylko od tekstu lub nieruchomych obrazów
Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik).
FAQ
FAQ Wan 2.6
Do jakiego rodzaju pracy wideo Wan 2.6 pasuje najlepiej?
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.
Jaki jest rzeczywisty zakres Wan 2.6 w Rivya?
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik). Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund. Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Kiedy ścieżka wideo źródłowego w Wan 2.6 jest prawdziwym powodem wyboru?
Ścieżka wideo źródłowego jest głównym powodem przejścia na Wan 2.6, gdy istniejący klip zawiera już ruch, rytm albo blokowanie warte zachowania. Jeśli najmocniejszym zasobem, który masz, jest sam klip, a nie tylko pisemny opis ujęcia, Wan 2.6 łatwiej uzasadnić, bo sterujesz na podstawie materiału filmowego zamiast odbudowywać scenę od zera.
Kiedy Wan 2.6 jest wart obecnego poziomu kredytów?
Wan 2.6 ma obecnie ceny `720p 5s = 70`, `720p 10s = 140`, `720p 15s = 210`, `1080p 5s = 105`, `1080p 10s = 210` i `1080p 15s = 315` kredytów. Ten poziom ma sens, gdy sama elastyczność oszczędza pracę, zwłaszcza jeśli ten sam model obejmuje pierwsze generowanie, ruch prowadzony obrazem i przerabianie wideo źródłowego w jednej opcji. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.
Kiedy wybrać Wan 2.6 zamiast Wan 2.7 albo węższej opcji?
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.
Co mogę najpierw przetestować na tej stronie?
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik).
Co mogę skonfigurować na tej stronie?
Wan 2.6 obsługuje tekst na wideo bez multimediów, obraz na wideo z dokładnie jednym obrazem oraz edycję wideo z jednym do trzech filmów; obrazów i filmów nie można mieszać. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund. Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Jakie ustawienia warto sprawdzić przed uruchomieniem?
Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana. Użyj dokładnie 1 obrazu JPG/PNG/WebP (co najmniej 256×256, do 10 MB) albo 1–3 filmów MP4/MOV (do 10 MB na plik).
Czy muszę się zalogować przed uruchomieniem i jak działają kredyty?
Strona jest publiczna, ale właściwe generowanie wideo nadal wymaga zalogowania. Ceny obecnie podążają za widoczną drabinką: `720p 5s = 70`, `720p 10s = 140`, `720p 15s = 210`, `1080p 5s = 105`, `1080p 10s = 210` i `1080p 15s = 315` kredytów. Możesz najpierw wybrać właściwą ścieżkę źródłową, czas trwania i rozdzielczość, a potem zalogować się, gdy będziesz gotowy do uruchomienia. Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.
Kiedy zostać na tej stronie, a kiedy przejść do pełnego Studio?
Zostań tutaj, gdy sprawdzasz pierwszą ścieżkę źródłową i poziom kosztu w Wan 2.6. Otwórz pełne Studio, gdy praca wymaga zapisanych wersji, kolejnych iteracji klipów, wielu skoordynowanych zasobów albo dłuższego projektu opartego na tym samym materiale lub zestawie scen.
Porównaj alternatywy
Inne modele warte rozważenia
Wideo
Seedance 2.0
Pełny model wideo Seedance 2.0 od ByteDance z jawną obsługą generowania tylko z promptu, animacji prowadzonej klatkami i generowania z referencją multimodalną. Rivya utrzymuje udokumentowany podział ról jawnie, aby wejścia klatek i referencje multimodalne pozostały wzajemnie wykluczające się, zamiast zlewać się w jeden niejasny koszyk uploadu.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt, klatki albo referencje obrazu/wideo/audio.
WejściePrompt, klatki albo referencje obrazu/wideo/audio
Szybszy model wideo Seedance 2.0 od ByteDance z pełnym routingiem scen dla generowania tylko z promptu, animacji obrazu prowadzonej klatkami i multimodalnego generowania wideo z referencją. Rivya utrzymuje udokumentowany podział scen jawnie, aby wejścia pierwszej i ostatniej klatki nie mieszały się z rolami obrazów, wideo i audio referencyjnych.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt, klatki albo referencje obrazu/wideo/audio.
WejściePrompt, klatki albo referencje obrazu/wideo/audio
Najlepsze doSzybkie prewizualizacje reklam z promptów lub klatek storyboardu
Wideo
Seedance 1.5 Pro
Model wideo Seedance do text-to-video i image-to-video z natywną synchronizacją audio-wideo. Obsługuje klipy 480p–1080p o długości 4–12 sekund, 6 proporcji obrazu, dynamiczny lub stały obiektyw, opcjonalne generowanie audio i lip-sync.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt + opcjonalne obrazy.
Przykład; model generujący niezweryfikowany · Podgląd klipu dla briefu wędrowca w północnym mglistym lesie, skupiony na głębi mgły, ruchu postaci, subtelnym świetle i finalnej kompozycji odsłonięcia.
Podgląd wideo północnego mglistego lasu z wędrowcem w szacie poruszającym się przez księżycową poświatę.
Przykład; model generujący niezweryfikowany · Podgląd ręcznie rysowanego ujęcia książki pop-up, skupiony na ciągłości przewracania strony, ręcznie wykonanej animacji, świetle zewnętrznym i końcowej kompozycji książki.
Podgląd wideo ręcznie rysowanej książki pop-up, z animowanymi papierowymi zwierzętami unoszącymi się z otwartej książki.
Przykład; model generujący niezweryfikowany · Klip podglądowy skupiony na ruchu ścieżką, skali rakiety, ciągłości wejścia na pokład i pionowym starcie.
Podgląd wideo akcji w lesie z biegaczem wbiegającym na polanę i startującym w kompaktowej rakiecie.
Przykład; model generujący niezweryfikowany · Klip podglądu ujęcia megastruktury orbitalnej o zachodzie słońca, skupiony na ustawieniu horyzontu, ujawnieniu przez paralaksę, czytelnej skali, edytowalnej temperaturze barwowej i końcowym kadrze głównym.
Podgląd wideo megastruktury orbitalnej o zachodzie słońca pokazujący spokojny horyzont, ujawnienie zakrzywionej struktury, miękkie różowo-niebieskie światło, dryf kamery i końcowy szeroki kadr główny.
Przykład; model generujący niezweryfikowany · Podgląd skupiony na geometrii podniesionych dróg, ruchu bliskiego przelotu, głębi ruchu, skali pojazdu i czytelnym szerokim zakończeniu.
Podgląd wideo miasta przyszłości sci-fi, pokazujący oryginalny speeder poruszający się przez warstwowy ruch na podniesionych drogach.
Przykład; model generujący niezweryfikowany · Podgląd klipu dla briefu wędrowca w północnym mglistym lesie, skupiony na głębi mgły, ruchu postaci, subtelnym świetle i finalnej kompozycji odsłonięcia.
Podgląd wideo północnego mglistego lasu z wędrowcem w szacie poruszającym się przez księżycową poświatę.
Przykład; model generujący niezweryfikowany · Podgląd ręcznie rysowanego ujęcia książki pop-up, skupiony na ciągłości przewracania strony, ręcznie wykonanej animacji, świetle zewnętrznym i końcowej kompozycji książki.
Podgląd wideo ręcznie rysowanej książki pop-up, z animowanymi papierowymi zwierzętami unoszącymi się z otwartej książki.
Przykład; model generujący niezweryfikowany · Klip podglądowy skupiony na ruchu ścieżką, skali rakiety, ciągłości wejścia na pokład i pionowym starcie.
Podgląd wideo akcji w lesie z biegaczem wbiegającym na polanę i startującym w kompaktowej rakiecie.
Dane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.
Domyślnie ustawione jest 1080p, 5 sekund, tryb ujęć Wyłączony i filtr treści Włączony. Oba ustawienia są wysyłane jawnie, a ścieżka audio nie jest generowana.
Najlepiej dopasowane zadania
Użyj go, gdy zadanie wygląda tak
Edycje wideo-na-wideo z istniejącego klipu źródłowegoDane tekstowe i obrazowe obsługują 5, 10 lub 15 sekund; dane wideo obsługują tylko 5 lub 10 sekund.Animowanie kadrów nieruchomych w elastycznym projekcie WanIteracyjne testy ruchu na wejściach tekstowych, obrazowych i wideoZespoły, które potrzebują jednego modelu do generowania i przerabiania wideo źródłowego
Wan 2.6 ma wywoływalne tryby Public API, ale tryby z mediami referencyjnymi nadal potrzebują obsługi przesyłania przez Files API. Sprawdź referencję modelu przed wysłaniem.