Utwórz wideo MiniMax H3 trwające od 4 do 15 sekund z tekstu, jednej lub dwóch klatek prowadzących albo zweryfikowanego pakietu multimodalnego, z dedykowanym poziomem 2K i jawną ceną referencji.
Dedykowany poziom 2K obok wyniku 768POsobne ścieżki tekstu, prowadzenia klatkami i referencji multimodalnychPakiety referencji z maksymalnie dziewięcioma obrazami, trzema wideo i trzema plikami audio
Sprawdź wejście, wyjście, kredyty i przykładowy wynik, a potem wypróbuj ten model bezpośrednio na stronie. Przejdź do Studio, gdy potrzebujesz zapisanej historii, zasobów albo dłuższej iteracji.
Przykładowy wynik
MiniMax H3
Najlepsze do
Krótkie koncepcje wideo 2K zbudowane z pisanego briefu ujęciaAnimacja pierwszej albo pierwszej i ostatniej klatki z jednym wyraźnym tematemReferencje ruchu łączące kierunek wizualny ze wspierającym audioSceny bogate w referencje, w których cena zależna od liczby obrazów musi pozostać widoczna
Obsługuje
Tekst na wideoObraz na wideoReferencja na wideo
Próba online
Twórz z MiniMax H3
Wybierz tekst, prowadzenie klatkami lub referencje multimodalne, następnie ustaw 768P albo 2K i czas od 4 do 15 sekund.
Wyniki
MiniMax H3
MiniMaxTekst na wideo
Utwórz wideo MiniMax H3 trwające od 4 do 15 sekund z tekstu, jednej lub dwóch klatek prowadzących albo zweryfikowanego pakietu multimodalnego, z dedykowanym poziomem 2K i jawną ceną referencji.
MiniMax H3
Brak wyniku. Prześlij prompt, aby rozpocząć uruchomienie.
Tekst na wideoObraz na wideoReferencja na wideo
Dopasowanie decyzyjne
Kiedy ten model jest właściwym wyborem
Dopasowanie decyzyjne
Sygnały dopasowania
Dedykowany poziom 2K obok wyniku 768P
Osobne ścieżki tekstu, prowadzenia klatkami i referencji multimodalnych
Pakiety referencji z maksymalnie dziewięcioma obrazami, trzema wideo i trzema plikami audio
Całkowity czas wyniku od 4 do 15 sekund
Przejrzysta formuła dla czasu wideo wejściowego i obrazów powyżej pierwszych pięciu
Najlepiej dopasowane zadania
Użyj go, gdy zadanie wygląda tak
Krótkie koncepcje wideo 2K zbudowane z pisanego briefu ujęciaAnimacja pierwszej albo pierwszej i ostatniej klatki z jednym wyraźnym tematemReferencje ruchu łączące kierunek wizualny ze wspierającym audioSceny bogate w referencje, w których cena zależna od liczby obrazów musi pozostać widoczna
Najważniejsze fakty
Wejścia, wyjście i kredyty do potwierdzenia
Dostawca
MiniMax
Kategoria
Wideo
Możliwości
Tekst na wideo · Obraz na wideo · Referencja na wideo
Użyj MiniMax H3 do wideo trwającego od 4 do 15 sekund, które wymaga kadru wyłącznie z promptu, jednej lub dwóch klatek prowadzących albo pakietu referencji multimodalnych. Model wyróżniają poziomy 768P i 2K oraz jawne uwzględnianie czasu wideo wejściowego i ponad pięciu obrazów.
Czym różnią się sceny MiniMax H3?
Wszystkie trzy sceny używają niepustego promptu o długości do 7000 znaków. Tekst nie przyjmuje plików i wymaga konkretnych, nieadaptacyjnych proporcji. Scena Klatki przyjmuje dokładnie jeden obraz jako klatkę początkową lub końcową albo dwa uporządkowane obrazy jako początek i koniec, bez wideo ani audio. Referencja wymaga co najmniej jednego pliku; audio nie może być użyte samodzielnie i musi towarzyszyć obrazowi lub wideo.
Jakich mediów mogę użyć w żądaniu referencyjnym MiniMax H3?
Rivya przyjmuje maksymalnie dziewięć obrazów JPEG, PNG lub WebP, trzy wideo MP4 lub MOV i trzy pliki audio MP3 lub WAV, łącznie nie więcej niż 15 plików. Każdy obraz jest ograniczony do 30 MB. Wideo jest ograniczone do 50 MB i od 2 do 15 sekund na plik, przy 15 sekundach wideo łącznie; audio jest ograniczone do 15 MB i od 2 do 15 sekund na plik, przy 15 sekundach audio łącznie.
Jaką geometrię obrazów i wideo przyjmuje MiniMax H3?
Obrazy i wideo referencyjne muszą mieć szerokość oraz wysokość od 256 do 5760 pikseli i proporcje od 0,4 do 2,5. Wideo referencyjne musi ponadto działać z częstotliwością od 23,976 do 60 klatek na sekundę.
Jak obliczane są kredyty MiniMax H3?
Stawka wynosi 16 kredytów w 768P lub 26 w 2K i jest mnożona przez sumę żądanych sekund wyniku oraz zweryfikowanych sekund wideo wejściowego. Pierwsze pięć obrazów nie dodaje opłaty za obrazy; każdy obraz od szóstego do dziewiątego dodaje 8 kredytów. Audio wejściowe nie zwiększa tej formuły. Rivya tylko raz zaokrągla w górę łączną sumę.
Jakie proporcje obrazu są dostępne w MiniMax H3?
Text-to-video wymaga 21:9, 16:9, 4:3, 1:1, 3:4 lub 9:16 i nie przyjmuje ustawienia adaptacyjnego. Reference-to-video może również używać proporcji adaptacyjnych. Ścieżka prowadzona klatkami wywodzi kadr z dostarczonego obrazu lub pary obrazów zamiast wysyłać osobną wartość proporcji.
Jak rozliczana jest końcowa opłata za MiniMax H3?
Rivya rezerwuje obliczoną kwotę przed generowaniem, zachowując wszystkie składniki stawki i zaokrąglając dopiero pełną sumę. Gdy zgłoszone rzeczywiste zużycie jest prawidłowe i nie przekracza rezerwacji, Rivya rozlicza zadanie według tej wartości. Brakujące, nieprawidłowe lub przekraczające rezerwację zużycie trafia do uzgodnienia zamiast powodować ukryte dodatkowe obciążenie.
Co mogę skonfigurować na tej stronie MiniMax H3?
Wybierz tekst, prowadzenie klatkami lub scenę referencji multimodalnych; ustaw 768P lub 2K; wybierz całkowity czas od 4 do 15 sekund; użyj proporcji tylko tam, gdzie przyjmuje je dana scena.
Czy mogę przesłać samo audio?
Nie. W scenie referencji audio musi towarzyszyć co najmniej jednemu obrazowi lub wideo. Sceny tekstu i klatek nie przyjmują audio.
Czy mogę użyć klatki końcowej bez klatki początkowej?
Tak. Przy jednym obrazie wybierz, czy jest klatką początkową, czy końcową. Przy dwóch ustaw je jako początek, a następnie koniec.
Kiedy obrazy zwiększają cenę MiniMax H3?
Pierwsze pięć obrazów jest zawarte w bazowej formule czasu. Każdy dodatkowy obraz od szóstego do dziewiątego dodaje 8 kredytów do łącznego szacunku, zanim suma zostanie jeden raz zaokrąglona w górę.
Od której rozdzielczości MiniMax H3 zacząć?
Użyj 768P za 16 kredytów na rozliczaną sekundę podczas testowania ruchu i ról referencji. Wybierz 2K za 26 kredytów na rozliczaną sekundę, gdy kierunek sceny jest gotowy na wyższy poziom.
Kiedy przejść do Studio?
Użyj tej strony, aby sprawdzić jedną scenę, czas i hierarchię referencji. Przejdź do Studio, aby zapisywać porównania 768P i 2K, wielokrotnie poprawiać referencje albo prowadzić dłuższy projekt.
Porównaj alternatywy
Inne modele warte rozważenia
Wideo
Seedance 2.0
Pełny model wideo Seedance 2.0 od ByteDance z jawną obsługą generowania tylko z promptu, animacji prowadzonej klatkami i generowania z referencją multimodalną. Rivya utrzymuje udokumentowany podział ról jawnie, aby wejścia klatek i referencje multimodalne pozostały wzajemnie wykluczające się, zamiast zlewać się w jeden niejasny koszyk uploadu.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt, klatki albo referencje obrazu/wideo/audio.
WejściePrompt, klatki albo referencje obrazu/wideo/audio
Szybszy model wideo Seedance 2.0 od ByteDance z pełnym routingiem scen dla generowania tylko z promptu, animacji obrazu prowadzonej klatkami i multimodalnego generowania wideo z referencją. Rivya utrzymuje udokumentowany podział scen jawnie, aby wejścia pierwszej i ostatniej klatki nie mieszały się z rolami obrazów, wideo i audio referencyjnych.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt, klatki albo referencje obrazu/wideo/audio.
WejściePrompt, klatki albo referencje obrazu/wideo/audio
Najlepsze doSzybkie prewizualizacje reklam z promptów lub klatek storyboardu
Wideo
Seedance 1.5 Pro
Model wideo Seedance do text-to-video i image-to-video z natywną synchronizacją audio-wideo. Obsługuje klipy 480p–1080p o długości 4–12 sekund, 6 proporcji obrazu, dynamiczny lub stały obiektyw, opcjonalne generowanie audio i lip-sync.
Dlaczego warto go rozważyć
Rozważ go, gdy następne zadanie wymaga Prompt + opcjonalne obrazy.
Zespoły porównujące poziom szkicu 768P z końcowym przebiegiem kierunku w 2K
Do 7,000 znaków
Dostęp dla deweloperów
Częściowo dostępne przez API
MiniMax H3 ma wywoływalne tryby Public API, ale tryby z mediami referencyjnymi nadal potrzebują obsługi przesyłania przez Files API. Sprawdź referencję modelu przed wysłaniem.