Przygotuj dokładnie jeden plik JPEG, PNG lub WebP z uregulowanymi prawami, do 10 MB, oraz jeden gotowy plik audio MP3, M4A, WAV, AAC lub OGG, do 10 MB i bezwzględnie krótszy niż 60 sekund. Obraz jest wizualną kotwicą: pokaż w jasnej sypialni jedną młodą dorosłą kobietę o długich, ciemnych falowanych włosach, jasnej skórze, z białą kwiatową spinką i w jasnobeżowym swetrze w kropki. Powinna patrzeć w obiektyw i już trzymać obiema dłońmi przezroczyste etui na telefon wypełnione płynem. Kolorowy brokat w kształcie gwiazd, cekiny, żółte buźki, biały jednorożec, żółta gumowa kaczka, niebieski dinozaur, różowe i niebieskie samochodziki oraz zielony kaktus muszą być czytelne na zdjęciu; nie oczekuj, że prompt wymyśli brakujące elementy etui. Nagraj dostarczoną angielską kwestię dokładnie w podanym brzmieniu, radosnym, entuzjastycznym głosem, z uśmiechem i lekkim śmiechem. Opcjonalny prompt Rivya ma 299 znaków JavaScript UTF-16. Zacznij od output_resolution 1080, pe_fast_mode false i seed -1. Audio dostarczone przez użytkownika steruje występem; prompt nie syntetyzuje dźwięku. Ta adaptacja wymaga jednego nieprzerwanego ujęcia prezenterki: delikatnie przechyla i potrząsa przezroczystym etui, dzięki czemu brokat i małe ozdoby wyraźnie wirują i unoszą się, przy lekkim naturalnym ruchu kamery i bez montażu wielokamerowego. Film z ledgeru jest niezależną referencją i nie stanowi dowodu wyniku OmniHuman. Przed użyciem sprawdź tożsamość, dłonie, geometrię etui, ruch płynu i ozdób, naturalną synchronizację ust, czytelny entuzjazm, stabilne tło i brak napisów.