Prepara un'immagine JPEG, PNG o WebP autorizzata fino a 10 MB e un audio finale MP3, M4A, WAV, AAC o OGG fino a 10 MB e sotto 60 secondi. In una camera luminosa mostra una giovane donna con lunghi capelli scuri ondulati, pelle chiara, fermaglio a fiore bianco e maglia beige chiaro a pois, rivolta all'obiettivo e con la cover liquida trasparente in entrambe le mani. L'immagine deve già mostrare glitter a stella colorati, paillettes, faccine gialle, unicorno bianco, papera gialla, dinosauro blu, auto rosa e blu e cactus verde; non chiedere al prompt di inventare dettagli mancanti. Registra la frase inglese esattamente con voce felice, entusiasta e una risata leggera. Il prompt facoltativo contiene 298 caratteri UTF-16; inizia con output_resolution 1080, pe_fast_mode false e seed -1. L'audio dell'utente guida la performance; il prompt non sintetizza audio. In una ripresa continua lei inclina e agita piano la cover, facendo ruotare e galleggiare glitter e ciondoli, senza montaggio multicamera. Il video del ledger è un riferimento indipendente, non prova un risultato OmniHuman. Controlla identità, mani, geometria della cover, movimento di liquido e ciondoli, sincronizzazione labiale, sfondo e assenza di sottotitoli.