Wan 2.2 A14B Turbo admite tres formas de empezar en Rivya: texto, una imagen o una imagen acompañada de un clip de audio para generar vídeo guiado por audio. Úsalo para pruebas Wan más ligeras, clips breves a partir de una imagen y movimiento de retrato guiado por el audio aportado.
Un solo modelo cubre vídeo desde texto, imagen e imagen más audioLos niveles de créditos separan las ejecuciones ligeras de texto o imagen de las más exigentes guiadas por audioLa ruta guiada por imagen más audio mantiene su propio subconjunto de parámetros avanzados en lugar de reducirlo todo a valores predeterminados
Vista previa de un brief de video de robot solitario en la cima, centrada en apertura amplia, ruta lenta de cámara, continuidad atmosférica, detalles editables y plano final protagonista.
Comprueba entrada, salida, créditos y resultado de ejemplo, y luego prueba este modelo directamente en la página. Pasa a Studio cuando necesites historial guardado, activos o una iteración más larga.
Salida de ejemplo
Vista previa de un brief de video de robot solitario en la cima, centrada en apertura amplia, ruta lenta de cámara, continuidad atmosférica, detalles editables y plano final protagonista.
Mejor para
Experimentos Wan más ligeros de texto a vídeoGenerar clips cortos desde una imagenClips de retrato talking-head o semi-talking desde una imagen fija y un archivo de audioEquipos que quieren un nivel de vídeo Wan más antiguo por debajo de Wan 2.6
Admite
Texto a videoImagen a videoGuiado por imagen y audio
Prueba en línea
Probar Wan 2.2 A14B Turbo
Prueba Wan 2.2 A14B Turbo cuando quieras la opción Wan más ligera que aún puede cubrir texto a vídeo, imagen a vídeo y vídeo con imagen más audio en una sola familia de modelos. Empieza desde texto, añade una imagen para imagen a vídeo o combina una imagen con un clip de audio para la ruta guiada por voz.
Resultados
Wan 2.2 A14B Turbo
AlibabaTexto a video
Wan 2.2 A14B Turbo admite tres formas de empezar en Rivya: texto, una imagen o una imagen acompañada de un clip de audio para generar vídeo guiado por audio. Úsalo para pruebas Wan más ligeras, clips breves a partir de una imagen y movimiento de retrato guiado por el audio aportado.
Wan 2.2 A14B Turbo
Aún no hay resultados. Envía un prompt para iniciar una ejecución.
Texto a videoImagen a videoGuiado por imagen y audio
Prompts iniciales
Empieza Wan 2.2 A14B Turbo con un prompt probado
Usa una plantilla ya asignada a Wan 2.2 A14B Turbo cuando quieras una primera ejecución más sólida que un prompt en blanco.
Usa la prueba en línea de arriba y luego compara estos resultados de ejemplo para juzgar acabado, ritmo y ajuste de tarea antes de gastar más créditos en Studio.
Vista previa de un brief de video de robot solitario en la cima, centrada en apertura amplia, ruta lenta de cámara, continuidad atmosférica, detalles editables y plano final protagonista.
Vista previa de video de un robot solitario en una cima, con montaña en plano amplio, deriva controlada de cámara, continuidad del sujeto, escala atmosférica y plano final protagonista.
Entrada
Prompt, 1 imagen o 1 imagen + 1 audio
Qué observar
Vista previa de video de un robot solitario en una cima, con montaña en plano amplio, deriva controlada de cámara, continuidad del sujeto, escala atmosférica y plano final protagonista.
Un solo modelo cubre vídeo desde texto, imagen e imagen más audio
Los niveles de créditos separan las ejecuciones ligeras de texto o imagen de las más exigentes guiadas por audio
La ruta guiada por imagen más audio mantiene su propio subconjunto de parámetros avanzados en lugar de reducirlo todo a valores predeterminados
Tareas más adecuadas
Tareas más adecuadas
Experimentos Wan más ligeros de texto a vídeoGenerar clips cortos desde una imagenClips de retrato talking-head o semi-talking desde una imagen fija y un archivo de audioEquipos que quieren un nivel de vídeo Wan más antiguo por debajo de Wan 2.6
Prueba del modelo
El vuelo en primera persona pasa junto a obstáculos de ruinas, mantiene visible la ruta de escape y termina en una vista amplia iluminada.
Vista previa de un vuelo POV de escape de águila con planeo rápido y legible por ruinas hacia una luz abierta.
Clip de vista previa para acción de personaje con referencias, enfocado en momentos de escena, ritmo de cámara, continuidad y cierre principal.
Vista previa de video de un clip de acción de personaje con referencias que muestra estilo de movimiento, dirección de cámara y ritmo de salida.
Vista previa para Speedcut de Zibo con neón y patrimonio, centrada en la configuración de escena, la ruta de cámara, la continuidad de movimiento, los detalles editables y el plano hero final.
Vista previa de video de Speedcut de Zibo con neón y patrimonio, mostrando ritmo de movimiento, continuidad del sujeto, dirección de cámara y plano hero final.
Vista previa de un FPV cyber patrimonial de Guangzhou en una sola toma, centrada en lógica de cámara continua, textura Lingnan, neón junto al río y escala estable del hito.
Vista previa de video urbano FPV de Guangzhou con arquitectura patrimonial, vapor de casa de té, neón del Pearl River y órbita de Canton Tower.
Clip de vista previa para una animación de dúo en rollo de tinta cinabrio, centrado en floración de tinta, movimiento simbólico, espacio negativo, transición de paisaje y cierre con sello editable.
Vista previa de animación 3D de tinta lavada con figuras auspiciosas de cinabrio moviéndose sobre un rollo de papel de arroz.
El vuelo en primera persona pasa junto a obstáculos de ruinas, mantiene visible la ruta de escape y termina en una vista amplia iluminada.
Vista previa de un vuelo POV de escape de águila con planeo rápido y legible por ruinas hacia una luz abierta.
Clip de vista previa para acción de personaje con referencias, enfocado en momentos de escena, ritmo de cámara, continuidad y cierre principal.
Vista previa de video de un clip de acción de personaje con referencias que muestra estilo de movimiento, dirección de cámara y ritmo de salida.
Vista previa para Speedcut de Zibo con neón y patrimonio, centrada en la configuración de escena, la ruta de cámara, la continuidad de movimiento, los detalles editables y el plano hero final.
Vista previa de video de Speedcut de Zibo con neón y patrimonio, mostrando ritmo de movimiento, continuidad del sujeto, dirección de cámara y plano hero final.
Vista previa de un FPV cyber patrimonial de Guangzhou en una sola toma, centrada en lógica de cámara continua, textura Lingnan, neón junto al río y escala estable del hito.
Vista previa de video urbano FPV de Guangzhou con arquitectura patrimonial, vapor de casa de té, neón del Pearl River y órbita de Canton Tower.
Clip de vista previa para una animación de dúo en rollo de tinta cinabrio, centrado en floración de tinta, movimiento simbólico, espacio negativo, transición de paisaje y cierre con sello editable.
Vista previa de animación 3D de tinta lavada con figuras auspiciosas de cinabrio moviéndose sobre un rollo de papel de arroz.
Ajuste de decisión
Cuándo este modelo es la opción correcta
Ajuste de decisión
Señales de ajuste
Un solo modelo cubre vídeo desde texto, imagen e imagen más audio
Los niveles de créditos separan las ejecuciones ligeras de texto o imagen de las más exigentes guiadas por audio
La ruta guiada por imagen más audio mantiene su propio subconjunto de parámetros avanzados en lugar de reducirlo todo a valores predeterminados
Las tres rutas devuelven resultados en el historial de generaciones guardadas
La imagen y el audio siguen el proyecto multimedia de menor riesgo que Rivya ya usa en otros lugares
Tareas más adecuadas
Úsalo cuando la tarea se parezca a esto
Experimentos Wan más ligeros de texto a vídeoGenerar clips cortos desde una imagenClips de retrato talking-head o semi-talking desde una imagen fija y un archivo de audioEquipos que quieren un nivel de vídeo Wan más antiguo por debajo de Wan 2.6Proyectos que quieren puntos de entrada de texto, imagen e imagen más audio bajo un solo modelo
Datos concretos
Entradas, salida y créditos por confirmar
Proveedor
Alibaba
Categoría
Vídeo
Capacidades
Texto a video · Imagen a video · Guiado por imagen y audio
Wan 2.2 A14B Turbo tiene modos invocables desde Public API, pero los modos con medios de referencia aún necesitan soporte de subida de Files API. Revisa la referencia del modelo antes de enviar.
¿Cuándo debería usar Wan 2.2 A14B Turbo para trabajo de vídeo?
Usa Wan 2.2 A14B Turbo para pruebas ligeras de texto a vídeo, clips breves desde una imagen o movimiento de retrato guiado por una imagen fija y un archivo de audio. Resulta útil cuando quieres esas tres entradas en un mismo modelo, con niveles de créditos distintos para las ejecuciones ligeras y las guiadas por audio.
¿Cuál es el alcance real de Wan 2.2 A14B Turbo en Rivya ahora mismo?
En Rivya, Wan 2.2 A14B Turbo actualmente admite texto a vídeo, imagen a vídeo y generación guiada por imagen + audio. También puede aceptar hasta 2 archivos de referencia entre entradas de imagen y entradas de audio.
¿Qué controles o entradas importan más al evaluar Wan 2.2 A14B Turbo para trabajo real?
Elige 480p, 580p o 720p, define la forma del encuadre y decide si la ejecución parte de texto, una imagen o una imagen con audio. Para movimiento de retrato guiado por audio, la imagen fija y la pista deben formar ya una pareja creíble.
¿Cuándo vale la pena Wan 2.2 A14B Turbo con el nivel actual de créditos de Rivya?
Las ejecuciones de texto o imagen duran 5 segundos fijos y cuestan 40/60/80 créditos en 480p/580p/720p. Las ejecuciones de imagen más audio cuestan 12/18/24 créditos por segundo de salida.
¿Cuándo debería elegir Wan 2.2 A14B Turbo frente a una alternativa más ligera o más barata en Rivya?
Elige Wan 2.2 A14B Turbo cuando necesites vídeo desde texto, imagen e imagen con audio en un mismo modelo. Si solo necesitas una prueba básica desde texto o imagen, compara primero una opción más acotada y económica.
¿Qué puedo probar primero en esta página?
Empieza aquí cuando la primera ejecución apunte a experimentos Wan más ligeros de texto a vídeo, generación de clips cortos desde una imagen y clips de retrato talking-head o semi-talking desde una imagen fija y un archivo de audio. Eso mantiene la primera ejecución práctica: comprueba aquí la entrada, la dirección y la calidad de salida antes de convertirlo en un proyecto más largo.
¿Qué puedo configurar en esta página?
Esta página actualmente admite texto a vídeo, imagen a vídeo y generación guiada por imagen + audio. Eso facilita ver si una descripción pura de la toma o un inicio desde imagen fija es la mejor entrada para experimentos Wan más ligeros de texto a vídeo. También puedes aportar hasta 2 archivos de referencia entre entradas de imagen y entradas de audio.
¿Qué controles conviene revisar antes de ejecutar?
Antes de ejecutar, las comprobaciones principales son los niveles de salida como 480p, 580p y 720p, la forma del encuadre y la dirección del prompt. Esas piezas suelen decidir si el primer resultado está lo bastante cerca como para seguir iterando aquí hacia experimentos Wan más ligeros de texto a vídeo sin hacer la configuración más pesada de lo necesario.
¿Necesito iniciar sesión antes de ejecutar aquí y cómo funcionan los créditos?
La página es pública, pero generar vídeo requiere iniciar sesión. Una ejecución fija de 5 segundos desde texto o imagen cuesta 40/60/80 créditos en 480p/580p/720p; imagen más audio cuesta 12/18/24 créditos por segundo de salida.
¿Cuándo debería quedarme en esta página y cuándo pasar al Studio completo?
Quédate en esta página mientras todavía válidas la primera toma, el tipo de fuente y si el primer resultado te acerca a experimentos Wan más ligeros de texto a vídeo en Wan 2.2 A14B Turbo. Abre el Studio completo cuando el trabajo necesite versiones guardadas, iteraciones repetidas de clip, varios recursos o una cadena de producción más larga alrededor del mismo conjunto de escenas.
Comparar alternativas
Otros modelos para considerar después
Vídeo
Seedance 2.0
Modelo completo de vídeo Seedance 2.0 de ByteDance con soporte explícito para generación solo con prompt, animación guiada por fotogramas y generación con referencia multimodal. Rivya mantiene explícita la división documentada de roles para que las entradas de fotograma y las referencias multimodales se mantengan mutuamente excluyentes en lugar de caer en un único contenedor ambiguo de subida.
Por qué considerarlo
Considéralo cuando tu próxima tarea necesite Prompt, fotogramas o referencias de imagen/video/audio.
EntradaPrompt, fotogramas o referencias de imagen/video/audio
Modelo de vídeo Seedance 2.0 más rápido de ByteDance, con enrutamiento completo de escenas para generación solo con prompt, animación de imagen guiada por fotogramas y generación de vídeo con referencia multimodal. Rivya mantiene explícita la división documentada de escenas para que las entradas de primer/último fotograma no se confundan con los roles de imagen, vídeo y audio de referencia.
Por qué considerarlo
Considéralo cuando tu próxima tarea necesite Prompt, fotogramas o referencias de imagen/video/audio.
EntradaPrompt, fotogramas o referencias de imagen/video/audio
Modelo de vídeo Seedance para texto a vídeo e imagen a vídeo con sincronización audiovisual nativa. Admite clips de 480p a 1080p y de 4 a 12 segundos, 6 relaciones de aspecto, control de lente dinámico o fijo, generación opcional de audio y sincronización labial.
Por qué considerarlo
Considéralo cuando tu próxima tarea necesite Prompt + imágenes opcionales.