
Vídeo guiado por referencia
Añade hasta 9 referencias para dar forma a la apariencia y mantener sujetos consistentes.
El texto-a-vídeo N°1 de Alibaba — hasta 1080p, 9 imágenes de referencia, 3 a 15 segundos, nueve proporciones incluyendo 21:9.
Paga una vez por los créditos: utilízalos en todos los modelos en ZOOOP. · Recarga cuando lo necesites, sin quemaduras mensuales.
Powered by Alibaba's API on ZOOOP
Del 21:9 ultrawide al 9:21 — incluido 16:9, 1:1, 5:4, 4:3, 3:4 y 4:5, una gama de encuadre más amplia que la versión 1.0.
Añade hasta 9 imágenes de referencia (20 MB cada una) para guiar la apariencia y anclar sujetos junto al prompt.
Genera clips de 3 a 15 segundos — entre las ventanas de toma única más largas.
Acepta prompts de hasta 2.500 caracteres para dirección de escena granular.

Añade hasta 9 referencias para dar forma a la apariencia y mantener sujetos consistentes.

Encuadre ultrawide 21:9 para secuencias de estilo cinematográfico — nuevo en la 1.1.

Hasta 15 segundos capturan un latido completo o acción continua en una generación.

9:16, 4:5 y 9:21 para clips listos para feed e historias.

Los prompts hasta 2.500 caracteres te permiten describir escenas complejas con precisión.

Salida 1080p para planos de calidad de entrega.
Elige el modelo de vídeo adecuado. Tus créditos funcionan en todo ZOOOP.
Abre Happy Horse V1.1 desde esta página o selecciónalo en el Generador de Vídeo.
Escribe el prompt ; añade hasta 9 imágenes de referencia para guiar la apariencia.
Elige la proporción de imagen (21:9 a 9:21), resolución (hasta 1080p) y duración (3–15s).
Genera, luego descarga o envía el clip a tu canvas.
Happy Horse V1.1 es el modelo texto-a-vídeo de Alibaba — el sucesor clasificado N°1 del original Happy Horse que escaló al primer puesto del leaderboard blind-test de la Artificial Analysis Video Arena. Toma un prompt más hasta 9 imágenes de referencia y genera un clip hasta 1080p. El soporte de referencia te permite dar forma a la apariencia y mantener sujetos consistentes sin depender solo del texto, y la asignación de prompt largo (hasta 2.500 caracteres) lo hace adecuado para escenas detalladas y precisamente descritas.
La mejora principal respecto a la 1.0 es el encuadre: V1.1 produce nueve proporciones de imagen, del 21:9 ultrawide para secuencias cinematográficas hasta el 9:21 para vertical alto, con 16:9, 1:1, 5:4, 4:3, 3:4 y 4:5 en medio — frente a cinco en el original. Combinado con una duración de clip de 3 a 15 segundos (una de las ventanas de toma única más largas de la selección) e imágenes de referencia más grandes de 20 MB, una acción completa o un latido cabe en un único formato y un solo paso.
Su posición: es una sólida opción general entre los modelos de vídeo de ZOOOP. Para un equilibrio diferente, Kling V3 es un general insignia, Seedance V2.0 lidera en física de movimiento, Wan V2.7 es el insignia Wan, y Grok Imagine es la elección rápida y estilizada; Pika V2.2 son los borradores más baratos. El punto fuerte de Happy Horse V1.1 es el texto-a-vídeo guiado por referencia, más largo, con la gama de encuadre más amplia, hasta 1080p.
Un modelo mental razonable: usa Happy Horse V1.1 por defecto cuando quieres vídeo guiado por referencia con una amplia elección de proporciones de imagen y una ventana de clip más larga en 1080p, y cambia a Seedance V2.0 o Veo 3.1 cuando el realismo de movimiento o calidad cinematográfica es la prioridad.
V1.1 es el lanzamiento N°1 de Alibaba. El cambio práctico más importante es la cobertura de encuadre — nueve proporciones de imagen del 21:9 ultrawide al 9:21, frente a cinco anteriormente — más imágenes de referencia más grandes de 20 MB. El número de referencias (9), la duración del clip (3–15s) y la salida 1080p se mantienen.
Hasta 9 — para guiar la apariencia y anclar sujetos junto al prompt, hasta 20 MB cada una.
De 3 a 15 segundos — una de las ventanas de toma única más largas disponibles.
720p o 1080p, en nueve proporciones de imagen del 21:9 al 9:21.
Happy Horse V1.1 es una opción texto-a-vídeo equilibrada con soporte de referencia, clips largos y la gama de encuadre más amplia. Kling V3 es un general insignia ; Seedance V2.0 lidera en física de movimiento. Elige según tus necesidades de referencia, encuadre y longitud.
Prompt*
Images
Resolución*
Relación De Aspecto*
Duración*