
Poner una foto en movimiento
Un retrato fijo ejecuta el movimiento de referencia — sin rodaje de por medio.
Dale un clip de referencia y tu personaje, y el movimiento se transfiere intacto — baile, gesto, expresión. El movimiento es exacto; el personaje sigue siendo el tuyo.
Un clip de referencia define el movimiento con mucha más precisión que las palabras — «que baile» te da la improvisación del modelo; una referencia te da ese baile.
El movimiento viene de la referencia, la apariencia de tu imagen de personaje. Dos controles independientes.
Un solo retrato fijo más un movimiento de referencia te da vídeo de esa persona ejecutándolo.
Aplica la misma referencia a distintos personajes y obtén una serie de clips con movimiento idéntico y personas diferentes.

Un retrato fijo ejecuta el movimiento de referencia — sin rodaje de por medio.

Toma un baile como referencia y haz que tu personaje lo ejecute marcando los mismos tiempos.

Aplica un mismo movimiento a varios personajes distintos para producir una serie homogénea.

Un personaje fijo más movimiento grabado, para producir contenido en volumen con una persona siempre igual.
Abre Motion control con IA y sube la imagen o el clip de tu personaje.
Sube un clip de referencia que defina el movimiento a transferir.
Descarga el resultado o mándalo al lienzo para seguir montando.
Escribe «que baile» en un generador de vídeo y obtendrás la idea que el modelo tiene del baile — quizá bonita, pero no el baile que tenías en mente. El movimiento tiene demasiada información para el texto: el tempo, la amplitud y los detalles de una pose no caben en un prompt.
Motion control cambia la entrada: le pasas un clip de referencia. El movimiento se extrae del vídeo, la apariencia viene de tu imagen de personaje, y los dos se controlan por separado. Así tu personaje ejecuta ese movimiento concreto.
La calidad de imagen de la referencia no importa — solo aporta movimiento, y la apariencia viene íntegramente de tu personaje. Lo que importa es que el movimiento sea legible:
Hay algo más que conviene igualar: el encuadre. Una referencia de baile a cuerpo entero frente a una imagen de personaje de cintura para arriba obliga al modelo a inventarse la mitad inferior que falta, y puede no encajar con tu personaje. Los resultados más ajustados llegan cuando ambos encuadres son parecidos.
El valor de esta página es la certeza sobre el movimiento. Por eso encaja en dos situaciones: tienes un movimiento que hay que reproducir (un baile concreto, un gesto concreto), o necesitas una tanda de clips con personajes distintos y movimiento idéntico.
Al revés, si el movimiento es indiferente y lo único que necesitas es que «se mueva», el generador de vídeo da menos trabajo — no hay referencia que preparar y basta con una frase.
En imagen a vídeo el modelo decide el movimiento y tú solo lo orientas vagamente con palabras — «bailando» te da la idea que el modelo tiene del baile. Motion control usa un clip real como plantilla de movimiento, así que lo que ocurre es ese movimiento concreto. Usa esta página cuando el movimiento deba ser exacto; usa imagen a vídeo cuando quieras la idea del modelo.
Lo que más pesa es un movimiento claro y un sujeto completo. El movimiento de cuerpo entero necesita el cuerpo entero visible; los gestos necesitan manos visibles. Las oclusiones, la luz muy escasa o varias personas moviéndose a la vez degradan la extracción. La calidad de imagen de la referencia da igual — solo aporta movimiento, y la apariencia viene de tu personaje.
Por diseño, no — el movimiento sale de la referencia y la apariencia de tu personaje. Pero cuando ambos difieren mucho en encuadre (una referencia de baile a cuerpo entero frente a una imagen de personaje de cintura para arriba), el modelo tiene que inventarse la parte que falta, y esa parte puede no coincidir exactamente con tu personaje.
Gobiernan partes distintas: la sincronización labial alinea la boca con el audio; motion control transfiere el movimiento corporal y la pose. Para un personaje que se mueve y habla, el orden habitual es primero el movimiento y después la sincronización labial.
Prompt
Image*
Video*