
¿Puede una sola persona hacer un cortometraje con IA? Storyboard, consistencia del personaje y continuidad
Sí. Aunque no todas las partes.
Probé el rodaje con IA en solitario con una historia deliberadamente mínima: un hombre encuentra una nota doblada en el bolsillo de un abrigo viejo. Ocho planos, una persona, de una sola frase a algo que se ve de principio a fin. Esto es lo que funcionó, dónde me atasqué y lo que costó de verdad.
Qué puede terminar una persona y qué no
Primero las conclusiones, para que no sigas leyendo con expectativas equivocadas.
Lo que una sola persona ya puede hacer: el storyboard, el aspecto del personaje y la consistencia del personaje, la imagen de cada plano, los empalmes entre planos, la voz y la sincronización labial. Un trabajo que antes necesitaba operador de cámara, iluminador, dirección de arte y actor cabe hoy de verdad en un solo escritorio.
Lo que sigue sin funcionar: acción continua compleja más allá de unos cinco segundos, interpretación ajustada con precisión a una línea de diálogo, cualquier plano con texto legible en cuadro (más abajo lo explico) y todo lo que exija una localización real o una persona real reaccionando.
Así que el terreno bueno del rodaje con IA hoy son 30 segundos a 2 minutos, montados con varios planos cortos. No intentes un plano secuencia de tres minutos: no es un problema de cómo escribes el prompt, es el techo actual del método.
¿Cómo se convierte un párrafo en storyboard?
El storyboard es el paso que hay que hacer primero y el más barato de todo el proceso de rodaje con IA. Es rápido, cuesta casi nada y saca a la luz los problemas de la historia antes de gastar dinero real en imágenes acabadas.
El método es tosco: parte la historia en una frase por plano y escribe tres cosas en cada frase: escala, acción, luz. Después haz una pasada de viñetas a lápiz con la generación de imágenes con IA.

El mío quedó así: general para presentar la habitación → medio, el abrigo descolgado de la percha → primer plano, una mano entrando en el bolsillo → primer plano, la nota abierta en la palma → medio, la cabeza que se levanta hacia la ventana → general, con el abrigo puesto, caminando hacia la puerta → la puerta de la escalera abriéndose a la luz de la mañana → plano largo, su espalda subiendo la calle.
Un consejo contraintuitivo en esta fase: no intentes dibujar bien. Solo compruebas tres cosas: si la historia se sostiene, si varían las escalas y si algún plano es redundante. Cuanto más basto el boceto, más fácil es cortar. Mi primera pasada tenía 11 viñetas; el ritmo solo funcionó cuando bajé a ocho.
¿Cómo mantener la misma cara en todos los planos?
La consistencia del personaje es donde el rodaje con IA se rompe más a menudo, y el paso que más tiempo me llevó.
La respuesta es una hoja de personaje: haz una y luego referénciala en cada plano en lugar de describir la cara con palabras. La consistencia sale de reutilizar una misma imagen de referencia, no de escribir una descripción más detallada.

Primero generé una toma frontal limpia: fondo gris, luz uniforme, sin estilismo, sin expresión; básicamente una foto de casting. Luego construí el tres cuartos, el perfil y la espalda a partir de ella. Esas cuatro imágenes son el «actor» de esta pieza, y cada plano posterior recibe esa hoja.
Tres notas prácticas:
No describas la cara con texto. «Treinta y tantos, pelo negro corto, barba de dos días» generará cien personas distintas. Deja la cara a la imagen de referencia; el prompt solo lleva lo que cambia en ese plano.
Genera la espalda y el perfil desde el principio. Si esperas a llegar al plano en que se aleja, lo más probable es que ya no sea el mismo hombre que de frente.
Mete la ropa en cada prompt. La consistencia del personaje no es solo la cara: deja que se desvíe el color o el corte del abrigo y el público sigue viendo el corte. Cumple esos tres puntos y la consistencia del personaje de un cortometraje con IA está prácticamente resuelta.
¿Cómo se empalman los planos sin que salten?
El método que menos esfuerzo pide es convertir el último fotograma de un plano en el primer fotograma del siguiente.

Esos dos fotogramas son la primera y la segunda mitad del mismo tiempo: a la izquierda mira la nota, a la derecha ha levantado la cabeza hacia la ventana. El encuadre no se ha movido, la dirección de la luz no se ha movido, el etalonaje no se ha movido; solo cambian el ángulo de la cabeza y hacia dónde mira. Montados juntos se leen como una única reacción continua.
Pasa los dos por primer y último fotograma a vídeo como puntos de inicio y fin y deja que el modelo rellene el hueco. Es mucho más estable que pedirle a un modelo que «interprete» una acción completa, y además protege la consistencia del personaje, porque has fijado los dos extremos.
Dos detalles del empalme se pasan por alto, y cuestan más en rodaje con IA que en rodaje real porque no se arreglan en el set. La dirección de la luz tiene que coincidir. Si la luz venía de la izquierda, no puede venir de la derecha en el plano siguiente: el público no sabrá decir qué falla, pero lo notará. El etalonaje tiene que coincidir. Mis ocho planos llevan «amanecer frío» en el propio prompt; no contaba con arreglarlo después.
¿Cómo revisar todos los planos de una vez y rehacer solo los malos?
Abrir las imágenes de una en una te engaña. Cada una parece bien por separado; solo en secuencia notas que la cara se desvió en el plano tres.
Extiendo los ocho en el lienzo generativo, en orden, en una sola fila, y me alejo. Los problemas de consistencia del personaje se cazan mejor en fila: una cara desviada o una luz mal puesta salta a la vista de una pasada. Ese único hábito eliminó casi todo el retrabajo de mi proceso de rodaje con IA: relanzo solo la celda que está mal en lugar de reconstruir la secuencia.

Estos son mis ocho definitivos. La mano del plano tres se relanzó dos veces; el contraluz del plano siete llevó un ajuste de exposición.
¿Y el sonido?
Las imágenes están listas a estas alturas, pero un cortometraje con IA sin sonido no aguanta a nadie más allá de 30 segundos.
El mío no tiene diálogo, así que solo pedía ambiente. Con diálogo, el orden es: generar la voz con texto a voz, o clonar un timbre fijo con clonación de voz, y después pasar la sincronización labial para ajustar la boca.
No invierta ese orden. Si haces las imágenes primero, verás que los movimientos de boca y la longitud de las frases no cuadran; fija la duración del audio primero y genera los fotogramas para encajar en él, y retrabajarás mucho menos. Dejar el audio para el final es el error de secuencia más común en el rodaje con IA.
¿Dónde está el límite para que una imagen se mueva?

Esos cinco segundos salen del plano de arriba: respiración, un parpadeo, la mirada moviéndose un poco, un leve ceño.
Pedí tres veces que «se diera la vuelta y caminara hacia la puerta» y se deformó todas: a los dos pasos ya no es él. Así que la frontera está clara: las reacciones pequeñas en el sitio son fiables; pedirle a un personaje que se desplace o haga una acción compleja todavía no. Para los planos que necesitan movimiento genero primero el fotograma final e interpolo, en vez de dejar que el modelo lo actúe.
Tres fallos, contados con honestidad
El texto en cuadro es falso. Amplía mi primer plano de la nota y la «letra» del papel es un galimatías: los modelos de generación no producen texto legible, lo que descarta en silencio toda una categoría de planos en el rodaje con IA. O no lo ruedas nítido (desenfocado, medio tapado) o pegas texto real después.
Las manos siguen necesitando revisión una a una. En el plano de la mano en el bolsillo, la primera versión tenía un nudillo mal colocado; hicieron falta dos relanzamientos. Todo plano con manos en cuadro pasa por el zoom.
La acción continua pierde la cara. Como decía arriba: un desplazamiento de más de dos o tres segundos casi siempre se rompe, y la consistencia del personaje es lo primero que cae.
La lista de ocho planos para copiar
Trabaja en este orden y no tendrás que volver atrás:
- Parte la historia en una frase por plano, cada una con escala, acción y luz
- Genera un storyboard basto y recorta hasta dejar solo los planos necesarios
- Construye la hoja de personaje para fijar la consistencia: frente, tres cuartos, perfil, espalda
- Genera plano a plano desde el board, dando la hoja cada vez, con el etalonaje escrito en cada prompt
- Donde los planos empalmen, produce primero el fotograma final y luego el primero
- Extiende todo en el lienzo y compara en fila; relanza solo lo roto
- Fija la duración del audio y después ajusta los fotogramas al audio
- Amplía manos, orejas y cualquier texto en cuadro
Los ocho planos completos me llevaron unas tres horas, la mayor parte escribiendo prompts y eligiendo tomas más que esperando la generación. La consistencia del personaje y los empalmes se hacen casi el doble de rápido cuando ya los has hecho unas cuantas veces.
Esto ya vale para cabeceras, piezas de concepto y material de presentación. Para una entrega comercial acabada seguiría rodando de verdad y usaría IA para completar planos. Si quieres recorrer tú mismo el proceso de rodaje con IA, la generación de vídeos con IA es el sitio por donde empezar: una frase basta para arrancar.