Club de la IA · Clase 2 · Módulo Video

El Video Cinematográfico con IA

Pasamos de la imagen al movimiento. Qué modelo usar y cuándo, cómo pensar tus prompts de video, los modos de entrada, character sheets para mantener personajes, y las herramientas que uso para producir tomas de nivel cine.

Seedance vs Kling 3.0 GPT-5.6 Sol Modo OMNI Character Sheet
// 01 · Los modelos

Seedance vs Kling 3.0

No hay un modelo "mejor" — hay el correcto para cada toma. Esta es mi guía personal de cuándo uso cada uno.

VS
Seedance — acción y VFX
Seedance · Acción · VFX · Potencia

Seedance

Ideal para: escenas de acción, VFX, tomas con cortes entre planos, y generar planos extra de una escena.

  • Muy potente — el más capaz para movimiento complejo
  • Calidad top, resultados muy limpios
  • Más caro que Kling
  • Muchas restricciones con personajes famosos / celebridades — a veces no funciona
💥 Acción✨ VFX✂️ Cortes$$ Caro
Kling — expresiones y lip sync
Kling 3.0 · Expresiones · Lip Sync · Omni

Kling 3.0

Ideal para: tomas con lip sync básico, expresiones faciales, y su modo Omni (muy útil).

  • Calidad 1080 sólida
  • Más barato que Seedance
  • Acepta cualquier rostro / celebridad · menos censura con violencia
  • No tan bueno en acción — algo de deformación / movimiento aún "de IA"
  • Un poco menos potente que Seedance
🗣️ Lip sync😐 Expresiones🧩 Omni$ Barato
🎯

Veredicto rápido

Seedance cuando manda la potencia, la acción o los VFX (y no dependes de una cara famosa). Kling cuando necesitas expresiones, lip sync, rostros específicos o cuidar el presupuesto. Muchos proyectos usan los dos: Kling para los primeros planos actorales, Seedance para los planos de acción.

// 02 · La herramienta de prompts

Recomiendo GPT-5.6 Sol

Para escribir prompts de video complejos (con reglas de filtros, límite de caracteres y formato por shots) conviene el modelo que mejor razona. Puedes usar el GPT personalizado SeedancePro o instalar la skill.

🟡
Sol
Buque insignia · máximo razonamiento
Recomendado
🟠
Terra
Equilibrio potencia / costo
🌙
Luna
El más rápido y económico

¿Por qué Sol?

  • Único con los controles de razonamiento profundo (max effort y modo ultra con subagentes)
  • Supera a Terra y a la generación previa en benchmarks de razonamiento y código
  • Ideal para tareas multi-paso como construir prompts estructurados con filtros y formato
  • Contra: es el más caro — pero vale la pena para prompts de calidad
Abrir GPT SeedancePro ↗
// 03 · Modos de entrada

¿OMNI o Frame Inicial?

La decisión depende de qué papel juega tu imagen en la toma: ¿es el primer fotograma exacto, o solo una referencia?

🎬

Frame Inicial

Cuando la escena empieza exactamente como está en tu imagen.

Tu imagen es el primer fotograma del video; el movimiento arranca desde ahí. (Nada de @: describe con palabras.)

🧩

OMNI (elementos)

Cuando la imagen es solo una referencia y la toma real empieza después o con modificaciones.

Tu imagen es una guía, no el punto de partida exacto. Puedes citar cada elemento con @image1, @image2

🔀

Transición

Cuando defines un frame inicial y uno final y quieres el recorrido entre ambos.

Marcas de dónde sale y a dónde llega la toma; el modelo construye la transición.

// 04 · A fondo

Entendiendo el Modo OMNI

El modo más versátil — y el que más resultados desbloquea. Vale la pena entenderlo bien.

✅ En Kling ✅ En Seedance

OMNI significa que la toma puede adquirir diferentes inputs a la vez para construirse. En vez de partir de un solo fotograma, combinas varias fuentes:

🖼️ Imagen 📝 Texto 🎬 Video 🔊 Audio · solo Seedance

¿Cuándo usar el modo OMNI?

🔄

Empezar distinto al primer frame

Si tu escena arranca con el sujeto mirando hacia abajo, pero tu imagen lo tiene mirando a cámara, OMNI hace que empiece desde el rostro abajo — y cuando el rostro sube, no lo deforma: ya conoce cómo es el personaje.

🧩

Componer sin ir shot por shot

Tienes elementos sueltos y no quieres crear todo plano por plano. Solo el escenario + el sujeto en un character sheet → una foto del entorno y una del personaje, y da un buen resultado.

Seedance
🎙️

Voz o lip sync con tu audio

¿Quieres la voz del personaje o un lip sync con un audio ya existente? Sube archivos de audio con una muestra de la voz — o la voz exacta que quieres usar.

🔗

Juntar 2 imágenes en una escena

Tienes dos imágenes con elementos separados y quieres que aparezcan juntos en una sola escena — sin tener que generar antes la imagen combinada. También se puede.

Seedance
⏭️

Extender una escena inconclusa

¿Una toma quedó incompleta o quieres alargarla? Puedes extenderla con el modo de Seedance (video extension / chaining).

📋 Prompt · Extender una escena

Toma como referencia los últimos 2 segundos de [@tuvideo] y extiende la escena con continuidad visual perfecta. La nueva toma debe comenzar exactamente en el último fotograma del video original, conservando al mismo sujeto, entorno, iluminación, encuadre y movimiento de cámara.

Sin cortes ni transiciones visibles, [describe lo que pasa en la escena]. Mantén movimientos fluidos, física realista y coherencia total con la velocidad, dirección y trayectoria de la escena original. No modifiques la apariencia del sujeto, su rostro, cuerpo, vestuario ni ningún elemento importante de la escena.

Reemplaza [@tuvideo] por tu video y [describe lo que pasa] por la continuación de la acción.

// 05 · Consistencia de personaje

El Character Sheet

Una hoja de personaje (close-up, cuerpo entero y perfil) es la mejor referencia para que tu personaje se mantenga idéntico en todas las tomas. Este es el prompt que uso para generarla.

📋 Prompt · Character Sheet (3 tomas)

Hoja de personaje de UN SOLO personaje, organizada en una única fila horizontal sobre un fondo blanco puro (#FFFFFF).
La fila contiene exactamente 3 tomas del MISMO personaje, en este orden exacto de izquierda a derecha:

1. CLOSE-UP DEL ROSTRO — retrato cerrado de frente, cámara perfectamente centrada a la altura de los ojos, mirada directa hacia el lente, expresión neutral, cabeza y hombros visibles, proporciones faciales precisas y detalles claros del rostro, piel y cabello.
2. CUERPO COMPLETO DE FRENTE — figura completa visible de pies a cabeza, de pie en una postura natural, brazos relajados a los costados, pies ligeramente separados, cuerpo completamente orientado hacia la cámara, cámara perfectamente centrada y a la altura de los ojos.
3. PERFIL LATERAL — vista lateral pura de 90 grados, cuerpo completo visible de pies a cabeza, cámara perfectamente alineada con el costado del rostro y del cuerpo, solo un ojo visible, brazos relajados, postura natural, con el cabello, la oreja, la nariz, la mandíbula, la silueta del vestuario y el calzado claramente visibles.

Las 3 tomas deben mostrar exactamente el mismo diseño de personaje, sin variaciones entre imágenes. Mantener idénticos los rasgos faciales, peinado, tono de piel, edad, proporciones corporales, vestuario, accesorios, materiales y colores de la imagen de referencia.
Usar iluminación de estudio neutral, suave, frontal y difusa en las 3 tomas, con sombras mínimas y sin contraste dramático. El fondo debe ser completamente plano, uniforme y blanco puro.
Las tomas deben estar distribuidas de manera uniforme en una composición horizontal limpia. Sin texto, sin etiquetas, sin bordes, sin marcos, sin objetos adicionales y sin otros personajes.
Usar [PERSONAJE DE REFERENCIA] como sujeto. Preservar con máxima precisión su identidad y apariencia visual en las 3 tomas.

Reemplaza [PERSONAJE DE REFERENCIA] por tu sujeto (o pásalo como imagen de referencia).

🎥

Otro uso favorito

Cuando tienes una toma muy abierta con todos los personajes y quieres que la cámara haga un close-up de cada uno, el character sheet lo hace posible: el modelo puede acercarse a cualquier rostro sin deformarlo, porque ya conoce cómo es cada personaje.

// 06 · La estructura

Las 5 categorías de un prompt de video

Un prompt de video sólido se arma por bloques. Estas son las categorías esenciales, en orden — desglosarlas así te da control total sobre la toma.

01

Tipo de toma

El género y estilo de la toma — define todo el look.

CinematográficoCasualAnimaciónStop motionAnuncio de producto
02

Sujeto y acción

Quién es, qué hace, e incluido su diálogo (siempre entre comillas).

enciende un cigarro y dice: "…"
03

Entorno y detalles

El lugar, la atmósfera y los detalles del set.

campo de tierra, cielo gris nublado
04

Movimiento de cámara

Cómo se mueve la cámara en la toma.

push-in lento · tracking · órbita
05

VFX / SFX

Efectos visuales y de sonido que ambientan la escena.

neblina, ruido de ciudad, lluvia
Ejemplo armado con las 5 categorías
Toma cinematográfica de un hombre con abrigo negro de los años 30 que enciende un cigarro y dice, en español latino con tono serio: "No vine a pedir permiso… vine a cobrar", de pie en un campo de tierra bajo un cielo gris nublado, con push-in lento de cámara y neblina fría flotando y ruido lejano de ciudad.
// 07 · Voz y diálogo

Dale voz a tus personajes

El modelo genera la voz automáticamente — pero tú tienes que decirle cómo debe decir las cosas. Ese detalle es lo que separa un diálogo plano de uno que se siente real.

🎧 Qué debes especificar

  • Idioma y acentoNo es lo mismo español latino que español de España o de Colombia. El acento cambia todo — indícalo siempre.
  • Tono de vozSerio, cálido, amenazante, cansado… el tono le da intención a la línea.
  • RitmoRápido y nervioso, o lento y pausado. Marca el pulso de la escena.
  • Pausas y micro-expresionesLos modelos ya son muy potentes: entienden una pausa, un suspiro o un titubeo dentro del diálogo y lo hacen más realista.
⚠️ Regla de oro

El diálogo SIEMPRE debe ir entre comillas "…". Así el modelo sabe exactamente qué debe pronunciar el personaje.

Ejemplo El sujeto mira a cámara y dice, en español latino, con tono serio y ritmo pausado, tras una breve pausa:

"No vine a pedir permiso… vine a cobrar."

📋 Prompt · Clonar voz con audio de referencia

Usa [Audio1] como referencia de voz y genera el siguiente diálogo manteniendo exactamente el mismo tono, timbre, acento, ritmo e intención. La frase que dice es: "[Tu dialogo]"

Acento latino, debe sonar natural, expresiva y perfectamente integrada con el audio de referencia, sin alterar la identidad de la voz.

Reemplaza [Audio1] por tu archivo de voz y [Tu dialogo] por la frase (entre comillas). Ideal con el modo OMNI de Seedance.

Del prompt al movimiento

La misma estética que trabajamos en la Clase 1, ahora respirando: cámara, luz y grano fílmico en movimiento.

// 08 · Ejemplos

Tomas en movimiento

Ejemplos reales generados con estos flujos — mismo personaje y estética cinematográfica de la Clase 1.

Ejemplo 01 · Frame inicial
Plano medio, luz de día nublado
Ejemplo 02 · Movimiento de cámara
Estética 35mm, grano fílmico
// Bonus · Tu regalo

Llévate la skill de video

La skill SeedancePro para dominar Seedance 2.0: modos de entrada, reglas de filtros, formato por shots, límite de caracteres y consistencia de personaje. Instálala en Claude Code o úsala como GPT.

Gratis para el Club
Recursos

SeedancePro

Convierte tu idea en un prompt de video profesional con el formato de 6 secciones, reglas de filtros y límite de 1,990 caracteres — listo para Seedance 2.0.

  • Elige el modo: Omni / Frame inicial / Transición
  • Prompts filter-safe por construcción
  • Consistencia de personaje con World ID + character sheets
📄
SKILL.md
seedancepro · 24 KB
Descargar la skill ↓ Usarla en ChatGPT ↗
Para Claude Code: colócala en ~/.claude/skills/seedancepro/ y reinicia. Recomendado correr con GPT-5.6 Sol.

Esta es la Clase 2

Imagen + video, cada semana en vivo. +250 creativos aprendiendo a producir cine con IA de verdad.

Unirme al Club · $35/mes ↗