Comparativa de modelos de video / Empieza aquí

Empieza aquí

Lo esencial del panorama, las tres formas de darle una imagen a un modelo, y qué modelo usar según lo que quieras hacer hoy.

Lo esencial

Si solo lees una sección, que sea esta

China domina el arena

En Artificial Analysis, 4 de los 5 primeros lugares en texto-a-video son chinos: Wan 3.0, MiniMax H3, Seedance y HappyHorse. El único que les pelea es Google con Gemini Omni Flash.

Sora está muerto

OpenAI cerró la app de Sora el 26 de abril de 2026 y apaga la API el 24 de septiembre. No hay sucesor anunciado. Si dependes de Sora 2, migra ya.

El techo subió a 30 s y 4K

Seedance 2.5 y Wan 3.0 generan 30 segundos en una sola toma. Seedance y Kling 3.0 ya dan 4K nativo; Seedance además con color 10-bit.

El audio nativo ya es estándar

Diálogo, SFX y música sincronizados en la misma pasada ya son lo normal: Seedance, Kling, Gemini Omni, Veo, Wan, H3, Vidu, LTX… Los que no lo tienen (Runway, Luma, Midjourney) se ven viejos.

Open source de verdad

LTX-2.5 (22B, 4K con audio) es el open weights occidental líder; Hunyuan 1.5 es el más accesible (corre en 14 GB de VRAM); Wan 2.2 sigue siendo el rey Apache 2.0.

Magnific tiene casi todo

De tus agregadores, Magnific (antes Freepik) es el catálogo más completo (52 modelos de video), incluyendo Runway y Sora 2 mientras dure. Seedance 2.5 y Gemini Omni Flash están en los tres: Magnific, Higgsfield y OpenArt.

Conceptos clave

Las 3 formas de darle una imagen a un modelo

🖼️🎬

1 · Primer frame

Tu imagen ES el fotograma 1 del video: mismo encuadre, mismo fondo, y de ahí todo empieza a moverse. Sirve para "dale vida a esta foto". Si además le das una imagen de cierre, eso es el start/end frame: el video viaja de una a la otra.

En OpenArt: image2video · En docs: I2V, first frame

🧑+👟🎬✨

2 · Referencia de imagen

El modelo usa tu imagen como "ingrediente": toma la identidad del personaje, producto o estilo y lo pone en una escena nueva que describe tu prompt. "Este perro, pero corriendo en la selva". No queda amarrado al encuadre original.

En OpenArt: element2video · En Veo: ingredients · En fal: reference-to-video

🖼️+🎞️+🎤🎬🔊

3 · Referencia omni

El modo pro: además de imágenes, el modelo acepta video (para copiar movimiento o continuar una escena) y audio (para clonar una voz o marcar el ritmo). Seedance, Kling Omni, MiniMax H3, Wan y SkyReels V4 juegan aquí.

En Seedance/Kling: OmniReference · La matriz lo marca como "Refs video / audio"

T2V
Texto-a-video: escribes el prompt y el modelo inventa todo.
Audio nativo
El modelo genera diálogo, música y efectos sincronizados en la misma pasada — no le pegas el audio después.
Open weights
Puedes descargar el modelo y correrlo en tu propia GPU (casi siempre NVIDIA, no Mac). Ojo: suele venir con condiciones de licencia.
API
Usar el modelo desde código o apps externas pagando por segundo, sin la interfaz oficial.
Crédito
La moneda interna de Magnific/Higgsfield/OpenArt. Cada plataforma cobra distinto por el mismo modelo.
ELO / Arena
Ranking por votos ciegos entre pares de videos (Artificial Analysis, LMArena). Mide preferencia, no verdad absoluta.

Por dónde empezar

¿Qué quieres hacer hoy?

Hailuo 2.3

150 créditos · 6 s · 768p

El secreto mejor guardado de Magnific: físicas y emoción facial de sobra por una fracción del precio. Empieza aquí siempre.

MiniMax H3

460 créditos · 5 s · 768p (2K cuesta más)

El #1 de imagen-a-video en el arena. Cuando el clip barato no te dio la actuación que querías.

Grok Imagine 1.5

1,400 créditos en Magnific · mejor: gratis en la app Grok

Rapidísimo y fiel a la foto — pero en Magnific sale caro. Úsalo en grok.com/imagine, donde regalan generaciones.

Seedance 2.5

2,200 créditos · 5 s · 720p (30 s cuesta más)

30 segundos en una toma y hasta 50 referencias: tu character sheet, la escena y la voz entran juntos. El máster final.

Kling 3.0 Omni

450 créditos · 5 s · 720p

Referencias de personaje desde imagen o video y clonación de voz, a una fracción del precio de Seedance.

Seedance 2.0 Mini

700 créditos · 5 s · 720p

Mismo sistema de referencias que sus hermanos caros. Boceta aquí las tomas y regenera solo la ganadora en grande.

Kling 3.0 (modo 4K)

desde 525 créditos en 720p; el modo 4K cuesta más

4K nativo real a 60 fps. Para el plano final que va al proyector, no para iterar.

Seedance 2.5 / 2.0

2.0 en modo std da 4K (1,400 cr en 720p); 2.5 es 4K 10-bit nativo en su casa

Ojo con el matiz: en Magnific, Seedance 2.5 llega a 1080p — su 4K nativo con color 10-bit vive en Dreamina y en la API.

Veo 3.1

1,500 créditos · 5 s · 720p (4K en tiers altos)

4K con ingredientes, first/last frame y Extend. El caro confiable de Google.

LTX-2.5

400–600 créditos (1080p en Magnific) · 4K HDR en local

El open weights que da 4K HDR nativo — gratis si lo corres en tu propia GPU.

Ojo con el "4K" de muchas plataformas: varios modelos no lo tienen nativo — generan primero en 720p o 1080p y después hacen upscale (Gemini Omni escala a 1080p, Firefly a 4K, y Magnific o Higgsfield ofrecen upscalers como Topaz para cualquier clip). Un buen upscale se ve muy bien, pero no inventa el detalle que un 4K nativo sí captura desde el origen.

Kling 2.5

140 créditos · 5 s · 720p

La ganga absoluta del catálogo. Sigue rindiendo para el 80% del contenido social. 15 clips de Kling 2.5 = 1 clip de Seedance 2.5.

Wan 2.2

160 créditos · 5 s · 720p

Casi regalado y con estética sólida. Ideal para probar 10 variaciones de un mismo prompt sin dolor.

PixVerse V6

600 créditos · 5 s · 720p

Multi-shot con audio y plantillas virales cuando el clip barato necesita más producción.

Kling 3.0

525 créditos · 5 s · 720p

Audio nativo en español confirmado (con acentos), y en Omni clonas una voz desde 3 segundos de muestra.

Seedance 2.5

2,200 créditos · 5 s · 720p

Diálogo con lip-sync en 10+ idiomas y control fino con referencias de audio. Para el video hablado importante.

Veo 3.1

1,500 créditos · 5 s · 720p

Diálogo multiidioma sincronizado. La tercera vía cuando los dos anteriores no dieron el tono.

LTX-2

400–600 créditos en Magnific · gratis en tu GPU

Open weights con 4K y audio en una pasada; corre en una RTX 4090. El open source occidental serio.

Hunyuan 1.5

Gratis en local · 14 GB de VRAM

Apache 2.0 de verdad y soporte nativo en ComfyUI. Sin audio y a 720p, pero para aprender el pipeline no hay mejor puerta.

Wan 2.2

160 créditos en Magnific · gratis en local

El rey Apache 2.0: lo mismo lo corres en casa que lo pagas baratísimo hosteado.

Regla de oro del Club: boceta barato, masteriza caro. Itera el prompt en Kling 2.5, Wan 2.2 o Hailuo 2.3 (140–210 créditos el intento) y cuando la toma funcione, regenérala una sola vez en el modelo caro. Equivocarte en Seedance 2.5 cuesta 15 intentos de Kling 2.5.