DIVERGENTES Acceso gratis
El libro 2.ª edición

Comparativa · 9 modelos · mismo prompt · oct. 2026

Los mejores modelos de imagen para crear el primer fotograma de tu vídeo con IA

En el vídeo con IA, el primer fotograma decide casi todo. Por eso probamos nueve modelos de imagen con el mismo prompt.

Modelos probados
9 con el mismo prompt
Texto en imagen
6 modelos, todos escribieron bien el título
Edición con referencia
4 modelos, todos mantuvieron al personaje
Coste por imagen
Entre 50 y 200 créditos de Magnific (oct. 2026)
Dónde
Todos disponibles en Magnific (antes Freepik)

Por qué el primer fotograma importa tanto

Cuando generas vídeo a partir de una imagen, el modelo hereda de ella el personaje, la luz, la paleta, el encuadre y el estilo. Si la imagen es mediocre, el vídeo también lo será. Por eso en un flujo profesional se dedica tanto tiempo al fotograma inicial como al propio vídeo.

Además, generar imágenes es muchísimo más barato que generar vídeo: puedes probar diez fotogramas por el precio de un clip y elegir el mejor antes de animarlo.

La prueba: nueve modelos, el mismo prompt

Pedimos a nueve modelos la misma escena: una detective con gabardina roja en un muelle mojado, de noche, mirando el haz de un faro bajo la lluvia. Los modelos fueron Seedream 5 Pro, Nano Banana Pro, GPT 2, Flux.2 Max, Recraft V4.1, Ideogram 4, Mystic 2.5, Luma Uni-1.1 y Grok.

  • Todos entendieron la escena, pero con estilos muy distintos: unos más fotográficos, otros más ilustrativos.
  • Las diferencias más grandes estuvieron en la luz (cómo resuelven el haz del faro y los reflejos de neón) y en la composición.
  • Los precios fueron de 50 a 200 créditos por imagen, una minucia comparada con el vídeo.

Runway Gen-4 (imagen) quedó fuera porque exige una imagen de referencia, y lo sustituimos por Grok.

Texto dentro de la imagen y edición con referencia

Hicimos dos pruebas más. En la primera pedimos un póster de cine con el título «LLUVIA ROJA», el lema «Siempre vuelve a la luz» y la palabra «PRÓXIMAMENTE». Los seis modelos probados (GPT 2, Ideogram 4, Nano Banana Pro, Seedream 5 Pro, Recraft V4.1 y Flux.2 Max) escribieron bien el texto, tildes incluidas. En 2024 esto era impensable.

En la segunda usamos una foto de la detective como referencia y pedimos colocarla en una cafetería de los años cincuenta. Seedream 5 Pro, Nano Banana Pro, Flux.1 Kontext Max y GPT 2 mantuvieron al personaje en los cuatro casos. Es la técnica que usamos para crear todos los fotogramas de nuestros ejercicios.

Cómo crear un fotograma inicial que luego anime bien lo explico paso a paso en el libro, y el contexto de cada herramienta está en el capítulo «Mapa de herramientas y grandes plataformas».

Mismo prompt, nueve modelos

Texto dentro de la imagen: el póster «Lluvia roja»

PROMPT DE EJEMPLO

Cinematic film still, photorealistic. A woman detective in her thirties with short dark wavy hair and a bright red raincoat stands on a wet harbour pier at night in the rain, looking up as the beam of a distant lighthouse sweeps across the stormy sky. Teal and magenta neon reflections, light fog, 35mm lens, shallow depth of field, subtle film grain. No text.

El prompt exacto de la prueba: sujeto, acción, entorno, luz, lente y estilo.

Portada del libro Vídeo con Inteligencia Artificial

Segunda edición · actualizada a 2026

Del prompt al plano: el manual completo

Lenguaje de cine, prompts listos para copiar, Kling, Seedance, Veo y Wan, consistencia de personajes, edición, la ley europea al día y un proyecto real paso a paso. Cada capítulo tiene un QR que te trae a los vídeos de esta web.