Cómo escribir un prompt para generar imágenes con IA

Un prompt no es una búsqueda: es una descripción. Los modelos de imagen no interpretan intenciones, reconstruyen lo que se les describe. Cuanto más completa sea la descripción, menos decisiones toma el modelo por su cuenta.

La estructura pesa más que las palabras sueltas

Acumular adjetivos rinde poco. Lo que mejora un resultado es cubrir los bloques que el modelo necesita resolver de todos modos: si no le dices de dónde viene la luz, la elige él. Cada bloque que dejas vacío es una decisión que cedes.

Los siete bloques

No hace falta usarlos todos en cada prompt, pero conviene recorrerlos mentalmente antes de generar. Los que más cambian el resultado por cantidad de texto son iluminación y cámara.

  • Sujeto — Qué o quién aparece, con rasgos concretos: edad aparente, vestimenta, expresión. Es lo primero que el modelo fija.
  • Acción / pose — Qué está haciendo y hacia dónde mira. Sin esto el modelo elige una pose neutra por su cuenta.
  • Entorno — Lugar, época y elementos de fondo. Define el contexto que da sentido al sujeto.
  • Iluminación — Tipo de luz, dirección y temperatura de color. Es el bloque que más cambia el resultado por unidad de texto.
  • Cámara — Plano (primer plano, plano medio, gran angular), lente, ángulo y profundidad de campo. Controla el encuadre.
  • Estilo — Medio (fotografía, ilustración, 3D), referencia estética, grano y paleta de color.
  • Calidad — Detalles de acabado. Conviene no abusar: repetir "8k ultra detailed masterpiece" no mejora nada en los modelos actuales.

El límite de 2000 caracteres

El prompt se recorta a 2000 caracteres sin ningún aviso. No aparece un error ni una advertencia: lo que sobra simplemente no llega al modelo. Si escribes un prompt muy largo y el resultado ignora el final, esa es la causa. Los saltos de línea se conservan; los caracteres de control se eliminan.

Un ejemplo completo

Este prompt cubre los siete bloques y produce un resultado predecible. Fíjate en la última línea: nombrar lo que NO se quiere es tan útil como describir lo que sí, sobre todo para evitar que el modelo derive hacia el fotorrealismo cuando se busca ilustración.

Ilustración estilo anime, plano medio, vertical 3:4.

SUJETO — Mujer de unos veinte años, cabello cobrizo largo, ojos turquesa
luminosos, campera de campo verde oliva con el cuello levantado.

POSE — De tres cuartos hacia la cámara, mirada directa, mentón apenas alzado.

ENTORNO — Filo de montaña en el último minuto del atardecer, el valle
cayendo por detrás reducido a bruma cálida.

VIENTO — Ráfaga fuerte: el cabello cruza el encuadre en diagonales marcadas.

ILUMINACIÓN — Sol bajo y duro justo detrás de la cabeza, halo encendido en
el pelo, sombras ámbar en el rostro, destello de lente horizontal.

CÁMARA — Ángulo bajo, equivalente a 50 mm, sujeto ligeramente descentrado.

ESTILO — Fotograma de anime cinematográfico, alto contraste, paleta cálida
aplastada hacia el naranja, ojos turquesa como único acento frío.

EVITAR — fotorrealismo, render 3D, iluminación plana, fondo recargado,
anatomía incorrecta, manos deformes.

Cada modelo responde distinto

Un modelo orientado a diseño interpreta el vocabulario del diseño; uno fotográfico responde a lente y apertura. Antes de escribir conviene mirar la ficha del modelo que vas a usar: cada una incluye para qué sirve mejor y sus propios consejos de prompt.