GLM-5.3 FlashX and MiniMax H3 Max are now live on CometAPI →
guide/Investigación de CometAPI

Cómo redactar prompts para GPT Image 2.5 como un profesional

Aprende a escribir mejores prompts para GPT Image 2.5 con fórmulas reutilizables, ejemplos prácticos, flujos de trabajo con imágenes de referencia y consejos de edición precisos.

CometAPI
AnnaEquipo de investigación de modelos de IA y API
Actualizado Sep 21, 2026 16 min de lectura
Cómo redactar prompts para GPT Image 2.5 como un profesional
Usa este patrón

Haz la primera llamada a la API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR GPT Image 2.5 cambia la redacción de prompts para imágenes en un aspecto importante: un buen prompt ya no describe solo lo que quieres crear. Para la edición y la generación basada en referencias, también debe definir lo que no debe cambiar.

Esto importa porque GPT Image 2.5 está diseñado para una edición más precisa y una preservación de referencia más sólida. OpenAI afirma que el modelo es mejor cambiando solo el elemento solicitado mientras mantiene intactos el sujeto, la composición y los detalles circundantes.

Buen prompt de GPT Image 2.5 = Entregable + Sujeto + Escena + Composición + Dirección visual + Texto exacto + Restricciones + Salida

Buen prompt de edición = Objetivo de cambio + Lista de elementos a preservar + Reglas de integración + Exclusiones + Salida

La segunda fórmula es especialmente importante. En lugar de decir “Change the background to a beach”, escribe: “Reemplaza únicamente el fondo por una playa mediterránea tranquila al atardecer. Mantén sin cambios a la persona, el rostro, la pose, la ropa, la posición de la cámara, el encuadre, la dirección de la iluminación y el primer plano”.

Conclusiones clave

  • GPT Image 2.5 mejora la fidelidad y la consistencia multivuelta, el renderizado de texto y la velocidad; Flare es el punto de partida recomendado para la mayoría de los usuarios.
  • Fórmula central de generación: Entregable + Sujeto + Composición + Estilo + Texto exacto (entre comillas) + Restricciones/Exclusiones.
  • Para ediciones, la regla de oro es “Cambia solo X. Conserva [lista completa de identidad, pose, iluminación, geometría, texto, estilo]”.
  • Varias imágenes de referencia funcionan cuando a cada una se le asigna un trabajo explícito (sujeto, vestuario, fondo, paleta, etc.).
  • Fondos transparentes, tipografía exacta y edición secuencial son notablemente más sólidos cuando se redacta correctamente el prompt y se configuran bien los parámetros.
  • Flare prioriza la velocidad y el volumen; Sunburst prioriza la precisión de edición y la fidelidad del activo final. Ambos comparten las mismas tarifas por token.
  • CometAPI ofrece acceso unificado y rentable a gpt-image-2.5-flare y gpt-image-2.5-sunburst a través de rutas compatibles con OpenAI.

Qué es GPT Image 2.5

OpenAI lanzó ChatGPT Images 2.5 el 8 de septiembre de 2026. La actualización se centra en detalles más nítidos, iluminación y textura más naturales, fidelidad a las imágenes de referencia, ediciones precisas y mayor consistencia a lo largo de múltiples turnos de edición. OpenAI también reporta hasta un 50% menos de latencia de generación de imágenes en comparación con Images 2.0.

Para desarrolladores, la familia se divide en dos modelos de API:

  • GPT-Image-2.5 Flare: optimizado para generación rápida, de alta calidad, y flujos de trabajo de alto volumen.
  • GPT-Image-2.5 Sunburst: optimizado para flujos de trabajo exigentes de generación y edición donde la precisión importa más que la latencia.

Los desarrolladores también pueden usar la API de GPT Image 2.5 en CometAPI, incluyendo los identificadores de modelo gpt-image-2.5-flare y gpt-image-2.5-sunburst.

Benchmark y capacidades

Benchmark de texto a imagen de ArenaGPT Image 2.5 SunburstGPT Image 2.5 FlareGPT Image 2
Puntuación de texto a imagen1421 ± 131399 ± 131381 ± 4
Posición de texto a imagen#1#2#3
Puntuación de edición de imagen única1520 ± 91491 ± 91461 ± 3
Posición de edición de imagen única#1#2#3

Pruebas independientes y primeros rankings de Arena situaron ambos modelos en la cima de las tablas de texto a imagen y edición de imágenes poco después del lanzamiento, con ganancias claras en composición, detalle, fidelidad de estilo, preservación del sujeto y velocidad (Flare a menudo finaliza en ~20–40 segundos frente a generaciones anteriores significativamente más largas en algunos benchmarks).

Las capacidades clave incluyen entradas de texto + imagen, salidas de imagen de hasta aproximadamente 4K (con restricciones: bordes múltiplos de 16, máximo ~3840 px por lado, relación de aspecto ≤ 3:1), fondos transparentes (PNG/WebP), niveles de calidad (low → max), vistas previas progresivas, inpainting/edición específica por áreas y sólido soporte para múltiples referencias y edición secuencial. OpenAI reporta más de 3 mil millones de imágenes creadas semanalmente en ChatGPT Images y la familia de API GPT-Image.

Fórmula general para generación y edición en GPT Image 2.5

La regla más importante: cambiar vs. conservar

Este distinción es el hábito de mayor impacto en GPT Image 2.5.

Generación (nueva imagen a partir de texto o referencias)
Describe todo lo que quieres que aparezca. Sé concreto sobre el sujeto, el encuadre, la iluminación, los materiales, los colores y lo que no debe aparecer.

Edición (image-to-image o refinamiento multivuelta)

  1. Nombra exactamente un cambio.
  2. Enumera explícitamente todo lo que debe permanecer sin cambios (identidad, pose, ángulo de cámara, encuadre, dirección de la luz, sombras, elementos de fondo, texto existente, colores, geometría, estilo general).
  3. Describe cómo el nuevo elemento debe integrarse con la luz, la perspectiva, la textura y las sombras de contacto existentes.
  4. Añade exclusiones claras (sin texto adicional, sin logos, sin marcas de agua, sin retoque pesado).

Prompts vagos con múltiples cambios o listas de preservación incompletas provocan deriva acumulativa. Reitera la lista de preservación en cada turno. Cuando una región deba permanecer píxel a píxel idéntica, compón la edición local aprobada de vuelta en el máster original en lugar de confiar por completo solo en el modelo.

Esqueleto mínimo de generación

[Entregable / uso previsto] + Sujeto + Composición + Estilo / iluminación / materiales + Texto exacto entre comillas + Restricciones y exclusiones

Esqueleto mínimo de edición

Cambia solo [elemento específico] a [nueva descripción]. Conserva [identidad, pose, encuadre, iluminación, sombras, fondo, texto, colores, estilo]. Haz que el nuevo elemento coincida con la luz y la geometría existentes. No añadas [elementos no deseados].

Cómo funcionan los prompts en GPT Image 2.5

La guía oficial de prompts de OpenAI es directa: comienza por la imagen que necesitas, luego describe el sujeto, la composición, el estilo y las restricciones. Para ediciones, separa claramente el cambio solicitado de los detalles que deben permanecer iguales. Refina un aspecto a la vez e inspecciona cada resultado. Estructura los prompts como Sujeto → Composición → Estilo → Texto (entre comillas) → Restricciones. Asigna roles claros a cada imagen de referencia, itera un cambio a la vez y configura tamaño/calidad/fondo como parámetros de la API en lugar de texto en el prompt.

Sujeto

Nombra a la persona, objeto o escena principal con detalles visibles y verificables: apariencia, vestimenta, pose, acción, escala relativa e interacción con objetos.
Ejemplo: “Una joven archivista con una melena corta castaña rojiza, gafas redondas negras y una bata de trabajo azul marino sosteniendo un sobre de papel sellado con un emblema de luna en cera roja”.

Composición

Especifica el encuadre, la altura y el ángulo de la cámara, la ubicación del sujeto (centrado, tercio izquierdo, etc.), el espacio negativo, la profundidad de campo y lo que debe ser visible (cuerpo completo con pies, plano medio, etc.).
Ejemplo: “Cuerpo completo, pies visibles, cámara a baja altura a nivel de ojos. Personaje en el tercio izquierdo; estanterías infinitas de archivo se pierden detrás de ella. Espacio limpio y oscuro en la parte superior derecha para colocar un título más adelante.”

Estilo

Describe el medio visual, la iluminación (fuente + dirección), los materiales, la paleta de colores, la textura y el nivel de realismo. Prefiere lenguaje visual concreto sobre adjetivos de ambiente. Pide explícitamente “fotorrealista”, “fotografía real”, grano de película o un estilo artístico nombrado cuando sea necesario.
Ejemplo: “Fondo de anime pintado a mano con detalle, sombreado cel moderado, proporciones naturales. Una lámpara de escritorio cálida frente a luz azul de luna fría procedente de ventanas altas.”

Texto

Coloca cada cadena requerida entre comillas. Especifica ubicación, jerarquía, tipografía aproximada y cuántas veces debe aparecer el texto. Deletrea nombres inusuales o de marca letra por letra cuando sea crítico. Solicita siempre “sin otro texto”.
Ejemplo: el titular "Abierto hasta tarde" en tipografía sans condensada en negrita a lo largo del tercio superior, y "De jueves a domingo" en un tamaño menor en la parte inferior. Sin otro texto.

Restricciones / Exclusiones

Enumera lo que no debe aparecer y lo que debe permanecer sin cambios. Exclusiones de alto valor incluyen sin texto adicional, sin logos, sin marcas de agua, y sin objetos no deseados.

Para solicitudes más largas o complejas, usa secciones etiquetadas (ESCENA / SUJETO / ESTILO / TEXTO / RESTRICCIONES). Esto mejora la legibilidad y facilita mantener ediciones posteriores.

Nota técnica crítica: establece el modelo, la calidad, el tamaño (o aspecto) y el fondo (auto / opaco / transparente) como parámetros de la API. No confíes en el texto del prompt para imponer resolución o transparencia.

¿Cómo usar múltiples imágenes de referencia con GPT Image 2.5?

GPT Image 2.5 acepta múltiples entradas de imagen. Los resultados mejoran drásticamente cuando a cada referencia se le asigna un rol explícito.

Patrón recomendado:

  1. Numera o nombra claramente cada imagen de referencia.
  2. Indica su función precisa: identidad del sujeto principal, referencia de ropa/estilo, fondo/escenario, solo paleta de color, referencia de iluminación, etc.
  3. Describe cómo deben combinarse los elementos y qué partes se mueven dónde.
  4. Reitera las restricciones de preservación para el sujeto principal y cualquier detalle protegido.

Ejemplo: “Usa la imagen 1 como el producto (botella de agua negra mate con el texto exacto de la etiqueta). Usa la imagen 2 solo para la repisa de concreto pálido y la dirección de iluminación natural. Coloca la botella de la imagen 1 sobre la repisa de la imagen 2, igualando las sombras suaves y el ángulo de luz existentes. Preserva la forma exacta de la botella, el texto de la etiqueta, los colores y los reflejos. No cambies la textura del concreto ni añadas objetos adicionales.”

Una asignación clara de roles evita hibridaciones no deseadas de sujetos o estilos.

Técnicas avanzadas de redacción de prompts

Guía de texto exacto y tipografía

  • Coloca siempre las cadenas requeridas entre comillas.
  • Especifica posición, jerarquía, peso y estilo aproximados, y cuántas veces debe aparecer el texto.
  • Solicita “sin otro texto”, “sin logos” y “sin marcas de agua”.
  • Para diseños densos o múltiples fuentes, prueba calidad media o alta y verifica visualmente la ortografía y legibilidad en la salida.
  • Los nombres de marca críticos pueden deletrearse letra por letra para mayor fiabilidad.

Fondos transparentes

Configura background="transparent" en la llamada a la API (o el control equivalente en la interfaz) y solicita salida PNG o WebP. Pide explícitamente bordes limpios y nada detrás del sujeto. Inspecciona el canal alfa cuidadosamente alrededor de cabello, vidrio, detalles finos y áreas de contacto. Añade exclusiones como “sin elementos de fondo, sin sombras proyectadas a menos que se soliciten”. La generación transparente es significativamente más fiable en 2.5 cuando el parámetro y las restricciones del prompt son correctos.

Flujo de trabajo de edición multivuelta

  1. Parte de una generación base sólida o de una referencia aprobada.
  2. Alimenta la salida previa como la nueva imagen de entrada.
  3. Solicita exactamente un cambio.
  4. Reitera la lista completa de preservación en cada turno.
  5. Inspecciona el resultado antes de continuar.
  6. Para regiones que deben permanecer perfectas a nivel de píxel, compón la edición local aprobada en el máster original.

Este ciclo disciplinado aprovecha al máximo la mejorada consistencia multivuelta de GPT Image 2.5 minimizando la deriva acumulativa.

Flare vs. Sunburst: ¿qué modelo encaja con cada prompt?

CriterioGPT-Image-2.5 FlareGPT-Image-2.5 Sunburst
Fortaleza principalVelocidad + alta calidad cotidianaPrecisión de edición y fidelidad del activo final
LatenciaHasta ~50% menor que GPT Image 2Tiempos de generación más largos
Mejores casos de usoContenido social, prototipado, alto volumen, iteración rápidaCampañas de producción, fotografías de producto pulidas, ediciones complejas multivuelta
Calidad vs GPT Image 2MayorMáximo control / preservación más estricta
Punto de partida recomendadoLa mayoría de los flujos de trabajoCuando la calidad o la precisión de edición sea el cuello de botella
Tarifación por tokenLas mismas tarifas para ambosLas mismas tarifas para ambos
Fondos transparentes y niveles de calidadTotalmente soportados (low → max)Totalmente soportados

Regla práctica: explora ideas, genera variaciones e itera rápidamente con Flare. Cuando necesites la versión final pulida o cuando una secuencia de ediciones compleja empiece a derivar, vuelve a ejecutar el prompt + referencias + ajustes idénticos en Sunburst y compara. Muchos equipos de producción mantienen ambos modelos disponibles y dirigen el tráfico en consecuencia.

Plantillas de prompts (listas para adaptar)

1. Producto héroe limpio

Purpose: Ecommerce or landing-page hero, square or 4:5.
Subject: [exact product description including materials and any label text in quotes].
Composition: Centered or slight three-quarter view, soft contact shadow, generous negative space at top for headline.
Style: Clean studio lighting from the left, photorealistic, high texture detail.
Constraints: No extra text, no logos, no people reflections, seamless background.

2. Póster/Anuncio con texto exacto

A vertical poster. Headline “YOUR EXACT HEADLINE” in bold condensed sans-serif across the upper third. Subhead “Secondary line here” in smaller weight directly below. [Full scene and subject description]. [Style]. No other text or logos.

3. Edición precisa de un solo elemento

Change only the [specific element] to [new description]. Preserve the subject’s exact face/identity, pose, clothing details, camera angle, lighting direction, shadows, background, and all existing text. Match the new element’s lighting, perspective, and contact shadows to the original scene. Do not add any new objects, text, or watermarks.

4. Consistencia de personaje con múltiples referencias

Usa la imagen 1 para el rostro, las proporciones corporales y la identidad del personaje. Usa la imagen 2 solo para el atuendo y la textura de la tela. Coloca al personaje de la imagen 1 vistiendo el atuendo de la imagen 2 dentro de [descripción de la escena]. Igualar la dirección de la iluminación de la imagen 1. Preserva exactamente la identidad y la pose. Sin accesorios adicionales ni texto.

5. Recorte/Activo transparente

[Descripción detallada del sujeto] aislado sobre un fondo completamente transparente. Bordes limpios, sin sombra proyectada, sin elementos de fondo, sin sombra de contacto con el suelo a menos que se solicite explícitamente. Fotorrealista. Salida lista para composición.

Reemplaza las secciones entre corchetes con tus especificaciones y reitera siempre las restricciones en turnos de edición posteriores.

Por qué fallan los prompts

Patrones de fallo comunes y cómo arreglarlos:

  • Confiar en palabras de ambiente vagas (“acogedor”, “épico”, “premium”) sin detalle visual asociado → añade escala concreta, dirección de luz, materiales y color.
  • Incluir múltiples cambios en un solo prompt → limita a un cambio por turno.
  • Omitir o acortar la lista de preservación en ediciones posteriores → los detalles derivan; reitera la lista completa cada vez.
  • No colocar el texto exacto entre comillas o sin guía de ubicación/tipografía → aparecen palabras incorrectas o texto adicional.
  • Subir imágenes de referencia sin roles asignados → el modelo las mezcla de forma impredecible.
  • Esperar que un nivel de calidad superior compense una descripción débil → el prompt determina el resultado; la calidad afecta principalmente al refinamiento, coste y latencia.
  • Usar sintaxis especial, pesos o apilar palabras clave tipo “masterpiece 8K ultra detailed” → oraciones claras y ordenadas superan sistemáticamente el “keyword stuffing”.
  • Olvidar instrucciones de integración en las ediciones → los nuevos elementos parecen compuestos en lugar de naturales.

Ajustes de calidad más altos (xhigh o max) ayudan con texto denso, detalle fino o diseños complejos, pero no compensan una descripción insuficiente.

PT Image 2.5 Prompting Mistakes Should You Avoid?

ErrorEnfoque débilEnfoque mejor
Sin entregable“Make something cinematic”“Create a 4:5 paid-social product photograph”
Edición vaga“Improve the background”“Replace only the background with…”
Sin reglas de preservación“Change the shirt”Bloquea rostro, pose, cámara y fondo
Referencias sin asignar“Use these images”Da a cada referencia un rol
Demasiados cambiosCinco ediciones mayores en una solicitudUn cambio controlado por pasada
Asumir que prompt = cumplimientoConfiar en la generaciónRealiza QA visual

Acceso a GPT Image 2.5 a través de CometAPI

CometAPI ofrece acceso compatible con OpenAI tanto a gpt-image-2.5-flare como a gpt-image-2.5-sunburst bajo una única clave de API y los endpoints familiares /v1/images/generations y edits. Los beneficios incluyen autenticación y facturación centralizadas, tarifas por token competitivas, cambio sencillo entre Flare y Sunburst, visibilidad de uso y la capacidad de combinar generación de imágenes con el catálogo más amplio de 500+ modelos sin gestionar múltiples cuentas de proveedores.

Una migración típica solo requiere cambiar la URL base a https://api.cometapi.com/v1, proporcionar tu clave de CometAPI y seleccionar el ID de modelo deseado. Esta configuración es especialmente valiosa para líneas de producción que necesitan hacer A/B de las dos variantes, controlar costes o dirigir eficientemente distintos niveles de calidad.

Para las listas de parámetros más recientes, precios y ejemplos de código, consulta la documentación de generación de imágenes de CometAPI junto con la guía oficial de prompts de imágenes de OpenAI.

Conclusión

GPT Image 2.5 recompensa la claridad, la estructura y la disciplina. Define el entregable, describe el sujeto y la composición visibles con detalle concreto, nombra el estilo a través de iluminación/materiales/color, pon el texto exacto entre comillas y (para cada edición) separa rigurosamente el único cambio de la lista completa de elementos a conservar. Asigna a cada imagen de referencia un trabajo claro, itera una decisión a la vez y deja que los parámetros de la API gestionen tamaño, calidad y transparencia. Comienza la exploración y el trabajo de alto volumen en Flare; pasa a Sunburst cuando la precisión final o las secuencias de edición complejas lo exijan.

Domina la regla Cambiar vs. Conservar y la estructura Sujeto–Composición–Estilo–Texto–Restricciones, y GPT Image 2.5 se convierte en una herramienta de producción fiable en lugar de una fuente de regeneración interminable. Complétalo con una pasarela unificada como CometAPI y ganarás tanto poder creativo como simplicidad operativa.

Preguntas frecuentes

¿Deben ser largos los prompts de GPT Image 2.5?

No necesariamente. Un prompt largo lleno de adjetivos vagos puede ser más débil que uno corto con instrucciones precisas de composición y preservación. Incluye detalle donde el fallo sería crítico.

¿Cómo evito que GPT Image 2.5 cambie toda la imagen?

Usa una instrucción estrecha como “Cambia solo la chaqueta”, y luego enumera explícitamente lo que debe permanecer sin cambios: identidad, pose, encuadre, posición de cámara, iluminación, fondo, texto y otros elementos aprobados.

¿Cómo preservo el rostro de una persona?

Usa una foto de referencia clara, asígnala como la referencia de identidad autorizada y especifica qué características deben permanecer estables. No confíes únicamente en “la misma persona”.

¿Cómo hago que GPT Image 2.5 genere texto exacto?

Proporciona el texto final literalmente, indica dónde debe aparecer, especifica su jerarquía e instruye al modelo para que no añada otras palabras. Verifica siempre visualmente el texto final.

¿Puede GPT Image 2.5 crear imágenes PNG transparentes?

Sí. Configura el fondo como transparente y usa salida PNG o WebP.

¿Puede GPT Image 2.5 generar imágenes 4K?

Sí. El máximo documentado incluye 3840 × 2160 apaisado y 2160 × 3840 vertical. Resoluciones por encima de 2560 × 1440 son experimentales, y las dimensiones personalizadas deben cumplir las restricciones de divisibilidad y relación de aspecto de la API.

¿GPT Image 2.5 es mejor para edición que GPT Image 2?

OpenAI destaca mejoras en edición precisa, preservación de referencias y consistencia multivuelta. Los primeros resultados de preferencia de Arena también favorecieron ambas variantes 2.5 en el momento señalado, pero estos rankings preliminares pueden cambiar.

Seguir aprendiendo

Conecta este artículo con la siguiente decisión.

Ver todos los temas
Publicado el Sep 21, 2026
Última actualización Sep 21, 2026
4 visitas
Revisado para mayor claridad, atribución de fuentes y terminología API actual.

¿Listo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Créditos de prueba gratuitos incluidos. No se requiere tarjeta de crédito.

Leer Más