¿Qué es GPT Image 2?
GPT Image 2 es el modelo de generación de imágenes de última generación de OpenAI, integrado de forma nativa en ChatGPT como ChatGPT Images 2.0. A diferencia de herramientas independientes anteriores como DALL·E 3, combina la comprensión del lenguaje de la serie GPT con una síntesis visual avanzada. El modelo genera imágenes precisas y utilizables, optimizadas para tareas profesionales en lugar de la experimentación puramente artística.
Capacidades clave
- Renderizado de texto casi perfecto: Alcanza una precisión de ~99% a nivel de carácter, generando texto legible y contextualmente preciso en inglés y en escrituras no latinas. Maneja bloques largos, menús, carteles e infografías sin la tipografía distorsionada común en modelos anteriores.
- Composición compleja y fidelidad de maquetación: Produce resultados estructurados como maquetas de UI, planos de planta, visualizaciones de datos, diapositivas, mapas, páginas de manga y cuadrículas multielemento (p. ej., matrices de iconos de 10x10 o carteles de productos).
- Soporte multilingüe y cultural: Genera texto preciso y recursos visuales culturalmente pertinentes en múltiples idiomas.
- Edición de imágenes y manejo de referencias: Aplica ediciones a imágenes cargadas preservando detalles, rostros y estilos con alta coherencia.
- Generación por lotes: Crea hasta 8 imágenes coherentes a partir de una sola instrucción, manteniendo la coherencia de personajes y objetos en el conjunto.
- Fotorrealismo y usabilidad: Los resultados parecen más naturales y listos para producción, con menos artefactos, mejor iconografía y una composición profesional.