O que é o GPT Image 2?
GPT Image 2 é o modelo de geração de imagens de última geração da OpenAI, integrado nativamente ao ChatGPT como ChatGPT Images 2.0. Diferentemente de ferramentas independentes anteriores, como o DALL·E 3, ele combina a compreensão de linguagem da série GPT com síntese visual avançada. O modelo gera imagens precisas e utilizáveis, otimizadas para tarefas profissionais, em vez de experimentação puramente artística.
Principais recursos
- Renderização de texto quase perfeita: Alcança ~99% de precisão em nível de caractere, produzindo texto legível e contextualmente correto em inglês e em sistemas de escrita não latinos. Lida com blocos longos, menus, cartazes e infográficos sem a tipografia embaralhada comum em modelos anteriores.
- Composição complexa e fidelidade de layout: Produz saídas estruturadas, como protótipos de UI, plantas baixas, visualizações de dados, slides, mapas, páginas de mangá e grades com múltiplos elementos (por exemplo, matrizes de ícones 10x10 ou cartazes de produtos).
- Suporte multilíngue e cultural: Gera texto preciso e visuais culturalmente relevantes em vários idiomas.
- Edição de imagem e tratamento de referências: Aplica edições a imagens enviadas, preservando detalhes, rostos e estilos com alta consistência.
- Geração em lote: Cria até 8 imagens coerentes a partir de um único prompt, mantendo a consistência de personagens e objetos em todo o conjunto.
- Fotorrealismo e usabilidade: Os resultados parecem mais naturais e prontos para produção, com menos artefatos, melhor iconografia e composição profissional.