Qu’est-ce que GPT Image 2 ?
GPT Image 2 est le modèle de génération d’images de pointe d’OpenAI, intégré nativement à ChatGPT sous la forme de ChatGPT Images 2.0. Contrairement aux outils autonomes antérieurs comme DALL·E 3, il combine la compréhension linguistique de la série GPT avec une synthèse visuelle avancée. Le modèle génère des images précises et exploitables, optimisées pour des tâches professionnelles plutôt que pour la seule expérimentation artistique.
Principales capacités
- Rendu de texte quasi parfait : Atteint une précision d’environ ~99% au niveau du caractère, produisant un texte lisible et contextuellement exact en anglais et dans des écritures non latines. Il gère de longs blocs, des menus, des affiches et des infographies sans les problèmes de typographie illisible fréquents dans les modèles précédents.
- Composition complexe et fidélité de mise en page : Produit des résultats structurés tels que des maquettes d’interface utilisateur (UI), des plans d’étage, des visualisations de données, des diapositives, des cartes, des pages de manga et des grilles multi-éléments (p. ex., des grilles d’icônes 10x10 ou des affiches produits).
- Prise en charge multilingue et culturelle : Génère un texte précis et des visuels culturellement pertinents dans plusieurs langues.
- Modification d’images et gestion des références : Applique des modifications aux images importées tout en préservant les détails, les visages et les styles avec une grande cohérence.
- Génération par lots : Crée jusqu’à 8 images cohérentes à partir d’un seul prompt, en maintenant la cohérence des personnages et des objets sur l’ensemble.
- Photoréalisme et praticité : Les résultats paraissent plus naturels et prêts pour la production, avec moins d’artefacts, une meilleure iconographie et une composition professionnelle.