什麼是 GPT Image 2?
GPT Image 2 是 OpenAI 最先進的影像生成模型,已作為 ChatGPT Images 2.0 原生整合於 ChatGPT。不同於早期如 DALL·E 3 這類獨立工具,它結合了 GPT 系列的語言理解與先進的視覺合成能力。該模型生成精確、可用的影像,重點優化於專業任務,而非單純的藝術試驗。
關鍵能力
- 近乎完美的文字渲染:達到 ~99% 的字元層級準確度,能在英語與非拉丁文字中呈現清晰且語境準確的文本。可處理長段落、選單、海報與資訊圖表,不會出現以往模型常見的亂碼與字形混亂。
- 複雜構圖與版面忠實度:能產出具結構的成果,例如 UI 原型圖、平面圖、資料視覺化、投影片、地圖、漫畫頁,以及多元素網格(例如 10x10 圖示陣列或產品海報)。
- 多語言與文化支援:能以多種語言生成準確文本與符合文化脈絡的視覺內容。
- 影像編輯與參考圖處理:可對上傳的影像套用編輯,同時以高一致性保留細節、臉部與風格。
- 批次生成:可從單一提示建立最多 8 張連貫的影像,並在整組中維持角色與物件的一致性。
- 寫實度與實用性:輸出更自然、達到可上線使用的水準,瑕疵更少、圖示設計更佳且構圖更專業。