Apakah API GPT-Image-1.5?
GPT-Image-1.5 ialah ahli terbaharu keluarga GPT Image OpenAI dan model di sebalik pengalaman Images ChatGPT yang diperbaharui. Ia direka untuk mengalihkan penjanaan imej daripada eksperimen novelti kepada peralatan kreatif bertaraf produksi: fotorealisme yang lebih tinggi, kawalan lebih halus untuk suntingan berulang, dan inferens lebih pantas untuk menyokong aliran kerja interaktif dan perusahaan.
gpt-image-1.5 API ialah titik akhir model imej multimodal yang menerima satu atau lebih input imej (pengenal fail atau bait) serta gesaan teks dan mengembalikan imej terjana atau imej yang disunting. Ia menyokong:
- Penjanaan teks-ke-imej (cipta daripada gesaan),
- Penyuntingan imej / in-painting / pengkomposisian (aplikasikan arahan pada imej sedia ada, input imej berbilang dibenarkan), dan
- Aliran kerja penyuntingan berulang, berbilang pusingan melalui Responses API (membolehkan UI “ubah suai & ulang”).
API memperlakukan gesaan imej secara berbeza daripada had DALL·E lama: model imej GPT menerima gesaan teks yang jauh lebih panjang (garis panduan 32k aksara), menjadikan arahan yang kompleks dan sarat kekangan menjadi boleh dilaksanakan.
Ciri utama (praktikal)
- Kebolehsuntingan dipertingkat / konsistensi berbilang pusingan: mengekalkan rupa watak, pencahayaan dan atribut visual utama merentas suntingan berulang. Ini menjadikan “model yang sama, suntingan berulang” lebih boleh diharap untuk aliran kerja seperti katalog produk atau aset jenama.
- Kadar pemprosesan lebih pantas — peningkatan kelajuan 4× berbanding GPT Image 1, disasarkan untuk menurunkan kependaman bagi aliran kerja kreatif berulang.
- Pengoptimuman kos — kos input/output imej dikurangkan sekitar 20% berbanding GPT Image 1, menurunkan kos per-iterasi imej untuk pengguna volum tinggi.
- Pengkomposisian berbilang imej & rujukan gaya — menerima pelbagai imej rujukan untuk mengkomposisi adegan atau memindahkan gaya/pencahayaan.
- Kawalan kualiti/kesetiaan — parameter API yang mengimbangi kelajuan vs. kesetiaan (gunakan kualiti lebih rendah untuk penjanaan pukal; kualiti lebih tinggi untuk aset produksi).
- Penyuntingan berbilang pusingan / integrasi Responses API — membolehkan aliran kerja berperingkat (minta perubahan, kemudian “buat pelarasan” sambil mengekalkan keadaan).
Keupayaan teknikal
- Had gesaan teks (model imej): sehingga 32,000 aksara (nota: OpenAI mendokumenkan ini sebagai peruntukan panjang teks untuk model imej GPT). Gunakan ini untuk gesaan panjang yang sarat kekangan.
- Input imej: menerima ID Fail (diutamakan untuk aliran berbilang pusingan) atau bait mentah; berbilang imej boleh diberikan untuk pengkomposisian dan rujukan.
- Output: artifak imej PNG/JPEG atau lalai platform yang dikembalikan oleh API (atau sebagai lampiran dalam ChatGPT). Output boleh merangkumi berbilang imej calon dan menyokong permintaan iteratif untuk memperincikan hasil.
- Mod penjanaan: teks-ke-imej, penyuntingan imej (inpaint/luaskan dengan arahan), dan varian. Penyuntingan berbilang pusingan menyokong arahan gaya “tambah/tolak/gabung”.
- Penyuntingan peka-arahan: model dioptimumkan untuk kesetiaan arahan (mengekalkan invariant yang ditentukan seperti “jangan ubah logo”, “kekalkan pose dan pencahayaan”). Corak kejuruteraan gesaan (ulang invariant yang eksplisit setiap iterasi) mengurangkan hanyutan semantik.
Prestasi penanda aras
- Kedudukan papan kedudukan: Satu laporan agregat menyebut GPT Image 1.5 mendahului ranking teks-ke-imej dengan ~1264 mata pada papan kedudukan Artificial Analysis, mendahului model seterusnya dengan margin yang boleh diukur.
- Metrik peringkat tugas (sunting & pemeliharaan): ringkasan metrik penilaian Microsoft Foundry menunjukkan GPT-Image-1.5 mencapai kejayaan pengubahsuaian binari hampir sempurna (100% pada BinaryEval satu pusingan) dan skor pemeliharaan wajah yang kukuh (sekitar 90% pada ukuran AuraFace) dalam jadual perbandingan mereka berbanding pesaing dan model OpenAI sebelumnya. Metrik perbandingan tersebut meletakkan GPT-Image-1.5 mendahului beberapa pesaing dari segi pemeliharaan dan kesetiaan suntingan.

Perbandingan GPT-Image-1.5 dengan rakan setara
- Berbanding GPT Image 1 (generasi OpenAI sebelumnya): lebih pantas (sehingga 4×), lebih murah (~20% kos IO imej lebih rendah), dan kesetiaan suntingan lebih kuat — disasarkan untuk beralih daripada “prototip/demo” kepada aliran kerja imej mesra produksi.
- Berbanding Nano Banana Pro / model imej Gemini Google: GPT-Image-1.5 dan keluarga Nano Banana Pro / Gemini 3 Google merupakan pesaing rapat — masing-masing mempunyai kekuatan dalam kelas gesaan yang berbeza. Pemesejan OpenAI menekankan kesetiaan penyuntingan dan kelajuan iterasi; penawaran Google dipuji atas realisme setaraf studio dalam sesetengah contoh.
- Berbanding Qwen Image dan model terbuka/tertutup lain: GPT-Image-1.5 mengatasi Qwen Image pada beberapa metrik sunting dan pemeliharaan dalam penilaian satu pusingan, tetapi perbezaan mengecil dalam berbilang pusingan atau ujian khusus domain lain.
Di mana GPT-Image-1.5 menonjol
- Pengimejan produk e-dagang: varian pukal, pertukaran latar belakang, katalog produk konsisten daripada satu foto (pemeliharaan jenama/logo).
- Penghasilan aset kreatif & pemasaran: iterasi konsep pantas, lakaran fotorealistik, pemindahan gaya terkawal.
- Penyuntingan semula foto & aliran kerja editorial: percubaan pakaian/gaya rambut yang realistik, penyuntingan terpilih yang mengekalkan identiti dan pencahayaan.
- Integrasi peralatan reka bentuk: pasangkan ke platform reka bentuk atau CMS untuk varian imej atas permintaan (kawalan kesetiaan membantu kawalan kos).
- Rantaian pengkomposisian berbilang langkah: input berbilang imej membolehkan pengkomposisian dan penjanaan berasaskan rujukan untuk adegan kompleks.
Cara mengakses API GPT Image 1.5
Langkah 1: Daftar untuk Kunci API
Log masuk ke cometapi.com. Jika anda bukan pengguna kami, sila daftar terlebih dahulu. Log masuk ke konsol CometAPI. Dapatkan kelayakan akses kunci API bagi antara muka. Klik “Add Token” pada token API di pusat peribadi, dapatkan kunci token: sk-xxxxx dan serahkan.
Langkah 2: Hantar Permintaan ke API GPT Image 1.5
Pilih titik akhir “gpt-image-1.5” untuk menghantar permintaan API dan tetapkan badan permintaan. Kaedah permintaan dan badan permintaan diperoleh daripada dokumen API laman web kami. Laman web kami juga menyediakan ujian Apifox untuk kemudahan anda. Gantikan <YOUR_API_KEY> dengan kunci CometAPI sebenar daripada akaun anda. URL asas ialah Images (https://api.cometapi.com/v1/images/generations) dan [Penyuntingan Imej]
Masukkan soalan atau permintaan anda ke dalam medan content—ini yang akan direspons oleh model. Proses respons API untuk mendapatkan jawapan yang dijana.
Langkah 3: Dapatkan dan Sahkan Hasil
Proses respons API untuk mendapatkan jawapan yang dijana. Selepas diproses, API membalas dengan status tugas dan data keluaran.
Lihat juga Gemini 3 Pro Preview API