Apa itu API GPT-Image-1.5?
GPT-Image-1.5 adalah anggota terbaru dari keluarga GPT Image milik OpenAI dan model di balik pengalaman Images yang diperbarui di ChatGPT. Model ini dirancang untuk mengubah pembuatan gambar dari eksperimen coba-coba menjadi perangkat kreatif kelas produksi: fotorealisme lebih tinggi, kontrol lebih halus untuk penyuntingan iteratif, dan inferensi lebih cepat untuk mendukung alur kerja interaktif dan perusahaan.
API gpt-image-1.5 adalah endpoint model gambar multimodal yang menerima satu atau lebih input gambar (pengidentifikasi file atau byte) beserta prompt teks dan menghasilkan gambar baru atau gambar yang telah diedit. API ini mendukung:
- Pembuatan teks-ke-gambar (membuat dari prompt),
- Penyuntingan gambar / in-painting / komposit (menerapkan instruksi pada gambar yang ada, mendukung banyak input gambar), dan
- Alur penyuntingan iteratif multi-putaran melalui Responses API (memungkinkan UI “tweak & iterate”).
API memperlakukan prompt gambar secara berbeda dibanding batasan DALL·E lama: model gambar GPT menerima prompt teks yang jauh lebih panjang (pedoman 32k karakter), sehingga instruksi yang kompleks dan penuh batasan menjadi memungkinkan.
Fitur utama (praktis)
- Ketereditan yang ditingkatkan / konsistensi multi-putaran: mempertahankan penampilan karakter, pencahayaan, dan atribut visual kunci di seluruh penyuntingan iteratif. Ini membuat skenario “model yang sama, penyuntingan berulang” lebih andal untuk alur kerja seperti katalog produk atau aset merek.
- Throughput lebih cepat — peningkatan kecepatan 4× dibanding GPT Image 1, ditujukan untuk menurunkan latensi pada alur kerja kreatif iteratif.
- Optimalisasi biaya — biaya input/output gambar berkurang sekitar 20% dibanding GPT Image 1, menurunkan biaya iterasi per gambar bagi pengguna dengan volume tinggi.
- Komposit multi-gambar & referensi gaya — menerima banyak gambar referensi untuk mengomposit adegan atau mentransfer gaya/pencahayaan.
- Pengaturan kualitas/fidelitas — parameter API yang menyeimbangkan kecepatan vs. fidelitas (gunakan kualitas lebih rendah untuk pembuatan massal; kualitas lebih tinggi untuk aset produksi).
- Penyuntingan multi-putaran / integrasi dengan Responses API — memungkinkan alur bertahap (minta perubahan, lalu “lakukan tweak” sambil mempertahankan keadaan).
Kapabilitas teknis
- Batas prompt teks (model gambar): hingga 32,000 karakter (catatan: OpenAI mendokumentasikan ini sebagai alokasi panjang teks untuk model gambar GPT). Gunakan ini untuk prompt panjang dengan banyak batasan.
- Input gambar: menerima File ID (disarankan untuk alur multi-putaran) atau byte mentah; beberapa gambar dapat disediakan untuk komposit dan referensi.
- Output: PNG/JPEG atau artefak gambar default platform yang dikembalikan oleh API (atau sebagai lampiran di dalam ChatGPT). Output dapat mencakup beberapa kandidat gambar dan mendukung permintaan iteratif untuk menyempurnakan sebuah output.
- Mode pembuatan: teks-ke-gambar, penyuntingan gambar (inpaint/perluas dengan instruksi), dan varian. Penyuntingan multi-putaran mendukung instruksi bergaya “tambah/kurangi/gabungkan”.
- Penyuntingan yang peka terhadap instruksi: model dioptimalkan untuk kepatuhan instruksi (mempertahankan invarian yang ditentukan seperti “jangan ubah logo”, “pertahankan pose dan pencahayaan”). Pola rekayasa prompt (mengulangi invarian secara eksplisit di tiap iterasi) mengurangi drift semantik.
Performa benchmark
- Posisi di leaderboard: Satu laporan agregat menyebut GPT Image 1.5 memimpin peringkat teks-ke-gambar dengan ~1264 poin pada leaderboard Artificial Analysis, unggul atas model berikutnya dengan selisih yang terukur.
- Metrik tingkat tugas (edit & pelestarian): ringkasan metrik evaluasi dari Microsoft Foundry menunjukkan GPT-Image-1.5 meraih keberhasilan modifikasi biner nyaris sempurna (100% pada BinaryEval satu putaran) dan skor pelestarian wajah yang kuat (sekitar 90% pada ukuran AuraFace) dalam tabel perbandingan mereka terhadap kompetitor dan model OpenAI sebelumnya. Metrik komparatif tersebut menempatkan GPT-Image-1.5 di depan beberapa rival pada pelestarian dan fidelitas penyuntingan.

Perbandingan GPT-Image-1.5 dengan para pesaing
- Vs. GPT Image 1 (generasi OpenAI sebelumnya): lebih cepat (hingga 4×), lebih murah (biaya IO gambar ~20% lebih rendah), dan fidelitas penyuntingan lebih kuat — ditujukan untuk beralih dari “prototipe/demo” ke alur kerja gambar yang ramah produksi.
- Vs. Google’s Nano Banana Pro / model gambar Gemini: GPT-Image-1.5 dan keluarga Google’s Nano Banana Pro / Gemini 3 adalah pesaing dekat — masing-masing memiliki kekuatan pada kelas prompt yang berbeda. Pesan OpenAI menekankan fidelitas penyuntingan dan kecepatan iterasi; penawaran Google dipuji karena realisme setingkat studio pada beberapa contoh.
- Vs. Qwen Image dan model terbuka/tertutup lainnya: GPT-Image-1.5 mengungguli Qwen Image pada beberapa metrik edit dan pelestarian dalam evaluasi satu putaran, namun perbedaannya menyempit pada skenario multi-putaran atau uji khusus domain lainnya.
Di mana GPT-Image-1.5 unggul
- Pencitraan produk e-commerce: varian massal, penggantian latar belakang, katalog produk yang konsisten dari satu foto (pelestarian merek/logo).
- Produksi aset kreatif & pemasaran: iterasi konsep cepat, mockup fotorealistik, transfer gaya yang terkontrol.
- Retouching foto & alur editorial: coba pakai pakaian/gaya rambut secara realistis, retouch selektif yang mempertahankan identitas dan pencahayaan.
- Integrasi ke alat desain: terhubung ke platform desain atau CMS untuk varian gambar on-demand (pengaturan fidelitas membantu kontrol biaya).
- Pipeline komposit multi-langkah: input multi-gambar memungkinkan komposit dan pembuatan berbasis referensi untuk adegan kompleks.
Cara mengakses GPT Image 1.5 API
Langkah 1: Daftar untuk Kunci API
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke konsol CometAPI. Dapatkan kredensial akses kunci API untuk antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx lalu kirim.
Langkah 2: Kirim Permintaan ke GPT Image 1.5 API
Pilih endpoint “gpt-image-1.5” untuk mengirim permintaan API dan atur body permintaan. Metode permintaan dan body permintaan diperoleh dari dokumen API di situs kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. base url is Images (https://api.cometapi.com/v1/images/generations) dan [Image Editing]
Masukkan pertanyaan atau permintaan Anda ke bidang content—itulah yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Ambil dan Verifikasi Hasil
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah pemrosesan, API akan merespons dengan status tugas dan data output.
Lihat juga Gemini 3 Pro Preview API