GLM-5.3 FlashX and MiniMax H3 Max are now live on CometAPI →
guide/Riset CometAPI

Cara Memberikan Prompt kepada GPT Image 2.5 Layaknya Profesional

Pelajari cara menulis prompt GPT Image 2.5 yang lebih baik dengan rumus yang dapat digunakan kembali, contoh praktis, alur kerja gambar referensi, dan tips pengeditan yang presisi.

CometAPI
AnnaTim riset model AI dan API
Diperbarui Sep 21, 2026 14 menit baca
Cara Memberikan Prompt kepada GPT Image 2.5 Layaknya Profesional
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR GPT Image 2.5 mengubah cara membuat prompt gambar dalam satu hal penting: prompt yang baik tidak lagi hanya mendeskripsikan apa yang ingin Anda buat. Untuk penyuntingan dan generasi berbasis referensi, prompt juga harus mendefinisikan apa yang tidak boleh berubah.

Hal ini penting karena GPT Image 2.5 dirancang untuk penyuntingan yang lebih presisi dan pelestarian referensi yang lebih kuat. OpenAI menyatakan model ini lebih baik dalam mengubah hanya elemen yang diminta sambil menjaga subjek, komposisi, dan detail sekitar tetap utuh.

Good GPT Image 2.5 Prompt = Deliverable + Subject + Scene + Composition + Visual Direction + Exact Text + Constraints + Output

Good Editing Prompt = Change Target + Preserve List + Integration Rules + Exclusions + Output

Formula kedua sangat penting. Alih-alih menulis “Ubah latar belakang menjadi pantai,” tulislah: “Ganti hanya latar belakang dengan pantai Mediterania yang tenang saat matahari terbenam. Biarkan orang, wajah, pose, pakaian, posisi kamera, framing, arah pencahayaan, dan foreground tetap tidak berubah.”

Poin Penting

  • GPT Image 2.5 meningkatkan fidelitas dan konsistensi multi-putaran, perenderan teks, dan kecepatan; Flare direkomendasikan sebagai titik awal untuk sebagian besar pengguna.
  • Rumus inti generasi: Deliverable + Subject + Composition + Style + Exact Text (dalam tanda kutip) + Constraints/Exclusions.
  • Untuk penyuntingan, aturan emas adalah “Hanya ubah X. Pertahankan [daftar lengkap identitas, pose, pencahayaan, geometri, teks, gaya].”
  • Beberapa gambar referensi berhasil ketika masing-masing diberi tugas eksplisit (subjek, pakaian, latar belakang, palet, dll.).
  • Latar belakang transparan, tipografi presisi, dan penyuntingan berurutan jauh lebih kuat jika prompt benar dan parameter diatur dengan benar.
  • Flare memprioritaskan kecepatan dan volume; Sunburst memprioritaskan presisi edit dan fidelitas aset final. Keduanya berbagi tarif token yang sama.
  • CometAPI menawarkan akses terpadu dan hemat biaya ke gpt-image-2.5-flare dan gpt-image-2.5-sunburst melalui rute kompatibel OpenAI yang familiar.

Apa itu GPT Image 2.5

OpenAI merilis ChatGPT Images 2.5 pada 8 September 2026. Pembaruan ini berfokus pada detail yang lebih tajam, pencahayaan dan tekstur yang lebih natural, fidelitas terhadap gambar referensi, penyuntingan yang presisi, dan konsistensi yang lebih kuat di banyak putaran penyuntingan. OpenAI juga melaporkan hingga 50% latensi pembuatan gambar lebih rendah dibandingkan Images 2.0.

Bagi pengembang, keluarga model ini dibagi menjadi dua model API:

  • GPT-Image-2.5 Flare — dioptimalkan untuk pembuatan cepat, berkualitas tinggi sehari-hari dan alur kerja volume tinggi.
  • GPT-Image-2.5 Sunburst — dioptimalkan untuk alur kerja pembuatan dan penyuntingan yang menuntut, di mana presisi lebih penting daripada latensi.

Pengembang juga dapat menggunakan API GPT Image 2.5 di CometAPI, termasuk pengenal model gpt-image-2.5-flare dan gpt-image-2.5-sunburst.

Benchmark dan kapabilitas

Benchmark teks-ke-gambar ArenaGPT Image 2.5 SunburstGPT Image 2.5 FlareGPT Image 2
Skor teks-ke-gambar1421 ± 131399 ± 131381 ± 4
Peringkat teks-ke-gambar#1#2#3
Skor penyuntingan satu gambar1520 ± 91491 ± 91461 ± 3
Peringkat penyuntingan tunggal#1#2#3

Pengujian independen dan peringkat Arena awal menempatkan kedua model pada puncak papan peringkat teks-ke-gambar dan penyuntingan gambar tak lama setelah peluncuran, dengan peningkatan jelas pada komposisi, detail, fidelitas gaya, pelestarian subjek, dan kecepatan (Flare sering selesai dalam ~20–40 detik vs. jauh lebih lama pada generasi sebelumnya di beberapa benchmark).

Kapabilitas utama mencakup input teks + gambar, output gambar hingga kira-kira 4K (dengan batasan: tepi kelipatan 16, maksimum ~3840 px per sisi, rasio aspek ≤ 3:1), latar belakang transparan (PNG/WebP), tier kualitas (rendah → maksimum), pratinjau progresif, inpainting/penyuntingan area spesifik, serta dukungan kuat untuk multi-referensi dan penyuntingan berurutan. OpenAI melaporkan lebih dari 3 miliar gambar dibuat setiap minggu di seluruh ChatGPT Images dan keluarga API GPT-Image.

Rumus Umum untuk Generasi dan Penyuntingan GPT Image 2.5

Aturan Terpenting: Ubah vs Pertahankan

Pembedaan ini adalah kebiasaan dengan leverage tertinggi untuk GPT Image 2.5.

Generasi (gambar baru dari teks atau referensi)
Jelaskan semua yang Anda ingin muncul. Nyatakan secara konkret tentang subjek, framing, pencahayaan, material, warna, dan apa yang tidak boleh muncul.

Penyuntingan (image-to-image atau penyempurnaan multi-putaran)

  1. Sebutkan tepat satu perubahan.
  2. Daftar secara eksplisit semua hal yang harus tetap tidak berubah (identitas, pose, sudut kamera, framing, arah pencahayaan, bayangan, elemen latar belakang, teks yang ada, warna, geometri, gaya keseluruhan).
  3. Jelaskan bagaimana elemen baru harus terintegrasi dengan cahaya, perspektif, tekstur, dan bayangan kontak yang ada.
  4. Tambahkan pengecualian yang jelas (tanpa teks tambahan, tanpa logo, tanpa watermark, tanpa retouch berat).

Prompt yang samar dengan banyak perubahan atau tanpa daftar pelestarian menyebabkan drift kumulatif. Ulangi daftar pelestarian pada setiap putaran. Ketika suatu area harus tetap identik piksel demi piksel, kompositkan edit lokal yang disetujui kembali ke master asli alih-alih sepenuhnya mengandalkan model.

Kerangka minimal generasi

[Deliverable / intended use] + Subjek + Komposisi + Gaya / pencahayaan / material + Teks persis dalam tanda kutip + Kendala dan pengecualian

Kerangka minimal penyuntingan

Hanya ubah [elemen spesifik] menjadi [deskripsi baru]. Pertahankan [identitas, pose, framing, pencahayaan, bayangan, latar belakang, teks, warna, gaya]. Cocokkan elemen baru dengan cahaya dan geometri yang ada. Jangan tambahkan [elemen yang tidak diinginkan].

Cara Kerja Prompting GPT Image 2.5

Panduan prompting resmi OpenAI sederhana: mulailah dari gambar yang Anda butuhkan, lalu jelaskan subjek, komposisi, gaya, dan kendala. Untuk penyuntingan, pisahkan secara jelas perubahan yang diminta dari detail yang harus tetap sama. Sempurnakan satu hal pada satu waktu dan inspeksi setiap hasil. Strukturkan prompt sebagai Subjek → Komposisi → Gaya → Teks (dalam tanda kutip) → Kendala. Berikan peran yang jelas pada setiap gambar referensi, iterasikan satu perubahan pada satu waktu, dan atur ukuran/kualitas/latar belakang sebagai parameter API alih-alih teks prompt.

Subjek

Sebutkan orang, objek, atau adegan utama dengan detail yang terlihat dan dapat diuji: penampilan, pakaian, pose, aksi, skala relatif, dan interaksi dengan objek.
Contoh: “Seorang arsiparis muda dengan bob auburn pendek, kacamata bulat hitam, dan mantol kerja navy yang memegang amplop kertas tersegel dengan emblem bulan lilin merah.”

Komposisi

Tentukan framing, tinggi dan sudut kamera, penempatan subjek (tengah, sepertiga kiri, dll.), ruang negatif, kedalaman bidang, dan apa yang harus terlihat (tubuh penuh dengan kaki terlihat, medium close-up, dll.).
Contoh: “Tubuh penuh, kaki terlihat, kamera pada ketinggian mata rendah. Karakter di sepertiga kiri; rak arsip tanpa akhir memudar di belakangnya. Ruang gelap bersih di kanan atas untuk penempatan judul nanti.”

Gaya

Deskripsikan medium visual, pencahayaan (sumber + arah), material, palet warna, tekstur, dan tingkat realisme. Utamakan bahasa visual konkret dibandingkan kata sifat mood semata. Minta secara eksplisit “fotorealistik,” “foto sungguhan,” butiran film, atau gaya artistik bernama ketika diperlukan.
Contoh: “Latar belakang anime lukisan tangan terperinci, cel shading yang terkendali, proporsi natural. Satu lampu meja hangat melawan cahaya bulan biru dingin dari jendela tinggi.”

Teks

Tempatkan setiap string yang diperlukan di dalam tanda kutip. Tentukan lokasi, hierarki, tipografi kira-kira, dan berapa kali teks harus muncul. Eja nama yang tidak lazim atau merek huruf demi huruf ketika kritis. Selalu minta “tanpa teks lain.”
Contoh: headline "Open Late" dalam huruf tebal condensed di bagian atas, dan "Thursday to Sunday" dalam huruf lebih kecil di bagian bawah. Tanpa teks lain.

Kendala / Pengecualian

Daftarkan apa yang tidak boleh muncul dan apa yang harus tetap tidak berubah. Pengecualian bernilai tinggi termasuk tanpa teks tambahan, tanpa logo, tanpa watermark, dan tanpa objek yang tidak diinginkan.

Untuk permintaan yang lebih panjang atau kompleks, gunakan bagian berlabel (SCENE / SUBJECT / STYLE / TEXT / CONSTRAINTS). Ini meningkatkan keterbacaan dan memudahkan pemeliharaan pada penyuntingan berikutnya.

Catatan teknis penting: Tetapkan model, kualitas, ukuran (atau aspek), dan latar belakang (auto / opaque / transparent) sebagai parameter API. Jangan andalkan teks prompt untuk memaksakan resolusi atau transparansi.

Bagaimana Menggunakan Beberapa Gambar Referensi dengan GPT Image 2.5?

GPT Image 2.5 menerima banyak input gambar. Hasil meningkat drastis ketika setiap referensi diberi peran eksplisit.

Pola yang disarankan:

  1. Nomori atau beri nama jelas tiap gambar referensi.
  2. Nyatakan tugasnya dengan tepat: identitas subjek utama, referensi pakaian/gaya, latar/seting, hanya palet warna, referensi pencahayaan, dll.
  3. Jelaskan bagaimana elemen harus digabungkan dan bagian mana yang dipindahkan ke mana.
  4. Ulangi kendala pelestarian untuk subjek utama dan detail yang dilindungi.

Contoh: “Gunakan gambar 1 sebagai produk (botol air matte hitam dengan teks label yang persis). Gunakan gambar 2 hanya untuk ambang beton pucat dan arah pencahayaan alami. Letakkan botol dari gambar 1 di ambang dari gambar 2, cocokkan bayangan lembut dan sudut cahaya yang ada. Pertahankan bentuk botol, teks label, warna, dan refleksi secara persis. Jangan ubah tekstur beton atau tambahkan objek lain.”

Penetapan peran yang jelas mencegah hybridisasi yang tidak diinginkan pada subjek atau gaya.

Teknik Prompting Lanjutan

Teks Persis & Tipografi

  • Selalu sertakan string yang diperlukan dalam tanda kutip.
  • Tentukan posisi, hierarki, bobot dan gaya kira-kira, serta jumlah kemunculan teks.
  • Minta “tanpa teks lain,” “tanpa logo,” dan “tanpa watermark.”
  • Untuk layout padat atau banyak font, uji kualitas medium atau tinggi dan verifikasi secara visual ejaan serta keterbacaan pada output.
  • Nama merek yang kritis dapat dieja huruf demi huruf untuk reliabilitas ekstra.

Latar Belakang Transparan

Set background="transparent" dalam panggilan API (atau kontrol UI yang setara) dan minta output PNG atau WebP. Minta tepi bersih dan tidak ada apa pun di belakang subjek. Periksa channel alpha dengan cermat di sekitar rambut, kaca, detail halus, dan area kontak. Tambahkan pengecualian seperti “tanpa elemen latar, tanpa drop shadow kecuali diminta.” Generasi transparan jauh lebih andal di 2.5 ketika parameter dan kendala prompt keduanya benar.

Alur Kerja Penyuntingan Multi-Putaran

  1. Mulai dari generasi dasar yang kuat atau referensi yang disetujui.
  2. Umpankan output sebelumnya kembali sebagai input gambar baru.
  3. Minta tepat satu perubahan.
  4. Ulangi daftar pelestarian lengkap pada setiap putaran.
  5. Inspeksi hasil sebelum melanjutkan.
  6. Untuk area yang harus tetap sempurna piksel-demi-piksel, kompositkan edit lokal yang disetujui ke dalam master asli.

Loop disiplin ini memanfaatkan konsistensi multi-putaran GPT Image 2.5 yang meningkat sambil meminimalkan drift kumulatif.

Flare vs. Sunburst: Model Mana Cocok untuk Prompt Mana?

KriteriaGPT-Image-2.5 FlareGPT-Image-2.5 Sunburst
Kekuatan utamaKecepatan + kualitas tinggi sehari-hariPresisi edit & fidelitas aset final
LatensiHingga ~50% lebih rendah dari GPT Image 2Waktu pembuatan lebih lama
Kasus penggunaan terbaikKonten sosial, prototyping, volume tinggi, iterasi cepatKreatif kampanye produksi, foto produk rapi, edit multi-putaran kompleks
Kualitas vs GPT Image 2Lebih tinggiKontrol tertinggi / pelestarian paling ketat
Titik awal yang direkomendasikanSebagian besar alur kerjaSaat kualitas atau presisi edit menjadi bottleneck
Harga tokenTarif sama untuk keduanyaTarif sama untuk keduanya
Latar transparan & tier kualitasDidukung penuh (rendah → maksimum)Didukung penuh

Aturan keputusan praktis: Eksplorasi ide, buat variasi, dan iterasi cepat di Flare. Saat Anda butuh versi akhir yang dipoles atau ketika rangkaian edit kompleks mulai drift, jalankan ulang prompt + referensi + pengaturan yang sama di Sunburst dan bandingkan. Banyak tim produksi menjaga kedua model tersedia dan mengarahkan trafik sesuai kebutuhan.

Templat Prompt (Siap Disesuaikan)

1. Clean Product Hero

Purpose: Ecommerce or landing-page hero, square or 4:5.
Subject: [exact product description including materials and any label text in quotes].
Composition: Centered or slight three-quarter view, soft contact shadow, generous negative space at top for headline.
Style: Clean studio lighting from the left, photorealistic, high texture detail.
Constraints: No extra text, no logos, no people reflections, seamless background.

2. Exact-Text Poster / Ad

A vertical poster. Headline “YOUR EXACT HEADLINE” in bold condensed sans-serif across the upper third. Subhead “Secondary line here” in smaller weight directly below. [Full scene and subject description]. [Style]. No other text or logos.

3. Precise Single-Element Edit

Change only the [specific element] to [new description]. Preserve the subject’s exact face/identity, pose, clothing details, camera angle, lighting direction, shadows, background, and all existing text. Match the new element’s lighting, perspective, and contact shadows to the original scene. Do not add any new objects, text, or watermarks.

4. Multi-Reference Character Consistency

Gunakan gambar 1 untuk wajah, proporsi tubuh, dan identitas karakter. Gunakan gambar 2 hanya untuk pakaian dan tekstur kain. Tempatkan karakter dari gambar 1 mengenakan pakaian dari gambar 2 di dalam [deskripsi adegan]. Cocokkan arah pencahayaan gambar 1. Pertahankan identitas dan pose secara persis. Tanpa aksesori atau teks tambahan.

5. Transparent Cutout / Asset

[Deskripsi subjek yang terperinci] terisolasi pada latar belakang transparan murni. Tepi bersih, tanpa drop shadow, tanpa elemen latar, tanpa bayangan kontak lantai kecuali diminta eksplisit. Fotorealistik. Output siap untuk compositing.

Ganti bagian dalam tanda kurung siku dengan spesifik Anda dan selalu ulangi kendala pada putaran penyuntingan berikutnya.

Mengapa Prompt Gagal

Pola kegagalan umum dan cara memperbaikinya:

  • Mengandalkan kata mood yang samar (“cozy,” “epic,” “premium”) tanpa detail visual → tambahkan skala konkret, arah cahaya, material, dan warna.
  • Mengemas banyak perubahan dalam satu prompt → batasi satu perubahan per putaran.
  • Melewatkan atau mempersingkat daftar pelestarian pada edit selanjutnya → detail drift; ulangi daftar lengkap setiap kali.
  • Teks persis tidak ditempatkan dalam tanda kutip atau tanpa panduan lokasi/tipografi → kata salah atau teks tambahan muncul.
  • Gambar referensi diunggah tanpa peran yang ditetapkan → model mencampurnya secara tak terduga.
  • Mengharapkan tier kualitas lebih tinggi menyelamatkan deskripsi yang lemah → prompt menentukan hasil; kualitas terutama memengaruhi perincian, biaya, dan latensi.
  • Menggunakan sintaks khusus, bobot, atau penumpukan kata kunci “masterpiece 8K ultra detailed” → kalimat yang jelas dan terurut secara konsisten mengungguli penumpukan kata kunci.
  • Melupakan instruksi integrasi pada edit → elemen baru terlihat seperti komposit alih-alih natural.

Pengaturan kualitas lebih tinggi (xhigh atau max) membantu untuk teks padat, detail halus, atau layout kompleks, tetapi tidak dapat menggantikan deskripsi yang kurang spesifik.

Kesalahan Prompting PT Image 2.5 yang Harus Anda Hindari?

KesalahanPendekatan lemahPendekatan lebih baik
Tidak ada deliverable“Buat sesuatu yang sinematik”“Buat foto produk 4:5 untuk iklan berbayar sosial”
Edit samar“Perbaiki latar belakang”“Ganti hanya latar belakang dengan…”
Tanpa aturan pelestarian“Ubah kemeja”Kunci wajah, pose, kamera, dan latar belakang
Referensi tanpa peran“Gunakan gambar-gambar ini”Beri setiap referensi satu peran
Terlalu banyak perubahanLima edit besar dalam satu permintaanSatu perubahan terkendali per pass
Asumsi prompt = kepatuhanPercaya hasil generasiLakukan QA visual

Mengakses GPT Image 2.5 Melalui CometAPI

CometAPI menyediakan akses kompatibel OpenAI ke gpt-image-2.5-flare dan gpt-image-2.5-sunburst dengan satu kunci API dan endpoint /v1/images/generations dan edits yang familiar. Keuntungannya mencakup autentikasi dan penagihan terpusat, tarif token kompetitif, peralihan mudah antara Flare dan Sunburst, visibilitas penggunaan, serta kemampuan menggabungkan pembuatan gambar dengan katalog lebih dari 500+ model tanpa mengelola banyak akun vendor.

Migrasi tipikal hanya memerlukan mengubah base URL ke https://api.cometapi.com/v1, menyuplai kunci CometAPI Anda, dan memilih ID model yang diinginkan. Setup ini sangat berharga untuk pipeline produksi yang perlu A/B dua varian, mengontrol biaya, atau merutekan tier kualitas secara efisien.

Untuk daftar parameter terbaru, harga, dan contoh kode, konsultasikan dokumentasi pembuatan gambar CometAPI bersamaan dengan panduan prompting gambar resmi OpenAI.

Kesimpulan

GPT Image 2.5 menghargai kejelasan, struktur, dan disiplin. Definisikan deliverable, jelaskan subjek dan komposisi yang terlihat dengan detail konkret, sebutkan gaya melalui pencahayaan/material/warna, letakkan teks persis dalam tanda kutip, dan (untuk setiap edit) bedakan secara tegas perubahan tunggal dari daftar pelestarian lengkap. Beri setiap gambar referensi tugas yang jelas, iterasikan satu keputusan pada satu waktu, dan biarkan parameter API menangani ukuran, kualitas, dan transparansi. Mulailah eksplorasi dan pekerjaan volume tinggi di Flare; beralih ke Sunburst ketika presisi akhir atau rangkaian edit kompleks menuntutnya.

Kuasai aturan Ubah vs Pertahankan dan struktur Subjek–Komposisi–Gaya–Teks–Kendala, dan GPT Image 2.5 menjadi alat produksi yang andal alih-alih sumber regenerasi tanpa akhir. Pasangkan dengan gateway terpadu seperti CometAPI untuk mendapatkan kekuatan kreatif dan kesederhanaan operasional.

FAQ

Haruskah prompt GPT Image 2.5 panjang?

Tidak harus. Prompt panjang penuh kata sifat samar bisa lebih lemah daripada prompt pendek dengan instruksi komposisi dan pelestarian yang presisi. Sertakan detail pada bagian yang kritikal jika gagal.

Bagaimana cara menghentikan GPT Image 2.5 dari mengubah seluruh gambar?

Gunakan instruksi sempit seperti “Hanya ubah jaket,” lalu daftar secara eksplisit apa yang harus tetap tidak berubah: identitas, pose, framing, posisi kamera, pencahayaan, latar belakang, teks, dan elemen lain yang telah disetujui.

Bagaimana cara mempertahankan wajah seseorang?

Gunakan foto referensi yang jelas, tetapkan sebagai referensi identitas otoritatif, dan nyatakan karakteristik mana yang harus stabil. Jangan sepenuhnya mengandalkan “orang yang sama.”

Bagaimana cara membuat GPT Image 2.5 menghasilkan teks persis?

Berikan naskah final apa adanya, nyatakan di mana teks harus muncul, tentukan hierarki, dan instruksikan model untuk tidak menambahkan kata lain. Selalu verifikasi teks akhir secara visual.

Bisakah GPT Image 2.5 membuat gambar PNG transparan?

Ya. Atur latar belakang menjadi transparan dan gunakan output PNG atau WebP.

Bisakah GPT Image 2.5 menghasilkan gambar 4K?

Ya. Batas maksimum yang didokumentasikan mencakup output 3840 × 2160 landscape dan 2160 × 3840 portrait. Resolusi di atas 2560 × 1440 bersifat eksperimental, dan dimensi kustom harus memenuhi batasan keterbagian dan rasio aspek API.

Apakah GPT Image 2.5 lebih baik untuk penyuntingan dibanding GPT Image 2?

OpenAI menyoroti peningkatan presisi penyuntingan, pelestarian referensi, dan konsistensi multi-putaran. Preferensi awal Arena juga memfavoritkan kedua varian 2.5 pada snapshot saat itu, namun peringkat awal ini dapat berubah.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Sep 21, 2026
Terakhir diperbarui Sep 21, 2026
4 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya