Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
guide/Penyelidikan CometAPI

Cara memberi arahan kepada GPT Image 2.5 seperti seorang profesional

Ketahui cara menulis prompt GPT Image 2.5 yang lebih baik dengan formula yang boleh digunakan semula, contoh praktikal, aliran kerja imej rujukan, serta petua penyuntingan yang tepat

CometAPI
AnnaPasukan penyelidikan model AI dan API
Dikemas kini Sep 21, 2026 14 min baca
Cara memberi arahan kepada GPT Image 2.5 seperti seorang profesional
Guna corak ini

Buat panggilan API pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR GPT Image 2.5 mengubah cara memprompt imej dalam satu hal penting: prompt yang baik bukan lagi hanya menerangkan apa yang anda mahu cipta. Untuk penyuntingan dan generasi berasaskan rujukan, ia juga perlu mendefinisikan perkara yang tidak boleh berubah.

Perkara ini penting kerana GPT Image 2.5 direka untuk penyuntingan yang lebih tepat dan pemeliharaan rujukan yang lebih kukuh. OpenAI menyatakan model ini lebih baik dalam menukar hanya elemen yang diminta sambil mengekalkan subjek, komposisi, dan butiran sekeliling.

Prompt GPT Image 2.5 yang baik = Deliverable + Subject + Scene + Composition + Visual Direction + Exact Text + Constraints + Output

Prompt Penyuntingan yang baik = Change Target + Preserve List + Integration Rules + Exclusions + Output

Formula kedua amat penting. Daripada berkata “Change the background to a beach,” tulis: “Replace only the background with a quiet Mediterranean beach at sunset. Keep the person, face, pose, clothing, camera position, framing, lighting direction, and foreground unchanged.”

Pengajaran Utama

  • GPT Image 2.5 meningkatkan kesetiaan, konsistensi berbilang pusingan, perenderan teks, dan kelajuan; Flare disyorkan sebagai titik permulaan untuk kebanyakan pengguna.
  • Formula generasi teras: Deliverable + Subject + Composition + Style + Exact Text (dalam tanda petikan) + Constraints/Exclusions.
  • Untuk penyuntingan, peraturan emas ialah “Change only X. Preserve [senarai penuh identiti, pose, pencahayaan, geometri, teks, gaya].”
  • Imej rujukan berbilang berjaya apabila setiap satu diberi tugas jelas (subjek, pakaian, latar belakang, palet, dll.).
  • Latar belakang telus, tipografi tepat, dan penyuntingan berjujukan jauh lebih kukuh apabila diprompt dengan betul dan parameter ditetapkan dengan tepat.
  • Flare mengutamakan kelajuan dan volum; Sunburst mengutamakan ketepatan suntingan dan kesetiaan aset akhir. Kedua-duanya berkongsi kadar token yang sama.
  • CometAPI menawarkan capaian bersatu dan kos efektif kepada gpt-image-2.5-flare dan gpt-image-2.5-sunburst melalui laluan serasi OpenAI yang biasa.

Apakah GPT Image 2.5

OpenAI mengeluarkan ChatGPT Images 2.5 pada 8 September 2026. Kemas kini ini memfokus pada butiran yang lebih tajam, pencahayaan dan tekstur yang lebih semula jadi, kesetiaan imej rujukan, penyuntingan tepat, dan konsistensi yang lebih kukuh merentasi berbilang pusingan penyuntingan. OpenAI juga melaporkan latensi penjanaan imej yang sehingga 50% lebih rendah berbanding Images 2.0.

Untuk pembangun, keluarga ini dibahagikan kepada dua model API:

  • GPT-Image-2.5 Flare — dioptimumkan untuk generasi harian pantas berkualiti tinggi dan aliran kerja volum tinggi.
  • GPT-Image-2.5 Sunburst — dioptimumkan untuk aliran kerja generasi dan penyuntingan yang menuntut, di mana ketepatan lebih penting daripada latensi.

Pembangun juga boleh menggunakan API GPT Image 2.5 dalam CometAPI, termasuk pengecam model gpt-image-2.5-flare dan gpt-image-2.5-sunburst.

Penanda aras dan keupayaan

Penanda aras Arena teks-ke-imejGPT Image 2.5 SunburstGPT Image 2.5 FlareGPT Image 2
Skor teks-ke-imej1421 ± 131399 ± 131381 ± 4
Kedudukan teks-ke-imej#1#2#3
Skor suntingan satu imej1520 ± 91491 ± 91461 ± 3
Kedudukan suntingan satu imej#1#2#3

Ujian bebas dan kedudukan Arena awal meletakkan kedua-dua model di puncak papan pendahulu teks-ke-imej dan penyuntingan imej sejurus selepas pelancaran, dengan peningkatan jelas dalam komposisi, butiran, kesetiaan gaya, pemeliharaan subjek, dan kelajuan (Flare sering menamatkan dalam ~20–40 saat berbanding generasi terdahulu yang jauh lebih lama dalam beberapa penanda aras).

Keupayaan utama termasuk input teks + imej, output imej sehingga kira-kira 4K (dengan kekangan: dimensi tepi gandaan 16, maks ~3840 px setiap sisi, nisbah aspek ≤ 3:1), latar belakang telus (PNG/WebP), peringkat kualiti (rendah → maks), pratonton progresif, inpainting/suntingan khusus kawasan, dan sokongan kukuh untuk rujukan berbilang serta penyuntingan berjujukan. OpenAI melaporkan lebih daripada 3 bilion imej dicipta setiap minggu merentasi ChatGPT Images dan keluarga API GPT-Image.

Formula Umum untuk Menjana dan Menyunting GPT Image 2.5

Peraturan Paling Penting: Ubah vs Kekalkan

Perbezaan ini ialah tabiat paling bernilai untuk GPT Image 2.5.

Generasi (imej baharu daripada teks atau rujukan)
Terangkan segala yang anda mahu muncul. Nyatakan secara konkrit subjek, pembingkaian, pencahayaan, bahan, warna, dan perkara yang tidak boleh muncul.

Penyuntingan (imej-ke-imej atau penapisan berbilang pusingan)

  1. Namakan tepat satu perubahan.
  2. Senaraikan dengan jelas segala yang mesti kekal tidak berubah (identiti, pose, sudut kamera, pembingkaian, arah pencahayaan, bayang-bayang, elemen latar, teks sedia ada, warna, geometri, gaya keseluruhan).
  3. Terangkan bagaimana elemen baharu harus bersepadu dengan cahaya, perspektif, tekstur, dan bayang sentuhan sedia ada.
  4. Tambah pengecualian yang jelas (tiada teks tambahan, tiada logo, tiada tera air, tiada retus berat).

Prompt dengan pelbagai perubahan yang kabur atau senarai kekal yang hilang menyebabkan hanyutan kumulatif. Ulang nyatakan senarai kekal pada setiap pusingan. Apabila kawasan mesti kekal identik piksel, gabungkan suntingan setempat yang diluluskan kembali ke imej induk asal dan jangan bergantung pada model semata-mata.

Rangka minimum generasi

[Deliverable / kegunaan yang dimaksudkan] + Subjek + Komposisi + Gaya / pencahayaan / bahan + Teks tepat dalam tanda petikan + Kekangan dan pengecualian

Rangka minimum suntingan

Ubah hanya [elemen khusus] kepada [perihalan baharu]. Kekalkan [identiti, pose, pembingkaian, pencahayaan, bayang, latar, teks, warna, gaya]. Padankan elemen baharu dengan cahaya dan geometri sedia ada. Jangan tambah [elemen yang tidak dikehendaki].

Cara Prompting GPT Image 2.5 Berfungsi

Panduan prompting rasmi OpenAI adalah jelas: mulakan dengan imej yang anda perlukan, kemudian terangkan subjek, komposisi, gaya, dan kekangan. Untuk penyuntingan, pisahkan dengan jelas perubahan yang diminta daripada butiran yang mesti kekal sama. Perhalusi satu perkara pada satu masa dan periksa setiap hasil. Strukturkan prompt sebagai Subjek → Komposisi → Gaya → Teks (dalam petikan) → Kekangan. Tugaskan peranan jelas kepada setiap imej rujukan, ulang satu perubahan pada satu masa, dan tetapkan saiz/kualiti/latar sebagai parameter API, bukan teks prompt.

Subjek

Namakan orang, objek, atau adegan utama dengan butiran yang boleh dilihat dan diuji: rupa, pakaian, pose, aksi, skala relatif, dan interaksi dengan objek.
Contoh: “Seorang arkivis muda berambut bob auburn pendek, berkaca bulat hitam, dan berkot kerja biru navy memegang sampul kertas tertutup dengan lambang bulan lilin merah.”

Komposisi

Nyatakan pembingkaian, ketinggian dan sudut kamera, penempatan subjek (tengah, suku kiri, dll.), ruang negatif, kedalaman medan, dan apa yang mesti kelihatan (badan penuh dengan kaki, jarak dekat sederhana, dll.).
Contoh: “Badan penuh, kaki kelihatan, kamera pada paras mata rendah. Watak di suku kiri; rak arkib tanpa henti meluncur ke belakangnya. Ruang gelap bersih di bahagian kanan atas untuk penempatan tajuk kemudian.”

Gaya

Terangkan medium visual, pencahayaan (sumber + arah), bahan, palet warna, tekstur, dan tahap realisme. Utamakan bahasa visual yang konkrit daripada adjektif suasana semata-mata. Nyatakan dengan jelas “fotorealistik,” “fotografi sebenar,” butiran butiran seperti bijian filem, atau gaya artistik bernama apabila diperlukan.
Contoh: “Latar anime dilukis tangan terperinci, bayang cel yang sederhana, perkadaran semula jadi. Satu lampu meja hangat melawan cahaya bulan biru sejuk dari tingkap tinggi.”

Teks

Letakkan setiap rentetan yang diperlukan dalam tanda petikan. Nyatakan lokasi, hierarki, anggaran tipografi, dan berapa kali teks harus muncul. Eja nama ganjil atau jenama huruf demi huruf apabila kritikal. Sentiasa minta “tiada teks lain.”
Contoh: tajuk "Open Late" dalam jenis tebal condensed merentasi bahagian atas, dan "Thursday to Sunday" dalam jenis lebih kecil di bahagian bawah. Tiada teks lain.

Kekangan / Pengecualian

Senaraikan perkara yang tidak boleh muncul dan apa yang mesti kekal tidak berubah. Pengecualian bernilai tinggi termasuk tiada teks tambahan, tiada logo, tiada tera air, dan tiada objek yang tidak diingini.

Untuk permintaan yang lebih panjang atau kompleks, gunakan bahagian berlabel (SCENE / SUBJECT / STYLE / TEXT / CONSTRAINTS). Ini memperbaiki kebolehbacaan dan memudahkan penyelenggaraan suntingan kemudian.

Nota teknikal kritikal: Tetapkan model, kualiti, saiz (atau aspek), dan latar (auto / legap / telus) sebagai parameter API. Jangan bergantung pada teks prompt untuk menguatkuasakan resolusi atau ketelusan.

Bagaimana Menggunakan Imej Rujukan Berbilang dengan GPT Image 2.5?

GPT Image 2.5 menerima input imej berbilang. Hasil bertambah baik dengan ketara apabila setiap rujukan diberikan peranan jelas.

Pola yang disyorkan:

  1. Nomborkan atau namakan dengan jelas setiap imej rujukan.
  2. Nyatakan tugas tepatnya: identiti subjek utama, rujukan pakaian/gaya, latar/setting, palet warna sahaja, rujukan pencahayaan, dll.
  3. Terangkan bagaimana elemen harus digabungkan dan bahagian mana bergerak ke mana.
  4. Ulang nyatakan kekangan pemeliharaan untuk subjek utama dan sebarang butiran yang dilindungi.

Contoh: “Gunakan imej 1 sebagai produk (botol air matte hitam dengan teks label tepat). Gunakan imej 2 hanya untuk tepi konkrit pucat dan arah pencahayaan luar semula jadi. Letakkan botol dari imej 1 pada tepi dari imej 2, memadankan bayang lembut sedia ada dan sudut cahaya. Kekalkan bentuk tepat botol, teks label, warna, dan pantulan. Jangan ubah tekstur konkrit atau tambah sebarang objek tambahan.”

Penugasan peranan yang jelas menghalang hibridisasi subjek atau gaya yang tidak diingini.

Teknik Prompting Lanjutan

Tutorial Teks Tepat & Tipografi

  • Sentiasa letakkan rentetan yang diperlukan dalam tanda petikan.
  • Nyatakan kedudukan, hierarki, anggaran berat dan gaya, serta bilangan kemunculan teks.
  • Minta “tiada teks lain,” “tiada logo,” dan “tiada tera air.”
  • Untuk susun atur padat atau fon berbilang, uji kualiti sederhana atau tinggi dan sahkan secara visual ejaan dan kebolehbacaan dalam output.
  • Nama jenama kritikal boleh dieja huruf demi huruf untuk kebolehpercayaan tambahan.

Latar Belakang Telus

Tetapkan background="transparent" dalam panggilan API (atau kawalan UI yang setara) dan minta output PNG atau WebP. Minta tepi yang bersih dan tiada apa-apa di belakang subjek. Periksa saluran alfa dengan teliti di sekitar rambut, kaca, butiran halus, dan kawasan sentuhan. Tambah pengecualian seperti “tiada elemen latar, tiada bayang jatuh melainkan diminta.” Generasi telus jauh lebih boleh dipercayai dalam 2.5 apabila parameter dan kekangan prompt kedua-duanya betul.

Aliran Kerja Penyuntingan Berbilang Pusingan

  1. Mulakan daripada generasi asas yang kuat atau rujukan yang diluluskan.
  2. Suapkan output sebelumnya kembali sebagai imej input baharu.
  3. Minta tepat satu perubahan.
  4. Ulang nyatakan senarai kekal lengkap pada setiap pusingan.
  5. Periksa hasil sebelum meneruskan.
  6. Untuk kawasan yang mesti kekal sempurna piksel, kompositkan suntingan setempat yang diluluskan ke dalam imej induk asal.

Gelung berdisiplin ini memanfaatkan konsistensi berbilang pusingan GPT Image 2.5 yang dipertingkatkan sambil meminimumkan hanyutan kumulatif.

Flare vs. Sunburst: Model Mana Sesuai untuk Prompt Mana?

KriteriaGPT-Image-2.5 FlareGPT-Image-2.5 Sunburst
Kekuatan utamaKelajuan + kualiti harian tinggiKetepatan suntingan & kesetiaan aset akhir
LatensiSehingga ~50% lebih rendah daripada GPT Image 2Masa generasi lebih panjang
Kes penggunaan terbaikKandungan sosial, pemprotan, volum tinggi, iterasi pantasKreatif kempen produksi, foto produk digilap, suntingan kompleks berbilang
Kualiti vs GPT Image 2Lebih tinggiKawalan tertinggi / pemeliharaan paling ketat
Titik permulaan yang disyorkanKebanyakan aliran kerjaApabila kualiti atau ketepatan suntingan menjadi halangan
Harga tokenKadar yang sama untuk kedua-duanyaKadar yang sama untuk kedua-duanya
Latar telus & peringkat kualitiDisokong sepenuhnya (rendah → maks)Disokong sepenuhnya

Peraturan keputusan praktikal: Teroka idea, jana variasi, dan ulang dengan pantas pada Flare. Apabila anda memerlukan versi akhir yang digilap atau apabila urutan suntingan kompleks mula hanyut, jalankan semula prompt + rujukan + tetapan yang sama pada Sunburst dan bandingkan. Banyak pasukan produksi mengekalkan kedua-dua model dan menghala trafik sewajarnya.

Templat Prompt (Sedia untuk Disesuaikan)

1. Clean Product Hero

Purpose: Ecommerce or landing-page hero, square or 4:5.
Subject: [exact product description including materials and any label text in quotes].
Composition: Centered or slight three-quarter view, soft contact shadow, generous negative space at top for headline.
Style: Clean studio lighting from the left, photorealistic, high texture detail.
Constraints: No extra text, no logos, no people reflections, seamless background.

2. Exact-Text Poster / Ad

A vertical poster. Headline “YOUR EXACT HEADLINE” in bold condensed sans-serif across the upper third. Subhead “Secondary line here” in smaller weight directly below. [Full scene and subject description]. [Style]. No other text or logos.

3. Precise Single-Element Edit

Change only the [specific element] to [new description]. Preserve the subject’s exact face/identity, pose, clothing details, camera angle, lighting direction, shadows, background, and all existing text. Match the new element’s lighting, perspective, and contact shadows to the original scene. Do not add any new objects, text, or watermarks.

4. Konsistensi Watak Berbilang Rujukan

Gunakan imej 1 untuk wajah, perkadaran badan, dan identiti watak. Gunakan imej 2 hanya untuk pakaian dan tekstur fabrik. Letakkan watak daripada imej 1 memakai pakaian daripada imej 2 di dalam [perihalan adegan]. Padankan arah pencahayaan imej 1. Kekalkan identiti dan pose dengan tepat. Tiada aksesori atau teks tambahan.

5. Transparent Cutout / Asset

[Detailed subject description] isolated on a pure transparent background. Clean edges, no drop shadow, no background elements, no floor contact shadow unless explicitly requested. Photorealistic. Output ready for compositing.

Gantikan bahagian bertanda kurungan dengan spesifikasi anda dan sentiasa ulang nyatakan kekangan pada pusingan penyuntingan berikutnya.

Mengapa Prompt Gagal

Pola kegagalan biasa dan cara membetulkannya:

  • Bergantung pada kata sifat suasana yang kabur (“cozy,” “epic,” “premium”) tanpa butiran visual terlampir → tambah skala konkrit, arah cahaya, bahan, dan warna.
  • Memasukkan pelbagai perubahan dalam satu prompt → hadkan kepada satu perubahan setiap pusingan.
  • Mengabaikan atau memendekkan senarai kekal pada suntingan berikutnya → butiran hanyut; ulang nyatakan senarai penuh setiap kali.
  • Teks tepat tidak diletakkan dalam tanda petikan atau tanpa panduan lokasi/tipografi → perkataan salah atau teks tambahan muncul.
  • Imej rujukan dimuat naik tanpa peranan yang ditugaskan → model menggabungkannya secara tidak dapat diramal.
  • Menyangka peringkat kualiti lebih tinggi akan menyelamatkan perihalan lemah → prompt menentukan hasil; kualiti terutamanya mempengaruhi penapisan, kos, dan latensi.
  • Menggunakan sintaks khas, pemberat, atau penumpukan kata kunci “masterpiece 8K ultra detailed” → ayat jelas dan teratur secara konsisten mengatasi penumpukan kata kunci.
  • Lupa arahan integrasi pada suntingan → elemen baharu kelihatan terkomposit, bukan semula jadi.

Tetapan kualiti lebih tinggi (xhigh atau max) membantu untuk teks padat, butiran halus, atau susun atur kompleks, tetapi tidak dapat menggantikan perihalan yang kurang dinyatakan.

PT Image 2.5 Prompting Mistakes Should You Avoid?

KesilapanPendekatan lemahPendekatan lebih baik
Tiada deliverable“Make something cinematic”“Create a 4:5 paid-social product photograph”
Suntiangan kabur“Improve the background”“Replace only the background with…”
Tiada peraturan pemeliharaan“Change the shirt”Kunci muka, pose, kamera, dan latar
Rujukan tidak ditugaskan“Use these images”Beri setiap rujukan satu peranan
Terlalu banyak perubahanLima suntingan besar satu permintaanSatu perubahan terkawal setiap laluan
Andaian prompt = pematuhanPercaya generasiLaksanakan QA visual

Mengakses GPT Image 2.5 Melalui CometAPI

CometAPI menyediakan capaian serasi OpenAI kepada kedua-dua gpt-image-2.5-flare dan gpt-image-2.5-sunburst di bawah satu kunci API dan endpoint /v1/images/generations dan edits yang biasa. Manfaat termasuk pengesahan dan pengebilan berpusat, kadar token kompetitif, pertukaran mudah antara Flare dan Sunburst, keterlihatan penggunaan, dan kebolehan menggabungkan penjanaan imej dengan katalog 500+ model yang lebih luas tanpa mengurus pelbagai akaun vendor.

Migrasi tipikal hanya memerlukan menukar URL asas kepada https://api.cometapi.com/v1, membekalkan kunci CometAPI anda, dan memilih ID model yang dikehendaki. Persediaan ini amat berharga untuk talian produksi yang perlu A/B dua varian tersebut, mengawal kos, atau menghala peringkat kualiti yang berbeza dengan cekap.

Untuk senarai parameter terkini, harga, dan contoh kod, rujuk dokumentasi penjanaan imej CometAPI bersama panduan prompting imej rasmi OpenAI.

Kesimpulan

GPT Image 2.5 memberi ganjaran kepada kejelasan, struktur, dan disiplin. Tentukan deliverable, terangkan subjek dan komposisi yang boleh dilihat dengan butiran konkrit, namakan gaya melalui pencahayaan/bahan/warna, letakkan teks tepat dalam tanda petikan, dan (untuk setiap suntingan) pisahkan dengan tegas perubahan tunggal daripada senarai kekal penuh. Berikan setiap imej rujukan tugas yang jelas, ulang satu keputusan pada satu masa, dan biarkan parameter API mengendalikan saiz, kualiti, dan ketelusan. Mulakan penerokaan dan kerja volum tinggi pada Flare; beralih ke Sunburst apabila ketepatan akhir atau urutan suntingan kompleks menuntutnya.

Kuasai peraturan Ubah vs Kekalkan dan struktur Subjek–Komposisi–Gaya–Teks–Kekangan, dan GPT Image 2.5 menjadi alat produksi yang boleh dipercayai bukannya sumber regenarasi tanpa henti. Pasangkan dengan gerbang bersatu seperti CometAPI dan anda memperoleh kuasa kreatif serta kesederhanaan operasi.

Soalan Lazim

Adakah prompt GPT Image 2.5 perlu panjang?

Tidak semestinya. Prompt panjang yang penuh dengan adjektif kabur boleh lebih lemah daripada prompt pendek dengan arahan komposisi dan pemeliharaan yang tepat. Sertakan butiran pada bahagian yang kegagalan akan memberi kesan.

Bagaimana saya menghalang GPT Image 2.5 daripada mengubah keseluruhan imej?

Gunakan arahan sempit seperti “Change only the jacket,” kemudian senaraikan dengan jelas perkara yang mesti kekal tidak berubah: identiti, pose, pembingkaian, kedudukan kamera, pencahayaan, latar, teks, dan elemen lain yang diluluskan.

Bagaimana saya memelihara wajah seseorang?

Gunakan foto rujukan yang jelas, tugaskan ia sebagai rujukan identiti autoritatif, dan nyatakan ciri yang mesti kekal stabil. Jangan bergantung sepenuhnya pada “orang sama.”

Bagaimana saya membuat GPT Image 2.5 menjana teks tepat?

Sediakan salinan akhir secara verbatim, nyatakan tempat ia harus muncul, tentukan hierarki, dan minta model untuk tidak menambah perkataan lain. Sentiasa sahkan teks akhir secara visual.

Bolehkah GPT Image 2.5 mencipta imej PNG telus?

Ya. Tetapkan latar belakang kepada telus dan gunakan output PNG atau WebP.

Bolehkah GPT Image 2.5 menjana imej 4K?

Ya. Maksimum yang didokumenkan termasuk 3840 × 2160 lanskap dan 2160 × 3840 potret. Resolusi di atas 2560 × 1440 adalah eksperimen, dan dimensi tersuai mesti memenuhi kekangan kebolehbahagian dan nisbah aspek API.

Adakah GPT Image 2.5 lebih baik untuk penyuntingan berbanding GPT Image 2?

OpenAI menonjolkan penyuntingan ketepatan yang dipertingkat, pemeliharaan rujukan, dan konsistensi berbilang pusingan. Keputusan pilihan Arena awal juga memihak kepada kedua-dua varian 2.5 pada snapshot bertarikh tersebut, tetapi kedudukan awal ini boleh berubah.

Terus belajar

Sambungkan artikel ini ke keputusan seterusnya.

Lihat semua topik
Diterbitkan pada Sep 21, 2026
Terakhir dikemas kini Sep 21, 2026
59 paparan
Disemak untuk kejelasan, atribusi sumber dan terminologi API semasa.

Baca Lagi