Wan3.0, GLM-5.3 Flash, and Qwen3.8 Flash are now live on CometAPI →
technology/Riset CometAPI

Harga GPT-5.6 2026: Biaya API Sol, Terra & Luna

请提供需要翻译的原始文本或文件(如定价页面、文档、HTML/Markdown/JSON/XML/代码片段等),我将在严格保留结构与技术元素不变的前提下,将其中可读内容精准翻译为 Bahasa Indonesia。

CometAPI
Mia MarenTim riset model AI dan API
Diperbarui Sep 1, 2026 12 menit baca
Harga GPT-5.6 2026: Biaya API Sol, Terra & Luna
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Harga diperbarui: Tarif konteks pendek Standard GPT-5.6 kini $5 input / $30 output untuk Sol, $2 / $12 untuk Terra, dan $0.20 / $1.20 untuk Luna per 1 juta token.

Pada 30 Juli 2026, OpenAI menurunkan harga GPT-5.6 Terra sebesar 20% dan Luna sebesar 80%. Harga Sol tetap tidak berubah.

Perhatikan pendorong biaya tersembunyi: alias umum gpt-5.6 diarahkan ke Sol, permintaan di atas 272K token input menggunakan tarif konteks panjang yang lebih tinggi, dan token output masih lebih mahal daripada token input di ketiga tier.

Untuk beban kerja Sol yang sensitif terhadap latensi, Fast mode baru dari OpenAI menawarkan pemrosesan hingga 2.5× lebih cepat dengan harga Standard.

Sekilas Harga OpenAI API

Bagi pengguna yang mencari secara umum tentang harga OpenAI API, pertanyaan pertama biasanya: model saat ini mana yang sebenarnya saya bayar? Tabel di bawah ini memberikan tampilan ringkas beberapa model teks OpenAI saat ini sebelum kita melihat lebih dekat GPT-5.6.

(> Pembaruan harga — 30 Juli 2026: OpenAI menurunkan harga API GPT-5.6 Terra sebesar 20% dan Luna sebesar 80%. Terra kini berharga $2 per 1M token input dan $12 per 1M token output, sementara Luna berharga $0.20 input dan $1.20 output. Harga Sol tetap tidak berubah.)

ModelInput / 1 juta tokenInput yang di-cacheOutput / 1 juta token
gpt-5.6-sol$5.00$0.50$30.00
gpt-5.6-terra$2.00$0.20$12.00
gpt-5.6-luna$0.20$0.02$1.20
gpt-5.5$5.00$0.50$30.00
gpt-5.4$2.50$0.25$15.00
gpt-5.4-mini$0.75$0.075$4.50
gpt-5.4-nano$0.20$0.02$1.25

Pada harga barunya, Luna menyamai tarif input $0.20 milik GPT-5.4 nano sekaligus menawarkan tarif output sedikit lebih rendah $1.20 dibanding $1.25.

Sumber*:* Harga OpenAI API

Pola terpenting mudah terlewat: token output GPT-5.6 berharga 6× dari token input di Sol, Terra, dan Luna. Jawaban panjang, agen yang verbose, dan alur kerja berat penalaran dapat menaikkan biaya lebih cepat daripada perubahan kecil pada panjang prompt.

Untuk tinjauan lebih luas tentang keluarga GPT-5.6—termasuk kemampuan model, posisi, tolok ukur, akses API, dan fitur peluncuran utama—lihat [Pengumuman GPT-5.6] OpenAI(https://openai.com/index/gpt-5-6/)atau Panduan GPT-5.6. dari CometAPI. Artikel ini berfokus khusus pada harga, perhitungan biaya, dan faktor yang dapat memengaruhi tagihan API nyata Anda.

Harga GPT-5.6: Sol vs Terra vs Luna

GPT-5.6 memperkenalkan tiga tier harga. OpenAI memposisikan Sol sebagai rute flagship, Terra sebagai opsi seimbang, dan Luna sebagai tier berbiaya lebih rendah untuk beban kerja volume tinggi.

Untuk gambaran lebih dalam tentang kemampuan, cara mengakses API GPT-5.6, dan use case masing-masing model,details to see the here about Model GPT-5.6.

Harga Standard GPT-5.6 untuk permintaan dengan ≤272K token input

ModelInput pendekInput yang di-cachePenulisan cacheOutput pendekInput panjangInput panjang yang di-cachePenulisan cache panjangOutput panjang
gpt-5.6-sol$5.00$0.50$6.25$30.00$10.00$1.00$12.50$45.00
gpt-5.6-terra$2.00$0.20$2.50$12.00$4.00$0.40$5.00$18.00
gpt-5.6-luna$0.20$0.02$0.25$1.20$0.40$0.04$0.50$1.80

Sumber*:* Harga OpenAI API

Harga konteks panjang: Permintaan dengan lebih dari 272K token input menggunakan tarif yang lebih tinggi. Input, input yang di-cache, dan penulisan cache ditagihkan dari tarif standar, sementara output ditagihkan 1.5×. Tarif yang lebih tinggi berlaku untuk seluruh permintaan.

Titik awal yang masuk akal adalah menguji Luna untuk tugas yang lebih sederhana dan bervolume tinggi, Terra untuk beban kerja aplikasi yang seimbang, dan Sol untuk tugas tersulit atau berdampak tinggi. Ini bukan rekomendasi universal: akurasi, retry, perilaku tool, dan review manusia dapat lebih menentukan daripada perbedaan harga daftar.

Satu detail alias penting

Panduan model OpenAI menyatakan bahwa alias umum gpt-5.6 diarahkan ke gpt-5.6-sol.

Artinya, permintaan yang dikirim ke gpt-5.6 menggunakan tier harga Sol. Jika beban kerja Anda berjalan baik di Terra atau Luna, gunakan ID model eksplisit alih-alih mengasumsikan alias umum memilih tier termurah yang cocok.

Contoh 1: Permintaan API Umum

Mulai dengan bentuk permintaan yang umum:

  • 1,000 token input
  • 500 token output
ModelBiaya input bulananBiaya output bulananTotal
gpt-5.6-sol$10,000$15,000$25,000
gpt-5.6-terra$4,000$6,000$10,000
gpt-5.6-luna$400$600$1,000

Di bawah beban kerja ini, harga baru Luna menurunkan estimasi tagihan token bulanan dari $5,000 menjadi $1,000, sementara Terra turun dari $12,500 menjadi $10,000.

Perhitungan untuk Sol:

(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020

Contoh ini juga menunjukkan mengapa panjang output penting. Meskipun permintaan berisi dua kali lebih banyak token input daripada token output, bagian output mewakili 75% dari biaya token Sol karena output dihargai enam kali tarif input.

Untuk chat, agen, dan pembuatan kode, mengendalikan verbositas yang tidak perlu terkadang dapat menghemat lebih banyak daripada memangkas prompt sistem yang kecil.

Contoh 2: Biaya Bulanan pada Skala

Sekarang asumsikan sebuah aplikasi menangani 1 juta permintaan per bulan, rata-rata:

  • 2,000 token input per permintaan
  • 500 token output per permintaan

Itu setara dengan 2 miliar token input dan 500 juta token output per bulan.

ModelBiaya input bulananBiaya output bulananTotal
gpt-5.6-sol$10,000$15,000$25,000
gpt-5.6-terra$5,000$7,500$12,500
gpt-5.6-luna$2,000$3,000$5,000

Kesenjangan cukup besar untuk membenarkan pengujian routing, namun baris paling bawah bukan otomatis pilihan terbaik produksi. Jika model yang lebih murah menyebabkan lebih banyak retry, tugas gagal, atau review manual, total biaya alur kerja bisa lebih tinggi.

Harga Konteks Panjang: Apa yang Terjadi di Atas 272K Token?

Model GPT-5.6 mendukung jendela konteks 1.05M token, tetapi OpenAI menerapkan tarif yang lebih tinggi ketika suatu permintaan berisi lebih dari 272,000 token input.

Untuk permintaan konteks panjang ini:

  • input ditagih dari tarif konteks pendek
  • input yang di-cache dan penulisan cache juga ditagih
  • output ditagih 1.5×
  • Tarif yang lebih tinggi berlaku untuk seluruh permintaan, bukan hanya token di atas 272K

Untuk Sol, itu mengubah input dari $5 menjadi $10 per 1M token dan output dari $30 menjadi $45. Struktur pengali yang sama berlaku untuk Terra dan Luna.

Ini menciptakan tebing biaya di dekat 272K. Untuk beban kerja yang mendekati ambang batas, kurangi potongan retrieval duplikat, riwayat percakapan yang usang, file repositori yang tidak perlu, atau output tool yang verbose sebelum mengirim permintaan. Lihat panduan optimasi biaya OpenAI untuk panduan pengurangan token tambahan.

Harga Standard, Batch, Flex, dan Priority

Untuk beban kerja teks GPT-5.6 yang memenuhi syarat, OpenAI menawarkan beberapa tier pemrosesan.

TierSol input/outputTerra input/outputLuna input/outputPenggunaan umum
Standard$5 / $30$2 / $12$0.20 / $1.20Lalu lintas sinkron normal
Batch$2.50 / $15$1 / $6$0.10 / $0.60Pekerjaan asinkron offline
Flex$2.50 / $15$1 / $6$0.10 / $0.60Beban kerja sensitif biaya yang dapat mentoleransi pemrosesan lebih lambat
Fast mode$10 / $60$4 / $24$0.40 / $2.40Lalu lintas konteks pendek sensitif latensi

Batch dan Flex tetap sekitar 50% lebih murah daripada harga Standard. Priority Processing diubah namanya menjadi Fast mode pada 30 Juli 2026, meskipun permintaan yang ada menggunakan service_tier: "priority" tetap kompatibel.

Untuk GPT-5.6 Sol, Fast mode menyediakan pemrosesan hingga 2.5× lebih cepat daripada Standard dengan harga token 2× Standard, tanpa perubahan kecerdasan model. Ini paling tepat ketika latensi yang dihadapi pengguna cukup penting untuk membenarkan premi.

Prompt Caching: Kapan Menghemat Biaya untuk GPT-5.6?

Untuk GPT-5.6, penulisan cache berharga 1.25× dari tarif input normal, sementara pembacaan yang di-cache menerima harga input yang di-cache yang lebih rendah.

Pertimbangkan awalan 100,000 token yang dapat digunakan kembali di Sol:

TindakanBiaya
Memproses sekali sebagai input normal tanpa cache$0.50
Menulis awalan ke cache$0.63
Membaca awalan yang di-cache nanti$0.05

Dua penggunaan tanpa cache berharga $1.00. Satu penulisan cache ditambah satu pembacaan cache yang cocok berharga $0.675, menghemat $0.325 dalam contoh yang disederhanakan ini.

Batas contoh ini: Perhitungan ini hanya membandingkan biaya input awalan yang dapat digunakan kembali. Ini tidak termasuk token output, input lain yang tidak di-cache, tool, atau retry. Penghematan nyata bergantung pada apakah awalan cocok dengan persyaratan cache dan seberapa sering benar-benar digunakan kembali.

Karena itu, caching paling berguna untuk awalan prompt yang panjang dan stabil yang menerima permintaan berulang yang cocok. Penulisan cache yang tidak pernah digunakan ulang menambah biaya alih-alih menguranginya.

panduan prompt caching OpenAI mendokumentasikan harga penulisan cache, pembacaan yang di-cache, breakpoint eksplisit, dan perilaku TTL.

Biaya Lain yang Dapat Mengubah Tagihan OpenAI API Anda

Token penalaran dan Pro mode

Token penalaran ditagihkan sebagai token output bahkan ketika tidak ditampilkan sebagai teks respons yang terlihat. Pengaturan penalaran yang lebih tinggi karenanya dapat meningkatkan total penggunaan token output dan latensi.

Di tempat yang didukung, reasoning.mode = "pro" lebih baik diperlakukan sebagai konfigurasi untuk benchmark, bukan aturan penghematan biaya atau kualitas default. OpenAI tidak mencantumkan biaya tetap Pro terpisah untuk mode ini; dampak biaya berasal dari penggunaan token yang dihasilkan. Tolok ukur yang masuk akal adalah menguji Standard dan Pro pada tugas perwakilan dan membandingkan keberhasilan tugas, total token output, latensi, dan retry.

Web search dan alat lain

OpenAI saat ini mencantumkan web search standar sebesar $10 per 1,000 panggilan, plus token konten pencarian yang ditagihkan pada tarif model yang dipilih. Dua web search pada permintaan Luna kecil karenanya dapat berharga lebih mahal daripada token model permintaan itu.

OpenAI juga mencantumkan harga web search preview terpisah untuk model non-reasoning sebesar $25 per 1,000 panggilan, dengan token konten pencarian gratis. Periksa kombinasi tool dan model yang tepat pada halaman harga resmi alih-alih menerapkan satu tarif web search ke setiap endpoint.

Pemrosesan regional

Endpoint pemrosesan regional atau residensi data yang memenuhi syarat untuk model yang dirilis pada atau setelah 5 Maret 2026 memiliki kenaikan 10% menurut halaman harga OpenAI. Tim perusahaan dengan persyaratan residensi harus memasukkan faktor tersebut dalam estimasi anggaran.

Cara Menghitung Biaya OpenAI API

Untuk permintaan dasar:

Biaya token =

(token input / 1M × tarif input)

  • (token output / 1M × tarif output)

Untuk perencanaan produksi, perluas agar mencakup:

Total biaya alur kerja =

input yang tidak di-cache

  • input yang di-cache
  • penulisan cache
  • token output dan penalaran
  • biaya tool
  • penyesuaian tier layanan
  • kenaikan regional, jika berlaku
  • retry dan permintaan fallback

KPI yang paling berguna sering kali adalah:

Biaya per tugas berhasil = total biaya alur kerja / tugas yang berhasil

Ini mencegah tarif token yang lebih murah tampak menarik secara artifisial ketika juga menghasilkan lebih banyak kegagalan atau pekerjaan review.

Cara Memilih Model yang Tepat Tanpa Membayar Berlebihan

Gunakan tabel harga sebagai titik awal, lalu uji pada tugas nyata.

  1. Mulai dengan model berbiaya terendah yang tampak mampu menyelesaikan tugas. Luna dapat menjadi uji awal yang masuk akal untuk pekerjaan sederhana dan bervolume tinggi, tetapi jangan menganggapnya terbaik untuk setiap ekstraksi atau rangkuman.
  2. Ukur panjang output. Token output GPT-5.6 berharga 6× token input, jadi respons yang verbose layak diperhatikan.
  3. Perhatikan ambang 272K. Melewatinya mengubah tarif untuk seluruh permintaan.
  4. Gunakan Batch atau Flex untuk pekerjaan non-urgent yang memenuhi syarat. Uji kendala operasional sebelum memindahkan lalu lintas produksi.
  5. Cache hanya awalan yang dapat digunakan ulang. Ukur hit cache aktual alih-alih mengasumsikan prompt panjang harus di-cache.
  6. Lacak tool dan retry. Keduanya dapat menghapus penghematan dari model yang lebih murah.

Untuk tim yang membandingkan rute di seluruh penyedia, harga CometAPI menyediakan tampilan lintas-model secara live. CometAPI Quickstart dan Cookbook dapat digunakan untuk menjalankan set uji yang sama di seluruh rute yang kompatibel dengan OpenAI.

FAQ

Berapa biaya GPT-5.6 pada tahun 2026?

Harga bergantung pada model. Tarif konteks pendek Standard GPT-5.6 berkisar dari $1 input / $6 output per 1M token untuk Luna hingga $5 / $30 untuk Sol. Model berbiaya lebih rendah seperti GPT-5.4 mini dan nano juga tersedia. Periksa model yang tepat pada halaman harga live OpenAI.

Apakah harga ChatGPT API sama dengan harga GPT-5.6?

“Harga ChatGPT API” sering digunakan secara informal untuk menyebut harga OpenAI API bagi model yang mampu chat, tetapi langganan ChatGPT dan penagihan API adalah produk terpisah. Penggunaan API dihargai berdasarkan model dan jenis penggunaan spesifik.

Model GPT-5.6 mana yang termurah?

gpt-5.6-luna adalah model GPT-5.6 termurah, dihargai $0.20 per 1M token input dan $1.20 per 1M token output. OpenAI menurunkan kedua tarif sebesar 80% pada 30 Juli, membuat Luna secara substansial lebih ekonomis untuk agen volume tinggi, klasifikasi, pemrosesan dokumen, dan alur kerja tool yang terdefinisi dengan baik.

Model apa yang digunakan gpt-5.6?

Panduan model OpenAI menyatakan bahwa alias gpt-5.6 diarahkan ke gpt-5.6-sol. Gunakan ID model Terra atau Luna eksplisit ketika Anda menginginkan tier tersebut.

Kapan harga konteks panjang GPT-5.6 berlaku?

Ketika input melebihi 272,000 token, GPT-5.6 menggunakan tarif konteks panjang yang lebih tinggi untuk seluruh permintaan: 2× tarif terkait input dan 1.5× tarif output.

Apakah Batch dan Flex lebih murah daripada Standard untuk GPT-5.6?

Untuk beban kerja GPT-5.6 yang memenuhi syarat, tarif token Batch dan Flex yang tercantum sekitar 50% lebih rendah daripada Standard. Keduanya memiliki karakteristik pemrosesan yang berbeda, jadi pastikan beban kerja dapat mentoleransi kendala tersebut.

Apakah penulisan cache dikenakan biaya tambahan untuk GPT-5.6?

Ya. Penulisan cache GPT-5.6 dihargai 1.25× dari input normal, sementara pembacaan cache yang cocok menggunakan tarif input yang di-cache yang didiskon. Penghematan bergantung pada penggunaan ulang aktual.

Bandingkan Biaya GPT-5.6 pada Beban Kerja Anda Sendiri

Tabel harga adalah titik awal. Biaya nyata Anda bergantung pada prompt, panjang output, tingkat hit cache, tool, retry, dan keberhasilan tugas.

Dengan CometAPI, Anda dapat menguji GPT-5.6 Sol, Terra, Luna, dan model lain melalui satu API yang kompatibel dengan OpenAI menggunakan beban kerja yang sama.

Langkah berikutnya: bandingkan harga model saat ini, ikuti CometAPI Quickstart, atau gunakan CometAPI Cookbook untuk membangun evaluasi model yang dapat diulang.

Pilih rute berbiaya terendah yang tetap memenuhi persyaratan kualitas, latensi, dan reliabilitas Anda.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Jul 15, 2026
Terakhir diperbarui Sep 1, 2026
605 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya