Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/Riset CometAPI

GPT-6.1 Harga Sol: Penetapan harga API, token yang di-cache, konteks panjang dan biaya CometAPI

Bandingkan harga API GPT-6.1 Sol, operasi baca dan tulis cache, tarif konteks panjang, tingkatan pemrosesan, biaya CometAPI, dan biaya per tugas yang diterima.

CometAPI
Deon GoodwinTim riset model AI dan API
Diperbarui Oct 10, 2026 15 menit baca
GPT-6.1 Harga Sol: Penetapan harga API, token yang di-cache, konteks panjang dan biaya CometAPI
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

GPT-6.1 Sol adalah model penalaran OpenAI untuk pengodean kompleks, penggunaan komputer, dan alur kerja profesional. Model ini mempertahankan tarif resmi Standard GPT-6 Sol untuk input baru dan output sebesar $2/$10 per satu juta token, sambil menurunkan biaya pembacaan cache konteks pendek dari $0.20 menjadi $0.10. Penggunaan ulang cache yang berhasil dapat menurunkan biaya konteks berulang. Input di atas 272K token memicu tarif lebih tinggi untuk seluruh permintaan, jadi perkirakan setiap permintaan sebelum mengagregasi tagihan. CometAPI memiliki jadwal gateway terpisah.

Key Takeaways

  • Pisahkan input baru, pembacaan cache, penulisan cache, dan output yang ditagihkan; output mencakup token penalaran.
  • Gunakan pita konteks yang benar untuk setiap permintaan. Kapasitas konteks 1.05M tidak menyiratkan harga konteks pendek.
  • Bandingkan OpenAI dan CometAPI dengan komposisi token yang sama dan ketentuan penagihan akun yang berlaku.
  • Pilih mode pemrosesan berdasarkan latensi, ketersediaan, dan dukungan rute.
  • Nilai ekonomi agen berdasarkan total biaya per tugas yang diterima, termasuk percobaan yang tidak berhasil.

What Is the GPT-6.1 Sol Price at a Glance?

Semua harga token di bawah ini adalah USD per satu juta token. Jadwal harga token resmi menyediakan baseline OpenAI; pembacaan dan penulisan cache adalah kategori penagihan terpisah. Pita konteks mengacu pada token input dalam satu permintaan.

Mode OpenAI / pita inputInput baruBaca cacheTulis cacheOutput
Standard: paling banyak 272K$2.00$0.10$2.50$10.00
Standard: di atas 272K$4.00$0.20$5.00$15.00
Batch/Flex: paling banyak 272K$1.00$0.05$1.25$5.00
Batch/Flex: di atas 272K$2.00$0.10$2.50$7.50
Fast: paling banyak 272K$4.00$0.20$5.00$20.00
Fast: di atas 272K$8.00$0.40$10.00$30.00
Ultrafast: paling banyak 272K$12.00$0.60$15.00$60.00
Ultrafast: di atas 272K$24.00$1.20$30.00$90.00

Tarif tingkat pemrosesan OpenAI diperiksa pada 9 Oktober 2026; perbandingan CometAPI mempertahankan jadwal gateway artikel sumber. Ini adalah tarif tingkat pemrosesan OpenAI, bukan jaminan bahwa setiap tier tersedia melalui suatu gateway. Pemrosesan regional menambah 10% jika berlaku. Konfirmasikan layanan yang dipilih dan ketentuan akun sebelum membuat anggaran.

Untuk pengembang yang mengakses GPT-6.1 Sol melalui CometAPI, tarif konteks standar lebih rendah daripada harga Standard langsung OpenAI.

Kategori tokenCometAPIOpenAI StandardPerbedaan
Input / 1M$1.60$2.0020% lebih rendah
Input di-cache / 1M$0.08$0.1020% lebih rendah
Penulisan cache / 1M$2.00$2.5020% lebih rendah
Output / 1M$8.00$10.0020% lebih rendah

Untuk permintaan konteks panjang, API GPT-6.1 Sol di CometAPI menggunakan:

Token konteks panjangCometAPIOpenAI
Input / 1M$3.20$4.00
Input di-cache / 1M$0.16$0.20
Penulisan cache / 1M$4.00$5.00
Output / 1M$12.00$15.00

Itu mempertahankan perbedaan harga sekitar 20% di seluruh kategori token utama. Untuk penganggaran, ini penting karena beban kerja produksi jarang hanya terdiri dari token input baru. Setelah pembacaan cache, pembuatan output, dan permintaan konteks panjang disertakan, membandingkan hanya tarif input yang diiklankan dapat secara signifikan meremehkan perbedaan antar rute.

Jadwal harga token CometAPI menyediakan referensi gateway. Pada 100K input baru dan 10K output yang ditagihkan, OpenAI Standard berharga $0.30; jadwal CometAPI yang sesuai berharga $0.24. Pada 10.000 permintaan identik, total token adalah $3,000 dan $2,400. Perbandingan ini tidak termasuk alat, penulisan cache, percobaan ulang, dan premi.

GPT-6.1 Sol diposisikan untuk pengodean kompleks, penggunaan komputer, dan alur kerja profesional. Jendela konteks 1.050.000 token dan output maksimum 128.000 token adalah batas kapasitas, bukan janji penagihan konteks pendek: permintaan di atas 272K token input menggunakan tarif lebih tinggi. Model menerima teks dan gambar serta menghasilkan teks; gunakan Responses API untuk pemanggilan alat, sementara Chat Completions mendukung permintaan tanpa alat. Periksa dukungan alat gateway dan tingkat pemrosesan secara terpisah saat memilih rute.

Additional GPT-6.1 Sol Agent Expenses

Anggaran agen juga mencakup alat yang dihosting, lingkungan eksekusi, penyimpanan, dan biaya layanan eksternal. OpenAI mencantumkan panggilan web-search sebesar $10 per 1.000 panggilan. Konten pencarian yang diambil ditagihkan pada tarif token model. Panggilan file-search adalah $2.50 per 1.000; penyimpanan adalah $0.10 per GB per hari setelah jatah gratis 1 GB.

Hosted Shell dan Code Interpreter menggunakan biaya kontainer terpisah di bawah jadwal harga OpenAI yang sama seperti di atas. Tarif 1 GB yang dipublikasikan adalah $0.03 per sesi 20 menit per kontainer; sesi yang memenuhi syarat menggunakan penagihan per menit dengan minimum lima menit. Gunakan ketentuan alat dan eksekusi gateway yang dipilih alih-alih mengasumsikan biaya layanan langsung ini berlaku tanpa perubahan.

Reasoning Effort and Total GPT-6.1 Sol Spend

Upaya penalaran bukan tarif terpisah di tabel token, tetapi dapat mengubah output yang ditagihkan, penggunaan alat, panjang lintasan, dan percobaan ulang. Bandingkan upaya yang didukung dari rendah hingga maksimum pada set tugas yang sama. Catat penggunaan alih-alih memperkirakan biaya penalaran hanya dari panjang jawaban yang terlihat.

How Does the 272K Threshold Change GPT-6.1 Sol Cost?

Saat input melebihi 272K token, OpenAI menerapkan tarif konteks panjang ke seluruh permintaan: input dan tarif cache berlipat ganda, sedangkan output naik 50%. Ambang input berlaku bahkan ketika sebagian besar input dilayani dari cache.

Beban kerjaInput baruOutput yang ditagihkanOpenAI StandardKatalog CometAPI
Analisis kecil20K2K$0.06$0.048
Tinjauan dokumen100K10K$0.30$0.24
Di bawah ambang270K10K$0.64$0.512
Di atas ambang280K10K$1.27$1.016
Analisis repositori300K20K$1.50$1.20
270K input: 0.27 x $2 + 0.01 x $10 = $0.64
280K input: 0.28 x $4 + 0.01 x $15 = $1.27
Input grows about 3.7%; token cost grows about 98.4%.

Ini adalah permintaan independen tanpa cache, alat, percobaan ulang, atau biaya premi. Efek ambang adalah alasan pemilihan konteks penting bahkan ketika model memiliki kapasitas untuk seluruh repositori.

How Does Prompt Caching Change GPT-6.1 Sol Input Costs?

Biaya pembacaan cache konteks pendek Standard adalah $0.10/M versus $2/M untuk input baru. Pembacaan yang berhasil karena itu 95% lebih murah untuk kategori token tersebut. Penulisan cache berharga $2.50/M. Penghematan bergantung pada reuse prefiks yang di-cache yang berhasil, bukan sekadar mengulang teks serupa.

Pertimbangkan sepuluh permintaan yang berbagi satu prefiks 100K token. Masing-masing tetap dalam pita konteks pendek. Kasus cache terkontrol menulis seluruh prefiks sekali dan membacanya dengan sukses sembilan kali, tanpa penulisan tambahan. Prefiks 100K token pada permintaan pertama ditagihkan hanya pada tarif penulisan cache; token yang sama tidak juga dikenakan biaya pada tarif input baru.

Biaya prefiks berulangTanpa cacheSatu penulisan + sembilan pembacaan
Input prefiks baru10 x 0.1 x $2 = $2.00$0.00
Penulisan cache$0.000.1 x $2.50 = $0.25
Pembacaan cache$0.009 x 0.1 x $0.10 = $0.09
Subtotal prefiks$2.00$0.34

Pengurangan $1.66 adalah 83% dari biaya prefiks berulang ini. Itu bukan pengurangan 83% dalam tagihan API total yang khas. Jika setiap permintaan juga menghasilkan 2K token output yang ditagihkan, output menambah $0.20 di seluruh sepuluh permintaan: total menjadi $2.20 dan $0.54, pengurangan sekitar 75.5%. Input baru, kegagalan cache, penulisan tambahan, alat, dan pita konteks panjang mengubah hasil.

Di bawah asumsi konteks pendek yang disederhanakan ini, menulis sekali plus N-1 pembacaan berbiaya 0.25 + 0.01(N-1) dolar untuk prefiks 100K, dibandingkan dengan 0.20N tanpa caching. Dua permintaan sudah cukup untuk membuat kasus cache yang dimodelkan lebih murah, asalkan permintaan kedua benar-benar mengenai cache dan tidak ada biaya lain yang berubah.

How Does GPT-6.1 Sol Pricing Compare with GPT-6 Sol and GPT-6 Astra?

OpenAI mendokumentasikan spesifikasi GPT-6 Sol. Penurunan tarif pembacaan cache adalah perbandingan tarif, bukan bukti biaya tugas total yang lebih rendah.

Perbandingan resmi Standard konteks pendekGPT-6.1 SolGPT-6 SolGPT-6 Astra
Input baru / 1M token$2.00$2.00$10.00
Pembacaan cache / 1M token$0.10$0.20$1.00
Penulisan cache / 1M token$2.50$2.50$12.50
Output / 1M token$10.00$10.00$50.00
Jendela konteks / output maksimum1.05M / 128K1.05M / 128K1.05M / 128K

GPT-6.1 Sol memangkas tarif pembacaan cache konteks pendek hingga separuhnya. Input baru, penulisan, dan output tidak berubah. Manfaat maksimum bergantung pada seberapa besar bagian tagihan Anda yang terdiri dari pembacaan cache yang berhasil. Uji ulang pengaturan upaya, loop alat, dan hasil tugas saat migrasi.

Dibandingkan dengan GPT-6 Sol, GPT-6.1 Sol mempertahankan tarif input baru, penulisan cache, dan output yang sama sambil menurunkan tarif pembacaan cache sebesar 50%. Dibandingkan dengan GPT-6 Astra, gunakan tarif di atas bersama dengan kualitas tugas terukur dan biaya lintasan total.

Jadwal tarif GPT-6 Astra menempatkan Astra pada tier harga token yang lebih tinggi.

GPT-6.1 Sol 80% lebih murah untuk input baru, penulisan cache, dan output, serta 90% lebih murah untuk pembacaan cache pada pita ini. Rasio tersebut tidak menetapkan kualitas yang setara. Astra bisa layak dengan premi jika hasil yang diterima lebih baik mengimbangi pengeluaran tambahan; GPT-6.1 Sol bisa lebih disukai ketika mencapai target penerimaan yang sama dengan biaya lebih rendah.

Bandingkan patch repositori, analisis dokumen, dan tugas penggunaan komputer secara terpisah. Tahan prompt, izin alat, pengaturan upaya, batas percobaan ulang, dan pemeriksaan penerimaan secara konstan. Catat kegagalan yang tidak terselesaikan serta hasil yang berhasil; jangan menyimpulkan peringkat pengodean atau riset universal dari harga token.

What Does GPT-6.1 Sol Cost for Real API Workloads?

Hitung biaya per permintaan dengan pita dan mode pemrosesan aktualnya, lalu jumlahkan hasilnya. Input baru mengecualikan pembacaan cache; jangan mengenakan biaya pada token input yang sama sebagai input baru dan di-cache. Gunakan catatan penggunaan penyedia untuk membedakan penulisan dari input lainnya. Dalam formula di bawah, fresh_input mengecualikan cache_reads dan cache_writes. Token yang ditagihkan pada tarif penulisan cache tidak boleh juga dihitung sebagai input baru. Perlakukan ketiga kuantitas sebagai kategori penagihan yang saling eksklusif dan rekonsiliasi dengan catatan penggunaan penyedia.

request_token_cost =
  fresh_input / 1_000_000 * fresh_rate
+ cache_reads / 1_000_000 * read_rate
+ cache_writes / 1_000_000 * write_rate
+ billed_output / 1_000_000 * output_rate

period_total = sum(request_token_cost) + other_charges

Aggregate Usage Across Multiple Short Requests

Sepuluh permintaan yang masing-masing menggunakan 100K input baru dan 20K output yang ditagihkan diagregasi menjadi 1M input dan 200K output. Setiap permintaan individual tetap di bawah 272K input dan di bawah batas output 128K. Total OpenAI Standard $4.00; total CometAPI $3.20. Perbedaan 20% berlaku untuk kategori token yang dimodelkan ini saja. Ini bukan satu permintaan dengan 1M input dan 200K output.

A Cache-Heavy Period With Separately Billed Writes

Misalkan suatu periode mencatat 1M input baru, 5M pembacaan cache, 500K output yang ditagihkan, dan 500K penulisan cache. Semua permintaan komponen tetap dalam pita konteks pendek Standard. Biaya OpenAI adalah $2.00 + $0.50 + $5.00 + $1.25 = $8.75. Biaya CometAPI adalah $1.60 + $0.40 + $4.00 + $1.00 = $7.00. Kategori ini adalah kuantitas penagihan yang berbeda; contoh tidak mengasumsikan semua input berulang adalah hit cache.

One Long-Context Request

Satu permintaan dengan 400K input baru dan 100K output yang ditagihkan menggunakan tarif konteks panjang. Biaya OpenAI Standard adalah 0.4 x $4 + 0.1 x $15 = $3.10. Biaya CometAPI adalah 0.4 x $3.20 + 0.1 x $12 = $2.48. Keduanya tidak termasuk penulisan cache baru dan biaya non-token. Kuantitas output 100K mencakup penalaran dan harus sesuai dengan anggaran output model.

How Do Standard, Batch, Flex, Fast, and Ultrafast Change GPT-6.1 Sol Cost?

Untuk permintaan 300K input baru dan 20K output yang ditagihkan, gunakan pita konteks panjang.

Mode OpenAIBiaya inputBiaya outputSubtotal token
Batch/Flex$0.60$0.15$0.75
Standard$1.20$0.30$1.50
Fast$2.40$0.60$3.00
Ultrafast$7.20$1.80$9.00

Perhitungan Ultrafast: 0.30M input baru x $24/M + 0.02M output yang ditagihkan x $90/M = $7.20 + $1.80 = $9.00. Ini menggunakan pita konteks panjang dan tidak termasuk cache, alat, dan biaya regional.

Batch cocok untuk evaluasi offline, pengayaan, backfill, dan pemrosesan dokumen massal. Flex menawarkan tarif lebih rendah untuk beban kerja yang memenuhi syarat yang mentoleransi pemrosesan dan ketersediaan yang variatif. Standard adalah baseline untuk permintaan interaktif. Fast menggandakan tarif token yang berlaku; pilih saat pengurangan waktu tunggu bernilai nyata.

Ultrafast memprioritaskan latensi dengan harga token lebih tinggi. Untuk GPT-6.1 Sol, set service_tier ke ultrafast dalam permintaan Responses. OpenAI merekomendasikan WebSockets untuk loop alat agen yang cepat; periksa batas spesifik tier dan dukungan gateway sebelum merutekan trafik produksi. Tarif berasal dari tabel harga resmi OpenAI.

Tarif ini tidak membuktikan bahwa setiap tier diaktifkan untuk akun gateway Anda. Verifikasi rute yang didukung dan batasan regional sebelum peluncuran. Jangan membuat anggaran opsi pemrosesan yang tidak berharga atau tidak tersedia seolah-olah sudah memiliki tarif Standard.

Why Is Cost per Successful GPT-6.1 Sol Task the Better Metric?

Bagi total pengeluaran model, alat, dan eksekusi yang diukur di seluruh set evaluasi dengan hasil yang diterima. Sertakan percobaan yang gagal dalam pembilang. Laporkan waktu koreksi manusia dan kegagalan yang tidak terselesaikan secara terpisah sehingga biaya tidak dapat membaik hanya dengan meninggalkan tugas yang lebih sulit.

observed_cost_per_accepted_task =
  all_evaluation_model_tool_execution_cost / accepted_tasks

Sebagai ilustrasi, percobaan $0.40 dengan probabilitas keberhasilan 60% memiliki biaya yang diharapkan $0.40 / 0.60 = sekitar $0.67 hingga berhasil. Percobaan $0.55 dengan probabilitas 85% berbiaya sekitar $0.65 dalam model yang sama. Ini adalah angka hipotetis, bukan hasil benchmark atau klaim tentang model tertentu.

Estimasi itu mengasumsikan percobaan ulang yang independen dengan biaya dan probabilitas keberhasilan yang tidak berubah, berlanjut hingga berhasil. Jangan menambahkan batas percobaan ulang kedua: pembagian tersebut sudah memperhitungkan pengulangan. Kegagalan yang berkorelasi, percobaan ulang yang dibatasi, perbedaan tingkat kesulitan tugas, alat, dan intervensi manusia dapat membuat model ini tidak cocok. Gunakan biaya per tugas yang diterima yang teramati untuk keputusan produksi.

How Can You Reduce GPT-6.1 Sol API Costs?

Maksimalkan prefiks prompt yang dapat digunakan kembali. Masukkan instruksi sistem yang stabil, definisi alat, skema, dan konteks latar ke prefiks yang dapat digunakan ulang. Harga input di-cache GPT-6.1 Sol sebesar $0.10/M membuat konteks berulang murah relatif terhadap input baru.

Pertahankan permintaan di bawah 272K saat konteks penuh tidak diperlukan. Melampaui 272K token input mengubah harga untuk seluruh permintaan. Retrieval, kompresi konteks, dan pemuatan file selektif karenanya dapat menurunkan biaya bahkan ketika model secara teknis mendukung jendela konteks 1.05M.

Gunakan Batch untuk alur kerja asinkron massal. Evaluasi offline, pengayaan, backfill, dan pemrosesan dokumen massal dapat menggunakan Batch saat hasil tidak harus kembali segera.

Gunakan Flex untuk permintaan prioritas rendah yang mentoleransi respons lebih lambat dan ketidaktersediaan sumber daya sesekali. Rencanakan penundaan dan percobaan ulang; periksa beban kerja yang memenuhi syarat dan dukungan rute. Batch dan Flex masing-masing menggunakan tarif lebih rendah seperti di atas, tetapi melayani kebutuhan pemrosesan yang berbeda.

Ukur biaya per tugas yang diterima. Log input baru, input di-cache, penulisan cache, token output, mode pemrosesan, biaya alat, percobaan ulang, dan keberhasilan tugas. Lalu hitung biaya nyata per penyelesaian yang berhasil.

Rutekan tugas yang lebih sederhana ke model yang lebih murah. Tidak setiap permintaan memerlukan penalaran tingkat Sol. Klasifikasi, perutean, ekstraksi sederhana, dan tugas lain yang sangat dapat diverifikasi mungkin cocok untuk model berbiaya lebih rendah, sementara GPT-6.1 Sol menangani tugas di mana penalaran lebih kuat secara material meningkatkan tingkat penyelesaian.

Ini sangat penting untuk agen karena satu run gagal senilai $0.50 yang diikuti dua percobaan ulang dapat lebih mahal daripada satu run sukses senilai $1.00.

Gunakan batas penyelesaian eksplisit, batas loop alat, dan anggaran percobaan ulang. Tinjau catatan penggunaan untuk input baru, pembacaan cache, penulisan, output penalaran, tier, pita konteks, dan biaya alat. Bandingkan penghematan terhadap kualitas tugas yang diterima setelah setiap perubahan.

Conclusion

GPT-6.1 Sol menarik saat alur kerja membutuhkan penalaran kompleks pada harga tier Sol dan dapat menggunakan kembali konteks yang stabil. Model ini mempertahankan tarif headline Standard GPT-6 Sol $2/$10 sambil menurunkan pembacaan cache konteks pendek menjadi $0.10/M. Astra memiliki tarif token yang lebih tinggi, tetapi pilihan harus mengikuti kualitas beban kerja dan biaya per tugas yang diterima.

Mulailah dengan estimasi per permintaan, pisahkan penulisan cache dari pembacaan, dan perhatikan batas 272K. Lalu ukur seluruh lintasan agen dan pilih tier pemrosesan yang sesuai dengan latensi dan ketersediaan. CometAPI menyediakan jadwal harga terpisah; konfirmasikan ketentuan akun dan alat yang sebenarnya sebelum penskalaan.

FAQ

How Should GPT-6.1 Sol Budgets Handle Failed or Cancelled Requests?

Lacak penggunaan penyedia untuk permintaan yang selesai, tidak lengkap, gagal, dan dibatalkan secara terpisah. Jangan berasumsi setiap permintaan yang tidak berhasil gratis atau setiap pembatalan klien mencegah pekerjaan sisi server. Rekonsiliasi pengenal permintaan dan penggunaan dengan catatan penagihan, lalu sertakan pekerjaan tidak berhasil yang ditagihkan dalam perhitungan tugas yang diterima. Konfirmasikan aturan biaya dan pengembalian dana khusus penyedia alih-alih menyimpulkannya dari status HTTP.

How Should Teams Forecast GPT-6.1 Sol Costs for Variable Traffic?

Segmentasikan trafik berdasarkan pita input, tier pemrosesan, komposisi cache, dan beban kerja. Gunakan distribusi token dan penyelesaian yang terukur alih-alih satu prompt rata-rata. Bangun prakiraan baseline dan skenario untuk tingkat hit yang lebih rendah, lebih banyak percobaan ulang, dan output lebih panjang; pantau juga porsi yang melampaui 272K. Perbarui prakiraan saat campuran tugas berubah.

How Can Teams Reconcile GPT-6.1 Sol Forecasts With Invoices?

Pilih periode penagihan yang telah selesai dan kelompokkan permintaan berdasarkan rute, tier pemrosesan, dan pita input. Rekonsiliasi penggunaan yang tercatat dengan kategori dan kredit faktur, termasuk penyesuaian, biaya alat, dan pajak atau konversi mata uang yang berlaku. Selidiki ketidaksesuaian menggunakan pengenal permintaan dan stempel waktu penagihan alih-alih menerapkan faktor koreksi yang tidak dijelaskan. Konfirmasikan pelaporan yang tertunda dan aturan pembulatan penyedia sebelum mengubah prakiraan.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Oct 10, 2026
Terakhir diperbarui Oct 10, 2026
0 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Baca Selengkapnya