Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/Riset CometAPI

Apa itu Claude Haiku 5.5? Spesifikasi, Benchmark, Harga, Fitur dan Akses API

Jelajahi spesifikasi Claude Haiku 5.5, jendela konteks 1M, tolok ukur, harga API, fitur, serta perbandingan dengan Haiku 4.5 dan Sonnet 5.5.

CometAPI
Deon GoodwinTim riset model AI dan API
Diperbarui Oct 8, 2026 13 menit baca
Apa itu Claude Haiku 5.5? Spesifikasi, Benchmark, Harga, Fitur dan Akses API
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Haiku 5.5 adalah model kecil tercepat milik Anthropic pada kecepatan standar untuk tugas volume tinggi yang sensitif terhadap latensi. Model ini menggabungkan jendela konteks 1 juta token, batas keluaran standar 128K, penalaran adaptif, dan harga dasar mulai dari $0.10 per satu juta token input dan $0.50 per satu juta token output. Tarif meningkat saat prompt melampaui 100.000 token. Untuk pengodean kompleks dan pekerjaan agentik yang diperluas, Sonnet 5.5 dan Opus 5.5 tetap menjadi pilihan yang lebih kuat. Harga CometAPI Standard 20% di bawah tarif resmi, dimulai dari $0.08 per satu juta token input dan $0.40 per satu juta token output. Halaman model CometAPI sudah aktif dan melaporkan akses API produksi.

Key Takeaways

  • Rilis resmi: 7 Oktober 2026; ID model Claude API: claude-haiku-5-5.
  • Tarif API awal: $0.10 input dan $0.50 output per satu juta token untuk prompt hingga 100K token. CometAPI: $0.08 input dan $0.40 output per satu juta token pada 80% dari harga Standard resmi.
  • Konteks dan keluaran: 1M token konteks dan 128K token keluaran standar.
  • Fokus: klasifikasi, ekstraksi dokumen, routing, dukungan, dan tugas agen yang didelegasikan.
  • Tokenizer yang lebih baru dapat menghitung sekitar 30% lebih banyak token untuk teks yang sama; evaluasi biaya per tugas yang diterima alih-alih hanya harga per token.

What Is Claude Haiku 5.5?

Claude Haiku 5.5 adalah anggota ringan dari keluarga Claude saat ini milik Anthropic, dikembangkan untuk volume permintaan besar di mana responsivitas dan ekonomi operasional menjadi pusat. Aplikasi utamanya mencakup pemrosesan dokumen, dukungan percakapan, ekstraksi informasi, dan pekerjaan subagen yang ringkas. Ikhtisar model Anthropic mengonfirmasi tanggal peluncuran, kemampuan, dan pengenal platform.

Claude Haiku 5.5 adalah model Haiku pertama yang mendukung tingkat usaha yang dapat dikonfigurasi, memungkinkan pengembang menukar kedalaman penalaran, latensi, dan penggunaan token dalam model yang sama.

What Are the Key Features of Claude Haiku 5.5?

Adaptive thinking and adjustable effort

Haiku 5.5 dapat memutuskan kapan dan seberapa besar perlu bernalar, sementara parameter effort menawarkan cara bagi pengembang untuk menyeimbangkan kualitas respons, latensi, dan penggunaan token. Effort default adalah medium. Untuk klasifikasi sederhana, effort rendah mungkin lebih disukai; untuk ekstraksi yang ambigu atau langkah perencanaan alat, pengaturan yang lebih tinggi mungkin dibenarkan.

Large-context processing

Jendela konteks 1M token memungkinkan dokumen panjang dan riwayat percakapan substansial masuk dalam satu permintaan. Pengembang tetap harus menggunakan retrieval, pemangkasan, dan caching bila sesuai: konteks panjang dapat memperkenalkan biaya yang tidak perlu dan trade-off akurasi, terutama melampaui ambang harga 100K.

Low-cost high-throughput processing

Tarif awal baru $0.10/$0.50 membuat permintaan pendek berulang jauh lebih murah daripada generasi Haiku sebelumnya pada basis per token. Namun Anthropic mendokumentasikan tokenizer yang berubah: teks identik menghasilkan sekitar 30% lebih banyak token dibanding Haiku 4.5. Karena itu, penghematan nyata pada tingkat tugas dapat lebih kecil daripada penurunan tarif utama.

Computer use and delegated agent tasks

Evaluasi yang dipublikasikan menunjukkan kinerja lebih kuat pada tugas interaksi komputer dan tugas berbantuan alat daripada model Haiku sebelumnya. Ini membuat Haiku 5.5 berguna untuk langkah agen yang terbatasi, tetapi otomasi yang berhasil tetap bergantung pada perizinan alat yang kuat, pemulihan kesalahan, dan persetujuan manusia untuk tindakan berisiko.

How Does Claude Haiku 5.5 Perform on Benchmarks?

Anthropic melaporkan peningkatan nyata di berbagai tugas pengetahuan profesional, penggunaan komputer, pengodean, dan penalaran. Hasil di bawah ini menggunakan pengaturan evaluasi yang dilaporkan; skor dari tolok ukur berbeda tidak boleh digabungkan menjadi satu “skor kecerdasan.”

BenchmarkHaiku 4.5Haiku 5.5Sonnet 5.5
GDPval-AA v2.1 (Elo)7351,6201,840
AA-Briefcase v1.1 (Elo)6141,5781,824
OSWorld 2.1, offline subset, partial credit15.7%72.4%83.9%
Humanity's Last Exam, no tools10.2%45.9%56.9%
Humanity's Last Exam, with tools18.7%57.4%64.5%
Terminal-Bench 4.00.0%39.2%70.6%
Chartography, no tools6.4%46.4%61.6%

Konfigurasi evaluasi standar system card Haiku 5.5 menggunakan penalaran adaptif pada effort maksimal, sampling default dan lima percobaan kecuali dinyatakan lain; default produk adalah medium, sehingga skor utama bukan jaminan pengaturan default. OSWorld menggunakan 82 tugas offline, tanpa akses internet, 1080p dan batas 500 aksi. Angka 72.4% adalah skor kredit parsial; tingkat lulus ketatnya 37.1%. GDPval-AA dan AA-Briefcase dilaporkan oleh Anthropic dari evaluasi Artificial Analysis yang dijalankan secara independen.

Terminal-Bench 4.0 menggunakan Claude Code dalam mode --bare dengan pengaman diaktifkan. Haiku 5.5 menggunakan effort maksimum, tanpa model fallback dan tanpa egress internet, dengan 10 percobaan per tugas; Sonnet 5.5 menggunakan lima percobaan dan fallback untuk beberapa permintaan yang ditandai. Haiku 4.5 menggunakan anggaran thinking tetap 63,999 token. Perbedaan konfigurasi ini penting saat menafsirkan 39.2% versus 70.6%.
Hasil tolok ukur yang dipublikasikan Anthropic menyajikan skor di atas. OSWorld menggunakan subset offline; Humanity's Last Exam memisahkan run dengan alat dan tanpa alat, dan Chartography tanpa alat. Ini adalah hasil yang dilaporkan vendor, bukan pengukuran independen di bawah konfigurasi universal. Anthropic menyediakan detail evaluasi dalam system card Haiku 5.5; replikasi pengaturan effort, alat, kerangka, dan anggaran yang relevan diperlukan sebelum membandingkan hasil Anda sendiri. Ringkasan peluncuran tidak menentukan lingkungan uji umum yang lengkap untuk setiap baris.

Apa itu Claude Haiku 5.5? Spesifikasi, Benchmark, Harga, Fitur dan Akses API

Grafik evaluasi resmi Anthropic di atas direproduksi dari system card-nya. Ini memberikan bukti tambahan tentang konfigurasi yang dievaluasi; ini bukan tolok ukur baru yang dibuat untuk artikel ini.

Benchmark Interpretation

Peningkatan OSWorld menunjukkan Haiku 5.5 menjadi jauh lebih berguna untuk tugas grafis terstruktur. Namun, 70.6% milik Sonnet 5.5 versus 39.2% milik Haiku 5.5 di Terminal-Bench menunjukkan keunggulan berkelanjutan untuk pengodean agentik model yang lebih besar. Pilih model berdasarkan biaya kegagalan dan tingkat kesulitan alur kerja sebenarnya.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

DimensionHaiku 4.5Haiku 5.5Sonnet 5.5
Context200K1M1M
Max standard output64K128K128K
Standard input / MTok$1$0.10 up to 100K; $0.50 over$2
Standard output / MTok$5$0.50 up to 100K; $2.50 over$10
ReasoningExtended thinking with a fixed token budgetAdaptive; medium defaultAdaptive; high default
Relative latencyFastFastest at standard speedFast
Coding depthBounded tasksStronger subagentsMore complex coding
Typical useLegacy small-model deploymentsHigh-volume workflowsComplex production workflows

Spesifikasi bersama: ketiga model menerima input teks dan gambar serta menghasilkan output teks. Model dapat diakses melalui Claude API dan platform mitra yang didukung; pengenal model dan akses akun bergantung pada penyedia. Dokumentasi produk yang dikutip tidak menetapkan jumlah parameter atau arsitektur terperinci.

Haiku 5.5 adalah pilihan pertama yang masuk akal untuk tugas yang dapat diverifikasi dan berulang. Sonnet 5.5 menjadi lebih menarik ketika penilaian yang lebih kuat menghemat panggilan gagal berulang, percobaan ulang alat, atau koreksi manusia. Opus 5.5 adalah opsi untuk penugasan multi-langkah yang sangat menuntut.

Label latensi komparatif merujuk pada mode kecepatan standar. Kualifikasi kecepatan Anthropic mengecualikan Opus Fast Mode dari klaim model tercepat. Detail arsitektur seperti jumlah parameter tidak ditetapkan oleh tier produk ini. Input teks-dan-gambar dengan output teks berbeda dari pembuatan gambar.

Perbandingan kapabilitas mengikuti spesifikasi model Anthropic. Akses platform bergantung pada penyedia yang dipilih dan akun; tidak ada tier model yang menyiratkan jumlah parameter yang dipublikasikan.

Workload Selection

WorkloadPractical defaultWhy
Email classificationHaiku 5.5Keputusan singkat, berulang, dan dapat diverifikasi
Document field extractionHaiku 5.5Pemrosesan terstruktur yang hemat biaya
Support triageHaiku 5.5Respons cepat dan eskalasi
Coding subagentsHaiku 5.5Pencarian file berbiaya rendah dan edit terkendali
Complex debuggingSonnet 5.5Kinerja tolok ukur pengodean yang lebih kuat
High-stakes multi-step reasoningOpus 5.5Model tier atas yang lebih kapabel
Mixed workloadHaiku + SonnetRute berdasarkan kompleksitas dan keyakinan

How Much Does Claude Haiku 5.5 Cost?

Mengapa Haiku 5.5 diiklankan sebagai “sekitar 75% lebih murah” jika harga tokennya 90% lebih rendah?

Angka 90% menggambarkan penurunan tarif Standard input dan output untuk prompt hingga 100.000 token; prompt yang lebih panjang menerima penurunan 50%. Anthropic melaporkan bahwa Haiku 5.5 menelan biaya sekitar 75% lebih rendah untuk dijalankan rata-rata, dengan mempertimbangkan campuran panjang permintaan model sebelumnya dan perubahan penggunaan token per tugas. Tokenisasi adalah salah satu faktor: input teks yang sama dapat dihitung sebagai sekitar 30% lebih banyak token, sehingga estimasi biaya harus menggunakan hitungan yang diukur dengan model baru.

Harga resmi Anthropic memiliki dua pita panjang prompt. Tarif pada tabel pertama adalah harga USD resmi per satu juta token; perbandingan CometAPI di bawah ini menerapkan diskon 20% pada tarif Standard input dan output resmi.

Rate categoryPrompt up to 100KPrompt over 100K
Input$0.10$0.50
Output$0.50$2.50
5-minute cache write$0.125$0.625
1-hour cache write$0.20$1.00
Cache read$0.01$0.05
Batch input (50% off)$0.05$0.25
Batch output (50% off)$0.25$1.25

Tarif Standard, cache, dan Batch resmi ditampilkan di atas, diperiksa pada 8 Oktober 2026. Panjang prompt menentukan pita harga; pita yang lebih tinggi berlaku untuk permintaan, bukan hanya token di atas 100K. Tarif Standard CometAPI di bawah ini sama dengan tarif Standard resmi yang bersesuaian dikalikan 0.8. Perbandingan ini tidak mengasumsikan diskon gateway ditumpuk dengan diskon Batch atau caching.

Prompt lengthToken categoryOfficial Standard / MTokCometAPI / MTok
Up to 100K tokensInput$0.10$0.08
Up to 100K tokensOutput$0.50$0.40
Over 100K tokensInput$0.50$0.40
Over 100K tokensOutput$2.50$2.00

Example: 100,000 short requests per month

Asumsikan setiap permintaan menggunakan 2,000 token input dan 500 token output; setiap permintaan tetap di bawah ambang 100K. Abaikan caching prompt, alat, dan percobaan ulang, dan asumsikan jumlah token identik di seluruh model untuk ilustrasi.

Model / providerInput/monthOutput/monthTotal/month
Haiku 4.5 — official Standard$200$250$450
Haiku 5.5 — official Standard$20$25$45
Sonnet 5.5 — official Standard$400$500$900
Haiku 5.5 — CometAPI$16$20$36

Dalam contoh ini, 100,000 permintaan menggunakan 200 juta token input dan 50 juta token output. Biaya input CometAPI 200 × $0.08 = $16 dan biaya output 50 × $0.40 = $20, total $36 per bulan dibanding resmi $45: penghematan $9, atau 20%. Skenario mengecualikan caching, alat, dan percobaan ulang serta menggunakan jumlah token tetap; ukurlah biaya per tugas yang diterima pada input representatif karena tokenizer yang lebih baru mengubah jumlah token.

Perbandingan $450-ke-$45 adalah ilustrasi token tetap dari penurunan tarif 90%, bukan janji penghematan 90% untuk beban kerja nyata yang setara. Dalam pengumuman peluncurannya, Anthropic melaporkan biaya operasional rata-rata sekitar 75% lebih rendah setelah mempertimbangkan panjang permintaan dan perubahan penggunaan token. Hitung ulang input representatif dan ukur biaya tugas yang selesai sebelum memperkirakan penghematan Anda sendiri.

Where Can You Access Claude Haiku 5.5?

Official access and cloud platforms

Haiku 5.5 tersedia melalui Claude API dan platform yang didukung di Amazon Web Services, Google Cloud, dan Microsoft Azure, menurut pengumuman ketersediaan Anthropic. ID model Claude API langsung adalah claude-haiku-5-5; Amazon Bedrock menggunakan anthropic.claude-haiku-5-5. Gunakan kredensial yang dikeluarkan oleh penyedia pilihan Anda dan periksa persyaratan akses akun saat ini.

Third-party access through CometAPI

Halaman model CometAPI mencantumkan claude-haiku-5-5 sebagai tersedia, dengan tarif Standard mulai $0.08 per satu juta token input dan $0.40 per satu juta token output untuk prompt hingga 100K, 20% di bawah tarif resmi yang bersesuaian. Gunakan kunci yang diterbitkan CometAPI dengan endpoint dan format permintaan CometAPI; ini adalah jalur akses terpisah dari akses langsung Anthropic API. Periksa halaman live untuk ketersediaan, pita harga, dan detail integrasi.

Saat mengganti penyedia atau meningkatkan dari Haiku 4.5, verifikasi ID model, hitung ulang token, dan uji batas respons serta penanganan percakapan. Untuk detail implementasi dan perubahan yang memutus kompatibilitas, lihat panduan migrasi Anthropic.

Migration Validation

  • Perbarui ID model dan validasi field permintaan spesifik endpoint.
  • Hitung ulang token dengan tokenizer yang diperbarui, termasuk prefiks stabil dan definisi alat.
  • Uji pengaturan penalaran adaptif, distribusi latensi, dan parsing blok respons.
  • Periksa panggilan alat, pemulihan kegagalan, dan pembatasan akun atas blok pemikiran yang tersimpan.
  • Bandingkan latensi p50/p95, tingkat tugas yang diterima, dan total token yang ditagihkan.
  • Gunakan peluncuran bertahap dan jalur rollback untuk alur kerja yang kritis bagi bisnis.
  • Prefill asisten dilarang

Panduan migrasi Haiku 5.5 menjelaskan perilaku tokenizer, ID dan kompatibilitas permintaan. Abaikan temperature, top_p dan top_k. Jika secara eksplisit disuplai, temperature harus 1 dan top_p harus 0.99; nilai top_k apa pun, atau menyuplai keduanya temperature dan top_p, menghasilkan error 400.

What Are the Limitations of Claude Haiku 5.5?

Haiku 5.5 bukan pengganti universal untuk model yang lebih besar. Pengodean kompleks dan penalaran horizon panjang tetap menjadi pembeda bermakna untuk Sonnet dan Opus. Prompt yang lebih panjang juga lebih mahal, sehingga jendela 1M token harus digunakan secara selektif. Penalaran adaptif memperkenalkan variasi dalam token yang dihasilkan dan latensi; tolok ukur tidak menetapkan jaminan untuk alur kerja bisnis individual.

Otomasi yang sensitif terhadap risiko harus memvalidasi keluaran terstruktur, membatasi perizinan alat eksternal, menyimpan log audit, dan memerlukan peninjauan sebelum tindakan yang berkonsekuensi. Rute tugas yang tidak pasti ke model yang lebih kuat alih-alih hanya mengandalkan harga token dasar Haiku yang lebih rendah.

Conclusion

Untuk pemrosesan volume tinggi dengan kriteria penerimaan yang terukur, Claude Haiku 5.5 adalah peningkatan yang menarik: harga masuk lebih rendah, konteks lebih besar, penalaran adaptif, dan evaluasi terpublikasi yang lebih kuat. Untuk pemrograman kompleks dan pengambilan keputusan yang ambigu, Sonnet 5.5 atau Opus 5.5 dapat memberikan ekonomi keseluruhan yang lebih baik dengan mengurangi percobaan ulang dan koreksi. Strategi yang menang adalah menguji tolok ukur seluruh alur kerja dan merutekan permintaan berdasarkan tingkat kesulitan.

FAQ

How does Haiku 5.5's 100K pricing boundary affect a cached workflow?

Panjang prompt menentukan pita tarif yang berlaku; jangan memperkirakan biaya dari teks baru saja atau mengasumsikan hanya token berlebih yang menggunakan tarif lebih tinggi. Hitung permintaan untuk model yang dipilih, termasuk riwayat dan definisi alat, lalu selaraskan penggunaan input, penulisan cache, pembacaan cache, dan output dengan pita yang relevan. Bandingkan invoice pada permintaan cache yang representatif sebelum menetapkan anggaran produksi.

Can Haiku 5.5 thinking blocks be replayed across accounts?

Blok tersebut hanya berfungsi di akun yang memproduksinya atau akun yang ditautkan. Jika akun yang tidak terkait mengirim blok pemikiran tersimpan, API akan membuangnya sebelum model melihatnya; permintaan tetap dapat berhasil tanpa penalaran itu. Lihat panduan migrasi resmi. Pertahankan blok percakapan dan gunakan akun asal atau akun tertaut saat melanjutkan alur kerja alat. Perubahan gateway atau akun harus diuji secara eksplisit; mencocokkan nama model tidak menjamin blok pemikiran tersimpan tetap dapat digunakan.

Why can Haiku 5.5 truncate a response that Haiku 4.5 completed?

Tokenizer yang lebih baru dapat menghitung lebih banyak token untuk teks yang sama, sehingga batas max_tokens yang tidak berubah mungkin menampung keluaran ekuivalen yang lebih sedikit. Penalaran adaptif juga dapat mengonsumsi anggaran output. Periksa stop_reason dan usage, hitung ulang prompt dengan model baru, dan atur ulang alokasi output pada tugas nyata alih-alih menyalin batas lama.

How should Haiku 5.5 routing thresholds be selected?

Gunakan sampel berlabel dari beban kerja aktual untuk mengukur tingkat tugas yang diterima, biaya koreksi, dan latensi. Rute permintaan yang gagal validasi eksplisit atau melampaui cakupan tugas yang diuji ke model yang lebih kuat. Sesuaikan ambang terhadap biaya total alur kerja, termasuk percobaan ulang dan eskalasi, dan pantau setelah perubahan pada prompt, alat, atau effort.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Oct 8, 2026
Terakhir diperbarui Oct 8, 2026
0 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Baca Selengkapnya