Claude Haiku 4.5 adalah model bahasa kelas lebih kecil yang dioptimalkan untuk tujuan khusus dari Anthropic, dirilis pada pertengahan Oktober 2025. Model ini diposisikan sebagai opsi cepat dan berbiaya rendah dalam lini Claude yang tetap mempertahankan kapabilitas kuat pada tugas seperti pengodean, orkestrasi agen, dan alur kerja “penggunaan komputer” interaktif, sekaligus memungkinkan throughput yang jauh lebih tinggi dan biaya per unit lebih rendah untuk penerapan di tingkat perusahaan.
Fitur utama
- Kecepatan & efisiensi biaya: Haiku 4.5 digambarkan lebih dari dua kali lebih cepat daripada Sonnet 4 dan sekitar sepertiga biayanya (dan jauh lebih murah daripada Opus), menjadikannya menarik untuk penggunaan skala besar.
- Pemikiran yang diperluas: Model Haiku pertama yang mendukung pemikiran yang diperluas (pemikiran yang diringkas/berselang-seling, anggaran pemikiran yang dapat dikonfigurasi) untuk penalaran multi-langkah yang lebih dalam sambil menyeimbangkan latensi.
- Alat & penggunaan komputer: Dukungan penuh untuk alat Claude (bash, eksekusi kode, editor teks, penelusuran web, dan otomatisasi penggunaan komputer). Dirancang untuk alur kerja beragen dan arsitektur sub-agen.
- Jendela konteks besar: Jendela konteks 200k token (dengan opsi 1M context tersedia pada model yang lebih besar sebagai beta untuk kelas model lain).
Detail teknis
- Data pelatihan & cutoff: Haiku 4.5 dilatih pada campuran proprietari dari data publik dan berlisensi dengan cutoff pelatihan sekitar Februari 2025.
- Pemikiran yang diperluas (mode penalaran hibrida) didukung sehingga model dapat menukar latensi dengan penalaran yang lebih mendalam ketika diminta.
- Jendela konteks saat rilis adalah 200.000 token, dan model ini secara eksplisit sadar konteks (melacak berapa banyak jendela yang telah digunakan).
- Performa / throughput: Laporan komunitas awal dan pengujian Anthropic menyebutkan OTPS (output tokens/sec) yang sangat tinggi dan kecepatan anekdotal sekitar ~200+ token/detik dalam beberapa pengujian internal/awal — jauh lebih cepat daripada banyak model kelas menengah sebanding.
Kinerja benchmark
SWE-Bench (coding): Haiku 4.5 meraih skor ~73.3% pada SWE-Bench Verified — hasil yang disoroti Anthropic sebagai menempatkan Haiku 4.5 di antara model pengodean terbaik di kelasnya.
Terminal / command-line / pengujian alat: Anthropic melaporkan ~41% pada Terminal-Bench (berfokus pada baris perintah) dan hasil yang sebanding dengan Sonnet 4 serta beberapa model frontier kelas menengah pesaing pada banyak tolok ukur penggunaan alat.
Mengikuti instruksi & teks slide: contoh internal Anthropic mengklaim Haiku 4.5 melampaui model sebelumnya pada beberapa tugas mengikuti instruksi (misalnya, pembuatan teks slide: 65% vs 44% untuk model premium sebelumnya dalam tolok ukur mereka).
Otomasi dunia nyata / tugas agen: evaluasi pihak ketiga dan pengadopsi awal melaporkan tingkat keberhasilan kompetitif pada tugas UI/agen otomatis (misalnya, tolok ukur gaya OSWorld atau agen melaporkan ≈50% keberhasilan pada otomasi kompleks dalam beberapa pengujian), menunjukkan kegunaan untuk alur kerja skala besar meskipun masih memiliki mode kegagalan yang tidak sepele.
Keterbatasan & catatan keselamatan
- Bukan model frontier: Anthropic secara eksplisit mengklasifikasikan Haiku 4.5 sebagai bukan pendorong batas terdepan; model ini dioptimalkan untuk efisiensi alih-alih mendorong batas tertinggi kemampuan. (Anthropic)
- Perilaku pada topik sensitif sesekali: pada beberapa prompt ilmiah/keamanan hayati, Haiku 4.5 terkadang memberikan informasi tingkat tinggi dengan penjelasan alih-alih penolakan tegas; Anthropic menandai ini sebagai area yang terus diperbaiki.
- Pemikiran yang diperluas dapat mengubah perilaku (terkadang meningkatkan asimetri dalam respons).
Kasus penggunaan yang direkomendasikan
- Pengodean beragen & orkestrasi multi-agen: sub-agen cepat, refaktor kode iteratif, uji otomatis dan pembuatan patch. (Sangat cocok.)
- Alur kerja pelanggan waktu nyata dan volume tinggi: asisten obrolan, otomasi internal di mana biaya per permintaan penting. (Sangat cocok.)
- Alur kerja berkemampuan alat & kendali komputer: mengotomasi tugas GUI/CLI, alur dokumen dan rantai alat di mana latensi rendah membantu. (Sangat cocok.)
- Tidak direkomendasikan (tanpa kontrol): peran mandiri yang memerlukan desain sekuens ilmiah tingkat frontier atau tugas biosekuriti dengan jaminan tinggi. (Gunakan dengan hati-hati.)
Cara mengakses API Claude Haiku 4.5
Langkah 1: Daftar untuk Kunci API
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke CometAPI console. Dapatkan kredensial akses kunci API antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirimkan.
Langkah 2: Kirim Permintaan ke API Claude Haiku 4.5
Pilih endpoint “claude-haiku-4-5-20251001” untuk mengirim permintaan API dan atur badan permintaan. Metode permintaan dan badan permintaan diperoleh dari dokumentasi API situs web kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. URL dasar adalah Anthropic Messages dan Chat.
Masukkan pertanyaan atau permintaan Anda ke dalam kolom konten — inilah yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Ambil dan Verifikasi Hasil
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah diproses, API merespons dengan status tugas dan data keluaran.