Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
guide/Riset CometAPI

Cara Menggunakan API Claude Haiku 5.5: Panduan Lengkap untuk Pengembang

Pelajari cara menggunakan API Claude Haiku 5.5 dengan CometAPI. Jelajahi penyiapan, contoh kode, streaming, pengaturan effort, harga, dan migrasi.

CometAPI
Deon GoodwinTim riset model AI dan API
Diperbarui Oct 10, 2026 16 menit baca
Cara Menggunakan API Claude Haiku 5.5: Panduan Lengkap untuk Pengembang
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR Claude Haiku 5.5 menyebutnya model kecil termurah, tercepat, dan paling andal yang pernah dirilis. Dirancang untuk beban kerja volume tinggi dan sensitif latensi seperti klasifikasi, ekstraksi, perutean, peringkasan, dan tugas subagen, model ini menghadirkan jendela konteks 1 juta token, hingga 128K token keluaran, serta pemikiran adaptif dengan tingkat effort yang dapat disesuaikan.

Rata-rata biayanya sekitar 75% lebih murah untuk dijalankan dibanding Haiku 4.5 sambil mencatat peningkatan besar pada tolok ukur agentic dan penggunaan komputer. Pengembang dapat mengaksesnya melalui Claude API resmi (claude-haiku-5-5), Amazon Bedrock, Google Cloud, Microsoft Foundry, atau gateway hemat biaya seperti CometAPI (mulai $0.08 / $0.40).

Key Takeaways

  • Release & Positioning: Diluncurkan 7 Oktober 2026 sebagai model kecil ber-throughput tinggi dalam keluarga Claude 5.5—ideal untuk dukungan waktu nyata, pemrosesan dokumen, dan langkah agen yang didelegasikan.
  • Core Specs: Konteks 1M token, output maksimum 128K (300K melalui Batch API beta), pemikiran adaptif (effort default medium), input teks + gambar → output teks, knowledge cutoff Juni 2026.
  • Pricing Advantage: $0.10 input / $0.50 output per juta token untuk prompt hingga 100K (≈90% lebih murah daripada Haiku 4.5 pada sebagian besar permintaan); tier lebih tinggi di atas 100K. Pembacaan cache serendah $0.01. CometAPI menawarkan tarif Standard ≈20% lebih rendah.
  • Performance Leap: Lonjakan besar vs Haiku 4.5 (mis., OSWorld 72.4% vs 15.7%, Terminal-Bench 39.2% vs 0%, GDPval-AA 1620 vs 735 Elo) sambil tetap kompetitif atau unggul dari GPT-6 Luna pada banyak tes.
  • Developer Features: Parameter effort (low–max), caching prompt, Batch API (diskon 50%), penggunaan komputer/peramban (dukungan SDK beta). Temperature/top_p/top_k harus dihilangkan atau akan terjadi error 400.

What Is Claude Haiku 5.5 and Why It Matters in 2026

Claude Haiku 5.5 adalah entri terbaru Anthropic di tier ringan keluarga Claude. Berbeda dengan Opus 5.5 dan Sonnet 5.5 yang lebih mahal dan dioptimalkan untuk penalaran kompleks serta agen berjangka panjang, Haiku 5.5 dibuat khusus untuk beban kerja volume tinggi, sensitif biaya, dan kritis latensi. Anthropic menggambarkannya sebagai “model kecil termurah, tercepat, dan paling andal yang pernah kami rilis.”

Penggunaan produksi yang umum meliputi:

  • Klasifikasi tiket dan perutean dalam dukungan pelanggan
  • Ekstraksi field dan peringkasan dari dokumen panjang
  • Kompaksi riwayat percakapan untuk model yang lebih besar
  • Kueri bergaya basis data dan tugas data terstruktur
  • Subagen cepat yang menangani langkah pengkodean sempit, penggunaan alat, atau peramban sementara model yang lebih kuat mengorkestrasi

Karena jauh lebih murah dan lebih cepat daripada pendahulunya sekaligus menutup banyak kesenjangan kualitas pada tugas agentic praktis, banyak tim merancang ulang pipeline sehingga Haiku 5.5 menangani mayoritas permintaan dan hanya mengeskalasi kasus sulit ke Sonnet atau Opus. Umpan balik awal pelanggan dari Asana, HubSpot, Box, dan lainnya menyoroti pengurangan latensi 30%+ dan peningkatan akurasi terukur pada evaluasi internal volume tinggi.

Technical Specifications of Claude Haiku 5.5

SpesifikasiNilaiCatatan
ID Model (Claude API)claude-haiku-5-5Tanpa sufiks tanggal
Amazon Bedrockanthropic.claude-haiku-5-5 (atau profil global/us/eu/au/jp)
Jendela konteks1,000,000 token≈555k kata dengan tokenizer baru
Output maksimal (Messages API)128,000 token300K dengan Batch API + beta header
Modalitas inputTeks + gambar
Modalitas outputTeks
PemikiranAdaptif (aktif secara default)Dikendalikan melalui effort
Effort defaultmediumOpsi: low, medium, high, xhigh, max
Batas pengetahuanJuni 2026
Komitmen penghentianTidak sebelum 7 Oktober 2027
TokenizerLebih baru (keluarga yang sama dengan Claude 4.7+)Teks yang sama ≈30% lebih banyak token daripada Haiku 4.5

Sumber: ringkasan model Anthropic dan dokumentasi platform.

Batas konteks dan output yang lebih besar, dikombinasikan dengan pemikiran adaptif, membuat Haiku 5.5 jauh lebih dapat digunakan untuk sistem produksi nyata dibanding model kecil sebelumnya yang membutuhkan pemangkasan agresif atau anggaran pemikiran tetap.

Responses and completion checks

Baca blok konten berdasarkan jenisnya, alih-alih mengasumsikan content[0] adalah jawaban yang terlihat. Periksa stop_reason sebelum menerima output: max_tokens menunjukkan generasi terpotong dan refusal memerlukan respons aplikasi eksplisit. Untuk permintaan yang mengaktifkan alat, proses blok penggunaan alat dan kembalikan hasil alat dalam format native, alih-alih memperlakukannya sebagai jawaban teks yang sudah selesai.

What Changed Compared With Claude Haiku 4.5 API?

Capacity, behavior and pricing changes

DimensiHaiku 4.5Haiku 5.5Sonnet 5.5
Jendela konteks200K1M1M
Output maksimum64K128K128K
Effort adaptifTidakYaYa
Anthropic input / MTok$1.00$0.10$2.00
Anthropic output / MTok$5.00$0.50$10.00
PositioningModel cepat lamaPekerjaan rutin skala besarTugas kompleks yang lebih sulit

Harga Haiku 5.5 pada perbandingan ini berlaku untuk prompt hingga 100.000 token; prompt yang lebih panjang berbiaya lebih tinggi. Ini adalah tarif Standard Anthropic, bukan tarif CometAPI. Perbandingan ini adalah titik awal perutean, bukan klaim bahwa model berperforma identik.

Untuk integrasi Haiku 4.5, perubahan implementasi kunci adalah pemikiran adaptif menggantikan anggaran manual, kontrol effort, parsing selektif blok konten, dan hitungan token yang diperbarui. Teks yang sama dapat menggunakan sekitar 30% lebih banyak token input. Hitung ulang prompt representatif alih-alih menggunakan estimasi token Haiku 4.5. Bagian migrasi mengubah perubahan ini menjadi daftar periksa penerapan.

Reported benchmark improvements

BenchmarkHaiku 4.5Haiku 5.5Sonnet 5.5
OSWorld 2.1 (subset offline; kredit parsial)15.7%72.4%83.9%
Terminal-Bench 4.00.0%39.2%70.6%
Humanity’s Last Exam (tanpa alat)10.2%45.9%56.9%
Chartography (tanpa alat)6.4%46.4%61.6%
GDPval-AA v2.1 (Elo)7351,6201,840

Anthropic melaporkan skor di atas dalam ringkasan peluncuran benchmark. Itu adalah hasil evaluasi yang dilaporkan, bukan tes langsung atas contoh CometAPI dalam panduan ini. OSWorld 72.4% adalah kredit parsial, bukan tingkat penyelesaian tugas yang ketat.

Haiku 5.5 system card menjelaskan kondisi evaluasi. Evaluasi standar Haiku 5.5 menggunakan pemikiran adaptif pada effort max dan sampling default kecuali dinyatakan lain; default produk adalah medium. OSWorld menggunakan 82 tugas offline, tanpa akses internet, resolusi 1080p, dan batas 500 aksi. Terminal-Bench 4.0 menggunakan Claude Code dalam mode bare, tanpa egress internet dan 10 percobaan per tugas untuk Haiku 5.5; setup Sonnet berbeda. Baris HLE dan Chartography di atas tanpa alat. GDPval-AA melaporkan rating Elo dari evaluasi Artificial Analysis. Cocokkan harness, effort, dan pengaturan alat yang relevan saat membandingkan hasil.

Cara Menggunakan API Claude Haiku 5.5: Panduan Lengkap untuk Pengembang

Grafik OSWorld asli Anthropic menunjukkan hubungan antara effort, biaya per tugas, dan skor kredit parsial. Ini tidak mengukur latensi API atau menjamin performa yang sama pada beban kerja Anda.

Skor menunjukkan performa penggunaan komputer dan tugas umum jauh lebih kuat daripada Haiku 4.5, tetapi tidak menjamin hasil yang sama dalam aplikasi Anda. Jalankan himpunan evaluasi representatif sebelum mengarahkan trafik produksi.

Tabel benchmark dan grafik yang disediakan dipertahankan sebagai perbandingan model. Ini adalah evaluasi yang dilaporkan, bukan tes langsung contoh CometAPI. Gunakan distribusi tugas, effort, dan pengaturan alat yang sama saat mengevaluasi aplikasi; skor benchmark tidak menetapkan latensi gateway atau tingkat keberhasilan Anda sendiri.

How to Use Claude Haiku 5.5 API Through CometAPI

Create a key and choose the native route

Buat akun CometAPI, konfirmasi akses ke claude-haiku-5-5 dan buat kunci API sisi server. Set COMETAPI_KEY di lingkungan Anda. Simpan kunci di luar kontrol sumber dan kode peramban. Kunci Anthropic dan CometAPI milik penyedia berbeda; gunakan kunci CometAPI untuk setiap contoh dalam panduan yang diperbarui ini.

export COMETAPI_KEY="your_cometapi_api_key"
pip install --upgrade anthropic
$env:COMETAPI_KEY="your_cometapi_api_key"
IntegrasiSDK base URLRequest pathKredensial
Messages kompatibel Anthropichttps://api.cometapi.com/v1/messagesCOMETAPI_KEY
Chat Completions kompatibel OpenAIhttps://api.cometapi.com/v1/chat/completionsCOMETAPI_KEY

CometAPI mendukung Messages native Claude dan format content-block. Gunakan Anthropic SDK dengan root base URL CometAPI. Messages native adalah rute yang disarankan dalam panduan ini untuk thinking dan content blocks khusus Claude. Rute Chat Completions yang kompatibel adalah opsi untuk aplikasi bergaya OpenAI yang sudah ada. Konfirmasikan dukungan field lanjutan pada rute gateway yang digunakan.

Send a minimal request and verify the result

curl https://api.cometapi.com/v1/messages \
  -H "Content-Type: application/json" \
  -H "x-api-key: $COMETAPI_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "output_config": {"effort": "low"},
    "messages": [{"role": "user", "content": "Summarize three AI uses in customer support."}]
  }'
import os
import anthropic

client = anthropic.Anthropic(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com",
    timeout=60.0,
    max_retries=2,
)

response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "Classify this ticket: I cannot log in."}],
)
if response.stop_reason != "end_turn":
    raise RuntimeError(f"Unaccepted completion: {response.stop_reason}")
print("".join(block.text for block in response.content if block.type == "text"))
print(response.usage)

Simpan contoh Python sebagai example.py dan jalankan python example.py. Pencapaian checkpoint yang berhasil adalah respons selesai dengan teks yang terlihat dan field usage. Kesalahan autentikasi berarti kunci perlu diperiksa; kesalahan model/rute berarti ID model, endpoint, atau akses akun perlu diperiksa.

Use the same native format from JavaScript

npm install @anthropic-ai/sdk
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: "https://api.cometapi.com",
  timeout: 60_000,
  maxRetries: 2,
});
const response = await client.messages.create({
  model: "claude-haiku-5-5",
  max_tokens: 2048,
  output_config: {effort: "low"},
  messages: [{role: "user", content: "Extract product, quantity and price: 3 laptops at $900 each."}],
});
if (response.stop_reason !== "end_turn") {
  throw new Error("Unaccepted completion: " + response.stop_reason);
}
for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}

Gunakan rilis Node.js yang didukung. Simpan file sebagai example.mjs, set COMETAPI_KEY dan jalankan node example.mjs. Catat versi SDK yang Anda validasi untuk deployment.

Adapt an existing OpenAI-compatible application

Jika aplikasi Anda sudah menggunakan Chat Completions, instal paket openai dan konfigurasikan klien terpisah di bawah ini. Rute ini mengembalikan choices alih-alih content block native. Jaga parsing spesifik rute tetap terpisah dan uji thinking, gambar, dan alat sebelum mengandalkan translasi gateway.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    messages=[
        {"role": "system", "content": "Be concise and helpful."},
        {"role": "user", "content": "Explain API rate limits."},
    ],
)
print(response.choices[0].message.content)

Sending images to Claude Haiku 5.5 API

Gunakan sebuah gambar bersama instruksi yang menentukan bukti dan output yang Anda butuhkan. Antarmuka vision resmi menerima blok konten gambar dengan data base64, URL gambar, atau referensi file unggahan yang didukung. Contoh ini membaca PNG lokal, menempatkan gambar sebelum pertanyaan, dan meminta nilai yang dapat diperiksa terhadap sumber.

Analisis PNG lokal nyata melalui Anthropic Messages API native.

import os
import base64
from pathlib import Path
import anthropic

# Replace dashboard.png with a real PNG file you are authorized to analyze.
image_data = base64.b64encode(Path("dashboard.png").read_bytes()).decode("ascii")
anthropic_client = anthropic.Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])
response = anthropic_client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    output_config={"effort": "low"},
    messages=[{
        "role": "user",
        "content": [
            {"type": "image", "source": {
                "type": "base64", "media_type": "image/png", "data": image_data
            }},
            {"type": "text", "text": (
                "Read the visible dashboard metrics. List anomalies with their "
                "labels and values, and state when text is unreadable."
            )},
        ],
    }],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

Gunakan tipe MIME yang sesuai dengan file aktual. Periksa keterbacaan, dimensi gambar, dan batas ukuran permintaan sebelum pengiriman; hindari mengirim media beresolusi tinggi yang tidak membantu tugas. Untuk CometAPI, ubah kunci dan root base URL seperti pada contoh Messages, dan verifikasi dukungan gambar pada rute yang digunakan.

Controlling Claude Haiku 5.5 reasoning

Haiku 5.5 menggunakan pemikiran adaptif secara default. Konfigurasi thinking resmi menjelaskan kapan disabled diterima dan bagaimana blok thinking dikembalikan. Set effort melalui output_config.effort; jangan gunakan kembali budget_tokens warisan.

EffortUse case awal yang baikTrade-off
lowKlasifikasi pendek, ekstraksi sederhanaBiasanya penggunaan token dan latensi lebih rendah
mediumRespons dukungan, pekerjaan agen rutinDefault seimbang
highAnalisis dokumen multi-langkahPotensi penalaran lebih banyak
xhighEvaluasi sulitLebih banyak pemrosesan dan biaya
maxKasus intensif penalaranBelanja penalaran potensial tertinggi

Konfigurasikan pemikiran adaptif dengan effort low.

import osimport anthropic​anthropic_client = anthropic.Anthropic(    api_key=os.environ["ANTHROPIC_API_KEY"],)​response = anthropic_client.messages.create(    model="claude-haiku-5-5",    max_tokens=4096,    thinking={"type": "adaptive"},    output_config={"effort": "low"},    messages=[{"role": "user", "content":        "Classify as billing, technical, or account: cannot log in."}],)for block in response.content:    if block.type == "text":        print(block.text)

Pengembang dapat menonaktifkan thinking pada effort low, medium, dan high, tetapi tidak pada xhigh atau max. Thinking mengonsumsi token output yang ditagih dan anggaran max_tokens bahkan ketika teksnya disembunyikan. Field thinking kosong masih dapat membawa tanda tangan; itu tidak membuktikan bahwa tidak ada penalaran yang terjadi. Biarkan blok konten yang dikembalikan tidak berubah saat melanjutkan percakapan alat.

Example request with thinking disabled

Kirim body permintaan native dengan thinking dinonaktifkan.

{  "model": "claude-haiku-5-5",  "max_tokens": 1024,  "thinking": {"type": "disabled"},  "output_config": {"effort": "low"},  "messages": [    {"role": "user", "content": "Return sentiment only: positive, neutral, negative."}  ]}

Streaming Claude Haiku 5.5 responses

Streaming mengirimkan teks yang terlihat secara bertahap dan meningkatkan responsivitas pada aplikasi interaktif. Perlakukan teks streaming sebagai sementara hingga permintaan selesai dengan sukses.

Stream teks yang terlihat dengan Anthropic Python SDK.

import osimport anthropic​anthropic_client = anthropic.Anthropic(    api_key=os.environ["ANTHROPIC_API_KEY"],)with anthropic_client.messages.stream(    model="claude-haiku-5-5",    max_tokens=4096,    output_config={"effort": "low"},    messages=[{"role": "user", "content": "Explain API caching."}],) as stream:    for text in stream.text_stream:        print(text, end="", flush=True)

Claude Haiku 5.5 API Pricing

Compare token rates and prompt-length bands

Tarif diperiksa 8 Oktober 2026. Tabel membandingkan harga Standard Anthropic dengan tarif CometAPI yang dipublikasikan, dalam USD per juta token. Band ditentukan oleh panjang prompt: hingga 100.000 token versus lebih dari 100.000. Permintaan yang lebih panjang menggunakan tarif band yang lebih tinggi yang berlaku, bukan sekadar biaya tambahan pada token yang melampaui. Penagihan akun, penggunaan cache, dan alat opsional harus direkonsiliasi secara terpisah.

Kategori tokenAnthropic ≤100KCometAPI ≤100KAnthropic >100KCometAPI >100K
Input$0.10$0.08$0.50$0.40
Output$0.50$0.40$2.50$2.00
Cache read$0.01$0.008$0.05$0.04
5-min cache write$0.125$0.10$0.625$0.50
1-hour cache write$0.20$0.16$1.00$0.80

Cuplikan tarif artikel asli dipertahankan di atas. Periksa listing CometAPI saat ini dan penagihan akun sebelum pembelian atau deployment; tarif input awal pada listing bukan kutipan lengkap untuk setiap band panjang prompt, operasi cache, atau alat opsional.

Example: Cost of 100,000 support requests

Asumsikan 100.000 permintaan bulanan, masing-masing dengan 2.000 token input dan 300 token output yang ditagih, termasuk thinking yang dihasilkan. Setiap prompt memenuhi syarat untuk band hingga 100K. Kecualikan caching, biaya alat, dan retry.

KomponenPenggunaanAnthropicCometAPI
Input200M token$20.00$16.00
Output30M token$15.00$12.00
Total100,000 permintaan$35.00$28.00

Di bawah asumsi ini, perbedaannya adalah $7 per bulan, atau 20%. Biaya produksi bergantung pada panjang permintaan, penalaran tersembunyi, caching, dan perilaku retry.

Gunakan hitungan token model saat ini dalam perhitungan. Biaya = token input × tarif input yang berlaku / 1.000.000 + token output yang ditagih × tarif output yang berlaku / 1.000.000, plus biaya cache, alat, dan retry yang berlaku terpisah. Token thinking adalah bagian dari output yang ditagih.

Reduce cost without losing accepted-task quality

OptimalisasiAksiManfaat
Penyetelan effortGunakan low jika kualitas memungkinkanOverhead penalaran lebih rendah
Reduksi promptHapus riwayat percakapan yang redundanToken input lebih sedikit
Caching promptJaga konteks yang digunakan ulang stabilBiaya input berulang lebih rendah
StreamingTampilkan token saat tibaResponsivitas yang lebih baik
Validasi skemaTolak record salah format lebih awalLebih sedikit rework hilir
Perutean modelEskalasi tugas kompleksKeseimbangan biaya-kualitas lebih baik
Pemrosesan batchBatch permintaan offline yang memenuhi syaratPotensi penghematan tambahan

Jangan otomatis memilih effort terendah. Panggilan yang lebih murah dapat meningkatkan total biaya jika menghasilkan lebih banyak retry. Evaluasi akurasi, latensi p50/p95, penggunaan token, dan biaya per tugas yang berhasil.

Untuk prompt caching, gunakan prefiks stabil yang dapat digunakan kembali dan periksa pembuatan cache serta penggunaan pembacaan cache alih-alih mengasumsikan hit. Haiku 5.5 memiliki minimum prompt yang dapat dicache 512 token pada Claude API yang didokumentasikan. Perubahan effort dapat membuat prefiks cache tidak berlaku; jaga pengaturan tetap stabil dalam percakapan. Jendela konteks 1M adalah batas kapasitas, bukan rekomendasi untuk mengirim setiap dokumen pada setiap giliran.

Pertahankan prefiks yang dapat digunakan ulang untuk caching, persingkat input yang tidak perlu, dan benchmark perubahan effort. Streaming meningkatkan responsivitas yang dirasakan, bukan otomatis mengurangi penggunaan yang ditagih. Bandingkan biaya per tugas yang diterima di seluruh workflow, termasuk retry dan panggilan alat.

Claude Haiku 4.5 to Haiku 5.5 Migration Guide

Update the integration and request format

AreaAksi migrasi
Model IDGanti dengan claude-haiku-5-5
ThinkingGanti budget_tokens manual dengan pemikiran adaptif
EffortGunakan output_config.effort jika perlu
SamplingHilangkan temperature, top_p dan top_k; nilai top_k apa pun tidak didukung
Response parserTangani beberapa jenis content block
Output budgetSediakan ruang cukup untuk penalaran dan output akhir
PrefillHapus prefilling asisten yang tidak didukung
CachingUji ulang prompt saat mengubah effort
Integrasi alatVerifikasi versi alat yang didukung

Untuk rute CometAPI yang digunakan di sini, pertahankan COMETAPI_KEY dan base URL native sambil mengganti ID model dan konfigurasi permintaan. Ganti thinking enabled warisan dengan anggaran oleh pemikiran adaptif dan effort. Hapus prefilling asisten dan hilangkan parameter sampling. Jaga perbedaan antara content array native Claude dan respons choices rute kompatibel.

Preserve state and recalculate budgets

Panduan migrasi Haiku 5.5 resmi melaporkan sekitar 30% lebih banyak token input untuk teks identik dibanding Haiku 4.5. Hitung ulang prompt representatif dan setel ulang batas sebelum memindahkan trafik. Blok thinking yang dikembalikan hanya berfungsi dalam akun yang memproduksinya atau akun tertaut; perubahan akun dapat diam-diam menghilangkan blok tersebut. Pertahankan prefiks percakapan append-only alih-alih mengubah pesan sebelumnya setelah generasi. Periksa stop_reason, termasuk max_tokens dan refusal, dan tangani secara eksplisit sebelum menerima output.

Hitung ulang prompt representatif dengan model target dan setel ulang max_tokens, batas latensi, dan estimasi biaya permintaan. Uji percakapan yang disimpan terhadap akun dan rute gateway yang akan memutarnya ulang; jangan mengasumsikan blok thinking bertanda tangan portabel di antara akun yang tidak terkait atau prefiks percakapan yang ditulis ulang.

Conclusion

Claude Haiku 5.5 mewakili titik belok nyata untuk AI yang hemat biaya dan ber-throughput tinggi. Dengan menghadirkan performa agentic dan penggunaan komputer yang jauh lebih baik pada sekitar sepersepuluh harga Haiku sebelumnya pada mayoritas permintaan, Anthropic membuat penerapan skala besar model kecil yang andal menjadi praktis. Apakah Anda memanggil API resmi, melalui Amazon Bedrock, atau menggunakan gateway terpadu seperti CometAPI untuk penghematan lebih lanjut dan kesederhanaan operasional, kombinasi kecepatan, kapabilitas, dan harga membuka peluang produk baru yang sebelumnya tidak ekonomis.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Oct 10, 2026
Terakhir diperbarui Oct 10, 2026
0 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Baca Selengkapnya