Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
guide/CometAPI araştırması

Claude Haiku 5.5 API Nasıl Kullanılır: Eksiksiz Geliştirici Rehberi

CometAPI ile Claude Haiku 5.5 API'sini nasıl kullanacağınızı öğrenin. Kurulum, kod örnekleri, akış, effort ayarları, fiyatlandırma ve geçiş konularını keşfedin.

CometAPI
Deon GoodwinAI model ve API araştırma ekibi
Güncellendi Oct 10, 2026 15 dk okuma
Claude Haiku 5.5 API Nasıl Kullanılır: Eksiksiz Geliştirici Rehberi
Bu kalıbı kullanın

İlk API çağrısını yapın.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR Claude Haiku 5.5, şimdiye kadar piyasaya sürdüğü en ucuz, en hızlı ve en yetenekli küçük model olarak tanımlanıyor. Sınıflandırma, çıkarım, yönlendirme, özetleme ve alt ajan görevleri gibi yüksek hacimli, gecikmeye duyarlı iş yükleri için tasarlanan model; 1 milyon token’lık bağlam penceresi, 128K’ye kadar çıktı token’ı, ayarlanabilir çaba seviyeleriyle uyarlanabilir düşünme sunuyor.

Ortalama olarak, ajan ve bilgisayar kullanımı kıyaslamalarında büyük artışlar kaydederken Haiku 4.5’e kıyasla çalıştırma maliyeti yaklaşık %75 daha düşük. Geliştiriciler modele resmi Claude API’si (claude-haiku-5-5), Amazon Bedrock, Google Cloud, Microsoft Foundry veya CometAPI gibi maliyet optimize edilmiş geçitler üzerinden (başlangıç $0.08 / $0.40) erişebilir.

Öne Çıkanlar

  • Çıkış ve Konumlandırma: 7 Ekim 2026’da, Claude 5.5 ailesinin küçük, yüksek verimli modeli olarak piyasaya sürüldü—gerçek zamanlı destek, belge işleme ve delege edilen ajan adımları için ideal.
  • Temel Özellikler: 1M-token bağlam, 128K maksimum çıktı (Batch API beta ile 300K), uyarlanabilir düşünme (varsayılan orta çaba), metin + görsel girdi → metin çıktı, bilgi kesimi Haziran 2026.
  • Fiyatlandırma Avantajı: 100K token’a kadar prompt’lar için milyon token başına $0.10 giriş / $0.50 çıkış (çoğu istekte Haiku 4.5’ten ≈%90 daha ucuz); 100K üzeri için daha yüksek katman. Cache okumaları $0.01’e kadar. CometAPI, Standart tarifelerde ≈%20 daha düşük sunar.
  • Performans Atılımı: Haiku 4.5’e göre büyük kazanımlar (ör. OSWorld %72.4 vs %15.7, Terminal-Bench %39.2 vs %0, GDPval-AA 1620 vs 735 Elo) ve birçok testte GPT-6 Luna ile rekabetçi veya önde.
  • Geliştirici Özellikleri: Effort parametresi (low–max), prompt caching, Batch API (%%50 indirim), bilgisayar/tarayıcı kullanımı (beta SDK desteği). Temperature/top_p/top_k belirtilmemeli; aksi halde 400 hatası döner.

Claude Haiku 5.5 Nedir ve 2026’da Neden Önemlidir

Claude Haiku 5.5, Claude ailesinin hafif katmanındaki en yeni Anthropic modelidir. Karmaşık akıl yürütme ve uzun ufuklu ajanlar için optimize edilen daha pahalı Opus 5.5 ve Sonnet 5.5’ten farklı olarak, Haiku 5.5 yüksek hacimli, maliyet duyarlı ve gecikme kritik iş yükleri için özel olarak tasarlanmıştır. Anthropic, modeli “şimdiye kadar yayınladığımız en ucuz, en hızlı ve en yetenekli küçük model” olarak tanımlar.

Tipik üretim kullanım alanları:

  • Müşteri desteğinde bilet sınıflandırma ve yönlendirme
  • Uzun belgelerden alan çıkarımı ve özetleme
  • Daha büyük modeller için konuşma geçmişinin sıkıştırılması
  • Veritabanı tarzı sorgular ve yapılandırılmış veri görevleri
  • Daha güçlü bir modelin orkestre ettiği süreçlerde dar kapsamlı kodlama, araç kullanımı veya tarayıcı adımlarını üstlenen hızlı alt ajanlar

Öncekine göre dramatik şekilde daha ucuz ve hızlı olup pratik ajansal görevlerde kalite farkının büyük bölümünü kapattığı için, pek çok ekip boru hatlarını yeniden tasarlayarak isteklerin çoğunu Haiku 5.5’in ele almasını ve yalnızca zor vakaları Sonnet veya Opus’a yükseltmesini sağlıyor. Asana, HubSpot, Box ve diğerlerinden gelen erken müşteri geri bildirimleri, yüksek hacimli dahili değerlendirmelerde %30’u aşan gecikme azalmaları ve ölçülebilir doğruluk artışları vurguluyor.

Claude Haiku 5.5 Teknik Özellikleri

ÖzellikDeğerNotlar
Model Kimliği (Claude API)claude-haiku-5-5Tarih soneki yok
Amazon Bedrockanthropic.claude-haiku-5-5 (veya global/us/eu/au/jp profilleri)
Bağlam penceresi1,000,000 tokens≈555k kelime, yeni tokenizer ile
Maks çıktı (Messages API)128,000 tokensBatch API + beta header ile 300K
Girdi kipleriMetin + görseller
Çıktı kipiMetin
DüşünmeUyarlanabilir (varsayılan açık)Effort üzerinden kontrol edilir
Varsayılan effortmediumSeçenekler: low, medium, high, xhigh, max
Bilgi kesimiHaziran 2026
Emeklilik taahhüdü7 Ekim 2027’den önce değil
TokenizerDaha yeni (Claude 4.7+ ile aynı aile)Aynı metin Haiku 4.5’e göre ≈%30 fazla token

Kaynak: Anthropic model genel bakışı ve platform dokümantasyonu.

Daha geniş bağlam ve çıktı sınırları, uyarlanabilir düşünme ile birleştiğinde, Haiku 5.5’i agresif kırpma veya sabit düşünme bütçeleri gerektiren önceki küçük modellere kıyasla gerçek üretim sistemleri için çok daha kullanılabilir kılar.

Yanıtlar ve tamamlanma kontrolleri

Görünür yanıtın content[0] olduğunu varsaymak yerine türüne göre içerik bloklarını okuyun. Çıktıyı kabul etmeden önce stop_reason’u inceleyin: max_tokens, kesilmiş bir üretimi; refusal, açık bir uygulama yanıtını gerektirir. Araç etkin isteklerde, araç kullanım bloklarını işleyin ve bunları tamamlanmış bir metin yanıtı gibi ele almak yerine yerel formatta araç sonuçlarını döndürün.

Claude Haiku 4.5 API ile Karşılaştırıldığında Ne Değişti?

Kapasite, davranış ve fiyatlandırma değişiklikleri

BoyutHaiku 4.5Haiku 5.5Sonnet 5.5
Bağlam penceresi200K1M1M
Maksimum çıktı64K128K128K
Uyarlanabilir effortHayırEvetEvet
Anthropic giriş / MTok$1.00$0.10$2.00
Anthropic çıkış / MTok$5.00$0.50$10.00
KonumlandırmaEski hızlı modelÖlçekli rutin işlerDaha zor karmaşık görevler

Bu karşılaştırmada Haiku 5.5 fiyatları, 100.000 token’a kadar olan prompt’lar için geçerlidir; daha uzun prompt’lar daha pahalıdır. Bunlar Anthropic Standart tarifeleridir; CometAPI tarifeleri değildir. Karşılaştırma bir yönlendirme başlangıç noktasıdır; modellerin aynı performansı verdiği iddiasında değildir.

Haiku 4.5 entegrasyonları için kilit uygulama değişiklikleri: manuel bütçe yerine uyarlanabilir düşünme, effort kontrolleri, içerik bloklarının seçici ayrıştırılması ve güncellenmiş token sayımlarıdır. Aynı metin yaklaşık %30 daha fazla giriş token’ı kullanabilir. Haiku 4.5 token tahminlerini yeniden kullanmak yerine temsilî prompt’ları yeniden sayın. Geçiş bölümü bu değişiklikleri bir dağıtım kontrol listesine dönüştürür.

Bildirilen kıyaslama iyileştirmeleri

KıyaslamaHaiku 4.5Haiku 5.5Sonnet 5.5
OSWorld 2.1 (çevrimdışı altküme; kısmi kredi)%15.7%72.4%83.9
Terminal-Bench 4.0%0.0%39.2%70.6
Humanity’s Last Exam (araçsız)%10.2%45.9%56.9
Chartography (araçsız)%6.4%46.4%61.6
GDPval-AA v2.1 (Elo)7351,6201,840

Anthropic, yukarıdaki puanları çıkış kıyaslama özetinde raporlamaktadır. Bunlar, bu rehberdeki CometAPI örneklerinin canlı testleri değil, raporlanan değerlendirme sonuçlarıdır. OSWorld’ün %72.4’ü kısmi kredidir; katı görev tamamlama oranı değildir.

Haiku 5.5 sistem kartı değerlendirme koşullarını açıklar. Standart Haiku 5.5 değerlendirmeleri, not edilmedikçe varsayılan örnekleme ile maksimum effort’ta uyarlanabilir düşünme kullanır; ürün varsayılanı medium’dur. OSWorld, 82 çevrimdışı görev, internet erişimi yok, 1080p çözünürlük ve 500 eylem sınırı kullanır. Terminal-Bench 4.0, çıplak modda Claude Code, internet çıkışı yok ve Haiku 5.5 için görev başına 10 deneme kullanır; Sonnet’in kurulumu farklıdır. HLE ve Chartography satırları araçsızdır. GDPval-AA, Artificial Analysis değerlendirmelerinden bir Elo derecesi raporlar. Sonuçları karşılaştırırken ilgili çerçeve, effort ve araç ayarlarını eşleştirin.

Claude Haiku 5.5 API Nasıl Kullanılır: Eksiksiz Geliştirici Rehberi

Anthropic’in orijinal OSWorld grafiği, effort, görev başına maliyet ve kısmi kredi puanı arasındaki ilişkiyi gösterir. API gecikmesini ölçmez veya iş yükünüzde aynı performansı garanti etmez.

Puanlar, Haiku 4.5’e göre çok daha güçlü bilgisayar kullanımı ve genel görev performansına işaret eder; ancak uygulamanızda aynı sonuçları garanti etmez. Üretim trafiğine geçmeden önce temsilî bir değerlendirme seti çalıştırın.

Kıyaslama tablosu ve sağlanan grafik, model karşılaştırmaları olarak korunmuştur. Bunlar, CometAPI örneklerinin canlı testleri yerine raporlanan değerlendirmelerdir. Bir uygulamayı değerlendirirken aynı görev dağılımını, effort’u ve araç ayarlarını kullanın; bir kıyas puanı, ağ geçidi gecikmesini veya kendi başarı oranınızı belirlemez.

CometAPI Üzerinden Claude Haiku 5.5 API’sini Nasıl Kullanılır

Bir anahtar oluşturun ve yerel rotayı seçin

Bir CometAPI hesabı oluşturun, claude-haiku-5-5 erişimini onaylayın ve sunucu tarafı bir API anahtarı üretin. COMETAPI_KEY’i ortamınıza ayarlayın. Anahtarı kaynak kontrolünün ve tarayıcı kodunun dışında tutun. Anthropic ve CometAPI anahtarları farklı sağlayıcılara aittir; bu güncellenmiş rehberdeki her örnek için CometAPI anahtarını kullanın.

export COMETAPI_KEY="your_cometapi_api_key"
pip install --upgrade anthropic
$env:COMETAPI_KEY="your_cometapi_api_key"
EntegrasyonSDK temel URL’siİstek yoluKimlik bilgisi
Anthropic-uyumlu Messageshttps://api.cometapi.com/v1/messagesCOMETAPI_KEY
OpenAI-uyumlu Chat Completionshttps://api.cometapi.com/v1/chat/completionsCOMETAPI_KEY

CometAPI, Claude’un yerel Messages ve içerik blok formatını destekler. CometAPI kök taban URL’si ile Anthropic SDK’sını kullanın. Yerel Messages, Claude’a özgü düşünme ve içerik blokları için bu rehberde tercih edilen rotadır. Uyumlu Chat Completions rotası, mevcut bir OpenAI tarzı uygulama için bir seçenektir. İlgili ağ geçidinde gelişmiş alan desteğini doğrulayın.

En küçük isteği gönderin ve sonucu doğrulayın

curl https://api.cometapi.com/v1/messages \
  -H "Content-Type: application/json" \
  -H "x-api-key: $COMETAPI_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "output_config": {"effort": "low"},
    "messages": [{"role": "user", "content": "Summarize three AI uses in customer support."}]
  }'
import os
import anthropic

client = anthropic.Anthropic(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com",
    timeout=60.0,
    max_retries=2,
)

response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "Classify this ticket: I cannot log in."}],
)
if response.stop_reason != "end_turn":
    raise RuntimeError(f"Unaccepted completion: {response.stop_reason}")
print("".join(block.text for block in response.content if block.type == "text"))
print(response.usage)

Python örneğini example.py olarak kaydedin ve python example.py çalıştırın. Başarılı bir kontrol noktası, görünür metin ve kullanım alanları olan tamamlanmış bir yanıttır. Kimlik doğrulama hatası, anahtarın kontrol edilmesi gerektiğini; model/rota hatası, model kimliği, uç nokta veya hesap erişiminin kontrol edilmesi gerektiğini gösterir.

Aynı yerel formatı JavaScript’te kullanın

npm install @anthropic-ai/sdk
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: "https://api.cometapi.com",
  timeout: 60_000,
  maxRetries: 2,
});
const response = await client.messages.create({
  model: "claude-haiku-5-5",
  max_tokens: 2048,
  output_config: {effort: "low"},
  messages: [{role: "user", content: "Extract product, quantity and price: 3 laptops at $900 each."}],
});
if (response.stop_reason !== "end_turn") {
  throw new Error("Unaccepted completion: " + response.stop_reason);
}
for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}

Desteklenen bir Node.js sürümü kullanın. Dosyayı example.mjs olarak kaydedin, COMETAPI_KEY ayarlayın ve node example.mjs çalıştırın. Dağıtım için doğruladığınız SDK sürümünü kaydedin.

Mevcut OpenAI uyumlu bir uygulamayı uyarlayın

Uygulamanız zaten Chat Completions kullanıyorsa openai paketini yükleyin ve aşağıdaki ayrı istemciyi yapılandırın. Bu rota, yerel içerik blokları yerine choices döndürür. Rota’ya özgü ayrıştırmayı ayrı tutun ve ağ geçidi çevirisine güvenmeden önce thinking, görseller ve araçları test edin.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    messages=[
        {"role": "system", "content": "Be concise and helpful."},
        {"role": "user", "content": "Explain API rate limits."},
    ],
)
print(response.choices[0].message.content)

Claude Haiku 5.5 API’sine görseller gönderme

Görseli, gereken kanıtı ve beklenen çıktıyı belirten bir talimatla birlikte kullanın. Resmî görsel arayüzü, base64 verisi olan görsel içerik bloklarını, bir görsel URL’sini veya desteklenen yüklenen dosya referansını kabul eder. Bu örnek, yerel bir PNG’yi okur, sorudan önce görseli yerleştirir ve kaynağa karşı doğrulanabilecek değerleri ister.

Yerel bir gerçek PNG’yi yerel Anthropic Messages API’si ile analiz edin.

import os
import base64
from pathlib import Path
import anthropic

# Replace dashboard.png with a real PNG file you are authorized to analyze.
image_data = base64.b64encode(Path("dashboard.png").read_bytes()).decode("ascii")
anthropic_client = anthropic.Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])
response = anthropic_client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=2048,
    output_config={"effort": "low"},
    messages=[{
        "role": "user",
        "content": [
            {"type": "image", "source": {
                "type": "base64", "media_type": "image/png", "data": image_data
            }},
            {"type": "text", "text": (
                "Read the visible dashboard metrics. List anomalies with their "
                "labels and values, and state when text is unreadable."
            )},
        ],
    }],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

Gerçek dosyayla eşleşen MIME türünü kullanın. Gönderimden önce okunabilirliği, görsel boyutlarını ve istek boyutu sınırlarını kontrol edin; görevi fayda sağlamayan yüksek çözünürlüklü medyayı göndermekten kaçının. CometAPI için, anahtarı ve kök taban URL’sini Messages örneğinde gösterildiği gibi değiştirin ve tam rota üzerinde görsel desteğini doğrulayın.

Claude Haiku 5.5 akıl yürütmesini kontrol etme

Haiku 5.5 varsayılan olarak uyarlanabilir düşünme kullanır. Resmî thinking yapılandırması, disabled’ın ne zaman kabul edildiğini ve thinking bloklarının nasıl döndürüldüğünü açıklar. Effort’u output_config.effort üzerinden ayarlayın; eski budget_tokens’u yeniden kullanmayın.

Effortİyi başlangıç kullanım durumuDeğiş tokuş
lowKısa sınıflandırma, basit çıkarımTipik olarak daha düşük token kullanımı ve gecikme
mediumDestek yanıtları, rutin ajan işleriDengeli varsayılan
highÇok adımlı belge analiziPotansiyel olarak daha fazla akıl yürütme
xhighZor değerlendirmelerDaha fazla işlem ve maliyet
maxAkıl yürütme yoğun vakalarEn yüksek potansiyel akıl yürütme harcaması

Uyarlanabilir düşünmeyi düşük effort ile yapılandırın.

import osimport anthropic​anthropic_client = anthropic.Anthropic(    api_key=os.environ["ANTHROPIC_API_KEY"],)​response = anthropic_client.messages.create(    model="claude-haiku-5-5",    max_tokens=4096,    thinking={"type": "adaptive"},    output_config={"effort": "low"},    messages=[{"role": "user", "content":        "Classify as billing, technical, or account: cannot log in."}],)for block in response.content:    if block.type == "text":        print(block.text)

Geliştiriciler thinking’i low, medium ve high effort’ta devre dışı bırakabilir; ancak xhigh veya max’ta değil. Thinking, metni gizli olsa bile faturalandırılan çıktı token’larını ve max_tokens bütçesini tüketir. Boş bir thinking alanı yine de bir imza taşıyabilir; akıl yürütme olmadığını kanıtlamaz. Araç konuşmalarına devam ederken döndürülen içerik bloklarını değiştirmeyin.

Thinking devre dışı iken örnek istek

Thinking’in devre dışı olduğu yerel bir istek gövdesi gönderin.

{  "model": "claude-haiku-5-5",  "max_tokens": 1024,  "thinking": {"type": "disabled"},  "output_config": {"effort": "low"},  "messages": [    {"role": "user", "content": "Return sentiment only: positive, neutral, negative."}  ]}

Claude Haiku 5.5 yanıtlarını akış halinde iletme

Akış, görünür metni artımlı olarak sağlar ve etkileşimli uygulamalarda duyarlılığı artırır. İstek başarıyla tamamlanana kadar akıştaki metni geçici olarak ele alın.

Anthropic Python SDK’sı ile görünür metni akışlayın.

import osimport anthropic​anthropic_client = anthropic.Anthropic(    api_key=os.environ["ANTHROPIC_API_KEY"],)with anthropic_client.messages.stream(    model="claude-haiku-5-5",    max_tokens=4096,    output_config={"effort": "low"},    messages=[{"role": "user", "content": "Explain API caching."}],) as stream:    for text in stream.text_stream:        print(text, end="", flush=True)

Claude Haiku 5.5 API Fiyatlandırması

Token oranlarını ve prompt uzunluğu bantlarını karşılaştırın

Oranlar 8 Ekim 2026’da kontrol edildi. Tablo, Anthropic Standart fiyatlandırmasını yayınlanan CometAPI oranlarıyla karşılaştırmaktadır; milyon token başına USD cinsindendir. Bant, prompt uzunluğuna göre belirlenir: 100.000 token’a kadar ve 100.000’den fazla. Daha uzun istekler, yalnızca fazla token’lar için ek ücret değil, ilgili yüksek bant oranlarını kullanır. Hesap faturalandırması, cache kullanımı ve isteğe bağlı araçlar ayrı ayrı uzlaştırılmalıdır.

Token kategorisiAnthropic ≤100KCometAPI ≤100KAnthropic >100KCometAPI >100K
Giriş$0.10$0.08$0.50$0.40
Çıkış$0.50$0.40$2.50$2.00
Cache okuma$0.01$0.008$0.05$0.04
5 dak. cache yazma$0.125$0.10$0.625$0.50
1 saat cache yazma$0.20$0.16$1.00$0.80

Orijinal makalenin oran anlık görüntüsü yukarıda korunmuştur. Satın alma veya dağıtımdan önce güncel CometAPI listelemesini ve hesap faturalandırmasını kontrol edin; listelemenin başlangıç giriş oranı, her prompt uzunluk bandı, cache işlemi veya isteğe bağlı araç için tam bir fiyat teklifi değildir.

Örnek: 100.000 destek isteğinin maliyeti

Aylık 100.000 istek varsayın; her birinde 2.000 giriş token’ı ve 300 faturalandırılan çıktı token’ı (üretilen thinking dahil). Her prompt, 100.000’e kadar olan bant için uygundur. Cache, araç ücretleri ve yeniden denemeler hariç tutulmuştur.

BileşenKullanımAnthropicCometAPI
Giriş200M token$20.00$16.00
Çıkış30M token$15.00$12.00
Toplam100,000 istek$35.00$28.00

Bu varsayımlar altında, örnek fark aylık $7 veya %20’dir. Üretim maliyetleri, istek uzunluklarına, gizli akıl yürütmeye, caching’e ve yeniden deneme davranışına bağlıdır.

Hesaplamada modelin güncel token sayılarını kullanın. Maliyet = giriş token’ları × uygulanabilir giriş oranı / 1,000,000 + faturalandırılan çıktı token’ları × uygulanabilir çıkış oranı / 1,000,000, artı ayrı ayrı uygulanabilir cache, araç ve yeniden deneme ücretleri. Thinking token’ları, faturalandırılan çıktının bir parçasıdır.

Kabul edilen görev kalitesini kaybetmeden maliyeti düşürün

OptimizasyonEylemYarar
Effort ayarıKalitenin izin verdiği yerde low kullanınDaha düşük akıl yürütme yükü
Prompt azaltmaGereksiz konuşma geçmişini kaldırınDaha az giriş token’ı
Prompt cachingYeniden kullanılan bağlamı sabit tutunTekrarlanan giriş maliyeti düşer
AkışToken’ları geldikçe render edinDaha iyi algılanan duyarlılık
Şema doğrulamaHatalı kayıtları erken reddedinDaha az aşağı akış yeniden işleme
Model yönlendirmeKarmaşık görevleri yükseltinDaha iyi maliyet-kalite dengesi
Batch işlemeUygun çevrimdışı istekleri batch’leyinPotansiyel ek tasarruf

Otomatik olarak en düşük effort’u seçmeyin. Daha ucuz tek bir çağrı, daha fazla yeniden deneme üretirse toplam maliyetleri artırabilir. Doğruluk, p50/p95 gecikme, token kullanımı ve başarılı görev başına maliyeti değerlendirin.

Prompt caching için, sabit bir ön ek (prefix) kullanın ve cache oluşturma ve cache okuma kullanımını varsayılan bir isabet yerine denetleyin. Haiku 5.5’te belgelenmiş Claude API’sinde en az 512 token’lık cache’lenebilir prompt vardır. Effort değiştirmek, cache’lenmiş ön ekleri geçersiz kılabilir; bir konuşma içinde ayarları sabit tutun. 1M bağlam penceresi bir kapasite tavanıdır; her turda her belgeyi göndermek için bir öneri değildir.

Caching için sabit ve yeniden kullanılabilir bir ön ek tutun, gereksiz girdileri kısaltın ve effort değişikliklerini kıyaslayın. Akış, faturalandırılan kullanımı otomatik olarak azaltmak yerine algılanan duyarlılığı artırır. Yeniden denemeler ve araç çağrıları dahil olmak üzere tüm iş akışı genelinde kabul edilen görev başına maliyeti karşılaştırın.

Claude Haiku 4.5’ten Haiku 5.5’e Geçiş Rehberi

Entegrasyonu ve istek formatını güncelleyin

AlanGeçiş eylemi
Model Kimliğiclaude-haiku-5-5 ile değiştirin
ThinkingManuel budget_tokens yerine uyarlanabilir düşünmeye geçin
EffortGerekirse output_config.effort kullanın
Örneklemetemperature, top_p ve top_k’yi çıkarın; herhangi bir top_k desteklenmez
Yanıt ayrıştırıcıBirden çok içerik blok türünü ele alın
Çıkış bütçesiAkıl yürütme ve nihai çıktı için yeterli alan bırakın
PrefillDesteklenmeyen assistant prefilling’i kaldırın
CachingEffort değiştirirken prompt’ları yeniden test edin
Araç entegrasyonlarıDesteklenen araç sürümlerini doğrulayın

Burada kullanılan CometAPI rotası için, model kimliği ve istek yapılandırmasını değiştirirken COMETAPI_KEY ve yerel taban URL’sini koruyun. Bütçeyle etkin thinking’i, uyarlanabilir thinking ve effort ile değiştirin. Assistant prefilling’i kaldırın ve örnekleme parametrelerini atlayın. Claude’un yerel content dizisi ile uyumlu rotanın choices yanıtı arasındaki ayrımı koruyun.

Durumu koruyun ve bütçeleri yeniden hesaplayın

Resmî Haiku 5.5 geçiş rehberi, Haiku 4.5’e göre aynı metin için yaklaşık %30 daha fazla giriş token’ı raporlar. Trafiği taşımadan önce temsilî prompt’ları yeniden sayın ve limitleri yeniden ayarlayın. Döndürülen thinking blokları yalnızca onları üreten hesapta veya bağlı bir hesapta çalışır; hesap değişikliği bu blokları sessizce düşürebilir. Üretimden sonra önceki iletileri değiştirmek yerine eklemeli bir konuşma ön eki koruyun. stop_reason’u—max_tokens ve refusal dahil—çıktıyı kabul etmeden önce açıkça denetleyin.

Hedef modelle temsilî prompt’ları yeniden sayın ve max_tokens, gecikme limitleri ve istek maliyeti tahminlerini yeniden ayarlayın. Kaydedilmiş konuşmaları, yeniden oynatılacak hesap ve ağ geçidi rotasında test edin; imzalı thinking bloklarının, ilişkili olmayan hesaplar veya yeniden yazılmış konuşma ön ekleri arasında taşınabilir olduğunu varsaymayın.

Sonuç

Claude Haiku 5.5, maliyet etkin, yüksek verimli yapay zekâ için gerçek bir kırılma noktasıdır. Çoğu istekte önceki Haiku fiyatının yaklaşık onda biriyle, ajan ve bilgisayar kullanımı performansında dramatik bir artış sunarak yetenekli küçük modellerin geniş ölçekte dağıtımını pratik hâle getirir. İster resmî API’yi çağırın, ister Amazon Bedrock üzerinden yönlendirin, ister ek tasarruf ve operasyonel sadelik için CometAPI gibi birleşik bir ağ geçidini kullanın; hız, yetenek ve fiyatın kombinasyonu, daha önce ekonomik olmayan yeni ürün olasılıklarını açar.

Öğrenmeye devam et

Bu makaleyi sonraki karara bağlayın.

Tüm konuları gör
Yayınlanma tarihi Oct 10, 2026
Son güncelleme Oct 10, 2026
4 görüntülenme
Netlik, kaynak ataması ve güncel API terminolojisi açısından gözden geçirildi.

Devamını Oku