TLDR Claude Haiku 5.5, şimdiye kadar piyasaya sürdüğü en ucuz, en hızlı ve en yetenekli küçük model olarak tanımlanıyor. Sınıflandırma, çıkarım, yönlendirme, özetleme ve alt ajan görevleri gibi yüksek hacimli, gecikmeye duyarlı iş yükleri için tasarlanan model; 1 milyon token’lık bağlam penceresi, 128K’ye kadar çıktı token’ı, ayarlanabilir çaba seviyeleriyle uyarlanabilir düşünme sunuyor.
Ortalama olarak, ajan ve bilgisayar kullanımı kıyaslamalarında büyük artışlar kaydederken Haiku 4.5’e kıyasla çalıştırma maliyeti yaklaşık %75 daha düşük. Geliştiriciler modele resmi Claude API’si (claude-haiku-5-5), Amazon Bedrock, Google Cloud, Microsoft Foundry veya CometAPI gibi maliyet optimize edilmiş geçitler üzerinden (başlangıç $0.08 / $0.40) erişebilir.
Öne Çıkanlar
- Çıkış ve Konumlandırma: 7 Ekim 2026’da, Claude 5.5 ailesinin küçük, yüksek verimli modeli olarak piyasaya sürüldü—gerçek zamanlı destek, belge işleme ve delege edilen ajan adımları için ideal.
- Temel Özellikler: 1M-token bağlam, 128K maksimum çıktı (Batch API beta ile 300K), uyarlanabilir düşünme (varsayılan orta çaba), metin + görsel girdi → metin çıktı, bilgi kesimi Haziran 2026.
- Fiyatlandırma Avantajı: 100K token’a kadar prompt’lar için milyon token başına $0.10 giriş / $0.50 çıkış (çoğu istekte Haiku 4.5’ten ≈%90 daha ucuz); 100K üzeri için daha yüksek katman. Cache okumaları $0.01’e kadar. CometAPI, Standart tarifelerde ≈%20 daha düşük sunar.
- Performans Atılımı: Haiku 4.5’e göre büyük kazanımlar (ör. OSWorld %72.4 vs %15.7, Terminal-Bench %39.2 vs %0, GDPval-AA 1620 vs 735 Elo) ve birçok testte GPT-6 Luna ile rekabetçi veya önde.
- Geliştirici Özellikleri: Effort parametresi (
low–max), prompt caching, Batch API (%%50 indirim), bilgisayar/tarayıcı kullanımı (beta SDK desteği). Temperature/top_p/top_k belirtilmemeli; aksi halde 400 hatası döner.
Claude Haiku 5.5 Nedir ve 2026’da Neden Önemlidir
Claude Haiku 5.5, Claude ailesinin hafif katmanındaki en yeni Anthropic modelidir. Karmaşık akıl yürütme ve uzun ufuklu ajanlar için optimize edilen daha pahalı Opus 5.5 ve Sonnet 5.5’ten farklı olarak, Haiku 5.5 yüksek hacimli, maliyet duyarlı ve gecikme kritik iş yükleri için özel olarak tasarlanmıştır. Anthropic, modeli “şimdiye kadar yayınladığımız en ucuz, en hızlı ve en yetenekli küçük model” olarak tanımlar.
Tipik üretim kullanım alanları:
- Müşteri desteğinde bilet sınıflandırma ve yönlendirme
- Uzun belgelerden alan çıkarımı ve özetleme
- Daha büyük modeller için konuşma geçmişinin sıkıştırılması
- Veritabanı tarzı sorgular ve yapılandırılmış veri görevleri
- Daha güçlü bir modelin orkestre ettiği süreçlerde dar kapsamlı kodlama, araç kullanımı veya tarayıcı adımlarını üstlenen hızlı alt ajanlar
Öncekine göre dramatik şekilde daha ucuz ve hızlı olup pratik ajansal görevlerde kalite farkının büyük bölümünü kapattığı için, pek çok ekip boru hatlarını yeniden tasarlayarak isteklerin çoğunu Haiku 5.5’in ele almasını ve yalnızca zor vakaları Sonnet veya Opus’a yükseltmesini sağlıyor. Asana, HubSpot, Box ve diğerlerinden gelen erken müşteri geri bildirimleri, yüksek hacimli dahili değerlendirmelerde %30’u aşan gecikme azalmaları ve ölçülebilir doğruluk artışları vurguluyor.
Claude Haiku 5.5 Teknik Özellikleri
| Özellik | Değer | Notlar |
|---|---|---|
| Model Kimliği (Claude API) | claude-haiku-5-5 | Tarih soneki yok |
| Amazon Bedrock | anthropic.claude-haiku-5-5 (veya global/us/eu/au/jp profilleri) | |
| Bağlam penceresi | 1,000,000 tokens | ≈555k kelime, yeni tokenizer ile |
| Maks çıktı (Messages API) | 128,000 tokens | Batch API + beta header ile 300K |
| Girdi kipleri | Metin + görseller | |
| Çıktı kipi | Metin | |
| Düşünme | Uyarlanabilir (varsayılan açık) | Effort üzerinden kontrol edilir |
| Varsayılan effort | medium | Seçenekler: low, medium, high, xhigh, max |
| Bilgi kesimi | Haziran 2026 | |
| Emeklilik taahhüdü | 7 Ekim 2027’den önce değil | |
| Tokenizer | Daha yeni (Claude 4.7+ ile aynı aile) | Aynı metin Haiku 4.5’e göre ≈%30 fazla token |
Kaynak: Anthropic model genel bakışı ve platform dokümantasyonu.
Daha geniş bağlam ve çıktı sınırları, uyarlanabilir düşünme ile birleştiğinde, Haiku 5.5’i agresif kırpma veya sabit düşünme bütçeleri gerektiren önceki küçük modellere kıyasla gerçek üretim sistemleri için çok daha kullanılabilir kılar.
Yanıtlar ve tamamlanma kontrolleri
Görünür yanıtın content[0] olduğunu varsaymak yerine türüne göre içerik bloklarını okuyun. Çıktıyı kabul etmeden önce stop_reason’u inceleyin: max_tokens, kesilmiş bir üretimi; refusal, açık bir uygulama yanıtını gerektirir. Araç etkin isteklerde, araç kullanım bloklarını işleyin ve bunları tamamlanmış bir metin yanıtı gibi ele almak yerine yerel formatta araç sonuçlarını döndürün.
Claude Haiku 4.5 API ile Karşılaştırıldığında Ne Değişti?
Kapasite, davranış ve fiyatlandırma değişiklikleri
| Boyut | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| Bağlam penceresi | 200K | 1M | 1M |
| Maksimum çıktı | 64K | 128K | 128K |
| Uyarlanabilir effort | Hayır | Evet | Evet |
| Anthropic giriş / MTok | $1.00 | $0.10 | $2.00 |
| Anthropic çıkış / MTok | $5.00 | $0.50 | $10.00 |
| Konumlandırma | Eski hızlı model | Ölçekli rutin işler | Daha zor karmaşık görevler |
Bu karşılaştırmada Haiku 5.5 fiyatları, 100.000 token’a kadar olan prompt’lar için geçerlidir; daha uzun prompt’lar daha pahalıdır. Bunlar Anthropic Standart tarifeleridir; CometAPI tarifeleri değildir. Karşılaştırma bir yönlendirme başlangıç noktasıdır; modellerin aynı performansı verdiği iddiasında değildir.
Haiku 4.5 entegrasyonları için kilit uygulama değişiklikleri: manuel bütçe yerine uyarlanabilir düşünme, effort kontrolleri, içerik bloklarının seçici ayrıştırılması ve güncellenmiş token sayımlarıdır. Aynı metin yaklaşık %30 daha fazla giriş token’ı kullanabilir. Haiku 4.5 token tahminlerini yeniden kullanmak yerine temsilî prompt’ları yeniden sayın. Geçiş bölümü bu değişiklikleri bir dağıtım kontrol listesine dönüştürür.
Bildirilen kıyaslama iyileştirmeleri
| Kıyaslama | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| OSWorld 2.1 (çevrimdışı altküme; kısmi kredi) | %15.7 | %72.4 | %83.9 |
| Terminal-Bench 4.0 | %0.0 | %39.2 | %70.6 |
| Humanity’s Last Exam (araçsız) | %10.2 | %45.9 | %56.9 |
| Chartography (araçsız) | %6.4 | %46.4 | %61.6 |
| GDPval-AA v2.1 (Elo) | 735 | 1,620 | 1,840 |
Anthropic, yukarıdaki puanları çıkış kıyaslama özetinde raporlamaktadır. Bunlar, bu rehberdeki CometAPI örneklerinin canlı testleri değil, raporlanan değerlendirme sonuçlarıdır. OSWorld’ün %72.4’ü kısmi kredidir; katı görev tamamlama oranı değildir.
Haiku 5.5 sistem kartı değerlendirme koşullarını açıklar. Standart Haiku 5.5 değerlendirmeleri, not edilmedikçe varsayılan örnekleme ile maksimum effort’ta uyarlanabilir düşünme kullanır; ürün varsayılanı medium’dur. OSWorld, 82 çevrimdışı görev, internet erişimi yok, 1080p çözünürlük ve 500 eylem sınırı kullanır. Terminal-Bench 4.0, çıplak modda Claude Code, internet çıkışı yok ve Haiku 5.5 için görev başına 10 deneme kullanır; Sonnet’in kurulumu farklıdır. HLE ve Chartography satırları araçsızdır. GDPval-AA, Artificial Analysis değerlendirmelerinden bir Elo derecesi raporlar. Sonuçları karşılaştırırken ilgili çerçeve, effort ve araç ayarlarını eşleştirin.

Anthropic’in orijinal OSWorld grafiği, effort, görev başına maliyet ve kısmi kredi puanı arasındaki ilişkiyi gösterir. API gecikmesini ölçmez veya iş yükünüzde aynı performansı garanti etmez.
Puanlar, Haiku 4.5’e göre çok daha güçlü bilgisayar kullanımı ve genel görev performansına işaret eder; ancak uygulamanızda aynı sonuçları garanti etmez. Üretim trafiğine geçmeden önce temsilî bir değerlendirme seti çalıştırın.
Kıyaslama tablosu ve sağlanan grafik, model karşılaştırmaları olarak korunmuştur. Bunlar, CometAPI örneklerinin canlı testleri yerine raporlanan değerlendirmelerdir. Bir uygulamayı değerlendirirken aynı görev dağılımını, effort’u ve araç ayarlarını kullanın; bir kıyas puanı, ağ geçidi gecikmesini veya kendi başarı oranınızı belirlemez.
CometAPI Üzerinden Claude Haiku 5.5 API’sini Nasıl Kullanılır
Bir anahtar oluşturun ve yerel rotayı seçin
Bir CometAPI hesabı oluşturun, claude-haiku-5-5 erişimini onaylayın ve sunucu tarafı bir API anahtarı üretin. COMETAPI_KEY’i ortamınıza ayarlayın. Anahtarı kaynak kontrolünün ve tarayıcı kodunun dışında tutun. Anthropic ve CometAPI anahtarları farklı sağlayıcılara aittir; bu güncellenmiş rehberdeki her örnek için CometAPI anahtarını kullanın.
export COMETAPI_KEY="your_cometapi_api_key"
pip install --upgrade anthropic
$env:COMETAPI_KEY="your_cometapi_api_key"
| Entegrasyon | SDK temel URL’si | İstek yolu | Kimlik bilgisi |
|---|---|---|---|
| Anthropic-uyumlu Messages | https://api.cometapi.com | /v1/messages | COMETAPI_KEY |
| OpenAI-uyumlu Chat Completions | https://api.cometapi.com/v1 | /chat/completions | COMETAPI_KEY |
CometAPI, Claude’un yerel Messages ve içerik blok formatını destekler. CometAPI kök taban URL’si ile Anthropic SDK’sını kullanın. Yerel Messages, Claude’a özgü düşünme ve içerik blokları için bu rehberde tercih edilen rotadır. Uyumlu Chat Completions rotası, mevcut bir OpenAI tarzı uygulama için bir seçenektir. İlgili ağ geçidinde gelişmiş alan desteğini doğrulayın.
En küçük isteği gönderin ve sonucu doğrulayın
curl https://api.cometapi.com/v1/messages \
-H "Content-Type: application/json" \
-H "x-api-key: $COMETAPI_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"output_config": {"effort": "low"},
"messages": [{"role": "user", "content": "Summarize three AI uses in customer support."}]
}'
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com",
timeout=60.0,
max_retries=2,
)
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=2048,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Classify this ticket: I cannot log in."}],
)
if response.stop_reason != "end_turn":
raise RuntimeError(f"Unaccepted completion: {response.stop_reason}")
print("".join(block.text for block in response.content if block.type == "text"))
print(response.usage)
Python örneğini example.py olarak kaydedin ve python example.py çalıştırın. Başarılı bir kontrol noktası, görünür metin ve kullanım alanları olan tamamlanmış bir yanıttır. Kimlik doğrulama hatası, anahtarın kontrol edilmesi gerektiğini; model/rota hatası, model kimliği, uç nokta veya hesap erişiminin kontrol edilmesi gerektiğini gösterir.
Aynı yerel formatı JavaScript’te kullanın
npm install @anthropic-ai/sdk
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
apiKey: process.env.COMETAPI_KEY,
baseURL: "https://api.cometapi.com",
timeout: 60_000,
maxRetries: 2,
});
const response = await client.messages.create({
model: "claude-haiku-5-5",
max_tokens: 2048,
output_config: {effort: "low"},
messages: [{role: "user", content: "Extract product, quantity and price: 3 laptops at $900 each."}],
});
if (response.stop_reason !== "end_turn") {
throw new Error("Unaccepted completion: " + response.stop_reason);
}
for (const block of response.content) {
if (block.type === "text") console.log(block.text);
}
Desteklenen bir Node.js sürümü kullanın. Dosyayı example.mjs olarak kaydedin, COMETAPI_KEY ayarlayın ve node example.mjs çalıştırın. Dağıtım için doğruladığınız SDK sürümünü kaydedin.
Mevcut OpenAI uyumlu bir uygulamayı uyarlayın
Uygulamanız zaten Chat Completions kullanıyorsa openai paketini yükleyin ve aşağıdaki ayrı istemciyi yapılandırın. Bu rota, yerel içerik blokları yerine choices döndürür. Rota’ya özgü ayrıştırmayı ayrı tutun ve ağ geçidi çevirisine güvenmeden önce thinking, görseller ve araçları test edin.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-haiku-5-5",
max_tokens=2048,
messages=[
{"role": "system", "content": "Be concise and helpful."},
{"role": "user", "content": "Explain API rate limits."},
],
)
print(response.choices[0].message.content)
Claude Haiku 5.5 API’sine görseller gönderme
Görseli, gereken kanıtı ve beklenen çıktıyı belirten bir talimatla birlikte kullanın. Resmî görsel arayüzü, base64 verisi olan görsel içerik bloklarını, bir görsel URL’sini veya desteklenen yüklenen dosya referansını kabul eder. Bu örnek, yerel bir PNG’yi okur, sorudan önce görseli yerleştirir ve kaynağa karşı doğrulanabilecek değerleri ister.
Yerel bir gerçek PNG’yi yerel Anthropic Messages API’si ile analiz edin.
import os
import base64
from pathlib import Path
import anthropic
# Replace dashboard.png with a real PNG file you are authorized to analyze.
image_data = base64.b64encode(Path("dashboard.png").read_bytes()).decode("ascii")
anthropic_client = anthropic.Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])
response = anthropic_client.messages.create(
model="claude-haiku-5-5",
max_tokens=2048,
output_config={"effort": "low"},
messages=[{
"role": "user",
"content": [
{"type": "image", "source": {
"type": "base64", "media_type": "image/png", "data": image_data
}},
{"type": "text", "text": (
"Read the visible dashboard metrics. List anomalies with their "
"labels and values, and state when text is unreadable."
)},
],
}],
)
for block in response.content:
if block.type == "text":
print(block.text)
Gerçek dosyayla eşleşen MIME türünü kullanın. Gönderimden önce okunabilirliği, görsel boyutlarını ve istek boyutu sınırlarını kontrol edin; görevi fayda sağlamayan yüksek çözünürlüklü medyayı göndermekten kaçının. CometAPI için, anahtarı ve kök taban URL’sini Messages örneğinde gösterildiği gibi değiştirin ve tam rota üzerinde görsel desteğini doğrulayın.
Claude Haiku 5.5 akıl yürütmesini kontrol etme
Haiku 5.5 varsayılan olarak uyarlanabilir düşünme kullanır. Resmî thinking yapılandırması, disabled’ın ne zaman kabul edildiğini ve thinking bloklarının nasıl döndürüldüğünü açıklar. Effort’u output_config.effort üzerinden ayarlayın; eski budget_tokens’u yeniden kullanmayın.
| Effort | İyi başlangıç kullanım durumu | Değiş tokuş |
|---|---|---|
| low | Kısa sınıflandırma, basit çıkarım | Tipik olarak daha düşük token kullanımı ve gecikme |
| medium | Destek yanıtları, rutin ajan işleri | Dengeli varsayılan |
| high | Çok adımlı belge analizi | Potansiyel olarak daha fazla akıl yürütme |
| xhigh | Zor değerlendirmeler | Daha fazla işlem ve maliyet |
| max | Akıl yürütme yoğun vakalar | En yüksek potansiyel akıl yürütme harcaması |
Uyarlanabilir düşünmeyi düşük effort ile yapılandırın.
import osimport anthropicanthropic_client = anthropic.Anthropic( api_key=os.environ["ANTHROPIC_API_KEY"],)response = anthropic_client.messages.create( model="claude-haiku-5-5", max_tokens=4096, thinking={"type": "adaptive"}, output_config={"effort": "low"}, messages=[{"role": "user", "content": "Classify as billing, technical, or account: cannot log in."}],)for block in response.content: if block.type == "text": print(block.text)
Geliştiriciler thinking’i low, medium ve high effort’ta devre dışı bırakabilir; ancak xhigh veya max’ta değil. Thinking, metni gizli olsa bile faturalandırılan çıktı token’larını ve max_tokens bütçesini tüketir. Boş bir thinking alanı yine de bir imza taşıyabilir; akıl yürütme olmadığını kanıtlamaz. Araç konuşmalarına devam ederken döndürülen içerik bloklarını değiştirmeyin.
Thinking devre dışı iken örnek istek
Thinking’in devre dışı olduğu yerel bir istek gövdesi gönderin.
{ "model": "claude-haiku-5-5", "max_tokens": 1024, "thinking": {"type": "disabled"}, "output_config": {"effort": "low"}, "messages": [ {"role": "user", "content": "Return sentiment only: positive, neutral, negative."} ]}
Claude Haiku 5.5 yanıtlarını akış halinde iletme
Akış, görünür metni artımlı olarak sağlar ve etkileşimli uygulamalarda duyarlılığı artırır. İstek başarıyla tamamlanana kadar akıştaki metni geçici olarak ele alın.
Anthropic Python SDK’sı ile görünür metni akışlayın.
import osimport anthropicanthropic_client = anthropic.Anthropic( api_key=os.environ["ANTHROPIC_API_KEY"],)with anthropic_client.messages.stream( model="claude-haiku-5-5", max_tokens=4096, output_config={"effort": "low"}, messages=[{"role": "user", "content": "Explain API caching."}],) as stream: for text in stream.text_stream: print(text, end="", flush=True)
Claude Haiku 5.5 API Fiyatlandırması
Token oranlarını ve prompt uzunluğu bantlarını karşılaştırın
Oranlar 8 Ekim 2026’da kontrol edildi. Tablo, Anthropic Standart fiyatlandırmasını yayınlanan CometAPI oranlarıyla karşılaştırmaktadır; milyon token başına USD cinsindendir. Bant, prompt uzunluğuna göre belirlenir: 100.000 token’a kadar ve 100.000’den fazla. Daha uzun istekler, yalnızca fazla token’lar için ek ücret değil, ilgili yüksek bant oranlarını kullanır. Hesap faturalandırması, cache kullanımı ve isteğe bağlı araçlar ayrı ayrı uzlaştırılmalıdır.
| Token kategorisi | Anthropic ≤100K | CometAPI ≤100K | Anthropic >100K | CometAPI >100K |
|---|---|---|---|---|
| Giriş | $0.10 | $0.08 | $0.50 | $0.40 |
| Çıkış | $0.50 | $0.40 | $2.50 | $2.00 |
| Cache okuma | $0.01 | $0.008 | $0.05 | $0.04 |
| 5 dak. cache yazma | $0.125 | $0.10 | $0.625 | $0.50 |
| 1 saat cache yazma | $0.20 | $0.16 | $1.00 | $0.80 |
Orijinal makalenin oran anlık görüntüsü yukarıda korunmuştur. Satın alma veya dağıtımdan önce güncel CometAPI listelemesini ve hesap faturalandırmasını kontrol edin; listelemenin başlangıç giriş oranı, her prompt uzunluk bandı, cache işlemi veya isteğe bağlı araç için tam bir fiyat teklifi değildir.
Örnek: 100.000 destek isteğinin maliyeti
Aylık 100.000 istek varsayın; her birinde 2.000 giriş token’ı ve 300 faturalandırılan çıktı token’ı (üretilen thinking dahil). Her prompt, 100.000’e kadar olan bant için uygundur. Cache, araç ücretleri ve yeniden denemeler hariç tutulmuştur.
| Bileşen | Kullanım | Anthropic | CometAPI |
|---|---|---|---|
| Giriş | 200M token | $20.00 | $16.00 |
| Çıkış | 30M token | $15.00 | $12.00 |
| Toplam | 100,000 istek | $35.00 | $28.00 |
Bu varsayımlar altında, örnek fark aylık $7 veya %20’dir. Üretim maliyetleri, istek uzunluklarına, gizli akıl yürütmeye, caching’e ve yeniden deneme davranışına bağlıdır.
Hesaplamada modelin güncel token sayılarını kullanın. Maliyet = giriş token’ları × uygulanabilir giriş oranı / 1,000,000 + faturalandırılan çıktı token’ları × uygulanabilir çıkış oranı / 1,000,000, artı ayrı ayrı uygulanabilir cache, araç ve yeniden deneme ücretleri. Thinking token’ları, faturalandırılan çıktının bir parçasıdır.
Kabul edilen görev kalitesini kaybetmeden maliyeti düşürün
| Optimizasyon | Eylem | Yarar |
|---|---|---|
| Effort ayarı | Kalitenin izin verdiği yerde low kullanın | Daha düşük akıl yürütme yükü |
| Prompt azaltma | Gereksiz konuşma geçmişini kaldırın | Daha az giriş token’ı |
| Prompt caching | Yeniden kullanılan bağlamı sabit tutun | Tekrarlanan giriş maliyeti düşer |
| Akış | Token’ları geldikçe render edin | Daha iyi algılanan duyarlılık |
| Şema doğrulama | Hatalı kayıtları erken reddedin | Daha az aşağı akış yeniden işleme |
| Model yönlendirme | Karmaşık görevleri yükseltin | Daha iyi maliyet-kalite dengesi |
| Batch işleme | Uygun çevrimdışı istekleri batch’leyin | Potansiyel ek tasarruf |
Otomatik olarak en düşük effort’u seçmeyin. Daha ucuz tek bir çağrı, daha fazla yeniden deneme üretirse toplam maliyetleri artırabilir. Doğruluk, p50/p95 gecikme, token kullanımı ve başarılı görev başına maliyeti değerlendirin.
Prompt caching için, sabit bir ön ek (prefix) kullanın ve cache oluşturma ve cache okuma kullanımını varsayılan bir isabet yerine denetleyin. Haiku 5.5’te belgelenmiş Claude API’sinde en az 512 token’lık cache’lenebilir prompt vardır. Effort değiştirmek, cache’lenmiş ön ekleri geçersiz kılabilir; bir konuşma içinde ayarları sabit tutun. 1M bağlam penceresi bir kapasite tavanıdır; her turda her belgeyi göndermek için bir öneri değildir.
Caching için sabit ve yeniden kullanılabilir bir ön ek tutun, gereksiz girdileri kısaltın ve effort değişikliklerini kıyaslayın. Akış, faturalandırılan kullanımı otomatik olarak azaltmak yerine algılanan duyarlılığı artırır. Yeniden denemeler ve araç çağrıları dahil olmak üzere tüm iş akışı genelinde kabul edilen görev başına maliyeti karşılaştırın.
Claude Haiku 4.5’ten Haiku 5.5’e Geçiş Rehberi
Entegrasyonu ve istek formatını güncelleyin
| Alan | Geçiş eylemi |
|---|---|
| Model Kimliği | claude-haiku-5-5 ile değiştirin |
| Thinking | Manuel budget_tokens yerine uyarlanabilir düşünmeye geçin |
| Effort | Gerekirse output_config.effort kullanın |
| Örnekleme | temperature, top_p ve top_k’yi çıkarın; herhangi bir top_k desteklenmez |
| Yanıt ayrıştırıcı | Birden çok içerik blok türünü ele alın |
| Çıkış bütçesi | Akıl yürütme ve nihai çıktı için yeterli alan bırakın |
| Prefill | Desteklenmeyen assistant prefilling’i kaldırın |
| Caching | Effort değiştirirken prompt’ları yeniden test edin |
| Araç entegrasyonları | Desteklenen araç sürümlerini doğrulayın |
Burada kullanılan CometAPI rotası için, model kimliği ve istek yapılandırmasını değiştirirken COMETAPI_KEY ve yerel taban URL’sini koruyun. Bütçeyle etkin thinking’i, uyarlanabilir thinking ve effort ile değiştirin. Assistant prefilling’i kaldırın ve örnekleme parametrelerini atlayın. Claude’un yerel content dizisi ile uyumlu rotanın choices yanıtı arasındaki ayrımı koruyun.
Durumu koruyun ve bütçeleri yeniden hesaplayın
Resmî Haiku 5.5 geçiş rehberi, Haiku 4.5’e göre aynı metin için yaklaşık %30 daha fazla giriş token’ı raporlar. Trafiği taşımadan önce temsilî prompt’ları yeniden sayın ve limitleri yeniden ayarlayın. Döndürülen thinking blokları yalnızca onları üreten hesapta veya bağlı bir hesapta çalışır; hesap değişikliği bu blokları sessizce düşürebilir. Üretimden sonra önceki iletileri değiştirmek yerine eklemeli bir konuşma ön eki koruyun. stop_reason’u—max_tokens ve refusal dahil—çıktıyı kabul etmeden önce açıkça denetleyin.
Hedef modelle temsilî prompt’ları yeniden sayın ve max_tokens, gecikme limitleri ve istek maliyeti tahminlerini yeniden ayarlayın. Kaydedilmiş konuşmaları, yeniden oynatılacak hesap ve ağ geçidi rotasında test edin; imzalı thinking bloklarının, ilişkili olmayan hesaplar veya yeniden yazılmış konuşma ön ekleri arasında taşınabilir olduğunu varsaymayın.
Sonuç
Claude Haiku 5.5, maliyet etkin, yüksek verimli yapay zekâ için gerçek bir kırılma noktasıdır. Çoğu istekte önceki Haiku fiyatının yaklaşık onda biriyle, ajan ve bilgisayar kullanımı performansında dramatik bir artış sunarak yetenekli küçük modellerin geniş ölçekte dağıtımını pratik hâle getirir. İster resmî API’yi çağırın, ister Amazon Bedrock üzerinden yönlendirin, ister ek tasarruf ve operasyonel sadelik için CometAPI gibi birleşik bir ağ geçidini kullanın; hız, yetenek ve fiyatın kombinasyonu, daha önce ekonomik olmayan yeni ürün olasılıklarını açar.
