Kısaca
Claude Haiku 5.5, yüksek hacimli ve gecikmeye duyarlı görevler için standart hızda Anthropic’in en hızlı küçük modelidir. 1 milyon tokenlık bir bağlam penceresini, 128K standart çıktı sınırını, uyarlanabilir akıl yürütmeyi ve milyon başına $0.10 giriş tokenı ile milyon başına $0.50 çıkış tokenından başlayan temel fiyatlandırmayı birleştirir. Bir istem 100.000 tokenı aştığında tarifeler yükselir. Karmaşık kodlama ve geniş kapsamlı ajan işleri için Sonnet 5.5 ve Opus 5.5 hâlâ daha güçlü seçeneklerdir. CometAPI Standart fiyatlandırması resmi tarifelerin %20 altında olup, 100K’ya kadar istemler için milyon başına $0.08 giriş ve milyon başına $0.40 çıkış tokenıyla başlar. CometAPI model sayfası yayında ve üretim API erişimini bildiriyor.
Öne Çıkanlar
- Resmi yayın: 7 Ekim 2026; Claude API model kimliği: claude-haiku-5-5.
- Başlangıç API ücretleri: 100K tokena kadar istemler için milyon başına $0.10 giriş ve milyon başına $0.50 çıkış. CometAPI: resmi Standart fiyatın %80’iyle milyon başına $0.08 giriş ve $0.40 çıkış.
- Bağlam ve çıktı: 1M token bağlam ve 128K token standart çıktı.
- Odak: sınıflandırma, belge çıkarımı, yönlendirme, destek ve delege edilen ajan görevleri.
- Yeni tokenizer aynı metin için yaklaşık %30 daha fazla token sayabilir; yalnızca token başına fiyat yerine kabul edilen görev başına maliyeti değerlendiriniz.
Claude Haiku 5.5 nedir?
Claude Haiku 5.5, yanıt verme hızı ve işletme ekonomisinin merkezde olduğu, yüksek istek hacimleri için geliştirilen Anthropic’in güncel Claude ailesinin hafif üyesidir. Başlıca kullanım alanları belge işleme, sohbet desteği, bilgi çıkarımı ve kompakt alt ajan işleridir. Anthropic’in model özeti lansman tarihini, yetenekleri ve platform tanımlayıcılarını doğrular.
Claude Haiku 5.5, geliştiricilerin aynı model içinde akıl yürütme derinliği, gecikme ve token kullanımı arasında ödünleşim yapabilmesini sağlayan yapılandırılabilir çaba düzeylerini destekleyen ilk Haiku modelidir.
Claude Haiku 5.5'in temel özellikleri nelerdir?
Uyarlanabilir düşünme ve ayarlanabilir çaba
Haiku 5.5, ne zaman ve ne kadar akıl yürüteceğine karar verebilir; çaba parametresi ise geliştiricilere yanıt kalitesi, gecikme ve token kullanımını dengeleme olanağı sunar. Varsayılan çaba orta düzeydedir. Basit sınıflandırmalar için düşük çaba tercih edilebilir; belirsiz çıkarım veya araç planlama adımları için daha yüksek bir ayar gerekçelendirilebilir.
Geniş bağlam işleme
1M tokenlık bir bağlam penceresi, uzun belgelerin ve önemli konuşma geçmişlerinin tek bir isteğe sığmasını sağlar. Yine de uygun olduğunda alma (retrieval), kesme (truncation) ve önbellekleme kullanınız: uzun bağlamlar özellikle 100K fiyatlandırma eşiğinin ötesinde gereksiz maliyet ve doğruluk ödünleşimleri getirebilir.
Düşük maliyetli, yüksek verimli işleme
Yeni $0.10/$0.50 başlangıç tarifeleri, önceki Haiku nesline göre token başına bazda tekrarlanan kısa istekleri belirgin biçimde daha ucuz hale getirir. Ancak Anthropic, değişen bir tokenizer belgeliyor: aynı metin Haiku 4.5’e göre yaklaşık %30 daha fazla token üretiyor. Bu nedenle, gerçek görev düzeyi tasarrufları manşet oran indirimi kadar büyük olmayabilir.
Bilgisayar kullanımı ve delege edilmiş ajan görevleri
Yayınlanan değerlendirmeler, önceki Haiku modeline kıyasla bilgisayar etkileşimi ve araç destekli görevlerde daha güçlü performans gösterildiğini belirtir. Bu, Haiku 5.5’i sınırlı ajan adımları için kullanışlı kılar; ancak başarılı otomasyon hâlâ güçlü araç izinlerine, hata kurtarmaya ve riskli eylemler için insan onayına bağlıdır.
Claude Haiku 5.5 kıyaslamalarda nasıl performans gösteriyor?
Anthropic, profesyonel bilgi görevleri, bilgisayar kullanımı, kodlama ve muhakeme alanlarında belirgin kazanımlar bildirmektedir. Aşağıdaki sonuçlar bildirilen değerlendirme ayarlarını kullanır; farklı kıyaslardan alınan puanlar tek bir “zeka puanı”na birleştirilmemelidir.
| Benchmark | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1,620 | 1,840 |
| AA-Briefcase v1.1 (Elo) | 614 | 1,578 | 1,824 |
| OSWorld 2.1, offline subset, partial credit | 15.7% | 72.4% | 83.9% |
| Humanity's Last Exam, no tools | 10.2% | 45.9% | 56.9% |
| Humanity's Last Exam, with tools | 18.7% | 57.4% | 64.5% |
| Terminal-Bench 4.0 | 0.0% | 39.2% | 70.6% |
| Chartography, no tools | 6.4% | 46.4% | 61.6% |
Sistem kartının standart Haiku 5.5 değerlendirme yapılandırması, aksi belirtilmedikçe maksimum çabayla uyarlanabilir düşünme, varsayılan örnekleme ve beş deneme kullanır; ürün varsayılanı orta düzey olduğundan, manşet puanlar varsayılan ayar garantisi değildir. OSWorld 82 çevrimdışı görev, internet erişimi yok, 1080p ve 500 eylem sınırı kullanır. %72.4 kısmi puandır; sıkı geçme oranı %37.1’dir. GDPval-AA ve AA-Briefcase, bağımsız yürütülen Artificial Analysis değerlendirmelerinden Anthropic tarafından raporlanmıştır.
Terminal-Bench 4.0, korumalar etkin halde --bare modunda Claude Code kullanır. Haiku 5.5 maksimum çaba, yedek model yok ve internet çıkışı yok ayarlarıyla, görev başına 10 deneme kullanır; Sonnet 5.5 bazı işaretli istekler için yedekle birlikte beş deneme kullanır. Haiku 4.5 sabit 63,999 tokenlık düşünme bütçesi kullanır. 39.2% ile 70.6% yorumlanırken bu yapılandırma farkları önemlidir.
Anthropic’in yayınlanan kıyaslama sonuçları yukarıdaki puanları sağlar. OSWorld çevrimdışı alt kümeyi kullanır; Humanity's Last Exam araç etkin ve araçsız koşuları ayırır, Chartography araçsızdır. Bunlar satıcı tarafından raporlanan sonuçlardır; evrensel bir yapılandırma altında bağımsız ölçümler değildir. Anthropic, Haiku 5.5 sistem kartında değerlendirme ayrıntıları sağlar; kendi sonuçlarınızı karşılaştırmadan önce ilgili çaba, araç, iskelet ve bütçe ayarlarını çoğaltınız.

Yukarıdaki Anthropic’in resmi değerlendirme görseli sistem kartından yeniden üretilmiştir. Değerlendirilen yapılandırmalar hakkında ek kanıt sağlar; bu makale için üretilmiş yeni bir kıyaslama değildir.
Kıyaslama yorumu
OSWorld’deki iyileşme, Haiku 5.5’in yapılandırılmış grafiksel görevler için belirgin biçimde daha kullanışlı hale geldiğini düşündürür. Ancak Terminal-Bench’te Sonnet 5.5’in %70.6’sına karşı Haiku 5.5’in %39.2’si, daha büyük model tabanlı ajans kodlamasında süregelen bir üstünlüğe işaret eder. Modelleri, gerçek iş akışının hata maliyeti ve zorluğuna göre seçiniz.
Claude Haiku 5.5 ile Haiku 4.5 ve Sonnet 5.5 karşılaştırması
| Boyut | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| Bağlam | 200K | 1M | 1M |
| Maksimum standart çıktı | 64K | 128K | 128K |
| Standart giriş / MTok | $1 | $0.10 100K’ya kadar; $0.50 üzeri | $2 |
| Standart çıkış / MTok | $5 | $0.50 100K’ya kadar; $2.50 üzeri | $10 |
| Muhakeme | Sabit token bütçeli genişletilmiş düşünme | Uyarlanabilir; varsayılan orta | Uyarlanabilir; varsayılan yüksek |
| Göreli gecikme | Hızlı | Standart hızda en hızlı | Hızlı |
| Kodlama derinliği | Sınırlı görevler | Daha güçlü alt ajanlar | Daha karmaşık kodlama |
| Tipik kullanım | Eski küçük model konuşlandırmaları | Yüksek hacimli iş akışları | Karmaşık üretim iş akışları |
Ortak özellikler: üç model de metin ve görsel girdileri kabul eder ve metin çıktıları üretir. Claude API ve desteklenen iş ortağı platformları üzerinden erişilebilirler; model tanımlayıcıları ve hesap erişimi sağlayıcıya bağlıdır. Atıf yapılan ürün dokümantasyonu, parametre sayıları veya ayrıntılı mimarileri ortaya koymaz.
Haiku 5.5, doğrulanabilir ve tekrarlanan görevler için mantıklı bir ilk seçimdir. Yinelenen başarısız çağrıları, araç yeniden denemelerini veya insan düzeltmelerini azaltmada daha güçlü yargının tasarruf sağlayabileceği durumlarda Sonnet 5.5 daha cazip hale gelir. Özellikle zorlu çok adımlı görevler için Opus 5.5 bir seçenektir.
Karşılaştırmalı gecikme etiketleri standart hız modlarına atıfta bulunur. Anthropic’in hız nitelemesi en hızlı model iddiasından Opus Fast Mode’u hariç tutar. Parametre sayısı gibi mimari ayrıntılar bu ürün katmanları tarafından ortaya konmamıştır. Metin ve görsel girdiyle metin çıktısı, görsel üretimden farklıdır.
Yetenek karşılaştırması Anthropic’in model özellikleri doğrultusundadır. Platform erişimi, seçilen sağlayıcıya ve hesaba bağlıdır; hiçbir model kademesi yayımlanmış bir parametre sayısını ima etmez.
İş yükü seçimi
| İş yükü | Pratik varsayılan | Neden |
|---|---|---|
| E-posta sınıflandırma | Haiku 5.5 | Kısa, tekrarlı, doğrulanabilir kararlar |
| Belge alanı çıkarımı | Haiku 5.5 | Maliyet-etkin yapılandırılmış işleme |
| Destek triyajı | Haiku 5.5 | Hızlı yanıtlar ve eskalasyon |
| Kodlama alt ajanları | Haiku 5.5 | Düşük maliyetli dosya arama ve sınırlı düzenleme |
| Karmaşık hata ayıklama | Sonnet 5.5 | Daha güçlü kodlama kıyas performansı |
| Yüksek riskli çok adımlı muhakeme | Opus 5.5 | Daha yetkin üst katman modeli |
| Karışık iş yükü | Haiku + Sonnet | Karmaşıklık ve güvene göre yönlendirme |
Claude Haiku 5.5 ne kadar maliyetlidir?
Neden Haiku 5.5’in token fiyatı %90 daha düşükken “yaklaşık %75 daha ucuz” olarak pazarlanıyor?
%90 rakamı, 100.000 tokena kadar istemler için Standart giriş ve çıkış ücretlerindeki azalmayı açıklar; daha uzun istemler %50 azalma alır. Anthropic, Haiku 5.5’in ortalama işletim maliyetinin, önceki modelin istek uzunluğu dağılımını ve görev başına token kullanımındaki değişiklikleri hesaba katarak yaklaşık %75 daha düşük olduğunu bildirir. Tokenizasyon bir etkendir: aynı giriş metni yaklaşık %30 daha fazla token olarak sayılabilir; maliyet tahminleri yeni modelle ölçülen sayımları kullanmalıdır.
Anthropic’in resmi fiyatlandırması iki istem uzunluğu bandına sahiptir. İlk tablodaki tarifeler, milyon token başına resmi USD fiyatlarıdır; aşağıdaki CometAPI karşılaştırması, resmi Standart giriş ve çıkış oranlarına %20 indirim uygular.
| Ücret kategorisi | 100K’ya kadar istem | 100K üzeri istem |
|---|---|---|
| Giriş | $0.10 | $0.50 |
| Çıkış | $0.50 | $2.50 |
| 5 dakikalık önbellek yazımı | $0.125 | $0.625 |
| 1 saatlik önbellek yazımı | $0.20 | $1.00 |
| Önbellekten okuma | $0.01 | $0.05 |
| Toplu giriş ( %50 indirim) | $0.05 | $0.25 |
| Toplu çıkış ( %50 indirim) | $0.25 | $1.25 |
Resmi Standart, önbellek ve Toplu tarifeler yukarıda, 8 Ekim 2026’da kontrol edilmiştir. İstem uzunluğu, hangi ücret bandının uygulanacağını belirler; daha yüksek bant, yalnızca 100K üzerindeki tokenlara değil, isteğin tamamına uygulanır. Aşağıdaki CometAPI Standart tarifeleri, karşılık gelen resmi Standart tarifelerin 0.8 ile çarpımına eşittir. Bu karşılaştırma, ağ geçidi indirimlerinin Toplu veya önbellekleme indirimleriyle birikeceğini varsaymaz.
| İstem uzunluğu | Token kategorisi | Resmi Standart / MTok | CometAPI / MTok |
|---|---|---|---|
| 100K tokena kadar | Giriş | $0.10 | $0.08 |
| 100K tokena kadar | Çıkış | $0.50 | $0.40 |
| 100K token üzeri | Giriş | $0.50 | $0.40 |
| 100K token üzeri | Çıkış | $2.50 | $2.00 |
Örnek: Ayda 100.000 kısa istek
Her isteğin 2,000 giriş tokenı ve 500 çıkış tokenı kullandığını varsayalım; her istek 100K eşiğinin altında kalsın. Önbelleklemeyi, araçları ve yeniden denemeleri yok sayın ve örnek olması için modeller arasında aynı token sayımlarını varsayın.
| Model / sağlayıcı | Giriş/ay | Çıkış/ay | Toplam/ay |
|---|---|---|---|
| Haiku 4.5 — resmi Standart | $200 | $250 | $450 |
| Haiku 5.5 — resmi Standart | $20 | $25 | $45 |
| Sonnet 5.5 — resmi Standart | $400 | $500 | $900 |
| Haiku 5.5 — CometAPI | $16 | $20 | $36 |
Bu örnekte, 100.000 istek 200 milyon giriş tokenı ve 50 milyon çıkış tokenı kullanır. CometAPI’de giriş maliyeti 200 × $0.08 = $16 ve çıkış maliyeti 50 × $0.40 = $20 olup, ayda $36 eder; resmî $45’a kıyasla: $9 tasarruf, yani %20. Senaryo önbellekleme, araçlar ve yeniden denemeleri dışlar ve sabit token sayımları kullanır; daha yeni tokenizer token sayımlarını değiştirdiğinden temsilî girdilerde kabul edilen görev başına maliyeti ölçünüz.
$450’dan $45’a karşılaştırması, eşit token sayısına dayalı %90 oran indirimi örneğidir; eşdeğer gerçek iş yüklerinde %90 tasarruf vaadi değildir. Lansman duyurusunda Anthropic, istek uzunlukları ve token kullanımındaki değişiklikler hesaba katıldıktan sonra ortalama çalıştırma maliyetinin yaklaşık %75 daha düşük olduğunu bildirir. Tasarrufunuzu tahmin etmeden önce temsilî girdileri yeniden sayın ve tamamlanan görev maliyetini ölçün.
Claude Haiku 5.5'e nereden erişebilirsiniz?
Resmi erişim ve bulut platformları
Haiku 5.5, Anthropic’in erişilebilirlik duyurusuna göre Claude API ve Amazon Web Services, Google Cloud ve Microsoft Azure üzerindeki desteklenen platformlar aracılığıyla kullanılabilir. Doğrudan Claude API model kimliği claude-haiku-5-5’tir; Amazon Bedrock anthropic.claude-haiku-5-5’i kullanır. Seçtiğiniz sağlayıcının verdiği kimlik bilgilerini kullanın ve geçerli hesap erişim gereksinimlerini kontrol edin.
CometAPI üzerinden üçüncü taraf erişimi
CometAPI model sayfası claude-haiku-5-5’i mevcut olarak listeler ve 100K’ya kadar istemler için Standart tarifelerin, milyon başına $0.08 giriş ve $0.40 çıkış tokenıyla, karşılık gelen resmi tarifelerden %20 düşük başladığını belirtir. CometAPI uç noktası ve istek formatıyla CometAPI tarafından verilen bir anahtar kullanın; bu, doğrudan Anthropic API erişiminden ayrı bir erişim yoludur. Kullanılabilirlik, fiyat bantları ve entegrasyon ayrıntıları için canlı sayfayı kontrol edin.
Sağlayıcı değiştirirken veya Haiku 4.5’ten yükseltme yaparken, model kimliklerini doğrulayın, tokenları yeniden sayın ve yanıt sınırlarını ve konuşma işleme davranışını test edin. Uygulama ayrıntıları ve uyumsuz değişiklikler için Anthropic’in geçiş kılavuzuna bakın.
Geçiş doğrulaması
- Model kimliğini güncelleyin ve uç nokta özel istek alanlarını doğrulayın.
- Yeni tokenizer ile, sabit önekler ve araç tanımları dahil tokenları yeniden sayın.
- Uyarlanabilir düşünme ayarlarını, gecikme dağılımlarını ve yanıt blok ayrıştırmayı test edin.
- Araç çağrılarını, hata kurtarmayı ve saklanan düşünme bloklarına dair hesap kısıtlarını kontrol edin.
- p50/p95 gecikme, kabul edilen görev oranı ve faturalanan toplam tokenları karşılaştırın.
- Kritik iş akışları için kademeli yayılım ve geri alma yolu kullanın.
- Assistant prefill yasaktır
Haiku 5.5 geçiş kılavuzu, tokenizer davranışını, kimlikleri ve istek uyumluluğunu açıklar. temperature, top_p ve top_k’yi atlayın. Açıkça sağlanırsa temperature 1 olmalı ve top_p 0.99 olmalıdır; herhangi bir top_k değeri veya hem temperature hem de top_p sağlanması 400 hatası döndürür.
Claude Haiku 5.5'in sınırlamaları nelerdir?
Haiku 5.5 daha büyük modellerin evrensel bir ikamesi değildir. Karmaşık kodlama ve uzun ufuklu muhakeme, Sonnet ve Opus için anlamlı farklılaştırıcılardır. Daha uzun istemler daha pahalıdır; bu nedenle 1M tokenlık pencere seçici olarak kullanılmalıdır. Uyarlanabilir muhakeme, oluşturulan tokenlarda ve gecikmede değişkenlik getirir; kıyaslamalar bireysel bir iş akışı için garanti oluşturmaz.
Riske duyarlı otomasyon yapılandırılmış çıktıları doğrulamalı, harici araç izinlerini sınırlamalı, denetim kayıtlarını tutmalı ve sonuç doğurucu eylemlerden önce inceleme gerektirmelidir. Belirsiz görevleri yalnızca Haiku’nun daha düşük temel token fiyatına güvenmek yerine daha güçlü modellere yönlendiriniz.
Sonuç
Ölçülebilir kabul kriterlerine sahip yüksek hacimli işleme için Claude Haiku 5.5 cazip bir yükseltmedir: daha düşük giriş fiyatı, daha büyük bağlam, uyarlanabilir muhakeme ve daha güçlü yayınlanmış değerlendirmeler. Karmaşık programlama ve belirsiz karar verme için, Sonnet 5.5 veya Opus 5.5 yeniden denemeleri ve düzeltmeleri azaltarak daha iyi genel ekonomi sunabilir. Kazanan strateji, tüm iş akışını kıyaslamak ve istekleri zorluğa göre yönlendirmektir.
SSS
Haiku 5.5’in 100K fiyatlandırma sınırı önbellekli bir iş akışını nasıl etkiler?
İstem uzunluğu hangi ücret bandının uygulanacağını belirler; yalnızca yeni metinden ücret tahmini yapmayın veya yalnızca aşan tokenların daha yüksek ücreti kullanacağını varsaymayın. Seçilen model için isteği, geçmiş ve araç tanımları dahil sayın; ardından giriş, önbellek yazımı, önbellekten okuma ve çıkış kullanımını ilgili bantla uzlaştırın. Üretim bütçesi belirlemeden önce temsilî önbellekli istekler üzerinde faturaları karşılaştırın.
Haiku 5.5 düşünme blokları hesaplar arasında yeniden oynatılabilir mi?
Yalnızca onları üreten hesapta veya onunla bağlantılı bir hesapta çalışırlar. İlişkisiz bir hesap saklanan bir düşünme bloğu gönderirse, API model görmeden önce onu atar; istek yine de bu akıl yürütme olmadan başarılı olabilir. Resmi geçiş kılavuzuna bakın. Araç iş akışını sürdürürken konuşma bloklarını koruyun ve kaynak veya bağlı hesabı kullanın. Bir ağ geçidi veya hesap değişimi açıkça test edilmelidir; bir model adının uyuşması, saklanan düşünme bloklarının kullanılabilir kalacağını garanti etmez.
Haiku 4.5’in tamamladığı bir yanıtı Haiku 5.5 neden kesebiliyor?
Yeni tokenizer aynı metin için daha fazla token sayabilir; bu nedenle değişmemiş bir max_tokens sınırı eşdeğer çıktıyı daha az tutabilir. Uyarlanabilir düşünme de çıktı bütçesini tüketebilir. stop_reason ve usage’ı inceleyin, istemleri yeni modelle yeniden sayın ve sınırlara körü körüne uyarlamak yerine gerçek görevlerde çıktı toleranslarını yeniden ayarlayın.
Haiku 5.5 yönlendirme eşikleri nasıl seçilmelidir?
Gerçek iş yükünden etiketli bir örneklem kullanarak kabul edilen görev oranını, düzeltme maliyetini ve gecikmeyi ölçün. Açık doğrulamadan kalan veya test edilen görev kapsamını aşan istekleri daha güçlü bir modele yönlendirin. Eşiği, yeniden denemeler ve eskalasyon dahil toplam iş akışı maliyetine karşı ayarlayın ve istemlere, araçlara veya çaba ayarlarına yapılan değişikliklerden sonra izleyin.
