Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/CometAPI-forskning

Hva er Claude Haiku 5.5? Spesifikasjoner, ytelsestester, priser, funksjoner og API-tilgang

Utforsk Claude Haiku 5.5-spesifikasjoner, 1M kontekstvindu, referansetester, API-priser, funksjoner og sammenligninger med Haiku 4.5 og Sonnet 5.5.

CometAPI
Deon GoodwinForskerteam for AI-modeller og API
Oppdatert Oct 8, 2026 12 min lesetid
Hva er Claude Haiku 5.5? Spesifikasjoner, ytelsestester, priser, funksjoner og API-tilgang
Bruk dette mønsteret

Gjør det første API-kallet.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Haiku 5.5 er Anthropics raskeste lille modell i standardhastighet for oppgaver med høyt volum og lav latens. Den kombinerer et kontekstvindu på 1 million tokens, en standard output-grense på 128K, adaptiv resonnering og basispriser fra $0.10 per million input tokens og $0.50 per million output tokens. Prisene øker når en prompt overstiger 100,000 tokens. For kompleks koding og utvidet agentarbeid er Sonnet 5.5 og Opus 5.5 fortsatt sterkere valg. CometAPI Standard-priser ligger 20% under de offisielle satsene, fra $0.08 per million input tokens og $0.40 per million output tokens. CometAPIs modellsiden er live og rapporterer produksjons-API-tilgang.

Key Takeaways

  • Offisiell lansering: 7. oktober 2026; Claude API-modell-ID: claude-haiku-5-5.
  • Startsatser for API: $0.10 input og $0.50 output per million tokens for promper opptil 100K tokens. CometAPI: $0.08 input og $0.40 output per million tokens til 80% av offisiell Standard-prising.
  • Kontekst og output: 1M tokens kontekst og 128K tokens standard output.
  • Fokus: klassifisering, dokumentuttrekk, ruting, support og delegerte agentoppgaver.
  • Den nyere tokenizeren kan telle omtrent 30% flere tokens for samme tekst; vurder kostnad per godkjent oppgave snarere enn kun pris per token.

What Is Claude Haiku 5.5?

Claude Haiku 5.5 er lettvektsmedlemmet i Anthropics nåværende Claude-familie, utviklet for store forespørselsvolumer der respons og driftsøkonomi er sentrale. Dets primære bruksområder inkluderer dokumentbehandling, samtalestøtte, informasjonsuttrekk og kompakte underagent-oppgaver. Anthropics modelloversikt bekrefter lanseringsdato, kapabiliteter og plattformidentifikatorer.

Claude Haiku 5.5 er den første Haiku-modellen som støtter konfigurerbare innsatsnivåer, slik at utviklere kan avveie dybde i resonnering, latens og tokenbruk innenfor samme modell.

What Are the Key Features of Claude Haiku 5.5?

Adaptive thinking and adjustable effort

Haiku 5.5 kan avgjøre når og hvor mye den skal resonnere, mens innsats-parameteren gir utviklere en måte å balansere svarkvalitet, latens og tokenbruk. Standardinnsats er medium. For enkel klassifisering kan lav innsats være å foretrekke; for tvetydig uttrekk eller verktøyplanleggingstrinn kan en høyere innstilling være berettiget.

Large-context processing

Et kontekstvindu på 1M tokens gjør at lange dokumenter og betydelige samtalehistorikker får plass i én forespørsel. Utviklere bør likevel bruke gjenfinning, trunkering og caching der det er hensiktsmessig: lange kontekster kan introdusere unødvendig kostnad og presisjonstap, spesielt over 100K-prisgrensen.

Low-cost high-throughput processing

De nye startsatsene $0.10/$0.50 gjør gjentatte korte forespørsler betydelig rimeligere enn forrige Haiku-generasjon på per-token-basis. Samtidig dokumenterer Anthropic en endret tokenizer: identisk tekst gir omtrent 30% flere tokens enn på Haiku 4.5. Faktiske besparelser på oppgavenivå kan derfor være mindre enn kuttene i overskriftspris.

Computer use and delegated agent tasks

Publiserte evalueringer indikerer sterkere ytelse på datamaskininteraksjon og verktøyassisterte oppgaver enn forrige Haiku-modell. Dette gjør Haiku 5.5 nyttig for avgrensede agentsteg, men vellykket automatisering avhenger fortsatt av gode verktøytillatelser, feilhåndtering og menneskelig godkjenning for risikable handlinger.

How Does Claude Haiku 5.5 Perform on Benchmarks?

Anthropic rapporterer markante forbedringer på tvers av profesjonskunnskap, datamaskinbruk, koding og resonnering. Resultatene under bruker de rapporterte evalueringsoppsettene; poeng fra ulike benchmarker bør ikke kombineres til én “intelligensscore”.

BenchmarkHaiku 4.5Haiku 5.5Sonnet 5.5
GDPval-AA v2.1 (Elo)7351,6201,840
AA-Briefcase v1.1 (Elo)6141,5781,824
OSWorld 2.1, offline subset, partial credit15.7%72.4%83.9%
Humanity's Last Exam, no tools10.2%45.9%56.9%
Humanity's Last Exam, with tools18.7%57.4%64.5%
Terminal-Bench 4.00.0%39.2%70.6%
Chartography, no tools6.4%46.4%61.6%

Systemkortets standard evalueringskonfigurasjon for Haiku 5.5 bruker adaptiv tenkning med maks innsats, standard sampling og fem forsøk med mindre annet er oppgitt; produktstandarden er medium, så overskriftsresultater er ikke garantier for standardinnstillinger. OSWorld bruker 82 offline-oppgaver, ingen internettilgang, 1080p og en grense på 500 handlinger. 72.4% er en delvis-kreditt-score; streng bestått-rate er 37.1%. GDPval-AA og AA-Briefcase rapporteres av Anthropic fra uavhengig kjørte Artificial Analysis-evalueringer.

Terminal-Bench 4.0 bruker Claude Code i --bare mode med sikkerhetstiltak aktivert. Haiku 5.5 bruker maks innsats, ingen fallback-modell og ingen utgående internett, med 10 forsøk per oppgave; Sonnet 5.5 bruker fem forsøk og en fallback for noen flaggede forespørsler. Haiku 4.5 bruker et fast tenkebudsjett på 63,999 tokens. Disse konfigurasjonsforskjellene er viktige når man tolker 39.2% versus 70.6%.
Anthropics publiserte benchmark-resultater gir poengene over. OSWorld bruker sin offline-delmengde; Humanity's Last Exam skiller mellom kjøringer med og uten verktøy, og Chartography er uten verktøy. Dette er leverandørrapporterte resultater, ikke uavhengige målinger under en universell konfigurasjon. Anthropic gir evalueringsdetaljer i sitt Haiku 5.5-systemkort; reproduser relevante innstillinger for innsats, verktøy, rammeverk og budsjett før du sammenligner egne resultater. Lanseringsoppsummeringen spesifiserer ikke et komplett felles testmiljø for hver rad.

Hva er Claude Haiku 5.5? Spesifikasjoner, ytelsestester, priser, funksjoner og API-tilgang

Anthropics offisielle evalueringsgrafikk over er gjengitt fra systemkortet. Den gir ytterligere evidens om evaluerte konfigurasjoner; det er ikke en ny benchmark produsert for denne artikkelen.

Benchmark Interpretation

Forbedringen på OSWorld tyder på at Haiku 5.5 har blitt betydelig mer nyttig for strukturerte grafiske oppgaver. Samtidig indikerer Sonnet 5.5s 70.6% mot Haiku 5.5s 39.2% i Terminal-Bench en fortsatt fordel for agentisk koding med større modeller. Velg modeller ut fra feilkostnad og vanskelighetsgrad i den faktiske arbeidsflyten.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

DimensjonHaiku 4.5Haiku 5.5Sonnet 5.5
Kontekst200K1M1M
Maks standard output64K128K128K
Standard input / MTok$1$0.10 up to 100K; $0.50 over$2
Standard output / MTok$5$0.50 up to 100K; $2.50 over$10
ResonneringUtvidet tenkning med fast token-budsjettAdaptiv; standard mediumAdaptiv; standard høy
Relativ latensRaskRaskest i standardhastighetRask
KodedybdeAvgrensede oppgaverSterkere subagenterMer kompleks koding
Typisk brukEldre småmodell-distribusjonerArbeidsflyter med høyt volumKomplekse produksjonsflyter

Felles spesifikasjoner: alle tre modellene aksepterer tekst- og bildeinput og produserer tekstoutput. De kan nås via Claude API og støttede partnerplattformer; modellidentifikatorer og kontotilgang avhenger av leverandør. Den siterte produktdokumentasjonen etablerer ikke antall parametere eller detaljerte arkitekturer.

Haiku 5.5 er et fornuftig førstevalg for verifiserbare og repeterbare oppgaver. Sonnet 5.5 blir mer attraktiv der sterkere vurdering reduserer gjentatte mislykkede kall, verktøyreturer eller menneskelige korreksjoner. Opus 5.5 er et alternativ for spesielt krevende flertrinnsoppdrag.

De relative latenstidsetikettene refererer til standardhastighetsmoduser. Anthropics hastighetskvalifisering ekskluderer Opus Fast Mode fra påstanden om raskeste modell. Arkitekturdetaljer som antall parametere er ikke etablert av disse produkttypene. Tekst- og bildeinput med tekstoutput er forskjellig fra bildegenerering.

Kapabilitetssammenligningen følger Anthropics modellspecifikasjoner. Plattformtilgang avhenger av valgt leverandør og konto; ingen modelltier innebærer et publisert parameterantall.

Workload Selection

ArbeidslastPraktisk standardvalgHvorfor
E-postklassifiseringHaiku 5.5Korte, repeterte, verifiserbare beslutninger
DokumentfeltuttrekkHaiku 5.5Kostnadseffektiv strukturert behandling
Support-triageHaiku 5.5Raske svar og eskalering
KodingssubagenterHaiku 5.5Rimelig filsøk og avgrensede endringer
Komplisert feilsøkingSonnet 5.5Sterkere kodebenchmark-ytelse
Høyrisiko flerstegsresonneringOpus 5.5Mer kapabel toppmodell
Blandet arbeidslastHaiku + SonnetRuter etter kompleksitet og selvtillit

How Much Does Claude Haiku 5.5 Cost?

Hvorfor annonseres Haiku 5.5 som “rundt 75% billigere” hvis tokenprisen er 90% lavere?

90%-tallet beskriver reduksjonen i Standard input- og output-satser for promper opptil 100,000 tokens; lengre promper får 50% reduksjon. Anthropic rapporterer at Haiku 5.5 i snitt koster rundt 75% mindre å kjøre, tatt i betraktning forrige modells forespørrelseslengder og endringer i tokenbruk per oppgave. Tokenisering er én faktor: samme inputtekst kan telles som omtrent 30% flere tokens, så kostnadsestimater bør bruke opptellinger med den nye modellen.

Anthropics offisielle prising har to prompt-lengdebånd. Satsene i den første tabellen er offisielle USD-priser per million tokens; CometAPI-sammenligningen under anvender 20% rabatt på offisiell Standard input- og output-prising.

PriskategoriPrompt opptil 100KPrompt over 100K
Input$0.10$0.50
Output$0.50$2.50
5-minute cache write$0.125$0.625
1-hour cache write$0.20$1.00
Cache read$0.01$0.05
Batch input (50% off)$0.05$0.25
Batch output (50% off)$0.25$1.25

Offisielle Standard-, cache- og Batch-satser vises over, kontrollert 8. oktober 2026. Prompt-lengde velger prisbånd; høyere bånd gjelder for hele forespørselen, ikke bare tokens over 100K. CometAPI Standard-satsene under tilsvarer de respektive offisielle Standard-satsene multiplisert med 0.8. Denne sammenligningen forutsetter ikke at gateway-rabatten kan kombineres med Batch- eller cache-rabatter.

Prompt-lengdeToken-kategoriOffisiell Standard / MTokCometAPI / MTok
Opptil 100K tokensInput$0.10$0.08
Opptil 100K tokensOutput$0.50$0.40
Over 100K tokensInput$0.50$0.40
Over 100K tokensOutput$2.50$2.00

Example: 100,000 short requests per month

Anta at hver forespørsel bruker 2,000 input tokens og 500 output tokens; hver forespørsel holder seg under 100K-grensen. Ignorer prompt-caching, verktøy og retrier, og anta identiske tokenantall på tvers av modeller for illustrasjon.

Modell / leverandørInput/månedOutput/månedTotalt/måned
Haiku 4.5 — offisiell Standard$200$250$450
Haiku 5.5 — offisiell Standard$20$25$45
Sonnet 5.5 — offisiell Standard$400$500$900
Haiku 5.5 — CometAPI$16$20$36

I dette eksemplet bruker 100,000 forespørsler 200 millioner input tokens og 50 millioner output tokens. CometAPI-input koster 200 × $0.08 = $16 og output koster 50 × $0.40 = $20, totalt $36 per måned mot offisielle $45: en besparelse på $9, eller 20%. Scenariet ekskluderer caching, verktøy og retrier og bruker faste tokenantall; mål kostnad per godkjent oppgave på representative input fordi den nyere tokenizeren endrer tokenantall.

Sammenligningen $450-til-$45 er en fast-token-illustrasjon av en 90% satsreduksjon, ikke et løfte om 90% besparelser for ekvivalente reelle arbeidslaster. I sin lanseringsmelding rapporterer Anthropic rundt 75% lavere gjennomsnittlig driftskostnad etter å ha tatt høyde for forespørselslengder og endringer i tokenbruk. Telle opp representative input på nytt og mål kostnad per fullført oppgave før du estimerer egne besparelser.

Where Can You Access Claude Haiku 5.5?

Official access and cloud platforms

Haiku 5.5 er tilgjengelig via Claude API og støttede plattformer på Amazon Web Services, Google Cloud og Microsoft Azure, ifølge Anthropics tilgjengelighetsmelding. Den direkte Claude API-modell-ID-en er claude-haiku-5-5; Amazon Bedrock bruker anthropic.claude-haiku-5-5. Bruk legitimasjon utstedt av valgt leverandør og sjekk gjeldende kontotilgangskrav.

Third-party access through CometAPI

CometAPI-modellsiden lister claude-haiku-5-5 som tilgjengelig, med Standard-satser fra $0.08 per million input tokens og $0.40 per million output tokens for promper opptil 100K, 20% under de tilsvarende offisielle satsene. Bruk en CometAPI-utstedt nøkkel med CometAPIs endepunkt og forespørselsformat; det er en separat tilgangsvei fra direkte Anthropic API-tilgang. Sjekk den live siden for tilgjengelighet, prisbånd og integrasjonsdetaljer.

Når du bytter leverandør eller oppgraderer fra Haiku 4.5, verifiser modell-ID-er, tell tokens på nytt, og test grensene for svar og håndtering av samtaler. For implementasjonsdetaljer og breaking changes, se Anthropics migreringsguide.

Migration Validation

  • Oppdater modell-ID og valider endepunktspesifikke felt i forespørselen.
  • Tell tokens på nytt med oppdatert tokenizer, inkludert stabile prefikser og verktøydefinisjoner.
  • Test innstillinger for adaptiv tenkning, latensfordelinger og parsing av svarblokker.
  • Sjekk verktøykall, feilgjenoppretting og eventuelle kontorestriksjoner for lagrede thinking-blokker.
  • Sammenlign p50/p95-latens, godkjent-oppgave-rate og totalt fakturerbare tokens.
  • Bruk trinnvis utrulling og en tilbakerullingsbane for forretningskritiske arbeidsflyter.
  • Assistant-prefill er forbudt

Haiku 5.5-migreringsguiden forklarer tokenizer-oppførsel, ID-er og forespørselkompatibilitet. Omit temperature, top_p and top_k. If explicitly supplied, temperature must be 1 and top_p must be 0.99; any top_k value, or supplying both temperature and top_p, returns a 400 error.

What Are the Limitations of Claude Haiku 5.5?

Haiku 5.5 er ikke en universell erstatter for større modeller. Kompleks koding og langhorisont-resonnering forblir meningsfulle differensiatorer for Sonnet og Opus. Lengre promper koster også mer, så 1M-token-vinduet bør brukes selektivt. Adaptiv resonnering introduserer variasjon i genererte tokens og latens; benchmarker etablerer ikke garantier for en individuell forretningsarbeidsflyt.

Risikosensitiv automasjon bør validere strukturerte utdata, begrense tillatelser for eksterne verktøy, føre revisjonslogger og kreve gjennomgang før konsekvensielle handlinger. Ruter usikre oppgaver til sterkere modeller i stedet for å stole utelukkende på Haikus lavere basis tokenpris.

Conclusion

For høyt volum med målbare akseptkriterier er Claude Haiku 5.5 en attraktiv oppgradering: lavere inngangsprising, større kontekst, adaptiv resonnering og sterkere publiserte evalueringer. For kompleks programmering og tvetydige beslutninger kan Sonnet 5.5 eller Opus 5.5 gi bedre totaløkonomi ved å redusere retrier og korreksjoner. Vinnerstrategien er å benchmarke hele arbeidsflyten og route forespørsler etter vanskelighetsgrad.

FAQ

How does Haiku 5.5's 100K pricing boundary affect a cached workflow?

Prompt-lengde bestemmer hvilket prisbånd som gjelder; ikke estimer kostnaden ut fra kun ny tekst eller anta at bare overskytende tokens bruker høyere sats. Tell forespørselen for valgt modell, inkludert historikk og verktøydefinisjoner, og avstem input, cache-skriving, cache-lesing og output mot relevant bånd. Sammenlign fakturaer på representative cachede forespørsler før du setter et produksjonsbudsjett.

Can Haiku 5.5 thinking blocks be replayed across accounts?

De virker bare i kontoen som produserte dem eller en konto knyttet til den. Hvis en ikke-relatert konto sender en lagret thinking-blokk, forkaster API-et den før modellen ser den; forespørselen kan fortsatt lykkes uten den resonneringen. Se den offisielle migreringsguiden. Bevar samtaleblokkene og bruk den opprinnelige eller lenkede kontoen når du fortsetter en verktøyarbeidsflyt. En gateway- eller kontobytte bør testes eksplisitt; samsvar i modellnavn garanterer ikke at lagrede thinking-blokker forblir brukbare.

Why can Haiku 5.5 truncate a response that Haiku 4.5 completed?

Den nyere tokenizeren kan telle flere tokens for samme tekst, så en uendret max_tokens-grense kan romme mindre ekvivalent output. Adaptiv tenkning kan også forbruke output-budsjett. Inspiser stop_reason og usage, tell promper på nytt med den nye modellen, og finstill output-rammer på reelle oppgaver i stedet for å kopiere gamle grenser.

How should Haiku 5.5 routing thresholds be selected?

Bruk et merket utvalg fra den faktiske arbeidslasten til å måle godkjent-oppgave-rate, korreksjonskostnad og latens. Ruter forespørsler som feiler eksplisitt validering eller overskrider testet oppgavescope til en sterkere modell. Juster terskelen opp mot total arbeidsflytkostnad, inkludert retrier og eskalering, og overvåk den etter endringer i promper, verktøy eller innsats.

Fortsett å lære

Koble denne artikkelen til neste beslutning.

Se alle temaer
Publisert Oct 8, 2026
Sist oppdatert Oct 8, 2026
0 visninger
Gjennomgått for klarhet, kildeangivelse og gjeldende API-terminologi.

Les mer