Anthropic presenterte Claude Haiku 5.5 den 7. oktober 2026. Inndatatokener koster 0,10 dollar per million for prompter på opptil 100 000 tokener og 0,50 dollar for lengre prompter. Selskapet posisjonerer modellen for masseoppgaver og arbeid med AI-agenter; kostnaden for en bestemt forespørsel avhenger av lengden og antallet behandlede tokener.

Modell for hyppige, avgrensede oppgaver
I kunngjøringen 7. oktober nevner Anthropic oppsummering, komprimering av kontekst (compaction), klassifisering og databasespørringer. Haiku 5.5 tilbys også som underagent for bestemte trinn i kodearbeid, og dokumentasjonen oppgir kundestøtte og nettleseroppgaver som bruksområder. Modell-ID-en på Claude Platform er claude-haiku-5-5.
Anthropic kaller Haiku 5.5 sin raskeste modell når standardhastighetsmoduser sammenlignes; Opus i Fast Mode kjører raskere. Den første modellen i Haiku-familien med justerbar effort lar brukerne velge en innstilling med vekt på enten kostnad eller kvaliteten på resonneringen. Redaksjonen har ikke gjennomført uavhengige tester, så vurderingene av hastighet og kvalitet er fortsatt selskapets egne påstander.
Hva tokenene koster
Prisene på Claude Platform er oppgitt per million tokener. Grensen avgjøres av promptlengden:
| Post | Opptil 100 000 tokener | Over 100 000 | Haiku 4.5 |
|---|---|---|---|
| Inndatatokener | 0,10 dollar | 0,50 dollar | 1 dollar |
| Utdat токener | 0,50 dollar | 2,50 dollar | 5 dollar |
| Lesing fra hurtigbuffer | 0,01 dollar | 0,05 dollar | 0,10 dollar |
| Skriving til hurtigbuffer i 5 minutter | 0,125 dollar | 0,625 dollar | 1,25 dollar |
Sammenlignet med Haiku 4.5 er tokenprisene 90 % lavere for prompter på opptil 100 000 tokener og 50 % lavere over grensen. Anthropic anslår i tillegg at den gjennomsnittlige kostnaden for å utføre arbeid er rundt 75 % lavere. Dette anslaget fra selskapet tar hensyn til fordelingen av forespørsler og en oppdatert tokenizer som bruker noe flere tokener på den samme oppgaven. Gjennomsnittsanslaget garanterer derfor ikke tilsvarende besparelser for hver forespørsel.

Begrensninger i anbefalingene og relaterte endringer
For kompleks agentbasert programmering anbefaler Anthropic de større Sonnet 5.5- eller Opus 5.5-modellene, og Haiku 5.5 for mer avgrensede trinn, som oppsummering og arbeid utført av en underagent. Dette fordeler kostnadene etter oppgavetype: hyppige, korte operasjoner kan sendes til den mindre modellen, mens de mer krevende oppgavene overlates til de større.
Fra 7. oktober ble prisen for lesing fra hurtigbuffer i Sonnet 5.5, ifølge samme kunngjøring, redusert fra 0,20 til 0,10 dollar per million tokener. Anthropic knytter endringen til en kostnadsreduksjon på rundt 20 % for de fleste agentoppgaver. Selskapet opplyste også at Haiku 5.5 er tilgjengelig på Claude Platform, AWS, Google Cloud og Azure; redaksjonen har ikke undersøkt tilgjengeligheten på hver enkelt tredjepartsplattform.
Anthropic lovet å begynne å rulle ut månedlige API-kreditter til Max- og Team-abonnenter i løpet av uken som startet 7. oktober. Per kontrolltidspunktet 8. oktober var utrullingen ikke bekreftet som fullført. Den praktiske lærdommen for team er å først sammenligne promptlengdene med grensen på 100 000 tokener, og deretter teste den aktuelle modellen på egne oppgaver og kostnader.