Anthropic presenterade Claude Haiku 5.5 den 7 oktober 2026. Inmatningstoken kostar 0,10 dollar per miljon för promptar på upp till 100 000 token och 0,50 dollar för längre promptar. Företaget positionerar modellen för storskaliga uppgifter och AI-agentarbete; kostnaden för en enskild förfrågan beror på dess längd och antalet behandlade token.

En modell för frekventa, avgränsade uppgifter
I tillkännagivandet den 7 oktober räknar Anthropic upp sammanfattning, kontextkomprimering (compaction), klassificering och databasfrågor. Haiku 5.5 erbjuds också som underagent för enskilda steg i kodarbete, och dokumentationen nämner kundsupport och webbläsaruppgifter. Modell-ID:t på Claude Platform är claude-haiku-5-5.
Anthropic kallar Haiku 5.5 sin snabbaste modell vid jämförelse av standardlägena; Opus i Fast Mode arbetar snabbare. Den första modellen i Haiku-familjen med justerbar effort gör det möjligt att välja en inställning med fokus på kostnad eller resonemangskvalitet. Redaktionen har inte gjort några oberoende tester, så bedömningarna av hastighet och kvalitet är fortsatt företagets egna påståenden.
Vad token kostar
Priserna på Claude Platform anges per miljon token. Gränsen avgörs av promptens längd:
| Post | Upp till 100 000 token | Över 100 000 | Haiku 4.5 |
|---|---|---|---|
| Inmatningstoken | 0,10 dollar | 0,50 dollar | 1 dollar |
| Utmatningstoken | 0,50 dollar | 2,50 dollar | 5 dollar |
| Läsning ur cache | 0,01 dollar | 0,05 dollar | 0,10 dollar |
| Cachelagring i 5 minuter | 0,125 dollar | 0,625 dollar | 1,25 dollar |
Jämfört med Haiku 4.5 är tokenpriserna 90 procent lägre för promptar på upp till 100 000 token och 50 procent lägre över gränsen. Anthropic uppskattar separat att den genomsnittliga kostnaden för att utföra arbete är omkring 75 procent lägre. Företagets uppskattning tar hänsyn till fördelningen av förfrågningar och en uppdaterad tokeniserare, som använder något fler token för samma uppgift. Den genomsnittliga uppskattningen garanterar därför inte samma besparing för varje förfrågan.

Rekommendationens begränsningar och relaterade ändringar
För avancerad agentbaserad programmering rekommenderar Anthropic de större modellerna Sonnet 5.5 eller Opus 5.5, och Haiku 5.5 för mer avgränsade steg, till exempel sammanfattning och arbete som underagent. På så sätt fördelas kostnaden efter arbetstyp: frekventa, korta operationer kan skickas till den mindre modellen, medan komplexa uppgifter lämnas till de större.
Från och med den 7 oktober sänktes priset för läsning ur Sonnet 5.5:s cache från 0,20 till 0,10 dollar per miljon token, enligt samma publicering. Anthropic kopplar ändringen till en kostnadsminskning på omkring 20 procent för de flesta agentuppgifter. Företaget uppgav också att Haiku 5.5 finns tillgänglig på Claude Platform, AWS, Google Cloud och Azure; redaktionen har inte separat verifierat tillgängligheten på varje tredjepartsplattform.
Anthropic lovade att börja införa månatliga API-krediter för Max- och Team-prenumeranter under veckan som inleddes den 7 oktober. När detta kontrollerades den 8 oktober hade införandet inte bekräftats vara slutfört. Den praktiska slutsatsen för team är att först jämföra promptarnas längd med gränsen på 100 000 token och därefter testa lämplig modell på de egna uppgifterna och kostnaderna.