Anthropic presenteerde Claude Haiku 5.5 op 7 oktober 2026. Invoertokens kosten $0,10 per miljoen voor prompts tot 100.000 tokens en $0,50 voor langere prompts. Het bedrijf positioneert het model voor veelvoorkomende taken en AI-agenten; de kosten van een specifieke aanvraag hangen af van de lengte en het aantal verwerkte tokens.

Een model voor frequente, afgebakende taken
In de aankondiging van 7 oktober noemt Anthropic samenvatten, contextcompressie (compaction), classificatie en databasequery's. Haiku 5.5 wordt ook aangeboden als subagent voor afzonderlijke stappen in softwareontwikkeling; de documentatie vermeldt daarnaast klantenondersteuning en browsertaken. De model-ID op Claude Platform is claude-haiku-5-5.
Anthropic noemt Haiku 5.5 zijn snelste model wanneer standaardmodi voor snelheid worden vergeleken; Opus in Fast Mode werkt sneller. Als eerste model in de Haiku-familie met instelbare effort kun je kiezen voor een instelling die de nadruk legt op kosten of op de kwaliteit van het redeneren. De redactie heeft geen onafhankelijke tests uitgevoerd, dus uitspraken over snelheid en kwaliteit blijven claims van het bedrijf.
Wat kosten de tokens?
De tarieven van Claude Platform worden weergegeven per miljoen tokens. De promptlengte bepaalt welke grens geldt:
| Onderdeel | Tot 100.000 tokens | Meer dan 100.000 | Haiku 4.5 |
|---|---|---|---|
| Invoertokens | $0,10 | $0,50 | $1 |
| Uitvoertokens | $0,50 | $2,50 | $5 |
| Cache lezen | $0,01 | $0,05 | $0,10 |
| Cache schrijven, 5 minuten | $0,125 | $0,625 | $1,25 |
Vergeleken met Haiku 4.5 liggen de tokenprijzen 90% lager voor prompts tot 100.000 tokens en 50% lager boven die grens. Anthropic schat daarnaast dat de gemiddelde kosten voor het uitvoeren van een taak ongeveer 75% lager zijn. Die bedrijfsinschatting houdt rekening met de verdeling van aanvragen en met de bijgewerkte tokenizer, die voor dezelfde taak iets meer tokens gebruikt. De gemiddelde schatting garandeert dus niet dezelfde besparing voor iedere aanvraag.

Beperkingen van het advies en verwante wijzigingen
Voor complexe agentische softwareontwikkeling beveelt Anthropic de grotere modellen Sonnet 5.5 of Opus 5.5 aan, en Haiku 5.5 voor beperktere stappen, zoals samenvatten en werk als subagent. Zo kunnen de kosten worden afgestemd op het soort werk: veelvoorkomende korte handelingen kunnen naar het kleinere model, terwijl complexere taken bij de grotere modellen blijven.
Vanaf 7 oktober werd volgens dezelfde publicatie het lezen van de Sonnet 5.5-cache goedkoper: van $0,20 naar $0,10 per miljoen tokens. Anthropic koppelt deze wijziging aan een kostenverlaging van ongeveer 20% voor de meeste agenttaken. Het bedrijf meldde ook dat Haiku 5.5 beschikbaar is op Claude Platform, AWS, Google Cloud en Azure; de redactie heeft de beschikbaarheid op de afzonderlijke platforms van derden niet onafhankelijk gecontroleerd.
Anthropic beloofde de maandelijkse API-tegoeden voor Max- en Team-abonnees in de week van 7 oktober te gaan invoeren. Op het moment van controle, 8 oktober, was niet bevestigd dat de invoering was afgerond. De praktische les voor teams: vergelijk eerst de promptlengtes met de grens van 100.000 tokens en test daarna welk model past bij hun eigen taken en uitgaven.