Anthropic zaprezentowało Claude Haiku 5.5 7 października 2026 roku. Tokeny wejściowe kosztują 0,10 USD za milion w przypadku promptów o długości do 100 tys. tokenów i 0,50 USD — w przypadku dłuższych. Firma pozycjonuje model jako rozwiązanie do częstych zadań i pracy agentów AI; koszt konkretnego zapytania zależy od jego długości i liczby przetworzonych tokenów.

Model do częstych, wąsko zakrojonych zadań
W ogłoszeniu z 7 października Anthropic wymienia podsumowywanie, kompresję kontekstu (compaction), klasyfikację i zapytania do baz danych. Haiku 5.5 jest również oferowane jako podagent do wykonywania poszczególnych etapów pracy nad kodem, a dokumentacja wskazuje obsługę klienta i zadania w przeglądarce. Identyfikator modelu na Claude Platform to claude-haiku-5-5.
Anthropic określa Haiku 5.5 jako swój najszybszy model przy porównaniu standardowych trybów szybkości; Opus w trybie Fast Mode działa szybciej. Pierwszy model z rodziny Haiku z regulowanym parametrem effort pozwala wybrać ustawienie kładące nacisk na koszt lub jakość rozumowania. Redakcja nie przeprowadziła niezależnych testów, dlatego oceny szybkości i jakości pozostają deklaracjami firmy.
Ile kosztują tokeny
Cennik Claude Platform podaje stawki za milion tokenów. Próg zależy od długości promptu:
| Pozycja | Do 100 tys. tokenów | Powyżej 100 tys. | Haiku 4.5 |
|---|---|---|---|
| Tokeny wejściowe | 0,10 USD | 0,50 USD | 1 USD |
| Tokeny wyjściowe | 0,50 USD | 2,50 USD | 5 USD |
| Odczyt pamięci podręcznej | 0,01 USD | 0,05 USD | 0,10 USD |
| Zapis w pamięci podręcznej na 5 minut | 0,125 USD | 0,625 USD | 1,25 USD |
W porównaniu z Haiku 4.5 ceny tokenów są niższe o 90% dla promptów do 100 tys. tokenów i o 50% powyżej tego progu. Osobno Anthropic szacuje, że średni koszt wykonania zadania jest niższy o około 75%. Szacunek firmy uwzględnia rozkład zapytań oraz zaktualizowany tokenizer, który wykorzystuje nieco więcej tokenów do wykonania tego samego zadania. Średni szacunek nie gwarantuje więc takich samych oszczędności przy każdym zapytaniu.

Zakres rekomendacji i powiązane zmiany
Do złożonego programowania agentowego Anthropic rekomenduje wyższe modele Sonnet 5.5 lub Opus 5.5, a Haiku 5.5 — do węższych etapów, takich jak podsumowywanie i praca podagenta. Taki wybór pozwala rozdzielić koszty według rodzaju pracy: częste, krótkie operacje można kierować do mniejszego modelu, pozostawiając trudniejsze zadania większym modelom.
Od 7 października, zgodnie z tym samym wpisem, odczyt pamięci podręcznej Sonnet 5.5 potaniał z 0,20 USD do 0,10 USD za milion tokenów. Anthropic wiąże tę zmianę ze spadkiem kosztu większości zadań agentowych o około 20%. Firma poinformowała również o dostępności Haiku 5.5 na Claude Platform, AWS, Google Cloud i Azure; redakcja nie sprawdzała niezależnie dostępności na każdej z platform zewnętrznych.
Anthropic zapowiedziało, że kredyty API przyznawane co miesiąc subskrybentom planów Max i Team zacznie wdrażać w tygodniu rozpoczynającym się 7 października. W chwili weryfikacji, 8 października, zakończenie wdrożenia nie było potwierdzone. Praktyczny wniosek dla zespołów po premierze: najpierw porównać długość promptów z progiem 100 tys. tokenów, a następnie przetestować odpowiedni model na własnych zadaniach i kosztach.