A Anthropic apresentou o Claude Haiku 5.5 em 7 de outubro de 2026. Os tokens de entrada custam US$ 0,10 por milhão para prompts com até 100 mil tokens e US$ 0,50 para os mais longos. A empresa posiciona o modelo para tarefas em grande escala e para o trabalho de agentes de IA; o custo de cada solicitação depende do seu tamanho e do número de tokens processados.

Um modelo para tarefas frequentes e específicas
No anúncio de 7 de outubro, a Anthropic lista sumarização, compactação de contexto (compaction), classificação e consultas a bancos de dados. A Haiku 5.5 também é oferecida como subagente para etapas específicas do trabalho de programação; a documentação menciona ainda suporte ao cliente e tarefas no navegador. O ID do modelo na Claude Platform é claude-haiku-5-5.
A Anthropic chama a Haiku 5.5 de seu modelo mais rápido ao comparar os modos de velocidade padrão; o Opus no Fast Mode é mais rápido. Primeiro modelo da família Haiku com effort ajustável, ela permite escolher uma configuração que priorize o custo ou a qualidade do raciocínio. A redação não realizou testes independentes; portanto, as avaliações de velocidade e qualidade continuam sendo declarações da empresa.
Quanto custam os tokens
As tarifas da Claude Platform são informadas por milhão de tokens. O limite depende do tamanho do prompt:
| Item | Até 100 mil tokens | Acima de 100 mil | Haiku 4.5 |
|---|---|---|---|
| Tokens de entrada | US$ 0,10 | US$ 0,50 | US$ 1 |
| Tokens de saída | US$ 0,50 | US$ 2,50 | US$ 5 |
| Leitura do cache | US$ 0,01 | US$ 0,05 | US$ 0,10 |
| Gravação no cache por 5 minutos | US$ 0,125 | US$ 0,625 | US$ 1,25 |
Em comparação com a Haiku 4.5, os preços dos tokens são 90% menores para prompts com até 100 mil tokens e 50% menores acima desse limite. Separadamente, a Anthropic estima que o custo médio de execução de uma tarefa seja cerca de 75% menor. Essa estimativa da empresa considera a distribuição das solicitações e o tokenizador atualizado, que usa um pouco mais de tokens para a mesma tarefa. Por isso, a estimativa média não garante a mesma economia em cada solicitação.

Limites das recomendações e mudanças relacionadas
Para programação complexa com agentes, a Anthropic recomenda os modelos mais avançados Sonnet 5.5 ou Opus 5.5, e a Haiku 5.5 para etapas mais específicas, como sumarização e trabalho de subagentes. Essa escolha distribui os custos conforme o tipo de trabalho: operações curtas e frequentes podem ser direcionadas ao modelo menor, enquanto as tarefas complexas ficam com os modelos mais avançados.
A partir de 7 de outubro, segundo a mesma publicação, a leitura do cache do Sonnet 5.5 ficou mais barata, passando de US$ 0,20 para US$ 0,10 por milhão de tokens. A Anthropic associa a mudança a uma redução de cerca de 20% no custo da maioria das tarefas com agentes. A empresa também anunciou a disponibilidade da Haiku 5.5 na Claude Platform, AWS, Google Cloud e Azure; a redação não verificou de forma independente a disponibilidade em cada plataforma de terceiros.
A Anthropic prometeu começar a implementar créditos mensais de API para assinantes Max e Team na semana de 7 de outubro. Na data da verificação, 8 de outubro, a conclusão da implementação não havia sido confirmada. Para as equipes, a conclusão prática do lançamento é comparar primeiro o tamanho dos prompts com o limite de 100 mil tokens e, em seguida, testar o modelo adequado com suas próprias tarefas e custos.