Anthropic은 2026년 10월 7일 Claude Haiku 5.5를 공개했다. 입력 토큰 요금은 프롬프트가 10만 토큰 이하일 때 백만 개당 $0.10, 그보다 길 때는 $0.50이다. 회사는 이 모델을 대량 작업과 AI 에이전트용으로 내세우며, 개별 요청의 비용은 길이와 처리되는 토큰 수에 따라 달라진다.

빈번하고 범위가 좁은 작업을 위한 모델
Anthropic은 10월 7일 발표에서 요약, 컨텍스트 압축(compaction), 분류, 데이터베이스 쿼리를 사용 사례로 제시한다. Haiku 5.5는 코딩 작업의 개별 단계를 맡는 하위 에이전트로도 제안되며, 문서에는 고객 지원과 브라우저 작업도 명시돼 있다. Claude Platform에서 사용하는 모델 ID는 claude-haiku-5-5다.
Anthropic은 표준 속도 모드끼리 비교할 때 Haiku 5.5가 자사에서 가장 빠른 모델이라고 설명한다. 다만 Opus는 Fast Mode에서 더 빠르게 작동한다. 조절 가능한 effort 기능을 갖춘 Haiku 계열 최초의 모델로, 비용 또는 추론 품질을 우선하는 설정을 선택할 수 있다. 편집부는 독립적인 테스트를 수행하지 않았으므로 속도와 품질 평가는 회사의 주장에 해당한다.
토큰 요금
Claude Platform 요금은 토큰 백만 개당 기준으로 표시된다. 요금 구간은 프롬프트 길이에 따라 정해진다.
| 항목 | 10만 토큰 이하 | 10만 토큰 초과 | Haiku 4.5 |
|---|---|---|---|
| 입력 토큰 | $0.10 | $0.50 | $1 |
| 출력 토큰 | $0.50 | $2.50 | $5 |
| 캐시 읽기 | $0.01 | $0.05 | $0.10 |
| 5분 캐시 쓰기 | $0.125 | $0.625 | $1.25 |
Haiku 4.5와 비교하면 토큰 요금은 프롬프트가 10만 토큰 이하일 때 90%, 기준을 초과할 때 50% 낮다. Anthropic은 별도로 작업 수행에 드는 평균 비용이 약 75% 줄어든다고 추산한다. 이 회사의 추산에는 요청 분포와 같은 작업에 조금 더 많은 토큰을 사용하는 새로운 토크나이저가 반영돼 있다. 따라서 평균 비용 절감 추산이 모든 요청에 동일하게 적용되는 것은 아니다.

권장 범위와 관련 변경 사항
Anthropic은 복잡한 에이전트형 프로그래밍에는 상위 모델인 Sonnet 5.5 또는 Opus 5.5를, 요약이나 하위 에이전트 작업 같은 범위가 좁은 단계에는 Haiku 5.5를 권장한다. 이 선택은 작업 유형에 따라 비용을 나눈다. 빈번한 단순 작업은 하위 모델에 맡기고, 복잡한 작업은 상위 모델에 맡길 수 있다.
같은 발표에 따르면 10월 7일부터 Sonnet 5.5의 캐시 읽기 요금은 토큰 백만 개당 $0.20에서 $0.10으로 낮아졌다. Anthropic은 이 변경으로 대부분의 에이전트 작업 비용이 약 20% 줄어든다고 설명한다. 회사는 Haiku 5.5를 Claude Platform, AWS, Google Cloud, Azure에서 이용할 수 있다고도 발표했지만, 편집부는 각 외부 플랫폼의 제공 여부를 별도로 확인하지 않았다.
Anthropic은 Max 및 Team 구독자에게 매월 API 크레딧을 10월 7일 주에 순차적으로 제공하기 시작하겠다고 예고했다. 확인 시점인 10월 8일에는 배포 완료 여부가 확인되지 않았다. 팀이 이번 출시에서 얻을 실질적인 교훈은 먼저 프롬프트 길이가 10만 토큰 기준과 어떻게 맞물리는지 살펴본 다음, 실제 작업과 비용을 기준으로 적합한 모델을 시험하는 것이다.