jsonscraper

Anthropic lancia Claude Haiku 5.5: il prezzo dipende dalla lunghezza del prompt

Il modello per attività ad alto volume costa da 0,10 $ per milione di token in ingresso; oltre la soglia di 100.000 token il prezzo aumenta.

© Marek Piwnicki

Anthropic ha presentato Claude Haiku 5.5 il 7 ottobre 2026. I token in ingresso costano 0,10 $ per milione per i prompt fino a 100.000 token e 0,50 $ per quelli più lunghi. L’azienda propone il modello per attività ad alto volume e per il lavoro degli agenti IA; il costo di una singola richiesta dipende dalla sua lunghezza e dal numero di token elaborati.

Forme geometriche astratte su uno sfondo sfumato rosa e viola, con ampio spazio per il testo.
Marek Piwnicki · Licenza Pexels

Un modello per attività frequenti e circoscritte

Nell’annuncio del 7 ottobre, Anthropic elenca la sintesi, la compattazione del contesto (compaction), la classificazione e le query ai database. Haiku 5.5 viene inoltre proposto come subagente per singole fasi del lavoro sul codice; la documentazione indica anche l’assistenza clienti e le attività nel browser. L’ID del modello su Claude Platform è claude-haiku-5-5.

Anthropic definisce Haiku 5.5 il proprio modello più veloce nel confronto tra le modalità di velocità standard; Opus in Fast Mode è più rapido. Primo modello della famiglia Haiku con un livello di effort regolabile, consente di scegliere un’impostazione orientata al costo oppure alla qualità del ragionamento. La redazione non ha svolto test indipendenti, quindi le valutazioni su velocità e qualità restano dichiarazioni dell’azienda.

Quanto costano i token

Le tariffe di Claude Platform sono indicate per milione di token. La soglia dipende dalla lunghezza del prompt:

VoceFino a 100.000 tokenOltre 100.000Haiku 4.5
Token in ingresso0,10 $0,50 $1 $
Token in uscita0,50 $2,50 $5 $
Lettura della cache0,01 $0,05 $0,10 $
Scrittura nella cache per 5 minuti0,125 $0,625 $1,25 $

Rispetto a Haiku 4.5, i prezzi dei token sono inferiori del 90% per i prompt fino a 100.000 token e del 50% oltre tale soglia. Separatamente, Anthropic stima che il costo medio per completare un’attività sia inferiore di circa il 75%. Questa stima dell’azienda tiene conto della distribuzione delle richieste e del nuovo tokenizer, che utilizza un numero leggermente maggiore di token per la stessa attività. Perciò il risparmio medio stimato non garantisce lo stesso risparmio per ogni richiesta.

Primo piano del display di un orologio digitale su un tablet, che segna le 18:40 con un design moderno ed elegante.
Sogi . · Licenza Pexels

Limiti delle raccomandazioni e novità correlate

Per la programmazione agentica complessa, Anthropic raccomanda i modelli superiori Sonnet 5.5 o Opus 5.5, mentre suggerisce Haiku 5.5 per fasi più circoscritte, come la sintesi e il lavoro dei subagenti. Questa scelta ripartisce i costi in base al tipo di attività: le operazioni brevi e frequenti possono essere indirizzate al modello più piccolo, riservando quelli superiori alle attività complesse.

Dal 7 ottobre, secondo la stessa pubblicazione, il costo della lettura della cache di Sonnet 5.5 è sceso da 0,20 $ a 0,10 $ per milione di token. Anthropic associa questa modifica a una riduzione di circa il 20% del costo della maggior parte delle attività agentiche. L’azienda ha inoltre annunciato la disponibilità di Haiku 5.5 su Claude Platform, AWS, Google Cloud e Azure; la redazione non ha verificato separatamente la disponibilità su ciascuna piattaforma di terze parti.

Anthropic aveva promesso di iniziare a distribuire crediti API mensili agli abbonati Max e Team nella settimana del 7 ottobre. Al momento della verifica, l’8 ottobre, il completamento della distribuzione non era confermato. Per i team, la conclusione pratica del lancio è innanzitutto confrontare la lunghezza dei prompt con la soglia di 100.000 token, quindi provare il modello più adatto sulle proprie attività e sui propri costi.

People

No people listed for this article yet.

Keep readingOpenAI aggiunge interfacce interattive basate su GPT‑6 a ChatGPT
Read the next article

Trasforma ciò che leggi in un'integrazione funzionante

Esplora le API per dati social di jsonscraper, prova le richieste e crea il tuo prossimo flusso di lavoro.

Esplora API