Anthropic ha rilasciato il 7 ottobre 2026 Claude Haiku 5.5, il modello leggero più veloce di sempre nella sua linea di prodotti. Con un prezzo di partenza di 0,10 $ per milione di token in input e 0,50 $ per milione di token in output, il nuovo modello offre un taglio dei costi fino al 90 % rispetto al suo predecessore Haiku 4.5. Su base blended, tenendo conto del traffico reale, la società dichiara un risparmio medio del 75 %.
Caratteristiche tecniche
Haiku 5.5 accetta prompt fino a 100.000 token, che secondo Anthropic rappresentano circa il 90 % delle richieste tipiche per Haiku 4.5. La finestra di contesto è stata ampliata a 1 milione di token, consentendo conversazioni più lunghe e complesse. L’output massimo è di 128.000 token, il doppio rispetto ai 64.000 token di Haiku 4.5, e il nuovo tokenizer produce più token per lo stesso testo, riducendo parzialmente i vantaggi di costo nominale.
Struttura tariffaria
La struttura dei prezzi prevede una soglia precisa: per prompt fino a 100.000 token il costo è di 0,10 $ in input e 0,50 $ in output. Oltre tale soglia, le tariffe si moltiplicano per cinque, passando a 0,50 $ in input e 2,50 $ in output. Inoltre, Anthropic ha ridotto il prezzo delle letture dalla cache su Sonnet 5.5, passando da 0,20 a 0,10 $ per milione di token, con una diminuzione stimata del 20 % del costo medio sui carichi di lavoro agentici.
- Prompt ≤ 100.000 token: 0,10 $ input / 0,50 $ output
- Prompt > 100.000 token: 0,50 $ input / 2,50 $ output
- Lettura cache Sonnet 5.5: 0,10 $ per milione di token
Benchmark e performance
Haiku 5.5 ha mostrato miglioramenti netti rispetto al predecessore su tutti i test principali. Sul test OSWorld, che misura la capacità di utilizzo autonomo del computer, il punteggio è salito dal 15,7 % al 72,4 %. Su Terminal‑Bench 4.0 il modello ha raggiunto il 39,2 % contro il 16,4 % di GPT‑6 Luna, mentre su FrontierCode 1.1 ha ottenuto il 46,4 % rispetto al 42,4 % del modello concorrente. Sebbene rimanga dietro a Claude Sonnet 5.5 su tutti i benchmark, Haiku 5.5 è posizionato su un segmento di prezzo diverso, mirato a scenari ad alto volume.
Velocità e modalità di utilizzo
In termini di velocità, Haiku 5.5 è il modello più rapido della serie Claude in modalità standard. Secondo Artificial Analysis, nella modalità “Max” il modello raggiunge 240 token al secondo. Solo i modelli Opus in “Fast Mode” lo superano. La configurazione predefinita è “Medium”, che bilancia velocità e qualità; riducendo lo sforzo a “Low”, il costo per task scende a circa 0,02 $.
Concorrenza e mercato
La guerra dei prezzi tra i principali fornitori di modelli non accenna a rallentare. GPT‑6 Luna di OpenAI compete nello stesso segmento di prezzo, ottenendo punteggi simili su alcuni test a un terzo del costo per task. Haiku 5.5 risponde con performance superiori sul coding e sull’uso autonomo del computer, puntando a diventare il motore economico delle pipeline agentiche multimodello.
Prospettive future
Anthropic punta esplicitamente a settori ad alto volume come la classificazione di documenti, le query su database, i riassunti automatici e il supporto clienti in tempo reale. Con la capacità di gestire un milione di token di contesto e una struttura di costi flessibile, Haiku 5.5 si propone come una soluzione scalabile per le imprese che necessitano di risposte rapide e a basso costo. Il continuo miglioramento dei benchmark suggerisce che la prossima generazione di modelli potrebbe spingere ancora più in là le frontiere dell’efficienza economica senza sacrificare la qualità.