Vai al contenuto
Scritta 'Claude Haiku 5.5' su sfondo bianco con elementi grafici colorati.

Foto: Anthropic

Il 7 ottobre 2026 Anthropic ha lanciato Claude Haiku 5.5, che l’azienda definisce il suo modello piccolo più economico, veloce e capace di sempre. Secondo la pagina di presentazione di Anthropic, è pensato per attività ripetitive e ad alto volume, dove il costo conta. Rispetto a Haiku 4.5 costa in media circa il 75% in meno.

A cosa serve Haiku 5.5 e dove non conviene

Anthropic lo indica per lavori rapidi e ripetitivi: riassunti, compattazione del contesto, query su database e richieste di classificazione. Può affiancare Opus 5.5 e Sonnet 5.5 come subagent nel lavoro di programmazione. Per la velocità, l’azienda lo suggerisce anche per assistenza clienti in tempo reale e uso del browser.

Il limite è dichiarato: per compiti complessi di coding agentico restano preferibili Sonnet 5.5 e Opus 5.5. Haiku 5.5 va invece sui compiti più circoscritti che con le versioni precedenti sarebbero stati troppo costosi.

Prezzi: cosa c’è dietro il «75% in meno»

Il dato medio deriva da due tagli, spiega Anthropic: il prezzo è inferiore del 90% rispetto a Haiku 4.5 per richieste fino a 100.000 token e del 50% oltre quella soglia. Su Haiku 4.5, il 90% delle richieste rientrava nella fascia fino a 100.000 token. Il calcolo tiene conto anche del nuovo tokenizer, simile a quello di Sonnet 5.5 e Opus 5.5, che consuma leggermente più token a parità di lavoro.

Prezzi per milione di token, in dollari:

Voce Haiku 5.5 (fino a 100k / oltre 100k) Haiku 4.5 Sonnet 5.5
Lettura cache $0,01 / $0,05 $0,10 $0,10
Scrittura cache $0,125 / $0,625 $1,25 $2,50
Token in input $0,10 / $0,50 $1,00 $2,00
Token in output $0,50 / $2,50 $5,00 $10,00

Prezzi in euro non sono stati comunicati.

Benchmark: i numeri dichiarati da Anthropic

Nella stessa pagina l’azienda confronta Haiku 5.5 con Haiku 4.5, GPT-6 Luna e Sonnet 5.5. Le metodologie sono descritte nella system card del modello.

  • OSWorld 2.1 (uso del computer, sottoinsieme offline): 72,4% contro 15,7% di Haiku 4.5, 48,9% di GPT-6 Luna e 83,9% di Sonnet 5.5.
  • Terminal-Bench 4.0 (coding agentico): 39,2% contro 0,0% di Haiku 4.5, 16,4% di GPT-6 Luna e 70,6% di Sonnet 5.5.
  • Humanity’s Last Exam senza strumenti: 45,9% contro 10,2% di Haiku 4.5 e 56,9% di Sonnet 5.5.
  • GDPval-AA v2.1 (lavoro di conoscenza): 1620 contro 735 di Haiku 4.5, 1437 di GPT-6 Luna e 1840 di Sonnet 5.5.

Haiku 5.5 è il primo modello Haiku con un’impostazione di effort regolabile, per scegliere se privilegiare costo o intelligenza.

Cosa dicono i clienti in test

Anthropic riporta le testimonianze di alcune aziende che lo hanno provato in anticipo. Asana, per il suo prodotto AI Teammates, ha misurato rispetto al modello in uso una riduzione di oltre il 30% della latenza e un’inferenza fino a 2,5 volte più rapida per turno d’agente. AlphaSense, sulla funzione Ask in Document, ha ottenuto 0,84 contro 0,76 di Haiku 4.5 su 400 query. Box parla di 11 punti in più rispetto a Haiku 4.5 con circa metà della latenza.

Specifiche, disponibilità e sicurezza

Haiku 5.5 è disponibile su tutte le piattaforme, tra cui Amazon Web Services, Google Cloud e Microsoft Azure. Sulla Claude Platform l’identificativo è claude-haiku-5-5. La documentazione per sviluppatori di Anthropic indica una finestra di contesto da 1 milione di token, fino a 128.000 token in output, ragionamento adattivo con effort predefinito medium e conoscenze affidabili fino a giugno 2026. Il ritiro non è previsto prima del 7 ottobre 2027.

Sulla sicurezza, Anthropic dichiara miglioramenti nella quasi totalità delle valutazioni di allineamento rispetto a Haiku 4.5. Le protezioni in ambito cybersecurity sono più restrittive di quelle di Haiku 4.5 ma meno di quelle applicate ad altri modelli recenti: consentono più attività difensive di quelle di Sonnet 5.5, ma bloccano penetration testing e tecniche più adatte agli attaccanti. Per le attività più ampie su biologia e cyber si può fare domanda ai programmi di verifica dell’azienda.

Sonnet 5.5 costa meno e arrivano i crediti API per Max e Team

Con il lancio, Anthropic dimezza il prezzo delle letture dalla cache di Sonnet 5.5, da $0,20 a $0,10 per milione di token. Secondo l’azienda, questo riduce di circa il 20% il costo di Sonnet 5.5 sulla maggior parte dei lavori agentici.

Gli abbonati Claude Max e Team ricevono inoltre un credito API mensile da usare sulla Claude Platform, con qualsiasi modello:

  • Max 5x: 100 dollari al mese.
  • Max 20x: 200 dollari al mese.
  • Team: fino a 500 dollari, condivisi tra gli utenti.

Come indicano le note di rilascio di Claude, il rollout richiede alcuni giorni. Per riscattare i crediti si collega un’organizzazione Claude Console in Settings > Billing (Max) o in Organization settings > Billing (Team). Secondo la pagina di presentazione di Anthropic, l’azienda aggiorna anche gli SDK Python e TypeScript con il supporto in beta a computer use e browser use.

Leggi anche