Vai al contenuto
Scritta Claude Sonnet 5.5 sovrimpressa alla vista della Terra dallo spazio

Foto: Anthropic

Anthropic ha annunciato il 28 settembre 2026 Claude Sonnet 5.5, il secondo modello della famiglia Claude 5.5 dopo Opus 5.5. Secondo il comunicato ufficiale di Anthropic, il nuovo modello gira oltre il 30% più veloce di Claude Sonnet 5 e costa fino al 30% in meno per la maggior parte dei compiti, a parità di listino prezzi.

Un complemento più rapido ed economico a Opus 5.5

Nella famiglia Claude 5.5, Opus 5.5 resta il modello per il lavoro complesso che richiede giudizio attento, mentre Sonnet 5.5 è pensato, spiega Anthropic, per compiti quotidiani ben definiti: correggere bug, creare documenti, presentazioni e fogli di calcolo rifiniti. L’azienda gli riconosce anche un occhio particolarmente attento al design. Claude Haiku 5.5, destinato ad applicazioni ad alto volume e sensibili al costo, si unirà alla famiglia nelle prossime settimane.

Le cinque aree di miglioramento rispetto a Sonnet 5

Anthropic elenca i punti su cui Sonnet 5.5 supera il predecessore:

  • Prestazioni: 70,6% su Terminal-Bench 4.0 contro il 10,3% di Sonnet 5; due punti sotto Opus 5.5 su GDPval-AA; è il primo modello Sonnet a battere Pokémon Red lavorando solo da screenshot.
  • Collaborazione: scrive in modo più chiaro della generazione precedente e i primi tester lo descrivono come un partner di collaborazione migliore di Sonnet 5, complice anche la velocità che favorisce l’iterazione rapida su compiti meno complessi.
  • Costo: stesso prezzo di Sonnet 5, ma richiede molti meno token per lo stesso lavoro, con un risparmio fino al 30% per singolo compito nei test di Anthropic.
  • Velocità: genera output oltre il 30% più velocemente di Sonnet 5, il Sonnet più rapido mai rilasciato.
  • Allineamento e sicurezza: nell’audit comportamentale automatizzato di Anthropic migliora o eguaglia Sonnet 5 sulla maggior parte delle misure; avendo capacità di cybersecurity comparabili a quelle di Opus 5, è il primo Sonnet a lanciarsi con le salvaguardie e i meccanismi di fallback sviluppati per i modelli più capaci, mentre le salvaguardie in ambito biologico restano quelle di Sonnet 5. Entrambe puntano a un insieme ristretto di richieste ad alto rischio: lo sviluppo software di routine e la maggior parte del lavoro nelle scienze della vita non ne sono toccati.

I risultati nei benchmark

Secondo i dati pubblicati da Anthropic, Sonnet 5.5 si avvicina in diversi test ai punteggi di Opus 5.5, pur restando quest’ultimo, nella valutazione dell’azienda e dei tester esterni, più forte sul lavoro complesso e aperto che richiede giudizio prolungato.

Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5
Terminal-Bench 4.0 (coding agentico) 70,6% 10,3% 66,4%
CursorBench 4.0 (coding agentico) 55,5% 34,1% 57,8%
Humanity’s Last Exam (con strumenti) 64,5% 54,9% 67,7%
OSWorld 2.1 (uso del computer, parziale) 80,1% 57,0% 81,8%
Chartography (lettura grafici, senza strumenti) 61,6% 15,6% 64,4%
GDPval-AA v2.1 (lavoro reale) 1844 1449 1846
AA-Briefcase v1.1 (lavoro di lungo periodo) 1811 1359 1822

Il salto in avanti nella programmazione

Secondo Anthropic, il miglioramento di Sonnet 5.5 è particolarmente marcato nel coding. A effort alto su FrontierCode segna dieci punti in più rispetto a Sonnet 5 nella stessa configurazione, a circa un quindicesimo del costo per compito. Su CursorBench, che valuta gli agenti su task ambigui multi-file tratti da sessioni reali di Cursor, il suo punteggio migliore è a circa due punti da quello di Opus 5.5.

I primi tester hanno apprezzato la rapidità con cui Sonnet 5.5 comprende una base di codice e la sua efficienza: nei confronti diretti raggruppa più chiamate di strumenti rispetto a Sonnet 5, con meno passaggi e costi inferiori. Tra le aziende citate da Anthropic figura Epic Games: «Nei primi test di Epic, Claude Sonnet 5.5 ha raggiunto lo stesso livello di qualità che ci si aspetterebbe da un modello di fascia superiore, reggendo in un audit di progettazione di sistema e in una revisione dei flussi di dati. Il nuovo modello ha gestito decine di migliaia di righe di codice per l’architettura dei sistemi di gameplay, ha mantenuto risposte rapide, ha portato a termine compiti di più ore e ha dato risultati con prompt meno prescrittivi», ha dichiarato Daniel Vogel, chief operating officer di Epic Games, citato da Anthropic.

Prezzo e disponibilità

Sonnet 5.5 mantiene lo stesso listino di Sonnet 5: 2 dollari per milione di token in input, 10 dollari per milione in output e 0,20 dollari per milione di token letti dalla cache. Anthropic non indica un listino separato in euro per l’Italia o per l’Unione europea.

Leggi anche