Claude Sonnet 5.5 si avvicina alle prestazioni di Opus riducendo i costi per attività fino al 30%
Punti chiave
- •Anthropic ha lanciato Claude Sonnet 5.5 come secondo modello della famiglia Claude 5.5, rivolto a programmazione, produttività quotidiana e lavoro sui documenti a un livello di costo inferiore.
- •Il modello produce output oltre il 30% più velocemente rispetto a Sonnet 5 e riduce i costi per attività fino al 30% grazie all'efficienza dei token, mentre il prezzo per token resta a 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita.
- •Sonnet 5.5 ha superato Opus 5.5 su Terminal-Bench 4.0 con il 70,6% contro il 66,4%, ed è arrivato a due punti di distanza su GDPval-AA, con un punteggio di 1.844 contro 1.846 di Opus.
- •Nelle valutazioni di programmazione, Sonnet 5.5 è migliorato di circa 10 punti rispetto a Sonnet 5 su FrontierCode con impegno High, costando circa un quindicesimo per attività.
- •È il primo modello Sonnet a includere salvaguardie di sicurezza informatica paragonabili ai modelli di fascia superiore di Anthropic, una modifica che potrebbe reindirizzare le richieste di cybersecurity ad alto rischio a Sonnet 5.

Anthropic ha lanciato Claude Sonnet 5.5, il secondo modello della famiglia Claude 5.5, posizionandolo come un'opzione più rapida ed economica per la programmazione, il lavoro quotidiano e la creazione di documenti.
Il modello genera output oltre il 30% più velocemente rispetto al predecessore Sonnet 5 e costa fino al 30% in meno per attività nei test dell'azienda, secondo l'annuncio di Anthropic. Il risparmio deriva in gran parte dall'efficienza: Sonnet 5.5 richiede meno token per completare lo stesso lavoro. Il prezzo per token resta invariato a 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita. Questa distinzione è importante per i team che utilizzano il modello su larga scala: poiché i prezzi di listino non cambiano, il risparmio si manifesta a livello di attività, dove i costi si accumulano con l'uso.
Anthropic presenta Sonnet 5.5 come un complemento a costo ridotto di Claude Opus 5.5. Opus resta orientato a lavori complessi e aperti che richiedono un giudizio costante, mentre Sonnet è progettato per compiti più definiti, come la correzione di bug e la creazione di documenti, presentazioni e fogli di calcolo.
Su alcune valutazioni, tuttavia, il divario tra i due modelli si è notevolmente ridotto. Sonnet 5.5 ha ottenuto un punteggio superiore a Opus 5.5 su Terminal-Bench 4.0, registrando il 70,6% contro il 66,4%. Su GDPval-AA, un benchmark che misura il lavoro conoscitivo nel mondo reale, i due sono stati praticamente in parità, con Sonnet 5.5 a 1.844 contro 1.846 di Opus 5.5. Anthropic ha dichiarato che, con determinate impostazioni di impegno, Sonnet 5.5 performs on par with Opus 5.5, anche se l'azienda continua a considerare Opus il modello più potente per i compiti complessi che richiedono un giudizio costante. Per chi valuta i due livelli, questi risultati offrono un punto di riferimento su quanta capacità misurata venga mantenuta al costo per attività inferiore di Sonnet.
La programmazione è una delle aree di miglioramento più significative. Anthropic ha riferito che Sonnet 5.5 ha guadagnato circa 10 punti rispetto a Sonnet 5 su FrontierCode con impegno High, costando circa un quindicesimo per attività. Il miglior punteggio di CursorBench del modello è inoltre arrivato a circa due punti da Opus 5.5.
Anche il lavoro conoscit più ampio ha registrato guadagni significativi. Anthropic ha dichiarato che Sonnet 5.5 si è avvicinato a Opus 5.5 nell'uso del computer e nel riconoscimento di grafici, superando Sonnet 5 nelle valutazioni interne ed esterne dell'azienda.
Sonnet 5.5 è anche il primo modello Sonnet a essere lanciato con salvaguardie di sicurezza informatica paragonabili a quelle dei modelli di fascia superiore di Anthropic, a seguito di un sostanziale miglioramento delle sue capacità informatiche rispetto alla generazione precedente. Di conseguenza, le richieste di cybersecurity ad alto rischio potrebbero essere reindirizzate a Sonnet 5, mentre i normali compiti di sviluppo restano disponibili — un compromesso tra salvaguardie più rigorose e disponibilità delle attività che i team che usano il modello per lavori legati alla sicurezza dovranno tenere in considerazione.
Il modello è disponibile sulle piattaforme di Anthropic nonché tramite Amazon Web Services, Google Cloud e Microsoft Azure. Gli sviluppatori possono accedervi tramite la Claude Platform utilizzando l'identificatore claude-sonnet-5-5.
Anthropic ha aggiunto che Claude Haiku 5.5, un modello pensato per applicazioni ad alto volume e sensibili ai costi, si unirà alla famiglia Claude 5.5 nelle prossime settimane. Una volta rilasciato, la famiglia coprirà l'intera gamma di livelli di Anthropic, dal lavoro complesso e continuativo fino al deployment su larga scala.