Anthropic lancia Claude Sonnet 5.5 mentre la valutazione dell'AI si sposta verso il costo per attività
Punti chiave
- •Anthropic dichiara che Claude Sonnet 5.5 è oltre il 30% più veloce del suo predecessore e completa la maggior parte delle attività fino al 30% in meno utilizzando meno token, mantenendo invariati i prezzi per token.
- •Sonnet 5.5 mantiene i prezzi esistenti a 2 dollari per milione di token di input, 10 dollari per milione di token di output e 0,20 dollari per milione di token di lettura dalla cache.
- •Il modello ottiene il 70,6% su Terminal-Bench 4.0 contro il 10,3% di Sonnet 5, ma dati indipendenti mostrano che concorrenti come GPT-6 Sol e il MiMo-V2.6-Pro di Xiaomi raggiungono livelli di intelligenza comparabili a costi per attività molto più bassi.
- •Le ricerche citate nell'articolo mostrano che il costo per raggiungere un determinato livello di prestazioni AI è diminuito di circa il 47% per trimestre dal 2023, ma Gartner prevede che la spesa totale per l'inferenza per flusso di lavoro agentico aumenterà di oltre cinque volte entro il 2028.
- •Anthropic, che ottiene circa l'80% dei suoi ricavi dai clienti enterprise, si starebbe preparando per una quotazione in borsa, con Haiku 5.5 atteso entro poche settimane.

Anthropic ha rilasciato Claude Sonnet 5.5 il 28 settembre, il secondo modello della serie Claude 5.5, annunciando il debutto attraverso un post ufficiale su X. Il lancio arriva mentre l'azienda si avvia verso una quotazione in borsa, secondo Reuters. Sottolinea inoltre un cambiamento nei criteri utilizzati per valutare la tecnologia AI: le prestazioni grezze nei benchmark rimangono una considerazione chiave, ma le aziende valutano sempre più quanto sia costoso ottenere risultati con un modello specifico.
Anthropic afferma che Sonnet 5.5 opera oltre il 30% più velocemente rispetto a Sonnet 5 e può completare la maggior parte delle attività fino al 30% in meno, anche se i prezzi dei token rimangono invariati. Secondo la pagina di lancio del modello, la riduzione dei costi deriva dall'uso di un numero inferiore di token per eseguire lo stesso lavoro.
Stesso prezzo di listino, meno token
Sonnet 5.5 ha un prezzo di 2 dollari per milione di token di input, 10 dollari per i token di output e 0,20 dollari per i token di lettura dalla cache — la tariffa scontata per il riutilizzo del contesto già elaborato dal modello. Opus 5.5, specializzato in operazioni di ragionamento complesso e giudizio, costa rispettivamente 4 e 20 dollari per i token di input e output. Sonnet è posizionato per carichi di lavoro quotidiani come la programmazione, la generazione documenti e i fogli di calcolo.
Il prezzo mette l'efficienza al centro della discussione. Per molte attività, le aziende non hanno bisogno del modello con le prestazioni più elevate disponibili; un modello a basso costo che completa costantemente un lavoro può contare più di pochi punti in più in un benchmark. Questa dinamica è particolarmente importante per Anthropic che, secondo Reuters, ottiene circa l'80% dei suoi ricavi dai clienti enterprise.
I benchmark non bastano più
Anthropic dichiara che Sonnet 5.5 ottiene il 70,6% su Terminal-Bench 4.0, un benchmark agentico che testa i modelli su compiti reali da terminale, contro il 10,3% di Sonnet 5. Ma la classifica di Artificial Analysis del valutatore indipendente Artificial Analysis mostra perché i risultati dei benchmark sono solo una parte del quadro. Al massimo impegno, Sonnet 5.5 raggiunge un punteggio di 56 sulla scala di intelligenza, con un costo stimato di 7,60 dollari per attività. GPT-6 Sol ottiene 48 punti a 1,06 dollari per attività, mentre il MiMo-V2.6-Pro di Xiaomi segna 46 per soli 0,13 dollari. In altre parole, un modello leader nell'intelligenza non è necessariamente leader nell'efficienza dei costi — e per i carichi di lavoro ad alto volume, divari per attività di tale entità si accumulano rapidamente.
Queste differenze di costo spingono le aziende verso strategie multi-modello: i compiti più difficili sono assegnati a sistemi di fascia premium, mentre il lavoro di routine è indirizzato ad alternative più economiche. Questo approccio consente alle organizzazioni di pagare la capacità di primo livello solo dove è realmente necessaria.
Il prezzo del pensiero continua a scendere
Questo cambiamento si inserisce in una tendenza molto più ampia. Secondo un rapporto di Epoch AI pubblicato il 22 settembre, il costo per raggiungere un determinato livello di prestazioni AI è diminuito di circa il 47% per trimestre dal 2023 — una riduzione di circa 13 volte all'anno. Un altro rapporto di Cryptopolitan del 29 settembre afferma che gli acquirenti aziendali favoriscono sempre più il modello più conveniente in grado di completare il lavoro richiesto, mentre i prezzi bassi rendono anche più facile per le aziende giustificare l'uso simultaneo di più modelli.
Token più economici, bollette più grandi
Tuttavia, costi unitari più bassi non garantiscono spese AI complessive inferiori. Un rapporto di Gartner pubblicato il 17 agosto, intitolato "Gartner Predicts AI Inference Costs Per Agentic Workflow Will Increase More Than Fivefold Through 2028", descrive un "paradosso dell'inferenza": la caduta dei prezzi dei token stimola flussi di lavoro più complessi, che spingono al rialzo l'utilizzo totale di token. I prezzi unitari e la spesa totale sono leve diverse: la prima stabilisce il costo di ogni token, mentre la seconda dipende da quanti token consuma un flusso di lavoro.
"I responsabili di prodotto non possono fare affidamento su un'economia dei token più efficiente per giustificare i costi dell'AI", ha dichiarato Will Sommer, Senior Director Analyst di Gartner nel rapporto del 17 agosto 2026.
Chi ottiene davvero l'AI più economica
Secondo il Global AI Diffusion Report di Microsoft, i modelli a basso costo e open-weight hanno il potenziale per migliorare significativamente l'accesso all'AI, in particolare nel Global South. Tuttavia, da soli i costi inferiori dei modelli non determineranno l'adozione — infrastrutture, connettività e competenze rimangono i fattori decisivi per stabilire se un'AI più economica verrà effettivamente utilizzata.
Per gli acquirenti enterprise, Sonnet 5.5 segnala la direzione del mercato: il modello migliore non è necessariamente il più potente, ma quello che sa fare bene il lavoro a un costo ragionevole. Haiku 5.5, il prossimo modello della serie, atteso nelle prossime settimane, potrebbe spingere ulteriormente questo cambiamento rendendo più economico l'esecuzione di lavori AI ad alto volume — e rendendo più difficile per le aziende giustificare il pagamento di prezzi premium per attività di routine.