// SMARTWORLD — INTELLIGENZA ARTIFICIALE
Claude Sonnet 5.5 ufficiale: 30% più veloce, 30% più efficiente e quasi al livello di Opus 5.5, ma ora quale uso?
Anthropic ha appena annunciato Claude Sonnet 5.5, il secondo modello della famiglia Claude 5.5, e i numeri che lo accompagnano sono tutt'altro che banali. Rispetto al predecessore Sonnet 5, genera output con una velocità superiore del 30% e, grazie a un uso più efficiente dei token, consuma fino al 30% in meno per task, pur mantenendo lo stesso prezzo di listino per milione di token.
In pratica: fa di più, lo fa prima e spende meno risorse per farlo. Per chi usa Claude in modo intensivo, soprattutto tramite API o strumenti come Claude Code, è un aggiornamento che si farà sentire quando arriva il conto a fine mese.
Preferisci ascoltare il riassunto audio? Abbiamo scelto una voce realizzata con strumenti avanzati IA per rendere i nostri testi subito accessibili a tutti
Il miglioramento più vistoso riguarda il coding agentivo, cioè la capacità del modello di lavorare su codebase reali, correggere bug e gestire task complessi in autonomia. Su Terminal-Bench 4.0, un benchmark che misura proprio questo tipo di lavoro, Sonnet 5.5 segna 70,6% contro il 10,3% di Sonnet 5: un salto che non ha precedenti tra due versioni consecutive dello stesso modello, ed è addirittura superiore al 66,4% di Opus 5.5.
Su CursorBench, che testa i modelli su sessioni reali di coding ambiguo e multi-file, Sonnet 5.5 si avvicina a soli due punti da Claude Opus 5.5, il modello di punta di Anthropic. I tester di Epic Games hanno descritto il modello come capace di "gestire decine di migliaia di righe di codice per l'architettura di sistemi di gioco, mantenendo risposte rapide e completando task di più ore". Base44, che sviluppa app, ha rilevato che Sonnet 5.5 completa le build in 3,6 iterazioni in media, contro le 7,7 di Opus 5, con il minor numero di chiamate agli strumenti fallite tra tutti i modelli testati.
Anche l'efficienza è migliorata in modo misurabile: nei test comparativi, Sonnet 5.5 raggruppa le chiamate agli strumenti più spesso di Sonnet 5, riducendo il numero di passaggi e abbassando i costi per task.
Al di là del coding, Sonnet 5.5 migliora su tutta la linea del lavoro di conoscenza: documenti, presentazioni, fogli di calcolo, analisi finanziarie.
Su GDPval-AA, un benchmark che misura le prestazioni su task reali in 44 professioni diverse, Sonnet 5.5 si avvicina quasi a Opus 5.5 e supera Sonnet 5 di circa 400 punti.
Zendesk ha segnalato che il modello risolve i ticket di supporto il 20% più velocemente rispetto ai modelli Claude usati in produzione. Balyasny Asset Management, che lavora in ambito finanziario, ha rilevato che Sonnet 5.5 usa circa 121.000 token per risposta dove Sonnet 5 ne usava 497.000, con qualità superiore su quasi tutti i task di ricerca e analisi.
Anthropic racconta anche un test interno: hanno dato al modello i materiali di un earnings call trimestrale di un'azienda quotata, un template di slide, e gli hanno chiesto di produrre una presentazione operativa da 10 slide. Due esperti hanno giudicato la prima bozza già pronta da inviare senza modifiche.