// PUNTO INFORMATICO — INTELLIGENZA ARTIFICIALE
Claude Sonnet 5.5: i 5 prompt per capire cosa sa fare davvero
Quando Anthropic rilascia un nuovo modello di punta, la tentazione è buttarsi su quello e ignorare tutto il resto. Claude Opus 5.5 è arrivato il 17 settembre con numeri impressionanti, e la reazione naturale è stata: ecco il modello da usare per tutto.
Poi, sei giorni dopo, è arrivato Claude Sonnet 5.5, il fratello minore, quello pensato per il lavoro di tutti i giorni, e ha fatto qualcosa di inaspettato: nei test che simulano le attività lavorative reali, ha ottenuto quasi lo stesso punteggio di Opus. Due punti di differenza.
Il dato che attira più attenzione arriva da un test progettato per valutare come i modelli di AI gestiscono il lavoro che le persone svolgono nel mondo reale. Copre attività di quarantaquattro professioni diverse, non quiz di matematica o domande di cultura generale, ma il tipo di compiti che si portano a un chatbot ogni giorno.
Sonnet 5.5 ha ottenuto 1.844 punti. Opus 5.5, il modello di punta di Anthropic, ha ottenuto 1.846. Due punti di differenza. La versione precedente di Sonnet si fermava a 1.449, quindi il salto è enorme. Su questo test specifico, il modello più economico è passato dal distanziare nettamente Opus a pareggiarlo di fatto.
Anthropic dichiara che Sonnet 5.5 genera risposte più del trenta per cento più veloce rispetto a Sonnet 5, scrive con più chiarezza e gestisce meglio i compiti quotidiani ben definiti. Usa anche meno token per completare lo stesso lavoro, il che significa che il costo reale di un compito tipico scende fino al trenta per cento. Opus 5.5 costa il doppio per token.
La maggior parte del tempo passato con Claude non riguarda problemi difficili. Si chiede di riassumere un documento, spiegare un argomento complicato, rielaborare un testo, pianificare un progetto, e poi si prosegue con domande di approfondimento man mano che la risposta prende forma.
In quel tipo di conversazione, un modello più veloce guadagna terreno ad ogni scambio. Qualche secondo in più di attesa per ogni risposta sembra irrilevante su un singolo messaggio. Moltiplicato per venti scambi in una conversazione lunga, diventa un’attesa che si avverte, e che interrompe il flusso del ragionamento proprio quando dovrebbe essere più fluido.
Opus 5.5 è ancora il modello di punta della famiglia Claude 5.5, e resta la scelta giusta per i compiti che richiedono la massima capacità: progetti di programmazione complessi, analisi articolate, problemi ambigui e qualsiasi lavoro in cui il modello deve tenere traccia di molte informazioni interconnesse per un lungo periodo.
Ma la maggior parte delle persone non chiede a Claude di risolvere quel tipo di problemi ogni giorno. E i risultati suggeriscono che per le attività più ordinarie come riscrivere un’e-mail, riassumere un documento lungo, trasformare appunti disordinati in qualcosa di utilizzabile, preparare una presentazione, scegliere Sonnet non è più un compromesso, ma la scelta giusta.
Il modello è disponibile su tutte le piattaforme di Anthropic e sostituisce Sonnet 5 come modello predefinito per gli utenti dei piani gratuito e a pagamento. Anthropic ha annunciato che una versione ancora più leggera, progettata per compiti ad alto volume e sensibili al costo, seguirà nelle prossime settimane.