// SMARTWORLD — INTELLIGENZA ARTIFICIALE
Claude Code: come ridurre del 45% il consumo di token senza perdere qualità
Se usate Claude Code regolarmente, probabilmente avete già incontrato il muro dei limiti di utilizzo. Quello che forse non sapete è che potreste star contribuendo al problema voi stessi, lasciando che l'AI lavori a piena potenza anche per compiti banali.
Anthropic ha introdotto da qualche mese un'impostazione che permette di controllare quanti token Claude dedica a ogni richiesta, e i risultati pratici sono sorprendenti.
Preferisci ascoltare il riassunto audio? Abbiamo scelto una voce realizzata con strumenti avanzati IA per rendere rendere i nostri testi subito accessibili a tutti
Il concetto di fondo è semplice: non ha senso affrontare con la massima concentrazione sia un problema di debugging complesso sia la rinomina di una variabile. Claude Code funziona allo stesso modo: alcuni compiti beneficiano di più ragionamento, altri no, e sprecare token su quelli semplici brucia il budget senza alcun vantaggio reale.
I modelli più recenti di Claude usano già un ragionamento adattivo, cioè decidono autonomamente quanto "pensare" in base alla difficoltà del compito. L'impostazione di cui parliamo agisce su questo meccanismo, permettendo di alzare o abbassare il limite entro cui il modello può muoversi.
I livelli disponibili sono sei: Basso, Medio, Alto, Extra, Max, Ultracode (non tutti sono accessibili su ogni modello). Il livello predefinito per Claude Sonnet 5 in Claude Code è Alto, che bilancia qualità e consumo. Max, invece, rimuove praticamente ogni freno al ragionamento, il che ha senso per problemi davvero difficili ma è uno spreco enorme per tutto il resto.
Chi ha condotto i test su XDA Developers ha assegnato a Claude Code le stesse cinque attività di programmazione due volte: una con il livello Alto e una con Medio, azzerando il progetto tra un ciclo e l'altro. Con Alto sono stati generati circa 26.000 token in uscita; con Medio circa 14.300, ovvero una riduzione del 45%. La parte più interessante è che Medio ha comunque completato tutti e cinque i compiti, arrivando spesso alle stesse conclusioni del livello superiore.
Se notate che Claude impiega molto tempo su richieste semplici e raggiungete i limiti più in fretta del solito, vale la pena controllare a quale livello state lavorando.
Probabilmente state pagando il "costo" di Alto (o addirittura Max) per compiti che Medio gestirebbe benissimo, e questo è un modo concreto per usare Claude Code in modo più efficiente.
Siamo noi insomma che tendiamo a sovrastimare la difficoltà di un compito, pensando magari che mettere il ragionamento al massimo non porti altri che benefici, ma in realtà non è detto, non solo in termini di tempo e token usati, ma anche di qualità delle risposte. Un modello che "ragiona troppo" su un problema semplice può suggerire una soluzione più complicata del dovuto, portandoci quindi a sperperare altre risorse. È il classico "cannone per sparare a una mosca".