Anthropic ha pubblicato una guida pratica per ridurre i costi di Claude Code, partendo da un dato che spiega bene il problema: l’uso medio stimato da parte degli sviluppatori arriva a circa 13 dollari al giorno, con una spesa mensile che può salire fra 150 e 250 dollari, e in alcuni casi anche molto di più a parità di attività.
Il punto centrale è che il costo non dipende solo dal modello scelto, ma soprattutto da come viene gestita la sessione: cronologia troppo lunga, output verbosi, cambi frequenti di modalità e uso inefficiente della cache possono moltiplicare il consumo di token.
Perché Claude Code può diventare molto più costoso del previsto
Ogni richiesta inviata a Claude Code comporta due fasi: la lettura completa del contesto della sessione e la generazione della risposta. Nella pratica, ogni nuovo prompt si porta dietro istruzioni di sistema, file di configurazione, messaggi precedenti, file letti e output dei comandi eseguiti. Più la conversazione cresce, più ogni turno successivo diventa pesante e quindi più caro.
Anthropic sottolinea anche che i token in uscita costano sensibilmente più di quelli in ingresso. Con Opus 5, per esempio, il prezzo indicato è di 5 dollari per milione di token in input e 25 dollari per milione in output. Questo spiega perché il livello di ragionamento incida così tanto: maggiore è l’effort, maggiore è la quantità di token generati internamente dal modello prima della risposta finale.
Un altro elemento chiave è la cache del prompt. Se il prefisso della richiesta resta identico, il sistema può riutilizzare il lavoro già svolto e abbattere il costo di rilettura del contesto fino a una frazione del normale. Però basta cambiare modello, intensità di ragionamento, modalità operativa o riscrivere la sessione con comandi di compattazione per invalidare il vantaggio accumulato.
Le sei mosse consigliate da Anthropic per spendere meno
La prima regola è semplice: finito un task, conviene usare /clear per ripartire con una sessione pulita. In questo modo bug precedenti, file aperti e log di comandi non restano nel contesto del lavoro successivo. La seconda è decidere subito modello ed effort level, evitando cambi in corsa che azzerano la cache e costringono a ricalcolare l’intera cronologia a prezzo pieno.
Anthropic consiglia poi di allegare i file con @ invece di scrivere manualmente i percorsi. Così Claude non deve cercarli da solo con passaggi intermedi che finiscono anch’essi nella storia della chat. Allo stesso modo è utile ridurre il rumore dei tool: per i test, ad esempio, ha senso usare parametri silenziosi come un reporter sintetico, in modo da salvare solo poche righe invece di centinaia.
Le ultime due tecniche riguardano la gestione delle sessioni lunghe. Il comando /compact va eseguito quando la cache è ancora attiva, perché comprime la conversazione con un costo molto più basso rispetto a una ricostruzione tardiva.
Gestire contesto e cache sta diventando una competenza tecnica vera
Il messaggio di Anthropic va oltre il semplice risparmio. Con strumenti di coding assistito usati in modo intensivo, la differenza fra una sessione ben organizzata e una gestita male può spostare il costo finale di diverse volte sullo stesso compito. Scegliere Sonnet per i lavori più semplici e riservare Opus ai casi davvero complessi rientra nella stessa logica: evitare di pagare capacità extra quando non servono.
In pratica, usare bene Claude Code oggi significa imparare a controllare contesto, output e continuità della cache con la stessa attenzione con cui si ottimizzano build, test o pipeline. È una competenza nuova, ma ormai incide direttamente su produttività e budget, soprattutto nei team che affidano all’AI una parte consistente del codice prodotto ogni giorno.


