Il prezzo ufficiale dell'API Claude non dice tutto: token di output, modalità riflessione estesa e aggiornamenti frequenti cambiano la fattura reale.

Il prezzo per milione di token che vedi nella pagina tariffaria di Anthropic non è quello che pagherai a fine mese. Quel numero conta solo l'input. È l'output, i token generati dal modello, che fa esplodere la fattura nella maggior parte dei casi d'uso reali di agenti IA.\n\nQuesto articolo dettagli la struttura di prezzo attuale dell'API Claude, spiega perché il tariffario quasi mai predice il costo finale, e fornisce un metodo per budgetare un progetto senza sorprese al primo estratto conto.\n\n## Quanto costa l'API Claude oggi\n\nAnthropic evolve la sua gamma rapidamente. Molto rapidamente, in realtà. Claude Opus 4.8 è stato lanciato il 28 maggio 2026 con un prezzo d'ingresso di 5$ per milione di token in input. Due mesi dopo, il 24 luglio 2026, Anthropic annunciava già Claude Opus 5, posizionato come capace di avvicinarsi alle prestazioni del suo modello più potente a un costo notevolmente ridotto, secondo Axios.\n\nDue mesi. È il tempo che un tariffario rimane aggiornato in questo settore.\n\nSui prezzi di output gli scostamenti sono ampi: tra 5$ e 25$ per milione di token a seconda del modello Claude scelto, contro 6$ per il modello codex-mini-latest di OpenAI su compiti comparabili. Di fronte alla concorrenza, lo scostamento può essere ancora più marcato: Grok 4.3 di xAI fattura il suo input a 1,25$ per milione di token, ossia un rapporto di 1 a 10 con l'input di Claude Opus 4.8.\n\n| Modello | Prezzo input (per 1M token) | Prezzo output (per 1M token) | Note |\n|---|---|---|---|\n| Claude Opus 4.8 | 5$ | nella fascia 5-25$ a seconda del modello | Lanciato il 28 maggio 2026 |\n| Claude Opus 5 | non comunicato in modo fisso al lancio | posizionato più economico del precedente top di gamma | Annunciato il 24 luglio 2026 |\n| Codex-mini-latest (OpenAI) |, | 6$ | Parametro di confronto |\n| Grok 4.3 (xAI) | 1,25$ |, | 10x più economico in input rispetto a Opus 4.8 |\n\nAnthropic non comunica sistematicamente un prezzo unico e stabile per Sonnet e Haiku su tutta la sua gamma. Diciamolo chiaramente: l'unica fonte affidabile rimane la pagina tariffaria ufficiale di Anthropic, da consultare prima di ogni preventivo cliente. Un tariffario fisso in un articolo di blog ha un'aspettativa di vita di poche settimane.\n\n## Perché il prezzo afficheggiato non predice la tua fattura\n\nEcco il vero problema. La maggior parte dei confronti si ferma al prezzo d'ingresso per token. Ma un agente che risponde in 2.000 token costa, a parità di volume di input, molto più di un agente che risponde in 200 token, e lo scostamento tra input e output può arrivare fino a 5x sullo stesso modello Claude, in base ai prezzi osservati tra 5$ e 25$ per milione di token di output.\n\nTre meccanismi gonfiavano la nota senza che il prezzo afficheggiato cambi:\n\nIl ragionamento esteso, innanzitutto. I modelli Claude che espongono una modalità di riflessione approfondita generano token intermedi prima della risposta finale. Questi token di ragionamento sono fatturati come qualsiasi token di output. Un agente che "pensa" più a lungo consuma meccanicamente più budget, anche se la risposta finale rimane breve.\n\nInoltre, la cache del prompt. Anthropic propone un meccanismo di caching del contesto ripetuto, utile quando un agente riutilizza lo stesso sistema di prompt su migliaia di chiamate. Il principio riduce il costo sui token già visti, ma il guadagno dipende interamente dalla struttura del prompt: un contesto che cambia a ogni chiamata non ne beneficia.\n\nInfine, l'automazione per default. Dal 14 agosto 2026, la modalità automatica di Claude Code diventa l'impostazione predefinita per le sessioni degli utenti dei piani Pro, Max e Team, secondo Anthropic citato da InfoWorld. Una modalità automatica encatena le chiamate senza validazione manuale a ogni step, pratico, ma significa più chiamate API se nessuno monitora il volume.\n\n
\n\n## Come valutare il costo reale prima di scegliere un modello\n\nNon partire mai da un prezzo per token per budgetare un progetto. Parti da un rapporto.\n\nPreendi un campione rappresentativo delle tue richieste previste, dieci o venti casi reali bastano per un primo ordine di grandezza. Conti il volume medio di token in ingresso e in uscita per ognuna. Un agente di supporto clienti che riassume ticket avrà un rapporto input/output molto diverso da un agente che genera codice lungo da un'istruzione breve.\n\nPoi, testa in condizioni reali prima di firmare un preventivo cliente su un importo fisso. La modalità riflessione estesa, se attivata, può moltiplicare il volume di token di output su compiti complessi, senza che sia visibile in un prompt di test rapido e semplice.\n\nConfronta anche con le alternative disponibili nel mercato attuale, non solo Claude. Abbiamo dettagliato gli scostamenti di costo tra Claude Code e Codex in un articolo dedicato: i due strumenti non fatturano gli stessi tipi di compiti nello stesso modo, e la scelta dipende tanto dal contesto del progetto quanto dal prezzo lordo. Per i team che cercano un'opzione a costo zero in fase di esplorazione, abbiamo anche passato in rassegna cosa è veramente gratuito nell'ecosistema degli agenti IA, la risposta è più sfumata di quanto non sembri.\n\nUn limite da conoscere: questo metodo di stima per campionamento funziona bene per un uso stabile nel tempo. È meno affidabile per un agente in apprendimento continuo, il cui comportamento, e quindi il volume di token generato, evolve nel corso delle settimane di produzione.\n\n## Conclusione\n\nTre punti da ricordare prima di budgetare un progetto sull'API Claude. Il prezzo d'ingresso per token rappresenta solo una parte della fattura, i token di output e il ragionamento esteso pesano spesso di più. La gamma di modelli cambia velocemente, due mesi hanno bastato tra Opus 4.8 e Opus 5 nel 2026: verifica sempre la pagina tariffaria ufficiale prima di impegnarti. E la modalità automatica, ora attivata per default nei piani a pagamento di Claude Code dal 14 agosto 2026, merita un monitoraggio del volume se non vuoi sorprese a fine mese.\n\nHai bisogno di aiuto a quotare un progetto di agente IA prima di lanciarti? Il team fstck.co accompagna questo tipo di stima quotidianamente.\n\n<div class="faq-section">\n\n## Domande frequenti\n\n### Quanto costa l'API Claude Opus 5 rispetto a Claude Opus 4.8?\n\nAnthropic presenta Opus 5, annunciato il 24 luglio 2026, come capace di avvicinarsi alle prestazioni del suo modello più potente a un costo ridotto. Il dettaglio tariffario preciso deve essere verificato sulla pagina ufficiale di Anthropic, la comunicazione pubblica non avendo fissato un prezzo unico e duraturo al lancio.\n\n### La modalità riflessione estesa di Claude aumenta il costo per richiesta?\n\nSì. I token generati durante la fase di ragionamento intermedio sono fatturati come token di output classici. Più il modello "pensa" a lungo prima di rispondere, più il volume fatturato aumenta, anche se la risposta finale rimane breve.\n\n### Conviene privilegiare Claude o un'alternativa come Grok o Codex per ridurre i costi?\n\nDipende dal rapporto input/output del tuo caso d'uso. Grok 4.3 fattura il suo input dieci volte meno caro di Claude Opus 4.8, ma il prezzo d'ingresso da solo non basta per confrontare due modelli: la qualità di output, la necessità di token di ragionamento e il volume reale di chiamate cambiano l'equazione.\n\n### Come ridurre la fattura dell'API Claude in produzione?\n\nLa cache del prompt riduce il costo sulle porzioni di contesto riutilizzate da una chiamata all'altra, utile se il tuo sistema di prompt rimane stabile. Limitare il ricorso alla modalità riflessione estesa solo ai compiti che la giustificano davvero, e monitorare il volume generato dalle modalità automatiche, aiuta anche a mantenere il controllo del budget.\n\n### L'API Claude è più costosa dell'API Codex di OpenAI?\n\nSui prezzi di output, Claude mostra una fascia di 5$ a 25$ per milione di token a seconda del modello, contro 6$ per codex-mini-latest. Il posizionamento dipende quindi fortemente dal modello Claude scelto: un Haiku entry-level e un Opus top di gamma non si confrontano allo stesso livello di Codex.\n\n\n


