Chiunque abbia provato a preventivare un progetto di intelligenza artificiale si è scontrato con la stessa domanda: quanto costa davvero far girare un modello linguistico? I listini di OpenAI, Google e Anthropic sono pubblici, ma espressi in dollari per milione di token, un'unità che non dice nulla a chi deve decidere un budget mensile. Questo calcolatore traduce quei listini in cifre concrete: inserisci quante richieste gestisci al mese e quanto sono lunghi i testi, e vedi la spesa reale di undici modelli a confronto.
Come funziona il costo a token
Un token è il frammento di testo che il modello elabora: non una parola intera, ma circa tre quarti di parola. In italiano la conversione pratica è di 1,6 token per parola, quindi un articolo da 1.000 parole vale intorno ai 1.600 token. Le parole comuni occupano un token, quelle lunghe o tecniche se ne prendono tre o quattro.
Il punto che sfugge a quasi tutti è che si paga due volte, a tariffe diverse. Il testo che invii al modello è l'input, quello che il modello ti restituisce è l'output, e l'output costa dalle quattro alle sei volte più dell'input. Claude Sonnet 5.5, per esempio, costa 2 dollari per milione di token in ingresso e 10 in uscita; GPT-5.5 passa da 5 a 30 dollari. Questo squilibrio cambia completamente i conti: un servizio che legge documenti lunghi e risponde in due righe costa una frazione di uno che riceve istruzioni brevi e scrive articoli interi.
C'è un terzo fattore che gonfia le bollette senza preavviso: in un chatbot, ogni messaggio rispedisce al modello tutta la conversazione precedente. Il modello non ha memoria, va riportato al punto ogni volta. Alla ventesima battuta di una chat stai pagando come input venti volte lo storico, e il costo per singola risposta non è più quello della prima.
Calcolatore costi API: ChatGPT, Claude e Gemini
Inserisci quanto usi l'IA al mese e scopri quanto spenderesti con ogni modello. Nessun dato lascia il tuo browser.
Impostazioni avanzate
| Modello | Per richiesta | Al mese | All'anno |
|---|
Prezzi di listino per 1 milione di token, tariffa standard, aggiornati al 4 ottobre 2026. Non includono sconti per prompt caching (fino al 90% sull'input ripetuto) né le tariffe batch (circa −50%). Gemini 3.8 e 3.7 Flash sono in tariffa promozionale fino al 31 dicembre 2026, poi raddoppiano. Fonti: OpenAI, Google, Anthropic.
Domande frequenti sui costi delle API di intelligenza artificiale
Quanto costa un chatbot di assistenza clienti al mese?
Molto meno di quanto si immagini. Un chatbot che gestisce 5.000 conversazioni al mese, con circa 400 parole di contesto in ingresso e 150 parole di risposta, costa meno di 1 dollaro al mese con un modello economico come GPT-6 luna, intorno ai 4 dollari con Gemini 2.5 Flash, circa 18 dollari con Claude Sonnet 5.5 e arriva a 50 dollari con GPT-5.5. La voce di spesa dominante in un progetto di questo tipo non è quasi mai l'API: è lo sviluppo e la manutenzione.
Conviene un modello Flash o mini, o serve un Pro?
Dipende da quanto è tollerante il tuo caso d'uso all'errore. I modelli leggeri — Gemini Flash, GPT mini, Claude Haiku — costano dieci o venti volte meno e sono più che adeguati per classificare richieste, estrarre dati da documenti strutturati, riassumere, moderare contenuti, smistare email. I modelli di punta si giustificano quando il compito richiede ragionamento su più passaggi, scrittura di codice, analisi di documenti ambigui o decisioni difficili da verificare a posteriori. La strategia che funziona in produzione è mista: il modello leggero gestisce il traffico ordinario e passa al modello grande solo i casi che non sa risolvere. Se stai ancora scegliendo il fornitore, parti dal confronto tra Gemini, ChatGPT e Claude.
Perché l'output costa più dell'input?
Perché costa più da produrre. L'input viene elaborato in parallelo in un unico passaggio, mentre l'output viene generato un token alla volta, in sequenza, e ogni token richiede un nuovo ciclo di calcolo sull'intero contesto. È un vincolo tecnico, non una scelta commerciale, ed è identico presso tutti i fornitori.
Come riduco la spesa senza cambiare modello?
Tre leve, in ordine di efficacia. Il prompt caching abbatte fino al 90% il costo della parte di prompt che resta identica tra richieste — istruzioni di sistema, documenti di riferimento, esempi — e per un chatbot con istruzioni lunghe è la singola ottimizzazione più redditizia. Le richieste batch costano circa la metà, se puoi accettare risposte entro 24 ore anziché in tempo reale: ideale per elaborazioni notturne e archivi da processare. Terzo, accorcia l'output: chiedere al modello di rispondere in modo sintetico taglia la voce più cara del conto.
I prezzi del calcolatore includono l'IVA?
No. I listini dei tre fornitori sono in dollari americani e al netto delle imposte. Se acquisti con partita IVA italiana la fatturazione avviene normalmente in regime di inversione contabile, ma le modalità variano per fornitore e paese di fatturazione: verifica con il tuo commercialista. Il calcolatore converte anche in euro, con un cambio che puoi modificare nelle impostazioni avanzate.
Quanti token consuma un articolo da 1.000 parole?
Circa 1.600 token in italiano. Generare 100 articoli da 1.200 parole partendo da istruzioni di 300 parole costa circa 2 dollari al mese con Claude Sonnet 5.5 e meno di 50 centesimi con Gemini 2.5 Flash. L'ordine di grandezza sorprende quasi sempre, e spiega perché i servizi che rivendono generazione di testi a decine di euro al mese abbiano margini così ampi.
Se vuoi inquadrare la spesa dentro un progetto piu ampio, leggi la guida su intelligenza artificiale e software SaaS e i dati sull'adozione dell'IA nelle PMI italiane.