Riferimentoaggiornato il 25 agosto 2026
Prezzi delle api dei modelli e quando scadono
Quanto costa un milione di token sui listini ufficiali dei sei fornitori che contano, e quali di questi prezzi hanno una data di scadenza già scritta dentro. Ogni riga è letta alla fonte, non ripresa da chi la cita.
I prezzi con una data dentro
Questa è la parte che nei confronti non compare. Un prezzo promozionale non è un prezzo, è una promozione con una scadenza, e chi dimensiona una spesa ricorrente su quel numero si trova l'aumento in fattura senza che nessuno abbia toccato niente.
| Cosa | Prezzo di oggi | Fino a | Poi |
|---|
| GPT-5.6 Sol, prezzo promozionaleOpenAI | 4 in ingresso e 20 in uscita | 21 novembre 2026 | il listino non dice a quanto risale. La formula usata è «at least through», quindi la data è un minimo, non una garanzia |
| Gemini 3.7 Flash e 3.6 FlashGoogle | 0,75 in ingresso e 3,75 in uscita | 31 dicembre 2026 | raddoppiano a 1,50 e 7,50 dal primo gennaio 2027, già scritto in listino |
| Claude Sonnet 5, aumento annullatoAnthropic | 2 in ingresso e 10 in uscita | nessuna scadenza | l'aumento a 3 e 15 previsto per il primo settembre 2026 è stato cancellato e il prezzo di lancio è diventato quello standard |
OpenAI
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
gpt-5.6-sol | 4,00 | 0,40 | 20,00 | promozionale fino almeno al 21 novembre 2026 |
gpt-5.6-terra | 2,00 | 0,20 | 12,00 | |
gpt-5.6-luna | 0,20 | 0,02 | 1,20 | |
gpt-5.5 | 5,00 | 0,50 | 30,00 | |
gpt-5.5-pro | 30,00 | — | 180,00 | |
gpt-5.4 | 2,50 | 0,25 | 15,00 | |
gpt-5.4-mini | 0,75 | 0,075 | 4,50 | |
gpt-5.4-nano | 0,20 | 0,02 | 1,25 | |
gpt-5.1 | 1,25 | 0,125 | 10,00 | |
gpt-5-mini | 0,25 | 0,025 | 2,00 | |
gpt-5-nano | 0,05 | 0,005 | 0,40 | |
- Contesto lungo, oltre la finestra standard, al doppio del prezzo. Su gpt-5.6-sol sono 8 in ingresso e 30 in uscita, cioè più del prezzo pieno di prima della promozione.
- Residenza dei dati, sugli endpoint regionali, più 10 per cento per i modelli usciti dal 5 marzo 2026.
- Modalità veloce al doppio delle tariffe standard.
- Batch e flex a metà prezzo.
Google
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
gemini-3.7-flash | 0,75 | 0,075 | 3,75 | dal primo gennaio 2027 diventa 1,50 e 7,50 |
gemini-3.6-flash | 0,75 | 0,075 | 3,75 | dal primo gennaio 2027 diventa 1,50 e 7,50 |
gemini-3.5-flash | 1,50 | 0,15 | 9,00 | |
gemini-3.5-flash-lite | 0,30 | 0,03 | 2,50 | |
gemini-3.1-pro-preview | 2,00 | 0,20 | 12,00 | oltre 200mila token di prompt sale a 4,00 e 18,00 |
gemini-3-flash-preview | 0,50 | 0,05 | 3,00 | audio in ingresso a 1,00 |
gemini-2.5-pro | 1,25 | 0,125 | 10,00 | oltre 200mila token sale a 2,50 e 15,00 |
gemini-2.5-flash | 0,30 | 0,03 | 2,50 | audio in ingresso a 1,00 |
gemini-2.5-flash-lite | 0,10 | 0,01 | 0,40 | |
- Batch a metà prezzo.
- Ricerca Google come fonte, 5.000 richieste al mese comprese sui modelli 3.x, poi 14 dollari ogni mille.
- Su diversi modelli il prezzo cambia sopra i 200mila token di prompt, quindi un agente che si porta dietro documenti interi entra nella fascia alta senza che nessuno lo decida.
Anthropic
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
Claude Fable 5 | 10,00 | 1,00 | 50,00 | |
Claude Opus 5 | 5,00 | 0,50 | 25,00 | |
Claude Sonnet 5 | 2,00 | 0,20 | 10,00 | l'aumento previsto per il primo settembre 2026 è stato annullato |
Claude Sonnet 4.6 | 3,00 | 0,30 | 15,00 | |
Claude Haiku 4.5 | 1,00 | 0,10 | 5,00 | |
- La colonna cache è la lettura, a un decimo del prezzo di ingresso. Scrivere in cache costa invece più dell'ingresso, 1,25 volte per la cache da 5 minuti e 2 volte per quella da un'ora.
- Contesto fino a un milione di token al prezzo standard sui modelli dal 4.6 in poi, senza fascia alta. È la differenza più grossa rispetto agli altri due listini.
- Residenza dei dati, con inferenza solo negli Stati Uniti, moltiplicatore 1,1 sui modelli dal 4.6 in poi. Endpoint regionali su Bedrock e Google Cloud più 10 per cento.
- Modalità veloce su Opus 5, 10 in ingresso e 50 in uscita.
- Batch a metà prezzo. Ricerca web 10 dollari ogni mille ricerche.
- I modelli dal 4.7 in poi usano un tokenizzatore che produce circa il 30 per cento di token in più a parità di testo, quindi il prezzo per token non basta a confrontarli con i precedenti.
xAI
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
grok-4.6 | 2,00 | 0,50 | 6,00 | da 200mila token di prompt raddoppia, 4,00 e 12,00 |
grok-4.5 | 2,00 | 0,30 | 6,00 | da 200mila token, 4,00 e 12,00 |
grok-4.3 | 1,25 | 0,20 | 2,50 | da 200mila token, 2,50 e 5,00 |
grok-build-0.1 | 1,00 | 0,20 | 2,00 | da 200mila token, 2,00 e 4,00 |
- Il listino non indica scadenze né prezzi promozionali.
Mistral
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
Mistral Large 3 | 0,50 | 0,05 | 1,50 | |
Mistral Medium 3.5 | 1,50 | 0,15 | 7,50 | |
Mistral Small 4 | 0,15 | 0,015 | 0,60 | |
Ministral 3 14B | 0,20 | 0,02 | 0,20 | |
Ministral 3 8B | 0,15 | 0,015 | 0,15 | |
Codestral | 0,30 | 0,03 | 0,90 | |
- Il listino non indica scadenze. È il fornitore europeo con i prezzi più bassi della fascia alta.
DeepSeek
Listino ufficiale verificato il 25 agosto 2026. Fonte
| Modello | Ingresso | Cache | Uscita | Note |
|---|
deepseek-v4-pro | 0,66 | 0,022 | 1,98 | prezzi fuori punta. Nelle ore di punta raddoppiano, 1,32 e 3,96 |
deepseek-v4-flash | 0,22 | 0,007 | 0,66 | fuori punta. In punta 0,44 e 1,32 |
- Unico listino che cambia per ora del giorno. Le ore di punta sono 01-04 e 06-10 UTC dal lunedì al venerdì, cioè in Italia 03-06 e 08-12 d'estate, quindi buona parte della mattinata lavorativa italiana cade nella fascia cara.
Come si legge questa tabella senza sbagliare il conto
Il prezzo per token è il numero meno importante dei quattro che servono. Contano quanto del contesto viene riusato, perché la cache costa un decimo dell'ingresso e in un agente di assistenza la parte riusata è quasi tutta. Conta la soglia del contesto lungo, perché su OpenAI, Google e xAI oltre una certa dimensione di prompt il prezzo cambia fascia da solo, mentre su Anthropic dal 4.6 in poi non cambia. Conta il moltiplicatore per la residenza dei dati, che per chi tratta dati di clienti o di iscritti non è un'opzione ma il presupposto per firmare. E conta il tokenizzatore, perché a parità di prezzo per token due modelli possono consumare quantità diverse di token sullo stesso testo.
Tutti i prezzi sono in dollari per milione di token, al netto di iva e di cambio. Sono esclusi i modelli ritirati e i listini dei rivenditori cloud, che hanno prezzi propri.
Errori e segnalazioni
Se un prezzo qui è cambiato o è sbagliato, scrivetemi a lukas.ferrazzi@rassegnaai.com e correggo con la data della verifica. Il conto completo di un agente reale, con volumi e assunzioni dichiarate, sta nella rubrica Costi.