Ogni settimana esce un modello nuovo e la domanda è sempre la stessa: quanto costa, quanto testo riesce a leggere in una volta, conviene rispetto a quello che uso già? Qui tengo la lista aggiornata dei prezzi dei modelli IA che contano, con finestra di contesto e data di rilascio, presi dalle pagine ufficiali dei provider.
La tabella si aggiorna insieme alla Rassegna AI di ogni mattina: quando esce un modello o cambia un listino, lo trovi qui. Clicca sulle intestazioni per ordinare le colonne, per esempio per trovare il modello più economico, e usa i filtri per restringere la lista.
| Modello | Provider | Rilascio | Contesto | Input | Output | Note |
|---|---|---|---|---|---|---|
Claude Opus 5.5
claude-opus-5-5 |
Anthropic | 22 set 2026 | 1M | $4,00 | $20,00 | Il consigliato da Anthropic per la maggior parte dei lavori: coding agentico e knowledge work. Batch a metà prezzo. Fonte Ne ho parlato qui |
GPT-6 Luna
gpt-6-luna |
OpenAI | 22 set 2026 | 1,05M | $0,10 | $0,50 | Il più economico di OpenAI, per lavori ad alto volume: riassunti, estrazione di dati, risposte rapide. Contesto lungo: $0,20 / $0,75. Fonte Ne ho parlato qui |
GPT-6 Sol
gpt-6-sol |
OpenAI | 22 set 2026 | 1,05M | $2,00 | $10,00 | Il cavallo da lavoro per coding e agenti, a circa metà prezzo di GPT-5.6 Sol. Contesto lungo: $4 / $15. Batch a metà prezzo. Fonte Ne ho parlato qui |
Gemini 3.8 Flash TTS
gemini-3.8-flash-tts |
22 set 2026 | 8K | $0,50 | $9,00 | Sintesi vocale. È la voce che legge la versione audio della rassegna di questo blog. Input testo, output audio. Fino al 31/12/2026, poi $1 / $18. Fonte Ne ho parlato qui | |
MiMo-V2.6-Pro
mimo-v2.6-pro |
Xiaomi | 22 set 2026 | 1M | $0,435 | $0,87 | Uno dei modelli di fascia alta più economici. Esiste anche la versione Flash a $0,14 / $0,28. Fonte |
Grok 4.7
grok-4.7 |
xAI | 21 set 2026 | 500K | $2,00 | $6,00 | Il modello più capace di xAI per coding e knowledge work, su un modello base più grande. Prompt da 200K token in su: $4 / $12. Fonte |
Qwen3.8-Omni-Flash
qwen3.8-omni-flash |
Alibaba | 18 set 2026 | 1M | $0,15 | $0,47 | Omni-modale ed economico: testo, immagini, audio e video. Fonte |
DeepSeek V4.1 Flash
pesi aperti deepseek-flash |
DeepSeek | 10 set 2026 | 1M | $0,15 | $0,60 | Multimodale e con pesi aperti (licenza MIT). Tariffa fuori picco. Nelle ore di punta (feriali 01-04 e 06-10 UTC) $0,30 / $1,20. Fonte |
GPT-6 Astra
gpt-6-astra |
OpenAI | 3 set 2026 | 1,05M | $10,00 | $50,00 | Il modello di punta di OpenAI, per i lavori più difficili e l'uso autonomo di computer e browser. Contesto lungo: $20 / $75. Fonte Ne ho parlato qui |
Gemini 3.8 Flash
gemini-3.8-flash |
2 set 2026 | 1M | $0,75 | $3,75 | Pensato per software engineering di lunga durata e agenti autonomi. Prezzo di lancio fino al 31/12/2026, poi $1,50 / $7,50. Fonte Ne ho parlato qui | |
Muse Spark 1.3
muse-spark-1.3 |
Meta | 2 set 2026 | 1M | $1,25 | $4,25 | Multimodale, per agenti e coding. Solo via API, niente pesi aperti. C'è anche un livello Contributor a $0,10 / $0,20. Fonte |
Claude Fable 5.1
claude-fable-5-1 |
Anthropic | 1 set 2026 | 1M | $10,00 | $50,00 | Il più potente di Anthropic, per ragionamento impegnativo e agenti che lavorano a lungo. Mythos 5.1 è la variante ad accesso ristretto. Lettura dalla cache al 2,5% del prezzo di input. Fonte Ne ho parlato qui |
GLM-5.3
pesi aperti glm-5.3 |
Z.ai | 28 ago 2026 | 1M | $1,40 | $4,40 | Pesi aperti, 753 miliardi di parametri, orientato al coding. Fonte |
DeepSeek V4 Pro
deepseek-v4-pro |
DeepSeek | 13 ago 2026 | 1M | $0,66 | $1,98 | Il modello più grande di DeepSeek, versione 0813. Tariffa fuori picco. Nelle ore di punta $1,32 / $3,96. Fonte |
Gemini 3.7 Flash
legacy gemini-3.7-flash |
13 ago 2026 | n.d. | $0,75 | $3,75 | Generazione precedente, stesso prezzo di Gemini 3.8 Flash. Fino al 31/12/2026, poi $1,50 / $7,50. Fonte | |
Qwen3.8-Max
qwen3.8-max |
Alibaba | 3 ago 2026 | 1M | $2,00 | $6,00 | Il flagship di Alibaba: MoE da 2,4 mila miliardi di parametri, legge testo, immagini e video. Aggiornato il 2 settembre (versione 0902). Fonte |
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite |
21 lug 2026 | n.d. | $0,30 | $2,50 | La versione leggera ed economica della famiglia Gemini. Fonte | |
Kimi K3
pesi aperti kimi-k3 |
Moonshot AI | 16 lug 2026 | 1M | $3,00 | $15,00 | Il modello a pesi aperti più grande mai pubblicato: 2,8 mila miliardi di parametri. Pesi scaricabili dal 27 luglio. Fonte |
GPT-5.6 Luna
legacy gpt-5.6-luna |
OpenAI | 9 lug 2026 | n.d. | $0,20 | $1,20 | Generazione precedente, ancora disponibile. Sostituito da GPT-6 Luna. Fonte |
GPT-5.6 Sol
legacy gpt-5.6-sol |
OpenAI | 9 lug 2026 | n.d. | $4,00 | $20,00 | Generazione precedente, ancora disponibile. Sostituito da GPT-6 Sol. Fonte |
GPT-5.6 Terra
legacy gpt-5.6-terra |
OpenAI | 9 lug 2026 | n.d. | $2,00 | $12,00 | Generazione precedente, ancora disponibile. Fonte |
Claude Sonnet 5
claude-sonnet-5 |
Anthropic | 30 giu 2026 | 1M | $2,00 | $10,00 | Il miglior compromesso tra velocità e intelligenza della famiglia Claude. Sonnet 5.5 è annunciato per le prossime settimane. Fonte |
Gemini 3.5 Flash
legacy gemini-3.5-flash |
19 mag 2026 | n.d. | $1,50 | $9,00 | Generazione precedente, oggi costa più dei Flash successivi. Fonte | |
Gemini 3.1 Pro
anteprima gemini-3.1-pro-preview |
19 feb 2026 | 1M | $2,00 | $12,00 | Il Pro più recente di Google, ancora in anteprima. Prompt oltre 200K token: $4 / $18. Fonte | |
Mistral Large 3
pesi aperti mistral-large-3 |
Mistral | 2 dic 2025 | n.d. | $0,50 | $1,50 | Il modello generalista di Mistral, multimodale e con pesi aperti. L'alternativa europea. Fonte |
Claude Haiku 4.5
claude-haiku-4-5-20251001 |
Anthropic | 15 ott 2025 | 200K | $1,00 | $5,00 | Il più veloce ed economico di Anthropic. Haiku 5.5 è annunciato per le prossime settimane. Fonte |
Come leggere i prezzi dei modelli IA
- Input e output sono in dollari per milione di token, tariffa standard via API. Niente sconti batch né cache: quando ci sono soglie di contesto lungo, fasce orarie o prezzi di lancio con scadenza, li trovi nelle note.
- Contesto è quanto testo il modello legge in una singola richiesta. Un milione di token sono qualche centinaio di migliaia di parole, il numero esatto dipende dal tokenizer.
- Pesi aperti vuol dire che puoi scaricare il modello e farlo girare sui tuoi server, se hai l’hardware per farlo. Il prezzo in tabella è quello dell’API ufficiale.
- n.d. significa che il provider non pubblica il dato in modo chiaro. Preferisco lasciare il buco piuttosto che inventare un numero.
Un avviso: il prezzo per token non si confronta uno a uno tra provider diversi. I tokenizer contano le parole in modo diverso e i modelli che ragionano prima di rispondere consumano parecchi token di output in più. Per scegliere davvero conviene provare due o tre candidati sul proprio caso d’uso e guardare il costo per richiesta, non il listino.
Da dove prendo i dati
Dalle pagine prezzi e dalla documentazione ufficiale dei provider (Anthropic, OpenAI, Google e così via). Quando un provider non ha un listino pubblico leggibile uso OpenRouter, e lo vedi dal link “Fonte” della riga. Se trovi un errore scrivimi a hello@albertogaia.it e lo correggo.
Se ti servono i dati per un tuo progetto, li trovi anche in JSON su /wp-json/ag/v1/modelli, con licenza CC BY 4.0: usali pure, basta citare la fonte.
Vuoi sapere quando esce un modello nuovo? La rassegna arriva ogni mattina via newsletter, sul canale Telegram e sul canale WhatsApp.