Modelli IA: prezzi API, contesto e date di rilascio

Ogni settimana esce un modello nuovo e la domanda è sempre la stessa: quanto costa, quanto testo riesce a leggere in una volta, conviene rispetto a quello che uso già? Qui tengo la lista aggiornata dei prezzi dei modelli IA che contano, con finestra di contesto e data di rilascio, presi dalle pagine ufficiali dei provider.

La tabella si aggiorna insieme alla Rassegna AI di ogni mattina: quando esce un modello o cambia un listino, lo trovi qui. Clicca sulle intestazioni per ordinare le colonne, per esempio per trovare il modello più economico, e usa i filtri per restringere la lista.

Aggiornato il · 21 modelli in listino · prezzi API in dollari per milione di token

Modello Provider Rilascio Contesto Input Output Note
Claude Opus 5.5 claude-opus-5-5 Anthropic 22 set 2026 1M $4,00 $20,00 Il consigliato da Anthropic per la maggior parte dei lavori: coding agentico e knowledge work. Batch a metà prezzo. Fonte Ne ho parlato qui
GPT-6 Luna gpt-6-luna OpenAI 22 set 2026 1,05M $0,10 $0,50 Il più economico di OpenAI, per lavori ad alto volume: riassunti, estrazione di dati, risposte rapide. Contesto lungo: $0,20 / $0,75. Fonte Ne ho parlato qui
GPT-6 Sol gpt-6-sol OpenAI 22 set 2026 1,05M $2,00 $10,00 Il cavallo da lavoro per coding e agenti, a circa metà prezzo di GPT-5.6 Sol. Contesto lungo: $4 / $15. Batch a metà prezzo. Fonte Ne ho parlato qui
Gemini 3.8 Flash TTS gemini-3.8-flash-tts Google 22 set 2026 8K $0,50 $9,00 Sintesi vocale. È la voce che legge la versione audio della rassegna di questo blog. Input testo, output audio. Fino al 31/12/2026, poi $1 / $18. Fonte Ne ho parlato qui
MiMo-V2.6-Pro mimo-v2.6-pro Xiaomi 22 set 2026 1M $0,435 $0,87 Uno dei modelli di fascia alta più economici. Esiste anche la versione Flash a $0,14 / $0,28. Fonte
Grok 4.7 grok-4.7 xAI 21 set 2026 500K $2,00 $6,00 Il modello più capace di xAI per coding e knowledge work, su un modello base più grande. Prompt da 200K token in su: $4 / $12. Fonte
Qwen3.8-Omni-Flash qwen3.8-omni-flash Alibaba 18 set 2026 1M $0,15 $0,47 Omni-modale ed economico: testo, immagini, audio e video. Fonte
DeepSeek V4.1 Flash pesi aperti deepseek-flash DeepSeek 10 set 2026 1M $0,15 $0,60 Multimodale e con pesi aperti (licenza MIT). Tariffa fuori picco. Nelle ore di punta (feriali 01-04 e 06-10 UTC) $0,30 / $1,20. Fonte
GPT-6 Astra gpt-6-astra OpenAI 3 set 2026 1,05M $10,00 $50,00 Il modello di punta di OpenAI, per i lavori più difficili e l'uso autonomo di computer e browser. Contesto lungo: $20 / $75. Fonte Ne ho parlato qui
Gemini 3.8 Flash gemini-3.8-flash Google 2 set 2026 1M $0,75 $3,75 Pensato per software engineering di lunga durata e agenti autonomi. Prezzo di lancio fino al 31/12/2026, poi $1,50 / $7,50. Fonte Ne ho parlato qui
Muse Spark 1.3 muse-spark-1.3 Meta 2 set 2026 1M $1,25 $4,25 Multimodale, per agenti e coding. Solo via API, niente pesi aperti. C'è anche un livello Contributor a $0,10 / $0,20. Fonte
Claude Fable 5.1 claude-fable-5-1 Anthropic 1 set 2026 1M $10,00 $50,00 Il più potente di Anthropic, per ragionamento impegnativo e agenti che lavorano a lungo. Mythos 5.1 è la variante ad accesso ristretto. Lettura dalla cache al 2,5% del prezzo di input. Fonte Ne ho parlato qui
GLM-5.3 pesi aperti glm-5.3 Z.ai 28 ago 2026 1M $1,40 $4,40 Pesi aperti, 753 miliardi di parametri, orientato al coding. Fonte
DeepSeek V4 Pro deepseek-v4-pro DeepSeek 13 ago 2026 1M $0,66 $1,98 Il modello più grande di DeepSeek, versione 0813. Tariffa fuori picco. Nelle ore di punta $1,32 / $3,96. Fonte
Qwen3.8-Max qwen3.8-max Alibaba 3 ago 2026 1M $2,00 $6,00 Il flagship di Alibaba: MoE da 2,4 mila miliardi di parametri, legge testo, immagini e video. Aggiornato il 2 settembre (versione 0902). Fonte
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite Google 21 lug 2026 n.d. $0,30 $2,50 La versione leggera ed economica della famiglia Gemini. Fonte
Kimi K3 pesi aperti kimi-k3 Moonshot AI 16 lug 2026 1M $3,00 $15,00 Il modello a pesi aperti più grande mai pubblicato: 2,8 mila miliardi di parametri. Pesi scaricabili dal 27 luglio. Fonte
Claude Sonnet 5 claude-sonnet-5 Anthropic 30 giu 2026 1M $2,00 $10,00 Il miglior compromesso tra velocità e intelligenza della famiglia Claude. Sonnet 5.5 è annunciato per le prossime settimane. Fonte
Gemini 3.1 Pro anteprima gemini-3.1-pro-preview Google 19 feb 2026 1M $2,00 $12,00 Il Pro più recente di Google, ancora in anteprima. Prompt oltre 200K token: $4 / $18. Fonte
Mistral Large 3 pesi aperti mistral-large-3 Mistral 2 dic 2025 n.d. $0,50 $1,50 Il modello generalista di Mistral, multimodale e con pesi aperti. L'alternativa europea. Fonte
Claude Haiku 4.5 claude-haiku-4-5-20251001 Anthropic 15 ott 2025 200K $1,00 $5,00 Il più veloce ed economico di Anthropic. Haiku 5.5 è annunciato per le prossime settimane. Fonte

Come leggere i prezzi dei modelli IA

  • Input e output sono in dollari per milione di token, tariffa standard via API. Niente sconti batch né cache: quando ci sono soglie di contesto lungo, fasce orarie o prezzi di lancio con scadenza, li trovi nelle note.
  • Contesto è quanto testo il modello legge in una singola richiesta. Un milione di token sono qualche centinaio di migliaia di parole, il numero esatto dipende dal tokenizer.
  • Pesi aperti vuol dire che puoi scaricare il modello e farlo girare sui tuoi server, se hai l’hardware per farlo. Il prezzo in tabella è quello dell’API ufficiale.
  • n.d. significa che il provider non pubblica il dato in modo chiaro. Preferisco lasciare il buco piuttosto che inventare un numero.

Un avviso: il prezzo per token non si confronta uno a uno tra provider diversi. I tokenizer contano le parole in modo diverso e i modelli che ragionano prima di rispondere consumano parecchi token di output in più. Per scegliere davvero conviene provare due o tre candidati sul proprio caso d’uso e guardare il costo per richiesta, non il listino.

Da dove prendo i dati

Dalle pagine prezzi e dalla documentazione ufficiale dei provider (Anthropic, OpenAI, Google e così via). Quando un provider non ha un listino pubblico leggibile uso OpenRouter, e lo vedi dal link “Fonte” della riga. Se trovi un errore scrivimi a hello@albertogaia.it e lo correggo.

Se ti servono i dati per un tuo progetto, li trovi anche in JSON su /wp-json/ag/v1/modelli, con licenza CC BY 4.0: usali pure, basta citare la fonte.

Vuoi sapere quando esce un modello nuovo? La rassegna arriva ogni mattina via newsletter, sul canale Telegram e sul canale WhatsApp.