AI: confronto, prezzi e classifiche

Quanto costa davvero un modello di intelligenza artificiale? Quale scegliere per scrivere, programmare o studiare? Qui trovi le classifiche costruite sui listini pubblici, aggiornate automaticamente.

Dati aggiornati al 2026-09-17 dalle fonti pubbliche OpenRouter e models.dev. Prezzi in dollari per milione di token, indicativi e senza IVA: verifica sempre sul sito del fornitore.

Le scelte della redazione

Miglior equilibrio

OpenAI: GPT-5.6 Luna

OpenAI

0,2 $ input · 1,2 $ output per milione di token · 1,1M token di contesto

Un milione di token di contesto, tool calling attivo e un prezzo da modello economico: è la scelta più sensata per la maggior parte dei lavori.

Il più economico

DeepSeek: DeepSeek V4 Flash 0423

DeepSeek

0,07 $ input · 0,14 $ output per milione di token · 1,0M token di contesto

Costa una frazione dei modelli di punta (0,07 $ di input e 0,14 $ di output per milione di token) con un contesto da oltre un milione di token.

Miglior gratuito

NVIDIA: Nemotron 3 Ultra (free)

nvidia

gratis input · gratis output per milione di token · 1M token di contesto

Un milione di token di contesto senza spendere nulla: perfetto per prova, studio e prototipi.

Per programmare

Anthropic: Claude Sonnet 5

Anthropic

2 $ input · 10 $ output per milione di token · 1M token di contesto

La famiglia usata da Claude Code: tool calling e ragionamento attivi, un milione di token di contesto. Prezzo medio-alto ma affidabile nel lavoro sul codice.

Ultima generazione

SpaceXAI: Grok 4.6

x-ai

2 $ input · 6 $ output per milione di token · 500k token di contesto

La versione più recente della famiglia Grok: 500mila token di contesto a 6 $ di output, con visione. Da provare se vuoi il modello appena uscito.

Testi lunghi e ragionamento

Anthropic: Claude Fable 5.1

anthropic

10 $ input · 50 $ output per milione di token · 1M token di contesto

La nuova generazione di Claude per i lavori più difficili: un milione di token di contesto, scrittura rifinita e ragionamento profondo. Fascia premium (10/50 $).

Contesto record

SpaceXAI: Grok 4.20

x-ai

1,25 $ input · 2,5 $ output per milione di token · 2M token di contesto

Due milioni di token di contesto a 2,50 $ di output: la generazione precedente resta imbattibile quando devi far digerire interi archivi a un modello.

Senza compromessi

OpenAI: GPT-6 Astra

OpenAI

10 $ input · 50 $ output per milione di token · 1,1M token di contesto

La fascia premium: 50 $ di output per milione di token. Da considerare solo quando la qualità conta più di ogni altra cosa.

Prezzo, contesto e capacità a colpo d'occhio

Due grafici per capire subito la scala: quanto costa un milione di token di risposta e quanto testo può leggere un modello in una volta sola.

Prezzo di output ($ per 1M token)

Contesto (token)

Classifica completa

Modello Fornitore Input $/1M Output $/1M Contesto TV

T = tool calling, V = visione (immagini in input). I prezzi sono per milione di token e non includono IVA. Le varianti "batch" costano meno ma non sono per uso interattivo.

Le AI, una per una

Schede dedicate a ogni famiglia: cosa sa fare, quanto costa via API e a chi serve.

ChatGPT · Claude · Gemini · DeepSeek · Grok · Qwen · Mistral

Quale strumento usare per programmare

Ai modelli si affiancano gli agenti da terminale e le estensioni che scrivono codice al posto tuo: Claude Code, Codex CLI, Gemini CLI, OpenCode e altri. Li abbiamo confrontati uno per uno, con prezzi e a chi servono.

Domande frequenti

I prezzi che vedo sono affidabili? Sono presi dai listini pubblici dei cataloghi (OpenRouter e models.dev) e aggiornati automaticamente. Possono variare senza preavviso: prima di un progetto importante controlla sul sito del fornitore.

Perché non vedo un punteggio di "qualità"? Non esiste una classifica oggettiva: la qualità dipende dal compito. Per questo mostriamo i dati certi (prezzo, contesto, capacità) e una selezione ragionata, non un numero inventato.

Che differenza c'è tra contesto e memoria? Il contesto è quanto testo il modello può leggere in una singola richiesta. La memoria tra una chat e l'altra dipende dall'app che usi, non dal modello.

Gratis vuol dire senza limiti? No: i modelli gratuiti hanno spesso code, limiti di velocità o disponibilità variabile. Vanno benissimo per provare, studiare e fare prototipi.