Qualità e prestazioni delle AI
Non solo prezzo: qui trovi quanto un modello è "bravo" (Intelligence Index), quanto costa completare un compito tipico, quanto è veloce e quanto ci mette a rispondere.
Fonti: Artificial Analysis (indice di intelligenza, costo per compito, velocità, latenza) e OpenRouter (prezzi token). Aggiornamento automatico settimanale: dati al 2026-09-17; benchmark al 2026-09-17.
Qualità contro costo: il grafico che conta davvero
Ogni punto è un modello: più in alto è l'indice di qualità, più in basso (e a sinistra) costa. Scala del costo logaritmica: muoversi di poco in alto può costare 10 volte tanto.
Classifica qualità e prestazioni
| Modello | Fornitore | Qualità | Costo/compito | Velocità | Latenza | Output $/1M | Contesto |
|---|
Qualità: Artificial Analysis Intelligence Index (0–100, compiti di ragionamento, matematica, coding e scienza). Costo/compito: costo medio per completare un set di compiti standard. Velocità: token di output al secondo. Latenza: secondi prima del primo pezzo di risposta (nei modelli "pensanti" include il ragionamento).
Come leggere questi numeri
- L'indice non è tutto: misura compiti standardizzati, non il tuo lavoro. Un modello con indice 45 può batterne uno con 50 sul tuo caso specifico.
- Il costo per compito è più onesto del prezzo per token: dice quanto ti costa completare un lavoro, ragionamenti inclusi.
- Velocità e latenza contano nell'uso interattivo e negli agenti: 200 token/s si sentono, 30 no.
- Sempre sul tuo caso: le stesse metriche non dicono nulla su italiano, stile e dominio. La prova finale si fa con i tuoi dati.
Spiegazione completa in Come si leggono i benchmark delle AI · metodo e fonti in Come valutiamo le AI · prezzi in Prezzi a confronto.