Confronto tra modelli di IA nel 2026: prezzi delle API e quale usare in azienda

Consultoría EHERO

12 minutos de lectura

Non esiste un «miglior modello di IA»: esistono compiti, e quasi sempre li risolve un modello più economico di quanto si pensi. Questo confronto tra modelli di IA raccoglie i prezzi ufficiali dell’API di Claude, GPT-6, Gemini, DeepSeek e Mistral al 3 ottobre 2026 e dice quale si adatta a ogni lavoro di un’azienda.

È una pagina viva. La aggiorniamo ogni volta che esce un modello o cambia un prezzo, e alla fine annotiamo cosa è cambiato e quando.

Prezzi verificati il 3 ottobre 2026

Modelli più recenti che si possono usare: Claude Opus 5.5 e Fable 5.1 (Anthropic), GPT-6 Astra e GPT-6.1 Sol (OpenAI), Gemini 3.8 Flash (Google).

E Gemini 4? Esiste, ma non si può ancora usare. Google ha presentato Gemini 4 Argon il 30 settembre 2026 e per il momento lo usa solo un gruppo di difensori della cybersicurezza.

La prossima cosa che cambia: l’apertura di Gemini 4 Argon, senza data annunciata, e Gemini 3.8 Flash, che raddoppia il suo prezzo il 1º gennaio 2027.

La risposta breve

I cinque fornitori vendono la stessa cosa in tre livelli, e la differenza di prezzo tra il livello più basso e quello più alto è di cento volte.

  • Livello piccolo (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): per leggere, classificare ed estrarre dati in quantità. È dove vive la maggior parte dell’automazione di un’azienda.
  • Livello medio (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): per scrivere, riassumere e rispondere con criterio. Claude Sonnet 5.5 e GPT-6.1 Sol costano uguale.
  • Livello alto (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): per programmare, per lavori con molti passaggi consecutivi e per ciò che il livello medio non risolve.

La regola che usiamo: si parte dal piccolo, si prova con casi reali e si sale di livello solo se fallisce. Tornare indietro quasi mai si fa, quindi conviene non iniziare dall’alto.

Prezzi dell’API, modello per modello

Prezzi di listino in dollari per ogni milione di token, così come li pubblica ciascun fornitore. Non includono le tasse.

Fornitore Modello Input Output Come lo presenta il produttore
Anthropic Claude Fable 5.1 10 $ 50 $ Ragionamento impegnativo e lavoro autonomo di lungo corso
Claude Opus 5.5 4 $ 20 $ Il punto di partenza che Anthropic raccomanda per la maggior parte dei lavori
Claude Sonnet 5.5 2 $ 10 $ La migliore combinazione di velocità e intelligenza
Claude Haiku 4.5 1 $ 5 $ Il più veloce della famiglia
OpenAI GPT-6 Astra 10 $ 50 $ Il modello di punta, per ragionamento complesso e programmazione
GPT-6.1 Sol 2 $ 10 $ Equilibrio tra intelligenza e costo
GPT-6 Luna 0,10 $ 0,50 $ Grande volume con costo contenuto
Google Gemini 3.1 Pro (versione preliminare) 2 $ 12 $ Comprensione di testo, immagine e video, e agenti. Non è ancora una versione stabile
Gemini 3.8 Flash 0,75 $ 3,75 $ Il Flash più capace. Prezzo fino al 31-12-2026; dal 1-1-2027, 1,50 $ e 7,50 $
Gemini 3.5 Flash-Lite 0,30 $ 2,50 $ Grande volume, traduzione e semplice elaborazione dei dati
DeepSeek DeepSeek V4 Pro 1,32 $ 3,96 $ Non supporta immagini. Fuori dalle ore di punta costa la metà
DeepSeek Flash (V4.1) 0,30 $ 1,20 $ Supporta immagini. Fuori dalle ore di punta costa la metà
Mistral Mistral Large 0,50 $ 1,50 $ Il modello grande del fornitore europeo

Le fonti sono le pagine dei prezzi di ciascun fornitore, collegate in fondo. OpenAI mantiene inoltre GPT-6 Sol allo stesso prezzo di GPT-6.1 Sol; in un nuovo progetto si sceglie il 6.1. Gemini 4 Argon non è nella tabella perché non si può ancora usare.

Gemini 4 Argon: ciò che si sa

Gemini 4 esiste. Google lo ha presentato il 30 settembre 2026 con il nome di Gemini 4 Argon, come suo nuovo modello di frontiera, ma al 3 ottobre non si può usare dall’API aperta né compare nell’elenco dei modelli di Gemini.

  • Chi lo ha. Un gruppo di difensori della cybersicurezza di fiducia, all’interno del programma Fairwind di Google, oltre ai team interni della stessa Google.
  • Quando si apre. Senza data. Google dice che lo aprirà il prima possibile, iniziando dai clienti paganti dell’API e dagli abbonati a Google AI Ultra, quando avrà finito di testare le sue salvaguardie.
  • Quanto costerà. Uscirà con un prezzo di lancio di 2 $ per milione di token di input e 10 $ di output, con l’input in cache il 95 % più economico. Alla fine di quel periodo passerà a 4 $ e 20 $.
  • Per cosa lo presenta Google. Per compiti lunghi e a più passaggi: programmazione, lavoro d’ufficio specializzato come quello legale o finanziario, e difesa contro i cyberattacchi. Può generare fino a un milione di token di output in una sola risposta.

Per un’azienda che automatizza oggi non cambia nulla: si costruisce con i modelli che si possono già usare e si lascia pronto il passaggio a un altro modello modificando un’impostazione. Quando Argon si aprirà, lo aggiungeremo alla tabella con i suoi prezzi.

Come si legge un prezzo per token

L’API non si paga al mese né per utente: si paga per testo elaborato, misurato in token. Un token è un pezzo di parola. Come riferimento, Anthropic calcola che un milione di token sono circa 555.000 parole nei suoi modelli attuali.

  • Input è ciò che invii: le istruzioni e il documento.
  • Output è ciò che risponde. Costa tra tre e otto volte più dell’input, a seconda del modello.
  • Il ragionamento conta come output. I modelli che pensano prima di rispondere fatturano quel ragionamento anche se non lo vedi. Google lo dice nella sua tariffa: il prezzo di output include i token di ragionamento.
  • Ogni fornitore conta i token a modo suo. Lo stesso testo non dà lo stesso numero in tutti. Anthropic avverte che i suoi modelli recenti generano circa il 30 % di token in più rispetto ai precedenti con lo stesso testo.

Per questo il prezzo per milione serve a ordinare, non a preventivare al centesimo. Il costo reale emerge provando con i tuoi documenti.

Quanto costa nella pratica

Due lavori tipici, calcolati con i prezzi della tabella. Le ipotesi sono nostre e sono visibili così puoi sostituirle con le tue:

  • Leggere 1.000 fatture e restituirne i dati: 2.000 token di input e 300 di output per fattura, con il testo già estratto dal PDF.
  • Redigere 1.000 schede prodotto: 800 token di input e 600 di output per scheda.
Modello Leggere 1.000 fatture Redigere 1.000 schede
GPT-6 Luna 0,35 $ 0,38 $
DeepSeek Flash (in ora di punta; la metà fuori da essa) 0,96 $ 0,96 $
Gemini 3.5 Flash-Lite 1,35 $ 1,74 $
Mistral Large 1,45 $ 1,30 $
Gemini 3.8 Flash 2,63 $ 2,85 $
Claude Haiku 4.5 3,50 $ 3,80 $
Claude Sonnet 5.5 7,00 $ 7,60 $
GPT-6.1 Sol 7,00 $ 7,60 $
Gemini 3.1 Pro 7,60 $ 8,80 $
Claude Opus 5.5 14,00 $ 15,20 $
GPT-6 Astra 35,00 $ 38,00 $
Claude Fable 5.1 35,00 $ 38,00 $

È un calcolo con prezzi di listino, non una misurazione. Nei modelli che ragionano, l’output reale è maggiore della risposta visibile e il conto sale. Se la fattura entra come immagine e non come testo, anche.

La lettura che regge davvero: lo stesso lavoro costa centesimi o decine di dollari a seconda del livello. La scelta del modello pesa cento volte più di qualsiasi sconto.

Quale modello usare per ogni compito

Questo è il punto di partenza che usiamo noi quando impostiamo un processo. Non è una classificazione di qualità: è da dove si comincia a provare.

Compito Inizia da Perché
Estrarre dati da documenti (fatture, DDT, ordini) Livello piccolo È molto volume e la risposta si verifica con regole: se la base più l’IVA non dà il totale, si capisce
Classificare e smistare (email, ticket, recensioni) Livello piccolo L’output è un’etichetta: pochi token e poco margine per inventare
Tradurre catalogo Livello piccolo o medio Il piccolo va bene per attributi e testi brevi; il medio, per descrizioni che devono vendere
Scrivere (schede, risposte ai clienti, riassunti) Livello medio Qui si nota il tono, e una persona lo leggerà
Lavori a più passaggi (consultare, decidere, scrivere in un altro programma) Livello medio o alto Un errore in un passaggio si trascina nei successivi; conviene pagare per meno errori
Programmare Livello alto È per questo che Anthropic e OpenAI presentano i loro modelli grandi

La prova che decide è sempre la stessa: venti casi reali tuoi, con la risposta corretta già nota, passati dal modello piccolo. Se indovina quelli che deve indovinare, non c’è nient’altro da comprare.

Quattro modi per pagare meno

  1. Elaborazione in batch. Se il lavoro non ha fretta, Anthropic, OpenAI, Google e Mistral lo fanno pagare la metà inviandolo in batch. Un lotto notturno di fatture o schede è il caso da manuale.
  2. Cache delle istruzioni. Quando tutte le richieste ripetono le stesse istruzioni lunghe, quella parte viene fatturata a prezzo molto ridotto dalla seconda volta in poi. In Claude, a un decimo del prezzo iniziale o meno.
  3. Prima il modello piccolo. Lascia che il piccolo risolva le cose facili e passi al medio solo ciò che non ha chiaro. Di solito è lo sconto più grande di tutti.
  4. Output brevi. L’output è la parte costosa. Chiedere i dati in una struttura fissa e senza spiegazioni riduce i costi e, in più, ne facilita la verifica.

Ciò che il prezzo non dice

  • Cosa fanno con i tuoi dati. Gemini ha un livello gratuito, ma Google indica che in esso il contenuto viene usato per migliorare i suoi prodotti; in quello a pagamento, no. Con dati di clienti o del personale, il livello gratuito non è un’opzione. Prima di inviare dati personali a qualsiasi fornitore bisogna controllare il suo contratto di nomina a responsabile del trattamento e dove vengono elaborati; DeepSeek è un’azienda cinese e Mistral, francese.
  • Preliminare non è stabile. Gemini 3.1 Pro è ancora in versione preliminare. Un modello così può cambiare o essere ritirato con poco preavviso, e non è una buona base per un processo che deve funzionare da solo.
  • I documenti molto lunghi costano di più. OpenAI raddoppia il prezzo iniziale nel contesto lungo, e Gemini 3.1 Pro lo raddoppia a partire da 200.000 token.
  • I prezzi si muovono. Gemini 3.8 Flash raddoppia il suo prezzo il 1º gennaio 2027, e DeepSeek fa pagare il doppio nelle sue ore di punta, che cadono nella notte e nella mattina della Spagna.
  • Il modello non è il progetto. Il conto del fornitore di solito è la parte piccola. Ciò che costa è collegarlo al tuo programma, gestire i casi rari e decidere cosa controlla una persona.

Quale processo vuoi smettere di fare a mano?

Realizziamo automazioni per negozi online e PMI: misuriamo quanto costa oggi il processo, proviamo con i vostri documenti qual è il modello più economico che lo risolve e lo lasciamo funzionante, con una persona che controlla dove serve. L’IA funziona con la vostra chiave API: il consumo viene fatturato dal fornitore sul vostro account, senza intermediari né ricarichi.

Calcolare quanto vi costa farlo a mano · Vedere un caso: fatture dei fornitori

Domande frequenti

Quanto costa l’API di ChatGPT?

Dipende dal modello. Al 3 ottobre 2026, GPT-6 Luna costa 0,10 $ per milione di token in ingresso e 0,50 $ in uscita; GPT-6.1 Sol, 2 $ e 10 $; GPT-6 Astra, 10 $ e 50 $. Si paga a consumo, senza quota fissa.

Quanto costa l’API di Claude?

Claude Haiku 4.5 costa 1 $ per milione di token in ingresso e 5 $ in uscita; Sonnet 5.5, 2 $ e 10 $; Opus 5.5, 4 $ e 20 $; Fable 5.1, 10 $ e 50 $.

Quanto costa l’API di Gemini?

Gemini 3.5 Flash-Lite costa 0,30 $ in ingresso e 2,50 $ in uscita per milione di token. Gemini 3.8 Flash, 0,75 $ e 3,75 $ fino al 31 dicembre 2026, e il doppio da gennaio. Esiste un livello gratuito con limiti, nel quale Google usa il contenuto per migliorare i suoi prodotti.

Esiste Gemini 4?

Sì. Google ha presentato Gemini 4 Argon il 30 settembre 2026, ma al 3 ottobre non è ancora disponibile: lo usa solo un gruppo di difensori della cybersicurezza e non compare nell’API di Gemini. Sarà aperto prima ai clienti a pagamento dell’API e agli abbonati a Google AI Ultra, senza data. La cosa più recente che si può usare oggi è Gemini 3.8 Flash. Gemma 4 è un’altra cosa: la famiglia di modelli aperti di Google.

Quanto costerà Gemini 4 Argon?

Google ha annunciato un prezzo di lancio di 2 $ per milione di token in ingresso e 10 $ in uscita, che passerà a 4 $ e 20 $ quando finirà quel periodo. Non ha detto quanto durerà.

È la stessa cosa un abbonamento a ChatGPT o a Claude e l’API?

No. L’abbonamento serve a una persona per usare la chat, con una quota fissa. L’API serve a un programma per chiamare il modello, e si paga per token. Per automatizzare un processo serve l’API.

Qual è il modello di IA migliore per un’azienda?

Il più economico che risolva il tuo compito con i tuoi documenti. Per estrarre dati e classificare di solito basta il livello piccolo; per scrivere, il medio; quello alto si riserva alla programmazione e ai lavori a più passaggi.

I prezzi includono l’IVA?

No. Sono prezzi di listino in dollari e non includono le imposte. Quella applicata dipende dal fornitore e da dove si trova la tua azienda.

Ogni quanto cambiano i modelli?

Più volte all’anno per ciascun fornitore. Per questo conviene che il processo non dipenda da un modello specifico: cambiarlo deve voler dire modificare un’impostazione, non rifare il lavoro.

Registro delle modifiche

  • 3-10-2026. Prima versione, con i prezzi di listino di Anthropic, OpenAI, Google, DeepSeek e Mistral verificati quel giorno, e quanto Google ha annunciato di Gemini 4 Argon, che ancora non si può acquistare.

Conclusione

Scegliere il modello significa scegliere il livello, e il livello lo decide il compito. Parti dal piccolo, prova con i tuoi casi e sali solo se fallisce. Il resto del confronto cambia ogni pochi mesi, e per questo lo manteniamo aggiornato qui.

I prezzi sono quelli di listino pubblicati da ciascun fornitore alla data indicata e possono cambiare. Gli esempi di costo sono calcoli orientativi, non un preventivo.

Link utili

Vuoi rimanere aggiornato su tutte le novità?

Seguici sui nostri social network per non perderti nulla!

Iscriviti alla nostra newsletter

Ricevi offerte esclusive e novità.

Ottieni il 10% di sconto sul tuo primo ordine!