{"id":17814,"date":"2026-10-03T01:11:42","date_gmt":"2026-10-02T23:11:42","guid":{"rendered":"https:\/\/consultoriaehero.com\/?p=17814"},"modified":"2026-10-03T01:23:47","modified_gmt":"2026-10-02T23:23:47","slug":"confronto-modelli-ia","status":"publish","type":"post","link":"https:\/\/consultoriaehero.com\/it\/confronto-modelli-ia\/","title":{"rendered":"Confronto tra modelli di IA nel 2026: prezzi delle API e quale usare in azienda"},"content":{"rendered":"<p>Non esiste un \u00abmiglior modello di IA\u00bb: esistono compiti, e quasi sempre li risolve un modello pi\u00f9 economico di quanto si pensi. Questo <strong>confronto tra modelli di IA<\/strong> raccoglie i prezzi ufficiali dell\u2019API di Claude, GPT-6, Gemini, DeepSeek e Mistral al 3 ottobre 2026 e dice quale si adatta a ogni lavoro di un\u2019azienda.<\/p>\n<p>\u00c8 una pagina viva. La aggiorniamo ogni volta che esce un modello o cambia un prezzo, e alla fine annotiamo cosa \u00e8 cambiato e quando.<\/p>\n<div class=\"wp-block-group has-background\" style=\"background-color:#f8fafc;padding:22px 26px;border-radius:12px;border:1px solid #cbd5e1;margin:1.8em 0\">\n<p style=\"margin:0 0 .7em\"><strong>Prezzi verificati il 3 ottobre 2026<\/strong><\/p>\n<p style=\"margin:0 0 .4em\">Modelli pi\u00f9 recenti che si possono usare: <strong>Claude Opus 5.5<\/strong> e <strong>Fable 5.1<\/strong> (Anthropic), <strong>GPT-6 Astra<\/strong> e <strong>GPT-6.1 Sol<\/strong> (OpenAI), <strong>Gemini 3.8 Flash<\/strong> (Google).<\/p>\n<p style=\"margin:0 0 .4em\">E Gemini 4? <strong>Esiste, ma non si pu\u00f2 ancora usare.<\/strong> Google ha presentato Gemini 4 Argon il 30 settembre 2026 e per il momento lo usa solo un gruppo di difensori della cybersicurezza.<\/p>\n<p style=\"margin:0\">La prossima cosa che cambia: l\u2019apertura di Gemini 4 Argon, senza data annunciata, e Gemini 3.8 Flash, che raddoppia il suo prezzo il 1\u00ba gennaio 2027.<\/p>\n<\/div>\n<nav class=\"w2g-toc\"><strong>In questa pagina<\/strong><\/p>\n<ol>\n<li><a href=\"#corta\">La risposta breve<\/a><\/li>\n<li><a href=\"#precios\">Prezzi dell\u2019API, modello per modello<\/a><\/li>\n<li><a href=\"#gemini-4\">Gemini 4 Argon: ci\u00f2 che si sa<\/a><\/li>\n<li><a href=\"#tokens\">Come si legge un prezzo per token<\/a><\/li>\n<li><a href=\"#ejemplos\">Quanto costa nella pratica<\/a><\/li>\n<li><a href=\"#tareas\">Quale modello usare per ogni compito<\/a><\/li>\n<li><a href=\"#ahorrar\">Quattro modi per pagare meno<\/a><\/li>\n<li><a href=\"#letra\">Ci\u00f2 che il prezzo non dice<\/a><\/li>\n<li><a href=\"#faq\">Domande frequenti<\/a><\/li>\n<li><a href=\"#cambios\">Registro delle modifiche<\/a><\/li>\n<\/ol>\n<\/nav>\n<h2 id=\"corta\">La risposta breve<\/h2>\n<p>I cinque fornitori vendono la stessa cosa in tre livelli, e la differenza di prezzo tra il livello pi\u00f9 basso e quello pi\u00f9 alto \u00e8 di cento volte.<\/p>\n<ul>\n<li><strong>Livello piccolo<\/strong> (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): per leggere, classificare ed estrarre dati in quantit\u00e0. \u00c8 dove vive la maggior parte dell\u2019automazione di un\u2019azienda.<\/li>\n<li><strong>Livello medio<\/strong> (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): per scrivere, riassumere e rispondere con criterio. Claude Sonnet 5.5 e GPT-6.1 Sol costano uguale.<\/li>\n<li><strong>Livello alto<\/strong> (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): per programmare, per lavori con molti passaggi consecutivi e per ci\u00f2 che il livello medio non risolve.<\/li>\n<\/ul>\n<p>La regola che usiamo: si parte dal piccolo, si prova con casi reali e si sale di livello solo se fallisce. Tornare indietro quasi mai si fa, quindi conviene non iniziare dall\u2019alto.<\/p>\n<h2 id=\"precios\">Prezzi dell\u2019API, modello per modello<\/h2>\n<p>Prezzi di listino in dollari per ogni milione di token, cos\u00ec come li pubblica ciascun fornitore. Non includono le tasse.<\/p>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:640px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Fornitore<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Modello<\/th>\n<th style=\"padding:10px 12px;text-align:right;white-space:nowrap\">Input<\/th>\n<th style=\"padding:10px 12px;text-align:right;white-space:nowrap\">Output<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Come lo presenta il produttore<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"4\"><strong>Anthropic<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Claude Fable 5.1<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Ragionamento impegnativo e lavoro autonomo di lungo corso<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Claude Opus 5.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">4&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">20&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Il punto di partenza che Anthropic raccomanda per la maggior parte dei lavori<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Claude Sonnet 5.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">La migliore combinazione di velocit\u00e0 e intelligenza<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Claude Haiku 4.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">5&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Il pi\u00f9 veloce della famiglia<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"3\"><strong>OpenAI<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>GPT-6 Astra<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Il modello di punta, per ragionamento complesso e programmazione<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>GPT-6.1 Sol<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Equilibrio tra intelligenza e costo<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>GPT-6 Luna<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Grande volume con costo contenuto<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\" rowspan=\"3\"><strong>Google<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Gemini 3.1 Pro (versione preliminare)<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">12&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Comprensione di testo, immagine e video, e agenti. Non \u00e8 ancora una versione stabile<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Gemini 3.8 Flash<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,75&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,75&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Il Flash pi\u00f9 capace. Prezzo fino al 31-12-2026; dal 1-1-2027, 1,50&nbsp;$ e 7,50&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Gemini 3.5 Flash-Lite<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,30&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Grande volume, traduzione e semplice elaborazione dei dati<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"2\"><strong>DeepSeek<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>DeepSeek V4 Pro<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,32&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,96&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Non supporta immagini. Fuori dalle ore di punta costa la met\u00e0<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>DeepSeek Flash (V4.1)<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,30&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,20&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Supporta immagini. Fuori dalle ore di punta costa la met\u00e0<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Mistral<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Mistral Large<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Il modello grande del fornitore europeo<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>Le fonti sono le pagine dei prezzi di ciascun fornitore, collegate in fondo. OpenAI mantiene inoltre GPT-6 Sol allo stesso prezzo di GPT-6.1 Sol; in un nuovo progetto si sceglie il 6.1. Gemini 4 Argon non \u00e8 nella tabella perch\u00e9 non si pu\u00f2 ancora usare.<\/p>\n<h2 id=\"gemini-4\">Gemini 4 Argon: ci\u00f2 che si sa<\/h2>\n<p>Gemini 4 esiste. Google lo ha presentato il 30 settembre 2026 con il nome di <strong>Gemini 4 Argon<\/strong>, come suo nuovo modello di frontiera, ma al 3 ottobre non si pu\u00f2 usare dall\u2019API aperta n\u00e9 compare nell\u2019elenco dei modelli di Gemini.<\/p>\n<ul>\n<li><strong>Chi lo ha.<\/strong> Un gruppo di difensori della cybersicurezza di fiducia, all\u2019interno del programma Fairwind di Google, oltre ai team interni della stessa Google.<\/li>\n<li><strong>Quando si apre.<\/strong> Senza data. Google dice che lo aprir\u00e0 il prima possibile, iniziando dai clienti paganti dell\u2019API e dagli abbonati a Google AI Ultra, quando avr\u00e0 finito di testare le sue salvaguardie.<\/li>\n<li><strong>Quanto coster\u00e0.<\/strong> Uscir\u00e0 con un prezzo di lancio di 2&nbsp;$ per milione di token di input e 10&nbsp;$ di output, con l\u2019input in cache il 95&nbsp;% pi\u00f9 economico. Alla fine di quel periodo passer\u00e0 a 4&nbsp;$ e 20&nbsp;$.<\/li>\n<li><strong>Per cosa lo presenta Google.<\/strong> Per compiti lunghi e a pi\u00f9 passaggi: programmazione, lavoro d\u2019ufficio specializzato come quello legale o finanziario, e difesa contro i cyberattacchi. Pu\u00f2 generare fino a un milione di token di output in una sola risposta.<\/li>\n<\/ul>\n<p>Per un\u2019azienda che automatizza oggi non cambia nulla: si costruisce con i modelli che si possono gi\u00e0 usare e si lascia pronto il passaggio a un altro modello modificando un\u2019impostazione. Quando Argon si aprir\u00e0, lo aggiungeremo alla tabella con i suoi prezzi.<\/p>\n<h2 id=\"tokens\">Come si legge un prezzo per token<\/h2>\n<p>L\u2019API non si paga al mese n\u00e9 per utente: si paga per testo elaborato, misurato in token. Un token \u00e8 un pezzo di parola. Come riferimento, Anthropic calcola che un milione di token sono circa 555.000 parole nei suoi modelli attuali.<\/p>\n<ul>\n<li><strong>Input<\/strong> \u00e8 ci\u00f2 che invii: le istruzioni e il documento.<\/li>\n<li><strong>Output<\/strong> \u00e8 ci\u00f2 che risponde. Costa tra tre e otto volte pi\u00f9 dell\u2019input, a seconda del modello.<\/li>\n<li><strong>Il ragionamento conta come output.<\/strong> I modelli che pensano prima di rispondere fatturano quel ragionamento anche se non lo vedi. Google lo dice nella sua tariffa: il prezzo di output include i token di ragionamento.<\/li>\n<li><strong>Ogni fornitore conta i token a modo suo.<\/strong> Lo stesso testo non d\u00e0 lo stesso numero in tutti. Anthropic avverte che i suoi modelli recenti generano circa il 30&nbsp;% di token in pi\u00f9 rispetto ai precedenti con lo stesso testo.<\/li>\n<\/ul>\n<p>Per questo il prezzo per milione serve a ordinare, non a preventivare al centesimo. Il costo reale emerge provando con i tuoi documenti.<\/p>\n<h2 id=\"ejemplos\">Quanto costa nella pratica<\/h2>\n<p>Due lavori tipici, calcolati con i prezzi della tabella. Le ipotesi sono nostre e sono visibili cos\u00ec puoi sostituirle con le tue:<\/p>\n<ul>\n<li><strong>Leggere 1.000 fatture<\/strong> e restituirne i dati: 2.000 token di input e 300 di output per fattura, con il testo gi\u00e0 estratto dal PDF.<\/li>\n<li><strong>Redigere 1.000 schede prodotto<\/strong>: 800 token di input e 600 di output per scheda.<\/li>\n<\/ul>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:520px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Modello<\/th>\n<th style=\"padding:10px 12px;text-align:right\">Leggere 1.000 fatture<\/th>\n<th style=\"padding:10px 12px;text-align:right\">Redigere 1.000 schede<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\">GPT-6 Luna<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,35&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,38&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">DeepSeek Flash (in ora di punta; la met\u00e0 fuori da essa)<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,96&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,96&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.5 Flash-Lite<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,35&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,74&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Mistral Large<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,45&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,30&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.8 Flash<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,63&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,85&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Haiku 4.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,80&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Claude Sonnet 5.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">GPT-6.1 Sol<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.1 Pro<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">8,80&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Opus 5.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">14,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">15,20&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">GPT-6 Astra<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">35,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">38,00&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Fable 5.1<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">35,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">38,00&nbsp;$<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>\u00c8 un calcolo con prezzi di listino, non una misurazione. Nei modelli che ragionano, l\u2019output reale \u00e8 maggiore della risposta visibile e il conto sale. Se la fattura entra come immagine e non come testo, anche.<\/p>\n<p>La lettura che regge davvero: lo stesso lavoro costa centesimi o decine di dollari a seconda del livello. La scelta del modello pesa cento volte pi\u00f9 di qualsiasi sconto.<\/p>\n<h2 id=\"tareas\">Quale modello usare per ogni compito<\/h2>\n<p>Questo \u00e8 il punto di partenza che usiamo noi quando impostiamo un processo. Non \u00e8 una classificazione di qualit\u00e0: \u00e8 da dove si comincia a provare.<\/p>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:560px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Compito<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Inizia da<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Perch\u00e9<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Estrarre dati da documenti<\/strong> (fatture, DDT, ordini)<\/td>\n<td style=\"padding:9px 12px\">Livello piccolo<\/td>\n<td style=\"padding:9px 12px\">\u00c8 molto volume e la risposta si verifica con regole: se la base pi\u00f9 l\u2019IVA non d\u00e0 il totale, si capisce<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Classificare e smistare<\/strong> (email, ticket, recensioni)<\/td>\n<td style=\"padding:9px 12px\">Livello piccolo<\/td>\n<td style=\"padding:9px 12px\">L\u2019output \u00e8 un\u2019etichetta: pochi token e poco margine per inventare<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Tradurre catalogo<\/strong><\/td>\n<td style=\"padding:9px 12px\">Livello piccolo o medio<\/td>\n<td style=\"padding:9px 12px\">Il piccolo va bene per attributi e testi brevi; il medio, per descrizioni che devono vendere<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Scrivere<\/strong> (schede, risposte ai clienti, riassunti)<\/td>\n<td style=\"padding:9px 12px\">Livello medio<\/td>\n<td style=\"padding:9px 12px\">Qui si nota il tono, e una persona lo legger\u00e0<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Lavori a pi\u00f9 passaggi<\/strong> (consultare, decidere, scrivere in un altro programma)<\/td>\n<td style=\"padding:9px 12px\">Livello medio o alto<\/td>\n<td style=\"padding:9px 12px\">Un errore in un passaggio si trascina nei successivi; conviene pagare per meno errori<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Programmare<\/strong><\/td>\n<td style=\"padding:9px 12px\">Livello alto<\/td>\n<td style=\"padding:9px 12px\">\u00c8 per questo che Anthropic e OpenAI presentano i loro modelli grandi<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>La prova che decide \u00e8 sempre la stessa: venti casi reali tuoi, con la risposta corretta gi\u00e0 nota, passati dal modello piccolo. Se indovina quelli che deve indovinare, non c\u2019\u00e8 nient\u2019altro da comprare.<\/p>\n<h2 id=\"ahorrar\">Quattro modi per pagare meno<\/h2>\n<ol>\n<li><strong>Elaborazione in batch.<\/strong> Se il lavoro non ha fretta, Anthropic, OpenAI, Google e Mistral lo fanno pagare la met\u00e0 inviandolo in batch. Un lotto notturno di fatture o schede \u00e8 il caso da manuale.<\/li>\n<li><strong>Cache delle istruzioni.<\/strong> Quando tutte le richieste ripetono le stesse istruzioni lunghe, quella parte viene fatturata a prezzo molto ridotto dalla seconda volta in poi. In Claude, a un decimo del prezzo iniziale o meno.<\/li>\n<li><strong>Prima il modello piccolo.<\/strong> Lascia che il piccolo risolva le cose facili e passi al medio solo ci\u00f2 che non ha chiaro. Di solito \u00e8 lo sconto pi\u00f9 grande di tutti.<\/li>\n<li><strong>Output brevi.<\/strong> L\u2019output \u00e8 la parte costosa. Chiedere i dati in una struttura fissa e senza spiegazioni riduce i costi e, in pi\u00f9, ne facilita la verifica.<\/li>\n<\/ol>\n<h2 id=\"letra\">Ci\u00f2 che il prezzo non dice<\/h2>\n<ul>\n<li><strong>Cosa fanno con i tuoi dati.<\/strong> Gemini ha un livello gratuito, ma Google indica che in esso il contenuto viene usato per migliorare i suoi prodotti; in quello a pagamento, no. Con dati di clienti o del personale, il livello gratuito non \u00e8 un\u2019opzione. Prima di inviare dati personali a qualsiasi fornitore bisogna controllare il suo contratto di nomina a responsabile del trattamento e dove vengono elaborati; DeepSeek \u00e8 un\u2019azienda cinese e Mistral, francese.<\/li>\n<li><strong>Preliminare non \u00e8 stabile.<\/strong> Gemini 3.1 Pro \u00e8 ancora in versione preliminare. Un modello cos\u00ec pu\u00f2 cambiare o essere ritirato con poco preavviso, e non \u00e8 una buona base per un processo che deve funzionare da solo.<\/li>\n<li><strong>I documenti molto lunghi costano di pi\u00f9.<\/strong> OpenAI raddoppia il prezzo iniziale nel contesto lungo, e Gemini 3.1 Pro lo raddoppia a partire da 200.000 token.<\/li>\n<li><strong>I prezzi si muovono.<\/strong> Gemini 3.8 Flash raddoppia il suo prezzo il 1\u00ba gennaio 2027, e DeepSeek fa pagare il doppio nelle sue ore di punta, che cadono nella notte e nella mattina della Spagna.<\/li>\n<li><strong>Il modello non \u00e8 il progetto.<\/strong> Il conto del fornitore di solito \u00e8 la parte piccola. Ci\u00f2 che costa \u00e8 collegarlo al tuo programma, gestire i casi rari e decidere cosa controlla una persona.<\/li>\n<\/ul>\n<div class=\"wp-block-group has-background\" style=\"background-color:#f0f7ff;padding:22px 26px;border-radius:12px;border-left:4px solid #017cba;margin:1.8em 0\">\n<p style=\"margin:0 0 .6em\"><strong>Quale processo vuoi smettere di fare a mano?<\/strong><\/p>\n<p style=\"margin:0 0 1em\">Realizziamo automazioni per negozi online e PMI: misuriamo quanto costa oggi il processo, proviamo con i vostri documenti qual \u00e8 il modello pi\u00f9 economico che lo risolve e lo lasciamo funzionante, con una persona che controlla dove serve. L\u2019IA funziona con la vostra chiave API: il consumo viene fatturato dal fornitore sul vostro account, senza intermediari n\u00e9 ricarichi.<\/p>\n<p style=\"margin:0\"><a href=\"https:\/\/consultoriaehero.com\/it\/automazione-dei-processi-per-e-commerce\/\"><strong>Calcolare quanto vi costa farlo a mano<\/strong><\/a> \u00b7 <a href=\"https:\/\/consultoriaehero.com\/it\/automatizzare-fatture-ia\/\">Vedere un caso: fatture dei fornitori<\/a><\/p>\n<\/div>\n<h2 id=\"faq\">Domande frequenti<\/h2>\n<p><strong>Quanto costa l\u2019API di ChatGPT?<\/strong><\/p>\n<p>Dipende dal modello. Al 3 ottobre 2026, GPT-6 Luna costa 0,10&nbsp;$ per milione di token in ingresso e 0,50&nbsp;$ in uscita; GPT-6.1 Sol, 2&nbsp;$ e 10&nbsp;$; GPT-6 Astra, 10&nbsp;$ e 50&nbsp;$. Si paga a consumo, senza quota fissa.<\/p>\n<p><strong>Quanto costa l\u2019API di Claude?<\/strong><\/p>\n<p>Claude Haiku 4.5 costa 1&nbsp;$ per milione di token in ingresso e 5&nbsp;$ in uscita; Sonnet 5.5, 2&nbsp;$ e 10&nbsp;$; Opus 5.5, 4&nbsp;$ e 20&nbsp;$; Fable 5.1, 10&nbsp;$ e 50&nbsp;$.<\/p>\n<p><strong>Quanto costa l\u2019API di Gemini?<\/strong><\/p>\n<p>Gemini 3.5 Flash-Lite costa 0,30&nbsp;$ in ingresso e 2,50&nbsp;$ in uscita per milione di token. Gemini 3.8 Flash, 0,75&nbsp;$ e 3,75&nbsp;$ fino al 31 dicembre 2026, e il doppio da gennaio. Esiste un livello gratuito con limiti, nel quale Google usa il contenuto per migliorare i suoi prodotti.<\/p>\n<p><strong>Esiste Gemini 4?<\/strong><\/p>\n<p>S\u00ec. Google ha presentato Gemini 4 Argon il 30 settembre 2026, ma al 3 ottobre non \u00e8 ancora disponibile: lo usa solo un gruppo di difensori della cybersicurezza e non compare nell\u2019API di Gemini. Sar\u00e0 aperto prima ai clienti a pagamento dell\u2019API e agli abbonati a Google AI Ultra, senza data. La cosa pi\u00f9 recente che si pu\u00f2 usare oggi \u00e8 Gemini 3.8 Flash. Gemma 4 \u00e8 un\u2019altra cosa: la famiglia di modelli aperti di Google.<\/p>\n<p><strong>Quanto coster\u00e0 Gemini 4 Argon?<\/strong><\/p>\n<p>Google ha annunciato un prezzo di lancio di 2&nbsp;$ per milione di token in ingresso e 10&nbsp;$ in uscita, che passer\u00e0 a 4&nbsp;$ e 20&nbsp;$ quando finir\u00e0 quel periodo. Non ha detto quanto durer\u00e0.<\/p>\n<p><strong>\u00c8 la stessa cosa un abbonamento a ChatGPT o a Claude e l\u2019API?<\/strong><\/p>\n<p>No. L\u2019abbonamento serve a una persona per usare la chat, con una quota fissa. L\u2019API serve a un programma per chiamare il modello, e si paga per token. Per automatizzare un processo serve l\u2019API.<\/p>\n<p><strong>Qual \u00e8 il modello di IA migliore per un\u2019azienda?<\/strong><\/p>\n<p>Il pi\u00f9 economico che risolva il tuo compito con i tuoi documenti. Per estrarre dati e classificare di solito basta il livello piccolo; per scrivere, il medio; quello alto si riserva alla programmazione e ai lavori a pi\u00f9 passaggi.<\/p>\n<p><strong>I prezzi includono l\u2019IVA?<\/strong><\/p>\n<p>No. Sono prezzi di listino in dollari e non includono le imposte. Quella applicata dipende dal fornitore e da dove si trova la tua azienda.<\/p>\n<p><strong>Ogni quanto cambiano i modelli?<\/strong><\/p>\n<p>Pi\u00f9 volte all\u2019anno per ciascun fornitore. Per questo conviene che il processo non dipenda da un modello specifico: cambiarlo deve voler dire modificare un\u2019impostazione, non rifare il lavoro.<\/p>\n<h2 id=\"cambios\">Registro delle modifiche<\/h2>\n<ul>\n<li><strong>3-10-2026.<\/strong> Prima versione, con i prezzi di listino di Anthropic, OpenAI, Google, DeepSeek e Mistral verificati quel giorno, e quanto Google ha annunciato di Gemini 4 Argon, che ancora non si pu\u00f2 acquistare.<\/li>\n<\/ul>\n<h2>Conclusione<\/h2>\n<p>Scegliere il modello significa scegliere il livello, e il livello lo decide il compito. Parti dal piccolo, prova con i tuoi casi e sali solo se fallisce. Il resto del confronto cambia ogni pochi mesi, e per questo lo manteniamo aggiornato qui.<\/p>\n<p><em>I prezzi sono quelli di listino pubblicati da ciascun fornitore alla data indicata e possono cambiare. Gli esempi di costo sono calcoli orientativi, non un preventivo.<\/em><\/p>\n<h2>Link utili<\/h2>\n<ul>\n<li><a href=\"https:\/\/consultoriaehero.com\/it\/automatizzare-fatture-ia\/\">Automatizzare le fatture con IA<\/a>: un intero processo, passo dopo passo, con un caso reale.<\/li>\n<li><a href=\"https:\/\/consultoriaehero.com\/it\/automazione-dei-processi-per-e-commerce\/\">Automazione dei processi per e-commerce<\/a>: cosa si automatizza, come lavoriamo e quanto costa.<\/li>\n<li><a href=\"https:\/\/platform.claude.com\/docs\/en\/about-claude\/pricing\" rel=\"noopener\" target=\"_blank\">Prezzi dell\u2019API di Claude<\/a> (Anthropic).<\/li>\n<li><a href=\"https:\/\/platform.openai.com\/docs\/pricing\" rel=\"noopener\" target=\"_blank\">Prezzi dell\u2019API di OpenAI<\/a>.<\/li>\n<li><a href=\"https:\/\/ai.google.dev\/gemini-api\/docs\/pricing\" rel=\"noopener\" target=\"_blank\">Prezzi dell\u2019API di Gemini<\/a> (Google).<\/li>\n<li><a href=\"https:\/\/blog.google\/innovation-and-ai\/models-and-research\/gemini-models\/gemini-4-argon\/\" rel=\"noopener\" target=\"_blank\">Annuncio di Gemini 4 Argon<\/a> (Google, in inglese).<\/li>\n<li><a href=\"https:\/\/api-docs.deepseek.com\/quick_start\/pricing\" rel=\"noopener\" target=\"_blank\">Prezzi dell\u2019API di DeepSeek<\/a>.<\/li>\n<li><a href=\"https:\/\/mistral.ai\/pricing\" rel=\"noopener\" target=\"_blank\">Prezzi di Mistral<\/a>.<\/li>\n<\/ul>\n<p><script type=\"application\/ld+json\">{\"@context\":\"https:\/\/schema.org\",\"@type\":\"Article\",\"headline\":\"Confronto tra modelli di IA nel 2026: prezzi delle API e quale usare in azienda\",\"description\":\"Confronto tra modelli di IA aggiornato: prezzi ufficiali delle API di Claude, GPT-6, Gemini, DeepSeek e Mistral, e quale modello usare per ogni attivit\u00e0.\",\"inLanguage\":\"it-IT\",\"author\":{\"@type\":\"Organization\",\"name\":\"Consultor\u00eda EHERO\",\"url\":\"https:\/\/consultoriaehero.com\/it\/\"},\"publisher\":{\"@type\":\"Organization\",\"name\":\"Consultor\u00eda EHERO\",\"url\":\"https:\/\/consultoriaehero.com\/it\/\"},\"about\":[{\"@type\":\"Thing\",\"name\":\"Modelli di intelligenza artificiale\"},{\"@type\":\"Thing\",\"name\":\"Prezzi delle API dei modelli linguistici\"}]}<\/script><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Confronto tra modelli di IA aggiornato: prezzi ufficiali delle API di Claude, GPT-6, Gemini, DeepSeek e Mistral, e quale modello usare per ogni attivit\u00e0.<\/p>\n","protected":false},"author":4,"featured_media":17852,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"_jf_save_progress":"","rank_math_focus_keyword":"confronto tra modelli di IA,prezzi API ChatGPT,prezzi API Claude,prezzi API Gemini,quale modello di IA usare","rank_math_title":"Confronto tra modelli di IA 2026: prezzi delle API | EHERO","rank_math_description":"Confronto tra modelli di IA aggiornato: prezzi ufficiali delle API di Claude, GPT-6, Gemini, DeepSeek e Mistral, e quale modello usare per ogni attivit\u00e0.","rank_math_robots":[],"rank_math_canonical_url":"","rank_math_seo_score":81,"footnotes":""},"categories":[5093],"tags":[8338,5305,8337],"class_list":["post-17814","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-intelligenza-artificiale","tag-automatizacion-de-procesos","tag-intelligenza-artificiale","tag-modelos-de-ia"],"acf":[],"_links":{"self":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17814","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/users\/4"}],"replies":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/comments?post=17814"}],"version-history":[{"count":3,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17814\/revisions"}],"predecessor-version":[{"id":17853,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17814\/revisions\/17853"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/media\/17852"}],"wp:attachment":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/media?parent=17814"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/categories?post=17814"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/tags?post=17814"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}