No hi ha un «millor model d’IA»: hi ha tasques, i gairebé sempre les resol un model més barat del que es pensa. Aquesta comparativa de models d’IA recull els preus oficials de l’API de Claude, GPT-6, Gemini, DeepSeek i Mistral a 3 d’octubre de 2026 i diu quin encaixa en cada feina d’una empresa.
És una pàgina viva. La revisem cada vegada que surt un model o canvia un preu, i al final apuntem què ha canviat i quan.
Preus comprovats el 3 d’octubre de 2026
Models més recents que es poden contractar: Claude Opus 5.5 i Fable 5.1 (Anthropic), GPT-6 Astra i GPT-6.1 Sol (OpenAI), Gemini 3.8 Flash (Google).
I Gemini 4? Existeix, però encara no es pot contractar. Google va presentar Gemini 4 Argon el 30 de setembre de 2026 i de moment només l’utilitza un grup de defensors de ciberseguretat.
El pròxim que canvia: l’obertura de Gemini 4 Argon, sense data anunciada, i Gemini 3.8 Flash, que duplica el seu preu l’1 de gener de 2027.
La resposta curta
Els cinc proveïdors venen el mateix en tres esglaons, i la diferència de preu entre el de baix i el de dalt és de cent vegades.
- Esglaó petit (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): per llegir, classificar i extreure dades en quantitat. És on viu la major part de l’automatització d’una empresa.
- Esglaó mitjà (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): per redactar, resumir i respondre amb criteri. Claude Sonnet 5.5 i GPT-6.1 Sol costen el mateix.
- Esglaó alt (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): per programar, per a feines de molts passos seguits i per al que el mitjà no resol.
La regla que fem servir: es comença pel petit, es prova amb casos reals i només es puja d’esglaó si falla. Baixar després gairebé mai es fa, així que convé no començar per dalt.
Preus de l’API, model per model
Preus de tarifa en dòlars per cada milió de tokens, tal com els publica cada proveïdor. No inclouen impostos.
| Proveïdor | Model | Entrada | Sortida | Com ho presenta el fabricant |
|---|---|---|---|---|
| Anthropic | Claude Fable 5.1 | 10 $ | 50 $ | Raonament exigent i treball autònom de llarg recorregut |
| Claude Opus 5.5 | 4 $ | 20 $ | El punt de partida que recomana Anthropic per a la majoria de feines | |
| Claude Sonnet 5.5 | 2 $ | 10 $ | La millor combinació de velocitat i intel·ligència | |
| Claude Haiku 4.5 | 1 $ | 5 $ | El més ràpid de la família | |
| OpenAI | GPT-6 Astra | 10 $ | 50 $ | El model insígnia, per a raonament complex i programació |
| GPT-6.1 Sol | 2 $ | 10 $ | Equilibri entre intel·ligència i cost | |
| GPT-6 Luna | 0,10 $ | 0,50 $ | Gran volum amb el cost ajustat | |
| Gemini 3.1 Pro (versió preliminar) | 2 $ | 12 $ | Comprensió de text, imatge i vídeo, i agents. Encara no és versió estable | |
| Gemini 3.8 Flash | 0,75 $ | 3,75 $ | El Flash més capaç. Preu fins al 31-12-2026; des de l’1-1-2027, 1,50 $ i 7,50 $ | |
| Gemini 3.5 Flash-Lite | 0,30 $ | 2,50 $ | Gran volum, traducció i procés de dades senzill | |
| DeepSeek | DeepSeek V4 Pro | 1,32 $ | 3,96 $ | No admet imatges. Fora de les hores punta costa la meitat |
| DeepSeek Flash (V4.1) | 0,30 $ | 1,20 $ | Admet imatges. Fora de les hores punta costa la meitat | |
| Mistral | Mistral Large | 0,50 $ | 1,50 $ | El model gran del proveïdor europeu |
Les fonts són les pàgines de preus de cada proveïdor, enllaçades al final. OpenAI manté a més GPT-6 Sol al mateix preu que GPT-6.1 Sol; en un projecte nou s’escull el 6.1. Gemini 4 Argon no és a la taula perquè encara no es pot contractar.
Gemini 4 Argon: el que se sap
Gemini 4 existeix. Google el va presentar el 30 de setembre de 2026 amb el nom de Gemini 4 Argon, com el seu nou model de frontera, però a 3 d’octubre no es pot fer servir des de l’API oberta ni apareix a la llista de models de Gemini.
- Qui el té. Un grup de defensors de ciberseguretat de confiança, dins del programa Fairwind de Google, a més dels equips interns de la mateixa Google.
- Quan s’obre. Sense data. Google diu que l’obrirà tan aviat com sigui possible, començant pels clients de pagament de l’API i els subscriptors de Google AI Ultra, quan acabi de provar les seves salvaguardes.
- Quant costarà. Sortirà amb un preu de llançament de 2 $ per milió de tokens d’entrada i 10 $ de sortida, amb l’entrada en memòria cau un 95 % més barata. En acabar aquest període passarà a 4 $ i 20 $.
- Per a què el presenta Google. Per a tasques llargues de diversos passos: programació, feina d’oficina especialitzada com la legal o la financera, i defensa davant de ciberatacs. Pot generar fins a un milió de tokens de sortida en una sola resposta.
Per a una empresa que automatitza avui no canvia res: es munta amb els models que ja es poden contractar i es deixa preparat per canviar de model tocant un ajust. Quan Argon s’obri, l’afegirem a la taula amb els seus preus.
Com es llegeix un preu per tokens
L’API no es paga per mes ni per usuari: es paga per text processat, mesurat en tokens. Un token és un tros de paraula. Com a referència, Anthropic calcula que un milió de tokens són unes 555.000 paraules en els seus models actuals.
- Entrada és el que li envies: les instruccions i el document.
- Sortida és el que contesta. Costa entre tres i vuit vegades més que l’entrada, segons el model.
- El raonament compta com a sortida. Els models que pensen abans de contestar facturen aquest raonament encara que no el vegis. Google ho diu a la seva tarifa: el preu de sortida inclou els tokens de raonament.
- Cada proveïdor compta els tokens a la seva manera. El mateix text no dona el mateix nombre en tots. Anthropic avisa que els seus models recents generen al voltant d’un 30 % més de tokens que els anteriors amb el mateix text.
Per això el preu per milió serveix per ordenar, no per pressupostar al cèntim. El cost real surt de provar amb els teus documents.
Quant costa en la pràctica
Dos treballs típics, calculats amb els preus de la taula. Els supòsits són nostres i són a la vista perquè els canviïs pels teus:
- Llegir 1.000 factures i retornar-ne les dades: 2.000 tokens d’entrada i 300 de sortida per factura, amb el text ja extret del PDF.
- Redactar 1.000 fitxes de producte: 800 tokens d’entrada i 600 de sortida per fitxa.
| Model | Llegir 1.000 factures | Redactar 1.000 fitxes |
|---|---|---|
| GPT-6 Luna | 0,35 $ | 0,38 $ |
| DeepSeek Flash (en hora punta; la meitat fora d’ella) | 0,96 $ | 0,96 $ |
| Gemini 3.5 Flash-Lite | 1,35 $ | 1,74 $ |
| Mistral Large | 1,45 $ | 1,30 $ |
| Gemini 3.8 Flash | 2,63 $ | 2,85 $ |
| Claude Haiku 4.5 | 3,50 $ | 3,80 $ |
| Claude Sonnet 5.5 | 7,00 $ | 7,60 $ |
| GPT-6.1 Sol | 7,00 $ | 7,60 $ |
| Gemini 3.1 Pro | 7,60 $ | 8,80 $ |
| Claude Opus 5.5 | 14,00 $ | 15,20 $ |
| GPT-6 Astra | 35,00 $ | 38,00 $ |
| Claude Fable 5.1 | 35,00 $ | 38,00 $ |
És un càlcul amb preus de tarifa, no una mesura. En els models que raonen, la sortida real és més gran que la resposta visible i el compte puja. Si la factura entra com a imatge i no com a text, també.
La lectura que sí que aguanta: la mateixa feina costa cèntims o desenes de dòlars segons l’esglaó. L’elecció del model pesa cent vegades més que qualsevol descompte.
Quin model usar per a cada tasca
Aquest és el punt de partida que fem servir nosaltres en muntar un procés. No és una classificació de qualitat: és per on es comença a provar.
| Tasca | Comença per | Per què |
|---|---|---|
| Extreure dades de documents (factures, albarans, comandes) | Esglaó petit | És molt volum i la resposta es comprova amb regles: si la base més l’IVA no dona el total, se sap |
| Classificar i repartir (correus, incidències, ressenyes) | Esglaó petit | La sortida és una etiqueta: pocs tokens i poc marge per inventar |
| Traduir catàleg | Esglaó petit o mitjà | El petit val per a atributs i textos curts; el mitjà, per a descripcions que han de vendre |
| Redactar (fitxes, respostes a clients, resums) | Esglaó mitjà | Aquí es nota el to, i una persona ho llegirà |
| Treballs de diversos passos (consultar, decidir, escriure en un altre programa) | Esglaó mitjà o alt | Un error en un pas s’arrossega als següents; compensa pagar per menys errors |
| Programar | Esglaó alt | És per al que Anthropic i OpenAI presenten els seus models grans |
La prova que decideix és sempre la mateixa: vint casos reals teus, amb la resposta correcta ja sabuda, passats pel model petit. Si encerta els que ha d’encertar, no hi ha res més a comprar.
Quatre formes de pagar menys
- Procés per lots. Si la feina no corre pressa, Anthropic, OpenAI, Google i Mistral ho cobren a meitat de preu enviant-ho en lot. Una tanda nocturna de factures o de fitxes és el cas de llibre.
- Caché d’instruccions. Quan totes les peticions repeteixen les mateixes instruccions llargues, aquesta part es cobra molt rebaixada a partir de la segona vegada. A Claude, a una desena part del preu d’entrada o menys.
- El model petit primer. Que el petit resolgui el fàcil i passi al mitjà només allò que no té clar. Sol ser la rebaixa més gran de totes.
- Sortides curtes. La sortida és el que és car. Demanar les dades en una estructura fixa i sense explicacions abarateix i, de passada, facilita comprovar-les.
El que el preu no diu
- Què fan amb les teves dades. Gemini té un nivell gratuït, però Google indica que en aquest el contingut s’usa per millorar els seus productes; en el de pagament, no. Amb dades de clients o de personal, el nivell gratuït no és opció. Abans d’enviar dades personals a qualsevol proveïdor cal mirar el seu contracte d’encàrrec de tractament i on es processen; DeepSeek és una empresa xinesa i Mistral, francesa.
- Preliminar no és estable. Gemini 3.1 Pro continua en versió preliminar. Un model així pot canviar o retirar-se amb poc avís, i no és una bona base per a un procés que ha de funcionar sol.
- Els documents molt llargs costen més. OpenAI dobla el preu d’entrada en context llarg, i Gemini 3.1 Pro el dobla a partir de 200.000 tokens.
- Els preus es mouen. Gemini 3.8 Flash dobla el seu preu l’1 de gener de 2027, i DeepSeek cobra el doble en les seves hores punta, que cauen a la matinada i el matí d’Espanya.
- El model no és el projecte. El compte del proveïdor sol ser la part petita. El que costa és connectar amb el teu programa, tractar els casos rars i decidir què revisa una persona.
Quin procés vols deixar de fer a mà?
Muntem automatitzacions per a botigues en línia i pimes: mesurem el que costa avui el procés, provem amb els vostres documents quin és el model més barat que el resol i el deixem funcionant, amb una persona revisant on calgui. La IA es contracta amb la vostra pròpia clau: el consum el factura el proveïdor al vostre compte, sense intermediaris ni recàrrecs.
Calcular el que us costa fer-ho a mà · Veure un cas: factures de proveïdors
Preguntes freqüents
Quant costa l’API de ChatGPT?
Depèn del model. A 3 d’octubre de 2026, GPT-6 Luna costa 0,10 $ per milió de tokens d’entrada i 0,50 $ de sortida; GPT-6.1 Sol, 2 $ i 10 $; GPT-6 Astra, 10 $ i 50 $. Es paga per ús, sense quota fixa.
Quant costa l’API de Claude?
Claude Haiku 4.5 costa 1 $ per milió de tokens d’entrada i 5 $ de sortida; Sonnet 5.5, 2 $ i 10 $; Opus 5.5, 4 $ i 20 $; Fable 5.1, 10 $ i 50 $.
Quant costa l’API de Gemini?
Gemini 3.5 Flash-Lite costa 0,30 $ d’entrada i 2,50 $ de sortida per milió de tokens. Gemini 3.8 Flash, 0,75 $ i 3,75 $ fins al 31 de desembre de 2026, i el doble des de gener. Hi ha un nivell gratuït amb límits, en què Google usa el contingut per millorar els seus productes.
Existeix Gemini 4?
Sí. Google va presentar Gemini 4 Argon el 30 de setembre de 2026, però a 3 d’octubre encara no es pot contractar: només l’usa un grup de defensors de ciberseguretat i no figura a l’API de Gemini. S’obrirà primer a clients de pagament de l’API i a subscriptors de Google AI Ultra, sense data. El més recent que es pot usar avui és Gemini 3.8 Flash. Gemma 4 és una altra cosa: la família de models oberts de Google.
Quant costarà Gemini 4 Argon?
Google ha anunciat un preu de llançament de 2 $ per milió de tokens d’entrada i 10 $ de sortida, que passarà a 4 $ i 20 $ quan acabi aquest període. No ha dit quant durarà.
És el mateix una subscripció de ChatGPT o de Claude que l’API?
No. La subscripció és perquè una persona faci servir el xat, amb una quota fixa. L’API és perquè un programa cridi el model, i es paga per tokens. Per automatitzar un procés cal l’API.
Quin model d’IA és millor per a una empresa?
El més barat que resolgui la teva tasca amb els teus documents. Per extreure dades i classificar sol bastar l’esglaó petit; per redactar, el mitjà; l’alt es reserva per programar i per a treballs de molts passos.
Els preus inclouen IVA?
No. Són preus de tarifa en dòlars i no inclouen impostos. El que s’apliqui depèn del proveïdor i d’on sigui la teva empresa.
Cada quant canvien els models?
Vàries vegades l’any a cada proveïdor. Per això convé que el procés no depengui d’un model concret: que canviar-lo sigui tocar un ajust, no refer la feina.
Registre de canvis
- 3-10-2026. Primera versió, amb els preus de tarifa d’Anthropic, OpenAI, Google, DeepSeek i Mistral comprovats aquell dia, i el que Google ha anunciat de Gemini 4 Argon, que encara no es pot contractar.
Conclusió
Triar model és triar esglaó, i l’esglaó el decideix la tasca. Comença pel petit, prova amb els teus casos i puja només si falla. La resta de la comparativa canvia cada pocs mesos, i per això la mantenim al dia aquí.
Els preus són els de tarifa publicats per cada proveïdor en la data indicada i poden canviar. Els exemples de cost són càlculs orientatius, no un pressupost.
Enllaços útils
- Automatitzar factures amb IA: un procés sencer, pas a pas, amb un cas real.
- Automatització de processos per a e-commerce: què s’automatitza, com treballem i quant costa.
- Preus de l’API de Claude (Anthropic).
- Preus de l’API d’OpenAI.
- Preus de l’API de Gemini (Google).
- Anunci de Gemini 4 Argon (Google, en anglès).
- Preus de l’API de DeepSeek.
- Preus de Mistral.



