Non hai un «mellor modelo de IA»: hai tarefas, e case sempre resólveas un modelo máis barato do que se pensa. Esta comparativa de modelos de IA recolle os prezos oficiais da API de Claude, GPT-6, Gemini, DeepSeek e Mistral a 3 de outubro de 2026 e di cal encaixa en cada traballo dunha empresa.
É unha páxina viva. Revisámola cada vez que sae un modelo ou cambia un prezo, e ao final apuntamos que cambiou e cando.
Prezos comprobados o 3 de outubro de 2026
Modelos máis recentes que se poden contratar: Claude Opus 5.5 e Fable 5.1 (Anthropic), GPT-6 Astra e GPT-6.1 Sol (OpenAI), Gemini 3.8 Flash (Google).
E Gemini 4? Existe, pero aínda non se pode contratar. Google presentou Gemini 4 Argon o 30 de setembro de 2026 e polo de agora só o usa un grupo de defensores de ciberseguridade.
O próximo que cambia: a apertura de Gemini 4 Argon, sen data anunciada, e Gemini 3.8 Flash, que duplica o seu prezo o 1 de xaneiro de 2027.
A resposta curta
Os cinco provedores venden o mesmo en tres chanzos, e a diferenza de prezo entre o de abaixo e o de arriba é de cen veces.
- Chanzo pequeno (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): para ler, clasificar e sacar datos en cantidade. É onde vive a maior parte da automatización dunha empresa.
- Chanzo medio (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): para redactar, resumir e contestar con criterio. Claude Sonnet 5.5 e GPT-6.1 Sol custan o mesmo.
- Chanzo alto (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): para programar, para traballos de moitos pasos seguidos e para o que o medio non resolve.
A regra que usamos: empeza polo pequeno, proba con casos reais e só sobe de chanzo se falla. Baixar despois case nunca se fai, así que convén non empezar por arriba.
Prezos da API, modelo por modelo
Prezos de tarifa en dólares por cada millón de tokens, tal como os publica cada provedor. Non inclúen impostos.
| Provedor | Modelo | Entrada | Saída | Como o presenta o fabricante |
|---|---|---|---|---|
| Anthropic | Claude Fable 5.1 | 10 $ | 50 $ | Razoamento esixente e traballo autónomo de longo percorrido |
| Claude Opus 5.5 | 4 $ | 20 $ | O punto de partida que recomenda Anthropic para a maioría dos traballos | |
| Claude Sonnet 5.5 | 2 $ | 10 $ | A mellor combinación de velocidade e intelixencia | |
| Claude Haiku 4.5 | 1 $ | 5 $ | O máis rápido da familia | |
| OpenAI | GPT-6 Astra | 10 $ | 50 $ | O modelo insignia, para razoamento complexo e programación |
| GPT-6.1 Sol | 2 $ | 10 $ | Equilibrio entre intelixencia e custo | |
| GPT-6 Luna | 0,10 $ | 0,50 $ | Gran volume co custo axustado | |
| Gemini 3.1 Pro (versión preliminar) | 2 $ | 12 $ | Comprensión de texto, imaxe e vídeo, e axentes. Aínda non é versión estable | |
| Gemini 3.8 Flash | 0,75 $ | 3,75 $ | O Flash máis capaz. Prezo ata o 31-12-2026; desde o 1-1-2027, 1,50 $ e 7,50 $ | |
| Gemini 3.5 Flash-Lite | 0,30 $ | 2,50 $ | Gran volume, tradución e proceso de datos sinxelo | |
| DeepSeek | DeepSeek V4 Pro | 1,32 $ | 3,96 $ | Non admite imaxes. Fóra das súas horas punta custa a metade |
| DeepSeek Flash (V4.1) | 0,30 $ | 1,20 $ | Admite imaxes. Fóra das súas horas punta custa a metade | |
| Mistral | Mistral Large | 0,50 $ | 1,50 $ | O modelo grande do provedor europeo |
As fontes son as páxinas de prezos de cada provedor, ligadas ao final. OpenAI mantén ademais GPT-6 Sol ao mesmo prezo que GPT-6.1 Sol; nun proxecto novo escóllese o 6.1. Gemini 4 Argon non está na táboa porque aínda non se pode contratar.
Gemini 4 Argon: o que se sabe
Gemini 4 existe. Google presentouno o 30 de setembro de 2026 co nome de Gemini 4 Argon, como o seu novo modelo de fronteira, pero a 3 de outubro non se pode usar desde a API aberta nin aparece na lista de modelos de Gemini.
- Quen o ten. Un grupo de defensores de ciberseguridade de confianza, dentro do programa Fairwind de Google, ademais dos equipos internos da propia Google.
- Cando se abre. Sen data. Google di que o abrirá o antes posible, empezando polos clientes de pago da API e os subscritores de Google AI Ultra, cando remate de probar as súas salvagardas.
- Canto custará. Sairá cun prezo de lanzamento de 2 $ por millón de tokens de entrada e 10 $ de saída, coa entrada en caché un 95 % máis barata. Ao rematar ese período pasará a 4 $ e 20 $.
- Para que o presenta Google. Para tarefas longas de varios pasos: programación, traballo de oficina especializado como o legal ou o financeiro, e defensa fronte a ciberataques. Pode xerar ata un millón de tokens de saída nunha soa resposta.
Para unha empresa que automatiza hoxe non cambia nada: montase cos modelos que xa se poden contratar e déixase preparado para cambiar de modelo tocando un axuste. Cando Argon se abra, engadímolo á táboa cos seus prezos.
Como se le un prezo por tokens
A API non se paga por mes nin por usuario: págase por texto procesado, medido en tokens. Un token é un anaco de palabra. Como referencia, Anthropic calcula que un millón de tokens son unhas 555.000 palabras nos seus modelos actuais.
- Entrada é o que lle mandas: as instrucións e o documento.
- Saída é o que contesta. Custa entre tres e oito veces máis ca entrada, segundo o modelo.
- O razoamento conta como saída. Os modelos que pensan antes de contestar facturan ese razoamento aínda que non o vexas. Google dío na súa tarifa: o prezo de saída inclúe os tokens de razoamento.
- Cada provedor conta os tokens á súa maneira. O mesmo texto non dá o mesmo número en todos. Anthropic avisa de que os seus modelos recentes xeran arredor dun 30 % máis de tokens ca os anteriores co mesmo texto.
Por iso o prezo por millón serve para ordenar, non para orzar ao céntimo. O custo real sae de probar cos teus documentos.
Canto custa na práctica
Dous traballos típicos, calculados cos prezos da táboa. Os supostos son nosos e están á vista para que os cambies polos teus:
- Ler 1.000 facturas e devolver os seus datos: 2.000 tokens de entrada e 300 de saída por factura, co texto xa extraído do PDF.
- Redactar 1.000 fichas de produto: 800 tokens de entrada e 600 de saída por ficha.
| Modelo | Ler 1.000 facturas | Redactar 1.000 fichas |
|---|---|---|
| GPT-6 Luna | 0,35 $ | 0,38 $ |
| DeepSeek Flash (en hora punta; a metade fóra dela) | 0,96 $ | 0,96 $ |
| Gemini 3.5 Flash-Lite | 1,35 $ | 1,74 $ |
| Mistral Large | 1,45 $ | 1,30 $ |
| Gemini 3.8 Flash | 2,63 $ | 2,85 $ |
| Claude Haiku 4.5 | 3,50 $ | 3,80 $ |
| Claude Sonnet 5.5 | 7,00 $ | 7,60 $ |
| GPT-6.1 Sol | 7,00 $ | 7,60 $ |
| Gemini 3.1 Pro | 7,60 $ | 8,80 $ |
| Claude Opus 5.5 | 14,00 $ | 15,20 $ |
| GPT-6 Astra | 35,00 $ | 38,00 $ |
| Claude Fable 5.1 | 35,00 $ | 38,00 $ |
É un cálculo con prezos de tarifa, non unha medición. Nos modelos que razoan, a saída real é maior ca resposta visible e a conta sobe. Se a factura entra como imaxe e non como texto, tamén.
A lectura que si aguanta: o mesmo traballo custa céntimos ou decenas de dólares segundo o chanzo. A elección do modelo pesa cen veces máis ca calquera desconto.
Que modelo usar para cada tarefa
Este é o punto de partida que usamos nós ao montar un proceso. Non é unha clasificación de calidade: é por onde se empeza a probar.
| Tarefa | Empeza por | Por que |
|---|---|---|
| Sacar datos de documentos (facturas, albarás, pedidos) | Chanzo pequeno | É moito volume e a resposta compróbase con regras: se a base máis o IVE non dá o total, sábese |
| Clasificar e repartir (correos, incidencias, reseñas) | Chanzo pequeno | A saída é unha etiqueta: poucos tokens e pouco marxe para inventar |
| Traducir catálogo | Chanzo pequeno ou medio | O pequeno vale para atributos e textos curtos; o medio, para descricións que teñen que vender |
| Redactar (fichas, respostas a clientes, resumos) | Chanzo medio | Aquí nótase o ton, e unha persoa vai lelo |
| Traballos de varios pasos (consultar, decidir, escribir noutro programa) | Chanzo medio ou alto | Un erro nun paso arrástrase aos seguintes; compensa pagar por menos fallos |
| Programar | Chanzo alto | É para o que Anthropic e OpenAI presentan os seus modelos grandes |
A proba que decide é sempre a mesma: vinte casos reais teus, coa resposta correcta xa sabida, pasados polo modelo pequeno. Se acerta os que ten que acertar, non hai nada máis que comprar.
Catro formas de pagar menos
- Proceso por lotes. Se o traballo non corre présa, Anthropic, OpenAI, Google e Mistral cóbranllo á metade de prezo mandándoo en lote. Unha tanda nocturna de facturas ou de fichas é o caso de libro.
- Caché de instrucións. Cando todas as peticións repiten as mesmas instrucións longas, esa parte cóbrase moi rebaixada a partir da segunda vez. En Claude, a unha décima parte do prezo de entrada ou menos.
- O modelo pequeno primeiro. Que o pequeno resolva o doado e pase ao medio só o que non ten claro. Adoita ser a maior rebaixa de todas.
- Saídas curtas. A saída é o caro. Pedir os datos nunha estrutura fixa e sen explicacións abarata e, de paso, facilita comprobalo.
O que o prezo non di
- Que fan cos teus datos. Gemini ten un nivel gratuíto, pero Google indica que nel o contido se usa para mellorar os seus produtos; no de pago, non. Con datos de clientes ou de persoal, o nivel gratuíto non é opción. Antes de mandar datos persoais a calquera provedor hai que mirar o seu contrato de encargo de tratamento e onde se procesan; DeepSeek é unha empresa chinesa e Mistral, francesa.
- Preliminar non é estable. Gemini 3.1 Pro segue en versión preliminar. Un modelo así pode cambiar ou retirarse con pouco aviso, e non é boa base para un proceso que ten que funcionar só.
- Os documentos moi longos custan máis. OpenAI dobra o prezo de entrada en contexto longo, e Gemini 3.1 Pro dóbrao a partir de 200.000 tokens.
- Os prezos móvense. Gemini 3.8 Flash dobra o seu prezo o 1 de xaneiro de 2027, e DeepSeek cobra o dobre nas súas horas punta, que caen na madrugada e a mañá de España.
- O modelo non é o proxecto. A conta do provedor adoita ser a parte pequena. O que custa é conectar co teu programa, tratar os casos raros e decidir que revisa unha persoa.
Que proceso queres deixar de facer á man?
Montamos automatizacións para tendas online e pemes: medimos o que custa hoxe o proceso, probamos cos vosos documentos cal é o modelo máis barato que o resolve e deixámolo funcionando, cunha persoa revisando onde fai falta. A IA contrátase coa vosa propia clave: o consumo factúrao o provedor na vosa conta, sen intermediarios nin recargas.
Calcular o que vos custa facelo á man · Ver un caso: facturas de provedores
Preguntas frecuentes
Canto custa a API de ChatGPT?
Depende do modelo. A 3 de outubro de 2026, GPT-6 Luna custa 0,10 $ por millón de tokens de entrada e 0,50 $ de saída; GPT-6.1 Sol, 2 $ e 10 $; GPT-6 Astra, 10 $ e 50 $. Págase por uso, sen cota fixa.
Canto custa a API de Claude?
Claude Haiku 4.5 custa 1 $ por millón de tokens de entrada e 5 $ de saída; Sonnet 5.5, 2 $ e 10 $; Opus 5.5, 4 $ e 20 $; Fable 5.1, 10 $ e 50 $.
Canto custa a API de Gemini?
Gemini 3.5 Flash-Lite custa 0,30 $ de entrada e 2,50 $ de saída por millón de tokens. Gemini 3.8 Flash, 0,75 $ e 3,75 $ ata o 31 de decembro de 2026, e o dobre desde xaneiro. Hai un nivel gratuíto con límites, no que Google usa o contido para mellorar os seus produtos.
Existe Gemini 4?
Si. Google presentou Gemini 4 Argon o 30 de setembro de 2026, pero a 3 de outubro aínda non se pode contratar: só o usa un grupo de defensores de ciberseguridade e non figura na API de Gemini. Abrirase primeiro a clientes de pago da API e a subscritores de Google AI Ultra, sen data. O máis recente que se pode usar hoxe é Gemini 3.8 Flash. Gemma 4 é outra cousa: a familia de modelos abertos de Google.
Canto custará Gemini 4 Argon?
Google anunciou un prezo de lanzamento de 2 $ por millón de tokens de entrada e 10 $ de saída, que pasará a 4 $ e 20 $ cando remate ese período. Non dixo canto durará.
É o mesmo unha subscrición de ChatGPT ou de Claude que a API?
Non. A subscrición é para que unha persoa use o chat, cunha cota fixa. A API é para que un programa chame ao modelo, e págase por tokens. Para automatizar un proceso fai falta a API.
Que modelo de IA é mellor para unha empresa?
O máis barato que resolva a túa tarefa cos teus documentos. Para sacar datos e clasificar adoita abondar o chanzo pequeno; para redactar, o medio; o alto resérvase para programar e para traballos de moitos pasos.
Os prezos inclúen IVE?
Non. Son prezos de tarifa en dólares e non inclúen impostos. O que se aplique depende do provedor e de onde estea a túa empresa.
Cada canto cambian os modelos?
Varias veces ao ano en cada provedor. Por iso convén que o proceso non dependa dun modelo concreto: que cambialo sexa tocar un axuste, non refacer o traballo.
Rexistro de cambios
- 3-10-2026. Primeira versión, cos prezos de tarifa de Anthropic, OpenAI, Google, DeepSeek e Mistral comprobados ese día, e o que Google anunciou de Gemini 4 Argon, que aínda non se pode contratar.
Conclusión
Elixir modelo é elixir chanzo, e o chanzo decídeo a tarefa. Comeza polo pequeno, proba cos teus casos e sobe só se falla. O resto da comparativa cambia cada poucos meses, e por iso mantémola ao día aquí.
Os prezos son os de tarifa publicados por cada provedor na data indicada e poden cambiar. Os exemplos de custo son cálculos orientativos, non un orzamento.
Ligazóns útiles
- Automatizar facturas con IA: un proceso enteiro, paso a paso, cun caso real.
- Automatización de procesos para e-commerce: que se automatiza, como traballamos e canto custa.
- Prezos da API de Claude (Anthropic).
- Prezos da API de OpenAI.
- Prezos da API de Gemini (Google).
- Anuncio de Gemini 4 Argon (Google, en inglés).
- Prezos da API de DeepSeek.
- Prezos de Mistral.



