Comparação de modelos de IA em 2026: preços da API e qual usar na sua empresa

Consultoria EHERO

13 minutos de lectura

Não existe um «melhor modelo de IA»: existem tarefas, e quase sempre são resolvidas por um modelo mais barato do que se pensa. Esta comparação de modelos de IA reúne os preços oficiais da API da Claude, GPT-6, Gemini, DeepSeek e Mistral a 3 de outubro de 2026 e diz qual se encaixa em cada trabalho de uma empresa.

É uma página viva. Revemo-la sempre que sai um modelo ou muda um preço, e no fim apontamos o que mudou e quando.

Preços verificados a 3 de outubro de 2026

Modelos mais recentes que se podem contratar: Claude Opus 5.5 e Fable 5.1 (Anthropic), GPT-6 Astra e GPT-6.1 Sol (OpenAI), Gemini 3.8 Flash (Google).

E o Gemini 4? Existe, mas ainda não se pode contratar. A Google apresentou o Gemini 4 Argon a 30 de setembro de 2026 e, por enquanto, só é usado por um grupo de defensores de cibersegurança.

O próximo a mudar: a abertura do Gemini 4 Argon, sem data anunciada, e o Gemini 3.8 Flash, que duplica o seu preço a 1 de janeiro de 2027.

A resposta curta

Os cinco fornecedores vendem o mesmo em três escalões, e a diferença de preço entre o de baixo e o de cima é de cem vezes.

  • Escalão pequeno (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): para ler, classificar e extrair dados em quantidade. É onde vive a maior parte da automatização de uma empresa.
  • Escalão médio (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): para redigir, resumir e responder com critério. Claude Sonnet 5.5 e GPT-6.1 Sol custam o mesmo.
  • Escalão alto (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): para programar, para trabalhos de muitos passos seguidos e para o que o escalão médio não resolve.

A regra que usamos: começa-se pelo pequeno, testa-se com casos reais e só se sobe de escalão se falhar. Descer depois quase nunca se faz, por isso convém não começar por cima.

Preços da API, modelo por modelo

Preços de tabela em dólares por cada milhão de tokens, tal como os publica cada fornecedor. Não incluem impostos.

Fornecedor Modelo Entrada Saída Como o fabricante o apresenta
Anthropic Claude Fable 5.1 10 $ 50 $ Raciocínio exigente e trabalho autónomo de longo percurso
Claude Opus 5.5 4 $ 20 $ O ponto de partida que a Anthropic recomenda para a maioria dos trabalhos
Claude Sonnet 5.5 2 $ 10 $ A melhor combinação de velocidade e inteligência
Claude Haiku 4.5 1 $ 5 $ O mais rápido da família
OpenAI GPT-6 Astra 10 $ 50 $ O modelo principal, para raciocínio complexo e programação
GPT-6.1 Sol 2 $ 10 $ Equilíbrio entre inteligência e custo
GPT-6 Luna 0,10 $ 0,50 $ Grande volume com o custo ajustado
Google Gemini 3.1 Pro (versão preliminar) 2 $ 12 $ Compreensão de texto, imagem e vídeo, e agentes. Ainda não é versão estável
Gemini 3.8 Flash 0,75 $ 3,75 $ O Flash mais capaz. Preço até 31-12-2026; a partir de 1-1-2027, 1,50 $ e 7,50 $
Gemini 3.5 Flash-Lite 0,30 $ 2,50 $ Grande volume, tradução e processamento de dados simples
DeepSeek DeepSeek V4 Pro 1,32 $ 3,96 $ Não admite imagens. Fora das horas de pico custa metade
DeepSeek Flash (V4.1) 0,30 $ 1,20 $ Admite imagens. Fora das horas de pico custa metade
Mistral Mistral Large 0,50 $ 1,50 $ O modelo grande do fornecedor europeu

As fontes são as páginas de preços de cada fornecedor, ligadas no fim. A OpenAI mantém também GPT-6 Sol ao mesmo preço que GPT-6.1 Sol; num projeto novo escolhe-se o 6.1. Gemini 4 Argon não está na tabela porque ainda não se pode contratar.

Gemini 4 Argon: o que se sabe

Gemini 4 existe. A Google apresentou-o a 30 de setembro de 2026 com o nome de Gemini 4 Argon, como o seu novo modelo de fronteira, mas a 3 de outubro ainda não pode ser usado a partir da API aberta nem aparece na lista de modelos do Gemini.

  • Quem o tem. Um grupo de defensores de cibersegurança de confiança, dentro do programa Fairwind da Google, além das equipas internas da própria Google.
  • Quando abre. Sem data. A Google diz que o abrirá assim que possível, começando pelos clientes pagos da API e pelos subscritores do Google AI Ultra, quando terminar de testar as suas salvaguardas.
  • Quanto custará. Sairá com um preço de lançamento de 2 $ por milhão de tokens de entrada e 10 $ de saída, com a entrada em cache 95 % mais barata. No fim desse período passará para 4 $ e 20 $.
  • Para que a Google o apresenta. Para tarefas longas de vários passos: programação, trabalho de escritório especializado como o jurídico ou o financeiro, e defesa contra ciberataques. Pode gerar até um milhão de tokens de saída numa única resposta.

Para uma empresa que automatiza hoje, nada muda: monta-se com os modelos que já se podem contratar e deixa-se preparado para mudar de modelo tocando num ajuste. Quando o Argon abrir, adicioná-lo-emos à tabela com os seus preços.

Como se lê um preço por tokens

A API não se paga por mês nem por utilizador: paga-se pelo texto processado, medido em tokens. Um token é um pedaço de palavra. Como referência, a Anthropic calcula que um milhão de tokens são cerca de 555.000 palavras nos seus modelos atuais.

  • Entrada é o que envias: as instruções e o documento.
  • Saída é o que responde. Custa entre três e oito vezes mais do que a entrada, consoante o modelo.
  • O raciocínio conta como saída. Os modelos que pensam antes de responder faturam esse raciocínio mesmo que não o vejas. A Google diz isso na sua tabela: o preço de saída inclui os tokens de raciocínio.
  • Cada fornecedor conta os tokens à sua maneira. O mesmo texto não dá o mesmo número em todos. A Anthropic avisa que os seus modelos recentes geram cerca de 30 % mais tokens do que os anteriores com o mesmo texto.

Por isso, o preço por milhão serve para ordenar, não para orçamentar ao cêntimo. O custo real sai de testar com os teus documentos.

Quanto custa na prática

Dois trabalhos típicos, calculados com os preços da tabela. Os pressupostos são nossos e estão à vista para que os troques pelos teus:

  • Ler 1.000 faturas e devolver os seus dados: 2.000 tokens de entrada e 300 de saída por fatura, com o texto já extraído do PDF.
  • Redigir 1.000 fichas de produto: 800 tokens de entrada e 600 de saída por ficha.
Modelo Ler 1.000 faturas Redigir 1.000 fichas
GPT-6 Luna 0,35 $ 0,38 $
DeepSeek Flash (em hora de pico; metade fora dela) 0,96 $ 0,96 $
Gemini 3.5 Flash-Lite 1,35 $ 1,74 $
Mistral Large 1,45 $ 1,30 $
Gemini 3.8 Flash 2,63 $ 2,85 $
Claude Haiku 4.5 3,50 $ 3,80 $
Claude Sonnet 5.5 7,00 $ 7,60 $
GPT-6.1 Sol 7,00 $ 7,60 $
Gemini 3.1 Pro 7,60 $ 8,80 $
Claude Opus 5.5 14,00 $ 15,20 $
GPT-6 Astra 35,00 $ 38,00 $
Claude Fable 5.1 35,00 $ 38,00 $

É um cálculo com preços de tabela, não uma medição. Nos modelos que raciocinam, a saída real é maior do que a resposta visível e a conta sobe. Se a fatura entrar como imagem e não como texto, também.

A leitura que se mantém: o mesmo trabalho custa cêntimos ou dezenas de dólares consoante o escalão. A escolha do modelo pesa cem vezes mais do que qualquer desconto.

Que modelo usar para cada tarefa

Este é o ponto de partida que usamos ao montar um processo. Não é uma classificação de qualidade: é por onde se começa a testar.

Tarefa Começa por Porquê
Extrair dados de documentos (faturas, guias de remessa, encomendas) Escalão pequeno É muito volume e a resposta verifica-se com regras: se a base mais o IVA não dá o total, sabe-se
Classificar e distribuir (emails, incidências, avaliações) Escalão pequeno A saída é uma etiqueta: poucos tokens e pouca margem para inventar
Traduzir catálogo Escalão pequeno ou médio O pequeno serve para atributos e textos curtos; o médio, para descrições que têm de vender
Redigir (fichas, respostas a clientes, resumos) Escalão médio Aqui nota-se o tom, e uma pessoa vai lê-lo
Trabalhos de vários passos (consultar, decidir, escrever noutro programa) Escalão médio ou alto Um erro num passo arrasta-se para os seguintes; compensa pagar por menos falhas
Programar Escalão alto É para isso que a Anthropic e a OpenAI apresentam os seus modelos grandes

O teste que decide é sempre o mesmo: vinte casos reais seus, com a resposta correta já conhecida, passados pelo modelo pequeno. Se acertar os que tem de acertar, não há mais nada a comprar.

Quatro formas de pagar menos

  1. Processamento em lotes. Se o trabalho não tiver pressa, Anthropic, OpenAI, Google e Mistral cobram metade do preço ao enviá-lo em lote. Uma remessa noturna de faturas ou fichas é o caso clássico.
  2. Cache de instruções. Quando todos os pedidos repetem as mesmas instruções longas, essa parte é cobrada muito mais barata a partir da segunda vez. Em Claude, a um décimo do preço de entrada ou menos.
  3. O modelo pequeno primeiro. Deixe o pequeno resolver o fácil e passe ao médio apenas o que não estiver claro. Costuma ser o maior desconto de todos.
  4. Saídas curtas. A saída é o que custa caro. Pedir os dados numa estrutura fixa e sem explicações reduz o custo e, de passagem, facilita a verificação.

O que o preço não diz

  • O que fazem com os seus dados. Gemini tem um nível gratuito, mas a Google indica que nele o conteúdo é usado para melhorar os seus produtos; no pago, não. Com dados de clientes ou de pessoal, o nível gratuito não é opção. Antes de enviar dados pessoais a qualquer fornecedor é preciso ver o contrato de subcontratação de tratamento e onde são processados; DeepSeek é uma empresa chinesa e Mistral, francesa.
  • Pré-lançamento não é estável. Gemini 3.1 Pro continua em versão preliminar. Um modelo assim pode mudar ou ser retirado com pouco aviso, e não é boa base para um processo que tem de funcionar sozinho.
  • Os documentos muito longos custam mais. OpenAI duplica o preço de entrada em contexto longo, e Gemini 3.1 Pro duplica-o a partir de 200.000 tokens.
  • Os preços mudam. Gemini 3.8 Flash duplica o seu preço a 1 de janeiro de 2027, e DeepSeek cobra o dobro nas suas horas de pico, que caem na madrugada e na manhã de Espanha.
  • O modelo não é o projeto. A conta do fornecedor costuma ser a parte pequena. O que custa é ligar ao seu programa, tratar os casos raros e decidir o que é revisto por uma pessoa.

Que processo quer deixar de fazer à mão?

Montamos automatizações para lojas online e PMEs: medimos quanto custa hoje o processo, testamos com os vossos documentos qual é o modelo mais barato que o resolve e deixamo-lo a funcionar, com uma pessoa a rever onde for necessário. A IA é contratada com a vossa própria chave: o consumo é faturado pelo fornecedor na vossa conta, sem intermediários nem sobretaxas.

Calcular quanto vos custa fazê-lo à mão · Ver um caso: faturas de fornecedores

Perguntas frequentes

Quanto custa a API do ChatGPT?

Depende do modelo. A 3 de outubro de 2026, GPT-6 Luna custa 0,10 $ por milhão de tokens de entrada e 0,50 $ de saída; GPT-6.1 Sol, 2 $ e 10 $; GPT-6 Astra, 10 $ e 50 $. Paga-se por uso, sem quota fixa.

Quanto custa a API do Claude?

Claude Haiku 4.5 custa 1 $ por milhão de tokens de entrada e 5 $ de saída; Sonnet 5.5, 2 $ e 10 $; Opus 5.5, 4 $ e 20 $; Fable 5.1, 10 $ e 50 $.

Quanto custa a API do Gemini?

Gemini 3.5 Flash-Lite custa 0,30 $ de entrada e 2,50 $ de saída por milhão de tokens. Gemini 3.8 Flash, 0,75 $ e 3,75 $ até 31 de dezembro de 2026, e o dobro a partir de janeiro. Há um nível gratuito com limites, no qual a Google usa o conteúdo para melhorar os seus produtos.

Existe Gemini 4?

Sim. A Google apresentou Gemini 4 Argon a 30 de setembro de 2026, mas a 3 de outubro ainda não se pode contratar: só é usado por um grupo de defensores de cibersegurança e não consta na API do Gemini. Será aberto primeiro a clientes pagos da API e a subscritores do Google AI Ultra, sem data. O mais recente que se pode usar hoje é Gemini 3.8 Flash. Gemma 4 é outra coisa: a família de modelos abertos da Google.

Quanto custará Gemini 4 Argon?

A Google anunciou um preço de lançamento de 2 $ por milhão de tokens de entrada e 10 $ de saída, que passará para 4 $ e 20 $ quando esse período terminar. Não disse quanto tempo durará.

É o mesmo uma subscrição do ChatGPT ou do Claude que a API?

Não. A subscrição é para uma pessoa usar o chat, com uma quota fixa. A API é para um programa chamar o modelo, e paga-se por tokens. Para automatizar um processo é necessária a API.

Que modelo de IA é melhor para uma empresa?

O mais barato que resolva a sua tarefa com os seus documentos. Para extrair dados e classificar, costuma bastar o escalão pequeno; para redigir, o médio; o alto fica reservado para programar e para trabalhos de muitos passos.

Os preços incluem IVA?

Não. São preços de tabela em dólares e não incluem impostos. O que se aplica depende do fornecedor e de onde está a sua empresa.

De quanto em quanto tempo mudam os modelos?

Várias vezes por ano em cada fornecedor. Por isso convém que o processo não dependa de um modelo concreto: que o mudar seja alterar uma definição, não refazer o trabalho.

Registo de alterações

  • 3-10-2026. Primeira versão, com os preços de tabela de Anthropic, OpenAI, Google, DeepSeek e Mistral verificados nesse dia, e o que a Google anunciou sobre Gemini 4 Argon, que ainda não se pode contratar.

Conclusão

Escolher modelo é escolher escalão, e o escalão é decidido pela tarefa. Comece pelo pequeno, teste com os seus casos e suba apenas se falhar. O resto da comparação muda de poucos em poucos meses, e por isso mantemo-la atualizada aqui.

Os preços são os de tabela publicados por cada fornecedor na data indicada e podem mudar. Os exemplos de custo são cálculos orientativos, não um orçamento.

Ligações úteis

Queres estar a par de todas as novidades?

Segue-nos nas nossas redes sociais para não perderes nada!

Subscreva a nossa newsletter

Receba ofertas exclusivas e atualizações.

Obtenha 10% de desconto no seu primeiro pedido!