{"id":17811,"date":"2026-10-03T01:11:01","date_gmt":"2026-10-02T23:11:01","guid":{"rendered":"https:\/\/consultoriaehero.com\/?p=17811"},"modified":"2026-10-03T01:23:41","modified_gmt":"2026-10-02T23:23:41","slug":"comparacao-modelos-ia","status":"publish","type":"post","link":"https:\/\/consultoriaehero.com\/pt\/comparacao-modelos-ia\/","title":{"rendered":"Compara\u00e7\u00e3o de modelos de IA em 2026: pre\u00e7os da API e qual usar na sua empresa"},"content":{"rendered":"<p>N\u00e3o existe um \u00abmelhor modelo de IA\u00bb: existem tarefas, e quase sempre s\u00e3o resolvidas por um modelo mais barato do que se pensa. Esta <strong>compara\u00e7\u00e3o de modelos de IA<\/strong> re\u00fane os pre\u00e7os oficiais da API da Claude, GPT-6, Gemini, DeepSeek e Mistral a 3 de outubro de 2026 e diz qual se encaixa em cada trabalho de uma empresa.<\/p>\n<p>\u00c9 uma p\u00e1gina viva. Revemo-la sempre que sai um modelo ou muda um pre\u00e7o, e no fim apontamos o que mudou e quando.<\/p>\n<div class=\"wp-block-group has-background\" style=\"background-color:#f8fafc;padding:22px 26px;border-radius:12px;border:1px solid #cbd5e1;margin:1.8em 0\">\n<p style=\"margin:0 0 .7em\"><strong>Pre\u00e7os verificados a 3 de outubro de 2026<\/strong><\/p>\n<p style=\"margin:0 0 .4em\">Modelos mais recentes que se podem contratar: <strong>Claude Opus 5.5<\/strong> e <strong>Fable 5.1<\/strong> (Anthropic), <strong>GPT-6 Astra<\/strong> e <strong>GPT-6.1 Sol<\/strong> (OpenAI), <strong>Gemini 3.8 Flash<\/strong> (Google).<\/p>\n<p style=\"margin:0 0 .4em\">E o Gemini 4? <strong>Existe, mas ainda n\u00e3o se pode contratar.<\/strong> A Google apresentou o Gemini 4 Argon a 30 de setembro de 2026 e, por enquanto, s\u00f3 \u00e9 usado por um grupo de defensores de ciberseguran\u00e7a.<\/p>\n<p style=\"margin:0\">O pr\u00f3ximo a mudar: a abertura do Gemini 4 Argon, sem data anunciada, e o Gemini 3.8 Flash, que duplica o seu pre\u00e7o a 1 de janeiro de 2027.<\/p>\n<\/div>\n<nav class=\"w2g-toc\"><strong>Nesta p\u00e1gina<\/strong><\/p>\n<ol>\n<li><a href=\"#corta\">A resposta curta<\/a><\/li>\n<li><a href=\"#precios\">Pre\u00e7os da API, modelo por modelo<\/a><\/li>\n<li><a href=\"#gemini-4\">Gemini 4 Argon: o que se sabe<\/a><\/li>\n<li><a href=\"#tokens\">Como se l\u00ea um pre\u00e7o por tokens<\/a><\/li>\n<li><a href=\"#ejemplos\">Quanto custa na pr\u00e1tica<\/a><\/li>\n<li><a href=\"#tareas\">Que modelo usar para cada tarefa<\/a><\/li>\n<li><a href=\"#ahorrar\">Quatro formas de pagar menos<\/a><\/li>\n<li><a href=\"#letra\">O que o pre\u00e7o n\u00e3o diz<\/a><\/li>\n<li><a href=\"#faq\">Perguntas frequentes<\/a><\/li>\n<li><a href=\"#cambios\">Registo de altera\u00e7\u00f5es<\/a><\/li>\n<\/ol>\n<\/nav>\n<h2 id=\"corta\">A resposta curta<\/h2>\n<p>Os cinco fornecedores vendem o mesmo em tr\u00eas escal\u00f5es, e a diferen\u00e7a de pre\u00e7o entre o de baixo e o de cima \u00e9 de cem vezes.<\/p>\n<ul>\n<li><strong>Escal\u00e3o pequeno<\/strong> (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): para ler, classificar e extrair dados em quantidade. \u00c9 onde vive a maior parte da automatiza\u00e7\u00e3o de uma empresa.<\/li>\n<li><strong>Escal\u00e3o m\u00e9dio<\/strong> (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): para redigir, resumir e responder com crit\u00e9rio. Claude Sonnet 5.5 e GPT-6.1 Sol custam o mesmo.<\/li>\n<li><strong>Escal\u00e3o alto<\/strong> (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): para programar, para trabalhos de muitos passos seguidos e para o que o escal\u00e3o m\u00e9dio n\u00e3o resolve.<\/li>\n<\/ul>\n<p>A regra que usamos: come\u00e7a-se pelo pequeno, testa-se com casos reais e s\u00f3 se sobe de escal\u00e3o se falhar. Descer depois quase nunca se faz, por isso conv\u00e9m n\u00e3o come\u00e7ar por cima.<\/p>\n<h2 id=\"precios\">Pre\u00e7os da API, modelo por modelo<\/h2>\n<p>Pre\u00e7os de tabela em d\u00f3lares por cada milh\u00e3o de tokens, tal como os publica cada fornecedor. N\u00e3o incluem impostos.<\/p>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:640px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Fornecedor<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Modelo<\/th>\n<th style=\"padding:10px 12px;text-align:right;white-space:nowrap\">Entrada<\/th>\n<th style=\"padding:10px 12px;text-align:right;white-space:nowrap\">Sa\u00edda<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Como o fabricante o apresenta<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"4\"><strong>Anthropic<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Claude Fable 5.1<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Racioc\u00ednio exigente e trabalho aut\u00f3nomo de longo percurso<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Claude Opus 5.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">4&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">20&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">O ponto de partida que a Anthropic recomenda para a maioria dos trabalhos<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Claude Sonnet 5.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">A melhor combina\u00e7\u00e3o de velocidade e intelig\u00eancia<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Claude Haiku 4.5<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">5&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">O mais r\u00e1pido da fam\u00edlia<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"3\"><strong>OpenAI<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>GPT-6 Astra<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">O modelo principal, para racioc\u00ednio complexo e programa\u00e7\u00e3o<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>GPT-6.1 Sol<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">10&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Equil\u00edbrio entre intelig\u00eancia e custo<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>GPT-6 Luna<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,10&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Grande volume com o custo ajustado<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\" rowspan=\"3\"><strong>Google<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Gemini 3.1 Pro (vers\u00e3o preliminar)<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">12&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Compreens\u00e3o de texto, imagem e v\u00eddeo, e agentes. Ainda n\u00e3o \u00e9 vers\u00e3o est\u00e1vel<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Gemini 3.8 Flash<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,75&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,75&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">O Flash mais capaz. Pre\u00e7o at\u00e9 31-12-2026; a partir de 1-1-2027, 1,50&nbsp;$ e 7,50&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Gemini 3.5 Flash-Lite<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,30&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Grande volume, tradu\u00e7\u00e3o e processamento de dados simples<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\" rowspan=\"2\"><strong>DeepSeek<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>DeepSeek V4 Pro<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,32&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,96&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">N\u00e3o admite imagens. Fora das horas de pico custa metade<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>DeepSeek Flash (V4.1)<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,30&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,20&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">Admite imagens. Fora das horas de pico custa metade<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Mistral<\/strong><\/td>\n<td style=\"padding:9px 12px\"><strong>Mistral Large<\/strong><\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px\">O modelo grande do fornecedor europeu<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>As fontes s\u00e3o as p\u00e1ginas de pre\u00e7os de cada fornecedor, ligadas no fim. A OpenAI mant\u00e9m tamb\u00e9m GPT-6 Sol ao mesmo pre\u00e7o que GPT-6.1 Sol; num projeto novo escolhe-se o 6.1. Gemini 4 Argon n\u00e3o est\u00e1 na tabela porque ainda n\u00e3o se pode contratar.<\/p>\n<h2 id=\"gemini-4\">Gemini 4 Argon: o que se sabe<\/h2>\n<p>Gemini 4 existe. A Google apresentou-o a 30 de setembro de 2026 com o nome de <strong>Gemini 4 Argon<\/strong>, como o seu novo modelo de fronteira, mas a 3 de outubro ainda n\u00e3o pode ser usado a partir da API aberta nem aparece na lista de modelos do Gemini.<\/p>\n<ul>\n<li><strong>Quem o tem.<\/strong> Um grupo de defensores de ciberseguran\u00e7a de confian\u00e7a, dentro do programa Fairwind da Google, al\u00e9m das equipas internas da pr\u00f3pria Google.<\/li>\n<li><strong>Quando abre.<\/strong> Sem data. A Google diz que o abrir\u00e1 assim que poss\u00edvel, come\u00e7ando pelos clientes pagos da API e pelos subscritores do Google AI Ultra, quando terminar de testar as suas salvaguardas.<\/li>\n<li><strong>Quanto custar\u00e1.<\/strong> Sair\u00e1 com um pre\u00e7o de lan\u00e7amento de 2&nbsp;$ por milh\u00e3o de tokens de entrada e 10&nbsp;$ de sa\u00edda, com a entrada em cache 95&nbsp;% mais barata. No fim desse per\u00edodo passar\u00e1 para 4&nbsp;$ e 20&nbsp;$. <\/li>\n<li><strong>Para que a Google o apresenta.<\/strong> Para tarefas longas de v\u00e1rios passos: programa\u00e7\u00e3o, trabalho de escrit\u00f3rio especializado como o jur\u00eddico ou o financeiro, e defesa contra ciberataques. Pode gerar at\u00e9 um milh\u00e3o de tokens de sa\u00edda numa \u00fanica resposta.<\/li>\n<\/ul>\n<p>Para uma empresa que automatiza hoje, nada muda: monta-se com os modelos que j\u00e1 se podem contratar e deixa-se preparado para mudar de modelo tocando num ajuste. Quando o Argon abrir, adicion\u00e1-lo-emos \u00e0 tabela com os seus pre\u00e7os.<\/p>\n<h2 id=\"tokens\">Como se l\u00ea um pre\u00e7o por tokens<\/h2>\n<p>A API n\u00e3o se paga por m\u00eas nem por utilizador: paga-se pelo texto processado, medido em tokens. Um token \u00e9 um peda\u00e7o de palavra. Como refer\u00eancia, a Anthropic calcula que um milh\u00e3o de tokens s\u00e3o cerca de 555.000 palavras nos seus modelos atuais.<\/p>\n<ul>\n<li><strong>Entrada<\/strong> \u00e9 o que envias: as instru\u00e7\u00f5es e o documento.<\/li>\n<li><strong>Sa\u00edda<\/strong> \u00e9 o que responde. Custa entre tr\u00eas e oito vezes mais do que a entrada, consoante o modelo.<\/li>\n<li><strong>O racioc\u00ednio conta como sa\u00edda.<\/strong> Os modelos que pensam antes de responder faturam esse racioc\u00ednio mesmo que n\u00e3o o vejas. A Google diz isso na sua tabela: o pre\u00e7o de sa\u00edda inclui os tokens de racioc\u00ednio.<\/li>\n<li><strong>Cada fornecedor conta os tokens \u00e0 sua maneira.<\/strong> O mesmo texto n\u00e3o d\u00e1 o mesmo n\u00famero em todos. A Anthropic avisa que os seus modelos recentes geram cerca de 30&nbsp;% mais tokens do que os anteriores com o mesmo texto.<\/li>\n<\/ul>\n<p>Por isso, o pre\u00e7o por milh\u00e3o serve para ordenar, n\u00e3o para or\u00e7amentar ao c\u00eantimo. O custo real sai de testar com os teus documentos.<\/p>\n<h2 id=\"ejemplos\">Quanto custa na pr\u00e1tica<\/h2>\n<p>Dois trabalhos t\u00edpicos, calculados com os pre\u00e7os da tabela. Os pressupostos s\u00e3o nossos e est\u00e3o \u00e0 vista para que os troques pelos teus:<\/p>\n<ul>\n<li><strong>Ler 1.000 faturas<\/strong> e devolver os seus dados: 2.000 tokens de entrada e 300 de sa\u00edda por fatura, com o texto j\u00e1 extra\u00eddo do PDF.<\/li>\n<li><strong>Redigir 1.000 fichas de produto<\/strong>: 800 tokens de entrada e 600 de sa\u00edda por ficha.<\/li>\n<\/ul>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:520px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Modelo<\/th>\n<th style=\"padding:10px 12px;text-align:right\">Ler 1.000 faturas<\/th>\n<th style=\"padding:10px 12px;text-align:right\">Redigir 1.000 fichas<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\">GPT-6 Luna<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,35&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,38&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">DeepSeek Flash (em hora de pico; metade fora dela)<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,96&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">0,96&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.5 Flash-Lite<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,35&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,74&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Mistral Large<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,45&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">1,30&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.8 Flash<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,63&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">2,85&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Haiku 4.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,50&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">3,80&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Claude Sonnet 5.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">GPT-6.1 Sol<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">Gemini 3.1 Pro<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">7,60&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">8,80&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Opus 5.5<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">14,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">15,20&nbsp;$<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\">GPT-6 Astra<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">35,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">38,00&nbsp;$<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\">Claude Fable 5.1<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">35,00&nbsp;$<\/td>\n<td style=\"padding:9px 12px;text-align:right;white-space:nowrap\">38,00&nbsp;$<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>\u00c9 um c\u00e1lculo com pre\u00e7os de tabela, n\u00e3o uma medi\u00e7\u00e3o. Nos modelos que raciocinam, a sa\u00edda real \u00e9 maior do que a resposta vis\u00edvel e a conta sobe. Se a fatura entrar como imagem e n\u00e3o como texto, tamb\u00e9m.<\/p>\n<p>A leitura que se mant\u00e9m: o mesmo trabalho custa c\u00eantimos ou dezenas de d\u00f3lares consoante o escal\u00e3o. A escolha do modelo pesa cem vezes mais do que qualquer desconto.<\/p>\n<h2 id=\"tareas\">Que modelo usar para cada tarefa<\/h2>\n<p>Este \u00e9 o ponto de partida que usamos ao montar um processo. N\u00e3o \u00e9 uma classifica\u00e7\u00e3o de qualidade: \u00e9 por onde se come\u00e7a a testar.<\/p>\n<div style=\"overflow:auto;max-width:100%\">\n<table style=\"width:100%;border-collapse:collapse;font-size:14px;min-width:560px\">\n<thead>\n<tr style=\"background:#334155;color:#fff\">\n<th style=\"padding:10px 12px;text-align:left\">Tarefa<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Come\u00e7a por<\/th>\n<th style=\"padding:10px 12px;text-align:left\">Porqu\u00ea<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Extrair dados de documentos<\/strong> (faturas, guias de remessa, encomendas)<\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o pequeno<\/td>\n<td style=\"padding:9px 12px\">\u00c9 muito volume e a resposta verifica-se com regras: se a base mais o IVA n\u00e3o d\u00e1 o total, sabe-se<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Classificar e distribuir<\/strong> (emails, incid\u00eancias, avalia\u00e7\u00f5es)<\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o pequeno<\/td>\n<td style=\"padding:9px 12px\">A sa\u00edda \u00e9 uma etiqueta: poucos tokens e pouca margem para inventar<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Traduzir cat\u00e1logo<\/strong><\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o pequeno ou m\u00e9dio<\/td>\n<td style=\"padding:9px 12px\">O pequeno serve para atributos e textos curtos; o m\u00e9dio, para descri\u00e7\u00f5es que t\u00eam de vender<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Redigir<\/strong> (fichas, respostas a clientes, resumos)<\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o m\u00e9dio<\/td>\n<td style=\"padding:9px 12px\">Aqui nota-se o tom, e uma pessoa vai l\u00ea-lo<\/td>\n<\/tr>\n<tr>\n<td style=\"padding:9px 12px\"><strong>Trabalhos de v\u00e1rios passos<\/strong> (consultar, decidir, escrever noutro programa)<\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o m\u00e9dio ou alto<\/td>\n<td style=\"padding:9px 12px\">Um erro num passo arrasta-se para os seguintes; compensa pagar por menos falhas<\/td>\n<\/tr>\n<tr style=\"background:#f8fafc\">\n<td style=\"padding:9px 12px\"><strong>Programar<\/strong><\/td>\n<td style=\"padding:9px 12px\">Escal\u00e3o alto<\/td>\n<td style=\"padding:9px 12px\">\u00c9 para isso que a Anthropic e a OpenAI apresentam os seus modelos grandes<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<\/div>\n<p>O teste que decide \u00e9 sempre o mesmo: vinte casos reais seus, com a resposta correta j\u00e1 conhecida, passados pelo modelo pequeno. Se acertar os que tem de acertar, n\u00e3o h\u00e1 mais nada a comprar.<\/p>\n<h2 id=\"ahorrar\">Quatro formas de pagar menos<\/h2>\n<ol>\n<li><strong>Processamento em lotes.<\/strong> Se o trabalho n\u00e3o tiver pressa, Anthropic, OpenAI, Google e Mistral cobram metade do pre\u00e7o ao envi\u00e1-lo em lote. Uma remessa noturna de faturas ou fichas \u00e9 o caso cl\u00e1ssico.<\/li>\n<li><strong>Cache de instru\u00e7\u00f5es.<\/strong> Quando todos os pedidos repetem as mesmas instru\u00e7\u00f5es longas, essa parte \u00e9 cobrada muito mais barata a partir da segunda vez. Em Claude, a um d\u00e9cimo do pre\u00e7o de entrada ou menos.<\/li>\n<li><strong>O modelo pequeno primeiro.<\/strong> Deixe o pequeno resolver o f\u00e1cil e passe ao m\u00e9dio apenas o que n\u00e3o estiver claro. Costuma ser o maior desconto de todos.<\/li>\n<li><strong>Sa\u00eddas curtas.<\/strong> A sa\u00edda \u00e9 o que custa caro. Pedir os dados numa estrutura fixa e sem explica\u00e7\u00f5es reduz o custo e, de passagem, facilita a verifica\u00e7\u00e3o.<\/li>\n<\/ol>\n<h2 id=\"letra\">O que o pre\u00e7o n\u00e3o diz<\/h2>\n<ul>\n<li><strong>O que fazem com os seus dados.<\/strong> Gemini tem um n\u00edvel gratuito, mas a Google indica que nele o conte\u00fado \u00e9 usado para melhorar os seus produtos; no pago, n\u00e3o. Com dados de clientes ou de pessoal, o n\u00edvel gratuito n\u00e3o \u00e9 op\u00e7\u00e3o. Antes de enviar dados pessoais a qualquer fornecedor \u00e9 preciso ver o contrato de subcontrata\u00e7\u00e3o de tratamento e onde s\u00e3o processados; DeepSeek \u00e9 uma empresa chinesa e Mistral, francesa.<\/li>\n<li><strong>Pr\u00e9-lan\u00e7amento n\u00e3o \u00e9 est\u00e1vel.<\/strong> Gemini 3.1 Pro continua em vers\u00e3o preliminar. Um modelo assim pode mudar ou ser retirado com pouco aviso, e n\u00e3o \u00e9 boa base para um processo que tem de funcionar sozinho.<\/li>\n<li><strong>Os documentos muito longos custam mais.<\/strong> OpenAI duplica o pre\u00e7o de entrada em contexto longo, e Gemini 3.1 Pro duplica-o a partir de 200.000 tokens.<\/li>\n<li><strong>Os pre\u00e7os mudam.<\/strong> Gemini 3.8 Flash duplica o seu pre\u00e7o a 1 de janeiro de 2027, e DeepSeek cobra o dobro nas suas horas de pico, que caem na madrugada e na manh\u00e3 de Espanha.<\/li>\n<li><strong>O modelo n\u00e3o \u00e9 o projeto.<\/strong> A conta do fornecedor costuma ser a parte pequena. O que custa \u00e9 ligar ao seu programa, tratar os casos raros e decidir o que \u00e9 revisto por uma pessoa.<\/li>\n<\/ul>\n<div class=\"wp-block-group has-background\" style=\"background-color:#f0f7ff;padding:22px 26px;border-radius:12px;border-left:4px solid #017cba;margin:1.8em 0\">\n<p style=\"margin:0 0 .6em\"><strong>Que processo quer deixar de fazer \u00e0 m\u00e3o?<\/strong><\/p>\n<p style=\"margin:0 0 1em\">Montamos automatiza\u00e7\u00f5es para lojas online e PMEs: medimos quanto custa hoje o processo, testamos com os vossos documentos qual \u00e9 o modelo mais barato que o resolve e deixamo-lo a funcionar, com uma pessoa a rever onde for necess\u00e1rio. A IA \u00e9 contratada com a vossa pr\u00f3pria chave: o consumo \u00e9 faturado pelo fornecedor na vossa conta, sem intermedi\u00e1rios nem sobretaxas.<\/p>\n<p style=\"margin:0\"><a href=\"https:\/\/consultoriaehero.com\/pt\/automacao-de-processos-para-e-commerce\/\"><strong>Calcular quanto vos custa faz\u00ea-lo \u00e0 m\u00e3o<\/strong><\/a> \u00b7 <a href=\"https:\/\/consultoriaehero.com\/pt\/automatizar-faturas-com-ia\/\">Ver um caso: faturas de fornecedores<\/a><\/p>\n<\/div>\n<h2 id=\"faq\">Perguntas frequentes<\/h2>\n<p><strong>Quanto custa a API do ChatGPT?<\/strong><\/p>\n<p>Depende do modelo. A 3 de outubro de 2026, GPT-6 Luna custa 0,10&nbsp;$ por milh\u00e3o de tokens de entrada e 0,50&nbsp;$ de sa\u00edda; GPT-6.1 Sol, 2&nbsp;$ e 10&nbsp;$; GPT-6 Astra, 10&nbsp;$ e 50&nbsp;$. Paga-se por uso, sem quota fixa.<\/p>\n<p><strong>Quanto custa a API do Claude?<\/strong><\/p>\n<p>Claude Haiku 4.5 custa 1&nbsp;$ por milh\u00e3o de tokens de entrada e 5&nbsp;$ de sa\u00edda; Sonnet 5.5, 2&nbsp;$ e 10&nbsp;$; Opus 5.5, 4&nbsp;$ e 20&nbsp;$; Fable 5.1, 10&nbsp;$ e 50&nbsp;$.<\/p>\n<p><strong>Quanto custa a API do Gemini?<\/strong><\/p>\n<p>Gemini 3.5 Flash-Lite custa 0,30&nbsp;$ de entrada e 2,50&nbsp;$ de sa\u00edda por milh\u00e3o de tokens. Gemini 3.8 Flash, 0,75&nbsp;$ e 3,75&nbsp;$ at\u00e9 31 de dezembro de 2026, e o dobro a partir de janeiro. H\u00e1 um n\u00edvel gratuito com limites, no qual a Google usa o conte\u00fado para melhorar os seus produtos.<\/p>\n<p><strong>Existe Gemini 4?<\/strong><\/p>\n<p>Sim. A Google apresentou Gemini 4 Argon a 30 de setembro de 2026, mas a 3 de outubro ainda n\u00e3o se pode contratar: s\u00f3 \u00e9 usado por um grupo de defensores de ciberseguran\u00e7a e n\u00e3o consta na API do Gemini. Ser\u00e1 aberto primeiro a clientes pagos da API e a subscritores do Google AI Ultra, sem data. O mais recente que se pode usar hoje \u00e9 Gemini 3.8 Flash. Gemma 4 \u00e9 outra coisa: a fam\u00edlia de modelos abertos da Google.<\/p>\n<p><strong>Quanto custar\u00e1 Gemini 4 Argon?<\/strong><\/p>\n<p>A Google anunciou um pre\u00e7o de lan\u00e7amento de 2&nbsp;$ por milh\u00e3o de tokens de entrada e 10&nbsp;$ de sa\u00edda, que passar\u00e1 para 4&nbsp;$ e 20&nbsp;$ quando esse per\u00edodo terminar. N\u00e3o disse quanto tempo durar\u00e1.<\/p>\n<p><strong>\u00c9 o mesmo uma subscri\u00e7\u00e3o do ChatGPT ou do Claude que a API?<\/strong><\/p>\n<p>N\u00e3o. A subscri\u00e7\u00e3o \u00e9 para uma pessoa usar o chat, com uma quota fixa. A API \u00e9 para um programa chamar o modelo, e paga-se por tokens. Para automatizar um processo \u00e9 necess\u00e1ria a API.<\/p>\n<p><strong>Que modelo de IA \u00e9 melhor para uma empresa?<\/strong><\/p>\n<p>O mais barato que resolva a sua tarefa com os seus documentos. Para extrair dados e classificar, costuma bastar o escal\u00e3o pequeno; para redigir, o m\u00e9dio; o alto fica reservado para programar e para trabalhos de muitos passos.<\/p>\n<p><strong>Os pre\u00e7os incluem IVA?<\/strong><\/p>\n<p>N\u00e3o. S\u00e3o pre\u00e7os de tabela em d\u00f3lares e n\u00e3o incluem impostos. O que se aplica depende do fornecedor e de onde est\u00e1 a sua empresa.<\/p>\n<p><strong>De quanto em quanto tempo mudam os modelos?<\/strong><\/p>\n<p>V\u00e1rias vezes por ano em cada fornecedor. Por isso conv\u00e9m que o processo n\u00e3o dependa de um modelo concreto: que o mudar seja alterar uma defini\u00e7\u00e3o, n\u00e3o refazer o trabalho.<\/p>\n<h2 id=\"cambios\">Registo de altera\u00e7\u00f5es<\/h2>\n<ul>\n<li><strong>3-10-2026.<\/strong> Primeira vers\u00e3o, com os pre\u00e7os de tabela de Anthropic, OpenAI, Google, DeepSeek e Mistral verificados nesse dia, e o que a Google anunciou sobre Gemini 4 Argon, que ainda n\u00e3o se pode contratar.<\/li>\n<\/ul>\n<h2>Conclus\u00e3o<\/h2>\n<p>Escolher modelo \u00e9 escolher escal\u00e3o, e o escal\u00e3o \u00e9 decidido pela tarefa. Comece pelo pequeno, teste com os seus casos e suba apenas se falhar. O resto da compara\u00e7\u00e3o muda de poucos em poucos meses, e por isso mantemo-la atualizada aqui.<\/p>\n<p><em>Os pre\u00e7os s\u00e3o os de tabela publicados por cada fornecedor na data indicada e podem mudar. Os exemplos de custo s\u00e3o c\u00e1lculos orientativos, n\u00e3o um or\u00e7amento.<\/em><\/p>\n<h2>Liga\u00e7\u00f5es \u00fateis<\/h2>\n<ul>\n<li><a href=\"https:\/\/consultoriaehero.com\/pt\/automatizar-faturas-com-ia\/\">Automatizar faturas com IA<\/a>: um processo inteiro, passo a passo, com um caso real.<\/li>\n<li><a href=\"https:\/\/consultoriaehero.com\/pt\/automacao-de-processos-para-e-commerce\/\">Automatiza\u00e7\u00e3o de processos para e-commerce<\/a>: o que se automatiza, como trabalhamos e quanto custa.<\/li>\n<li><a href=\"https:\/\/platform.claude.com\/docs\/en\/about-claude\/pricing\" rel=\"noopener\" target=\"_blank\">Pre\u00e7os da API do Claude<\/a> (Anthropic).<\/li>\n<li><a href=\"https:\/\/platform.openai.com\/docs\/pricing\" rel=\"noopener\" target=\"_blank\">Pre\u00e7os da API da OpenAI<\/a>.<\/li>\n<li><a href=\"https:\/\/ai.google.dev\/gemini-api\/docs\/pricing\" rel=\"noopener\" target=\"_blank\">Pre\u00e7os da API do Gemini<\/a> (Google).<\/li>\n<li><a href=\"https:\/\/blog.google\/innovation-and-ai\/models-and-research\/gemini-models\/gemini-4-argon\/\" rel=\"noopener\" target=\"_blank\">An\u00fancio de Gemini 4 Argon<\/a> (Google, em ingl\u00eas).<\/li>\n<li><a href=\"https:\/\/api-docs.deepseek.com\/quick_start\/pricing\" rel=\"noopener\" target=\"_blank\">Pre\u00e7os da API do DeepSeek<\/a>.<\/li>\n<li><a href=\"https:\/\/mistral.ai\/pricing\" rel=\"noopener\" target=\"_blank\">Pre\u00e7os da Mistral<\/a>.<\/li>\n<\/ul>\n<p><script type=\"application\/ld+json\">{\"@context\":\"https:\/\/schema.org\",\"@type\":\"Article\",\"headline\":\"Compara\u00e7\u00e3o de modelos de IA em 2026: pre\u00e7os da API e qual usar na sua empresa\",\"description\":\"Compara\u00e7\u00e3o de modelos de IA sempre atualizada: pre\u00e7os oficiais da API do Claude, GPT-6, Gemini, DeepSeek e Mistral, e que modelo usar em cada tarefa.\",\"inLanguage\":\"pt-PT\",\"author\":{\"@type\":\"Organization\",\"name\":\"Consultor\u00eda EHERO\",\"url\":\"https:\/\/consultoriaehero.com\/pt\/\"},\"publisher\":{\"@type\":\"Organization\",\"name\":\"Consultor\u00eda EHERO\",\"url\":\"https:\/\/consultoriaehero.com\/pt\/\"},\"about\":[{\"@type\":\"Thing\",\"name\":\"Modelos de intelig\u00eancia artificial\"},{\"@type\":\"Thing\",\"name\":\"Pre\u00e7os da API de modelos de linguagem\"}]}<\/script><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Compara\u00e7\u00e3o de modelos de IA sempre atualizada: pre\u00e7os oficiais da API do Claude, GPT-6, Gemini, DeepSeek e Mistral, e que modelo usar em cada tarefa.<\/p>\n","protected":false},"author":4,"featured_media":17850,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"_jf_save_progress":"","rank_math_focus_keyword":"compara\u00e7\u00e3o de modelos de IA,pre\u00e7os API ChatGPT,pre\u00e7os API Claude,pre\u00e7os API Gemini,que modelo de IA usar","rank_math_title":"Compara\u00e7\u00e3o de modelos de IA 2026: pre\u00e7os da API | EHERO","rank_math_description":"Compara\u00e7\u00e3o de modelos de IA sempre atualizada: pre\u00e7os oficiais da API do Claude, GPT-6, Gemini, DeepSeek e Mistral, e que modelo usar em cada tarefa.","rank_math_robots":[],"rank_math_canonical_url":"","rank_math_seo_score":81,"footnotes":""},"categories":[1573],"tags":[8338,1785,8337],"class_list":["post-17811","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-inteligencia-artificial-pt","tag-automatizacion-de-procesos","tag-inteligencia-artificial-pt","tag-modelos-de-ia"],"acf":[],"_links":{"self":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17811","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/users\/4"}],"replies":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/comments?post=17811"}],"version-history":[{"count":3,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17811\/revisions"}],"predecessor-version":[{"id":17851,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/posts\/17811\/revisions\/17851"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/media\/17850"}],"wp:attachment":[{"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/media?parent=17811"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/categories?post=17811"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/consultoriaehero.com\/wp-json\/wp\/v2\/tags?post=17811"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}