Comparativa de modelos de IA en 2026: precios de la API y cuál usar en tu empresa

Consultoría ehero

13 minutos de lectura

No hay un «mejor modelo de IA»: hay tareas, y casi siempre las resuelve un modelo más barato del que se piensa. Esta comparativa de modelos de IA recoge los precios oficiales de la API de Claude, GPT-6, Gemini, DeepSeek y Mistral a 3 de octubre de 2026 y dice cuál encaja en cada trabajo de una empresa.

Es una página viva. La revisamos cada vez que sale un modelo o cambia un precio, y al final apuntamos qué ha cambiado y cuándo.

Precios comprobados el 3 de octubre de 2026

Modelos más recientes que se pueden contratar: Claude Opus 5.5 y Fable 5.1 (Anthropic), GPT-6 Astra y GPT-6.1 Sol (OpenAI), Gemini 3.8 Flash (Google).

¿Y Gemini 4? Existe, pero aún no se puede contratar. Google presentó Gemini 4 Argon el 30 de septiembre de 2026 y de momento solo lo usa un grupo de defensores de ciberseguridad.

Lo próximo que cambia: la apertura de Gemini 4 Argon, sin fecha anunciada, y Gemini 3.8 Flash, que dobla su precio el 1 de enero de 2027.

La respuesta corta

Los cinco proveedores venden lo mismo en tres escalones, y la diferencia de precio entre el de abajo y el de arriba es de cien veces.

  • Escalón pequeño (GPT-6 Luna, Gemini 3.5 Flash-Lite, DeepSeek Flash, Claude Haiku 4.5): para leer, clasificar y sacar datos en cantidad. Es donde vive la mayor parte de la automatización de una empresa.
  • Escalón medio (Claude Sonnet 5.5, GPT-6.1 Sol, Gemini 3.8 Flash, Mistral Large): para redactar, resumir y contestar con criterio. Claude Sonnet 5.5 y GPT-6.1 Sol cuestan lo mismo.
  • Escalón alto (Claude Opus 5.5, GPT-6 Astra, Claude Fable 5.1): para programar, para trabajos de muchos pasos seguidos y para lo que el medio no resuelve.

La regla que usamos: se empieza por el pequeño, se prueba con casos reales y solo se sube de escalón si falla. Bajar después casi nunca se hace, así que conviene no empezar por arriba.

Precios de la API, modelo por modelo

Precios de tarifa en dólares por cada millón de tokens, tal como los publica cada proveedor. No incluyen impuestos.

Proveedor Modelo Entrada Salida Cómo lo presenta el fabricante
Anthropic Claude Fable 5.1 10 $ 50 $ Razonamiento exigente y trabajo autónomo de largo recorrido
Claude Opus 5.5 4 $ 20 $ El punto de partida que recomienda Anthropic para la mayoría de trabajos
Claude Sonnet 5.5 2 $ 10 $ La mejor combinación de velocidad e inteligencia
Claude Haiku 4.5 1 $ 5 $ El más rápido de la familia
OpenAI GPT-6 Astra 10 $ 50 $ El modelo insignia, para razonamiento complejo y programación
GPT-6.1 Sol 2 $ 10 $ Equilibrio entre inteligencia y coste
GPT-6 Luna 0,10 $ 0,50 $ Gran volumen con el coste ajustado
Google Gemini 3.1 Pro (versión preliminar) 2 $ 12 $ Comprensión de texto, imagen y vídeo, y agentes. Aún no es versión estable
Gemini 3.8 Flash 0,75 $ 3,75 $ El Flash más capaz. Precio hasta el 31-12-2026; desde el 1-1-2027, 1,50 $ y 7,50 $
Gemini 3.5 Flash-Lite 0,30 $ 2,50 $ Gran volumen, traducción y proceso de datos sencillo
DeepSeek DeepSeek V4 Pro 1,32 $ 3,96 $ No admite imágenes. Fuera de sus horas punta cuesta la mitad
DeepSeek Flash (V4.1) 0,30 $ 1,20 $ Admite imágenes. Fuera de sus horas punta cuesta la mitad
Mistral Mistral Large 0,50 $ 1,50 $ El modelo grande del proveedor europeo

Las fuentes son las páginas de precios de cada proveedor, enlazadas al final. OpenAI mantiene además GPT-6 Sol al mismo precio que GPT-6.1 Sol; en un proyecto nuevo se elige el 6.1. Gemini 4 Argon no está en la tabla porque todavía no se puede contratar.

Gemini 4 Argon: lo que se sabe

Gemini 4 existe. Google lo presentó el 30 de septiembre de 2026 con el nombre de Gemini 4 Argon, como su nuevo modelo de frontera, pero a 3 de octubre no se puede usar desde la API abierta ni aparece en la lista de modelos de Gemini.

  • Quién lo tiene. Un grupo de defensores de ciberseguridad de confianza, dentro del programa Fairwind de Google, además de los equipos internos de la propia Google.
  • Cuándo se abre. Sin fecha. Google dice que lo abrirá lo antes posible, empezando por los clientes de pago de la API y los suscriptores de Google AI Ultra, cuando termine de probar sus salvaguardas.
  • Cuánto costará. Saldrá con un precio de lanzamiento de 2 $ por millón de tokens de entrada y 10 $ de salida, con la entrada en caché un 95 % más barata. Al acabar ese periodo pasará a 4 $ y 20 $.
  • Para qué lo presenta Google. Para tareas largas de varios pasos: programación, trabajo de oficina especializado como el legal o el financiero, y defensa frente a ciberataques. Puede generar hasta un millón de tokens de salida en una sola respuesta.

Para una empresa que automatiza hoy no cambia nada: se monta con los modelos que ya se pueden contratar y se deja preparado para cambiar de modelo tocando un ajuste. Cuando Argon se abra, lo añadiremos a la tabla con sus precios.

Cómo se lee un precio por tokens

La API no se paga por mes ni por usuario: se paga por texto procesado, medido en tokens. Un token es un trozo de palabra. Como referencia, Anthropic calcula que un millón de tokens son unas 555.000 palabras en sus modelos actuales.

  • Entrada es lo que le mandas: las instrucciones y el documento.
  • Salida es lo que contesta. Cuesta entre tres y ocho veces más que la entrada, según el modelo.
  • El razonamiento cuenta como salida. Los modelos que piensan antes de contestar facturan ese razonamiento aunque no lo veas. Google lo dice en su tarifa: el precio de salida incluye los tokens de razonamiento.
  • Cada proveedor cuenta los tokens a su manera. El mismo texto no da el mismo número en todos. Anthropic avisa de que sus modelos recientes generan en torno a un 30 % más de tokens que los anteriores con el mismo texto.

Por eso el precio por millón sirve para ordenar, no para presupuestar al céntimo. El coste real sale de probar con tus documentos.

Cuánto cuesta en la práctica

Dos trabajos típicos, calculados con los precios de la tabla. Los supuestos son nuestros y están a la vista para que los cambies por los tuyos:

  • Leer 1.000 facturas y devolver sus datos: 2.000 tokens de entrada y 300 de salida por factura, con el texto ya extraído del PDF.
  • Redactar 1.000 fichas de producto: 800 tokens de entrada y 600 de salida por ficha.
Modelo Leer 1.000 facturas Redactar 1.000 fichas
GPT-6 Luna 0,35 $ 0,38 $
DeepSeek Flash (en hora punta; la mitad fuera de ella) 0,96 $ 0,96 $
Gemini 3.5 Flash-Lite 1,35 $ 1,74 $
Mistral Large 1,45 $ 1,30 $
Gemini 3.8 Flash 2,63 $ 2,85 $
Claude Haiku 4.5 3,50 $ 3,80 $
Claude Sonnet 5.5 7,00 $ 7,60 $
GPT-6.1 Sol 7,00 $ 7,60 $
Gemini 3.1 Pro 7,60 $ 8,80 $
Claude Opus 5.5 14,00 $ 15,20 $
GPT-6 Astra 35,00 $ 38,00 $
Claude Fable 5.1 35,00 $ 38,00 $

Es un cálculo con precios de tarifa, no una medición. En los modelos que razonan, la salida real es mayor que la respuesta visible y la cuenta sube. Si la factura entra como imagen y no como texto, también.

La lectura que sí aguanta: el mismo trabajo cuesta céntimos o decenas de dólares según el escalón. La elección del modelo pesa cien veces más que cualquier descuento.

Qué modelo usar para cada tarea

Este es el punto de partida que usamos nosotros al montar un proceso. No es una clasificación de calidad: es por dónde se empieza a probar.

Tarea Empieza por Por qué
Sacar datos de documentos (facturas, albaranes, pedidos) Escalón pequeño Es mucho volumen y la respuesta se comprueba con reglas: si la base más el IVA no da el total, se sabe
Clasificar y repartir (correos, incidencias, reseñas) Escalón pequeño La salida es una etiqueta: pocos tokens y poco margen para inventar
Traducir catálogo Escalón pequeño o medio El pequeño vale para atributos y textos cortos; el medio, para descripciones que tienen que vender
Redactar (fichas, respuestas a clientes, resúmenes) Escalón medio Aquí se nota el tono, y una persona va a leerlo
Trabajos de varios pasos (consultar, decidir, escribir en otro programa) Escalón medio o alto Un error en un paso se arrastra a los siguientes; compensa pagar por menos fallos
Programar Escalón alto Es para lo que Anthropic y OpenAI presentan sus modelos grandes

La prueba que decide es siempre la misma: veinte casos reales tuyos, con la respuesta correcta ya sabida, pasados por el modelo pequeño. Si acierta los que tiene que acertar, no hay nada más que comprar.

Cuatro formas de pagar menos

  1. Proceso por lotes. Si el trabajo no corre prisa, Anthropic, OpenAI, Google y Mistral lo cobran a mitad de precio mandándolo en lote. Una tanda nocturna de facturas o de fichas es el caso de libro.
  2. Caché de instrucciones. Cuando todas las peticiones repiten las mismas instrucciones largas, esa parte se cobra muy rebajada a partir de la segunda vez. En Claude, a una décima parte del precio de entrada o menos.
  3. El modelo pequeño primero. Que el pequeño resuelva lo fácil y pase al medio solo lo que no tiene claro. Suele ser la mayor rebaja de todas.
  4. Salidas cortas. La salida es lo caro. Pedir los datos en una estructura fija y sin explicaciones abarata y, de paso, facilita comprobarlos.

Lo que el precio no dice

  • Qué hacen con tus datos. Gemini tiene un nivel gratuito, pero Google indica que en él el contenido se usa para mejorar sus productos; en el de pago, no. Con datos de clientes o de personal, el nivel gratuito no es opción. Antes de mandar datos personales a cualquier proveedor hay que mirar su contrato de encargo de tratamiento y dónde se procesan; DeepSeek es una empresa china y Mistral, francesa.
  • Preliminar no es estable. Gemini 3.1 Pro sigue en versión preliminar. Un modelo así puede cambiar o retirarse con poco aviso, y no es buena base para un proceso que tiene que funcionar solo.
  • Los documentos muy largos cuestan más. OpenAI dobla el precio de entrada en contexto largo, y Gemini 3.1 Pro lo dobla a partir de 200.000 tokens.
  • Los precios se mueven. Gemini 3.8 Flash dobla su precio el 1 de enero de 2027, y DeepSeek cobra el doble en sus horas punta, que caen en la madrugada y la mañana de España.
  • El modelo no es el proyecto. La cuenta del proveedor suele ser la parte pequeña. Lo que cuesta es conectar con tu programa, tratar los casos raros y decidir qué revisa una persona.

¿Qué proceso quieres dejar de hacer a mano?

Montamos automatizaciones para tiendas online y pymes: medimos lo que cuesta hoy el proceso, probamos con vuestros documentos cuál es el modelo más barato que lo resuelve y lo dejamos funcionando, con una persona revisando donde hace falta. La IA se contrata con vuestra propia clave: el consumo lo factura el proveedor en vuestra cuenta, sin intermediarios ni recargos.

Calcular lo que os cuesta hacerlo a mano · Ver un caso: facturas de proveedores

Preguntas frecuentes

¿Cuánto cuesta la API de ChatGPT?

Depende del modelo. A 3 de octubre de 2026, GPT-6 Luna cuesta 0,10 $ por millón de tokens de entrada y 0,50 $ de salida; GPT-6.1 Sol, 2 $ y 10 $; GPT-6 Astra, 10 $ y 50 $. Se paga por uso, sin cuota fija.

¿Cuánto cuesta la API de Claude?

Claude Haiku 4.5 cuesta 1 $ por millón de tokens de entrada y 5 $ de salida; Sonnet 5.5, 2 $ y 10 $; Opus 5.5, 4 $ y 20 $; Fable 5.1, 10 $ y 50 $.

¿Cuánto cuesta la API de Gemini?

Gemini 3.5 Flash-Lite cuesta 0,30 $ de entrada y 2,50 $ de salida por millón de tokens. Gemini 3.8 Flash, 0,75 $ y 3,75 $ hasta el 31 de diciembre de 2026, y el doble desde enero. Hay un nivel gratuito con límites, en el que Google usa el contenido para mejorar sus productos.

¿Existe Gemini 4?

Sí. Google presentó Gemini 4 Argon el 30 de septiembre de 2026, pero a 3 de octubre todavía no se puede contratar: solo lo usa un grupo de defensores de ciberseguridad y no figura en la API de Gemini. Se abrirá primero a clientes de pago de la API y a suscriptores de Google AI Ultra, sin fecha. Lo más reciente que se puede usar hoy es Gemini 3.8 Flash. Gemma 4 es otra cosa: la familia de modelos abiertos de Google.

¿Cuánto costará Gemini 4 Argon?

Google ha anunciado un precio de lanzamiento de 2 $ por millón de tokens de entrada y 10 $ de salida, que pasará a 4 $ y 20 $ cuando acabe ese periodo. No ha dicho cuánto durará.

¿Es lo mismo una suscripción de ChatGPT o de Claude que la API?

No. La suscripción es para que una persona use el chat, con una cuota fija. La API es para que un programa llame al modelo, y se paga por tokens. Para automatizar un proceso hace falta la API.

¿Qué modelo de IA es mejor para una empresa?

El más barato que resuelva tu tarea con tus documentos. Para sacar datos y clasificar suele bastar el escalón pequeño; para redactar, el medio; el alto se reserva para programar y para trabajos de muchos pasos.

¿Los precios incluyen IVA?

No. Son precios de tarifa en dólares y no incluyen impuestos. El que se aplique depende del proveedor y de dónde esté tu empresa.

¿Cada cuánto cambian los modelos?

Varias veces al año en cada proveedor. Por eso conviene que el proceso no dependa de un modelo concreto: que cambiarlo sea tocar un ajuste, no rehacer el trabajo.

Registro de cambios

  • 3-10-2026. Primera versión, con los precios de tarifa de Anthropic, OpenAI, Google, DeepSeek y Mistral comprobados ese día, y lo que Google ha anunciado de Gemini 4 Argon, que todavía no se puede contratar.

Conclusión

Elegir modelo es elegir escalón, y el escalón lo decide la tarea. Empieza por el pequeño, prueba con tus casos y sube solo si falla. El resto de la comparativa cambia cada pocos meses, y por eso la mantenemos al día aquí.

Los precios son los de tarifa publicados por cada proveedor en la fecha indicada y pueden cambiar. Los ejemplos de coste son cálculos orientativos, no un presupuesto.

Enlaces útiles

¿Quieres estar al tanto de todas las novedades?

¡Síguenos en nuestras redes sociales para no perderte nada!

Suscríbete a nuestro boletín

Recibe ofertas exclusivas y novedades.

¡Obtén un 10% de descuento en tu primer pedido!