[ Observatorio · precios oficiales · verificado 2026-09-23 ]

Observatorio de precios
de modelos de IA.

Lo que cobran hoy Anthropic, OpenAI y Google por millón de tokens en su API: entrada, salida, caché y batch. Solo precios de lista publicados en la fuente oficial, con enlace y fecha de verificación. Sin estimaciones ni cifras de terceros.

Verificado · 23 de septiembre de 2026 Fuentes · páginas de precios oficiales de los 3 proveedores Moneda · USD por millón de tokens, sin impuestos Revisión · mensual o cuando cambie un precio
[ Lectura rápida ]

Lo que dicen los precios a 2026-09-23.

  1. El modelo más caro ya no es el más capaz. Claude Opus 5.5, lanzado el 22 de septiembre a 4 $ / 20 $, supera a Claude Fable 5.1 (10 $ / 50 $) en la mayoría de los benchmarks que publica el propio fabricante, costando 2,5 veces menos por token. Es el primer lanzamiento de esta serie en el que bajar de gama mejora el resultado.
  2. Los dos modelos de la franja frontera cuestan exactamente lo mismo. Claude Fable 5.1 y GPT-6 Astra se venden a 10 $ de entrada y 50 $ de salida por millón de tokens. La diferencia está en la caché: Anthropic relee al 2,5 % (0,25 $) y OpenAI al 10 % (1 $). Google no compite en esa franja: Gemini 3.1 Pro (preview) está en 2 $ / 12 $.
  3. Entre el modelo más caro y el más barato de la tabla hay 100-200 veces de diferencia. Un millón de tokens de salida cuesta 50 $ en Fable 5.1 o Astra y 0,40 $ en GPT-5 nano o Gemini 2.5 Flash-Lite. Elegir el modelo por tarea, no uno para todo, es la primera decisión de coste de cualquier agente.
  4. Hay tres precios con fecha de caducidad. GPT-5.6 Sol es promocional hasta el 21 de noviembre de 2026; Gemini 3.8, 3.7 y 3.6 Flash duplican su precio el 1 de enero de 2027 (de 0,75 $ / 3,75 $ a 1,50 $ / 7,50 $). Al contrario, Claude Sonnet 5 ha consolidado su precio de lanzamiento (2 $ / 10 $) como definitivo.
[ Precios de lista por proveedor ]

Tablas oficiales, modelo a modelo.

Precios en dólares por millón de tokens de texto en la API directa de cada proveedor. Los tres aplican un 50 % de descuento en Batch (procesamiento asíncrono) sobre entrada y salida. Las notas al pie recogen promociones, tramos y excepciones tal como las publica la fuente.

Anthropic · Claude Fuente oficial ↗

ModeloEntradaEscritura caché 5 minLectura cachéSalidaBatch (entrada / salida)
Claude Fable 5.1 10 $ 12,50 $ 0,25 $ 50 $ 5 $ / 25 $
Claude Fable 5 10 $ 12,50 $ 1 $ 50 $ 5 $ / 25 $
Claude Opus 5.5 4 $ 5 $ 0,20 $ 20 $ 2 $ / 10 $
Claude Opus 5 5 $ 6,25 $ 0,50 $ 25 $ 2,50 $ / 12,50 $
Claude Opus 4.8 5 $ 6,25 $ 0,50 $ 25 $ 2,50 $ / 12,50 $
Claude Sonnet 5 2 $ 2,50 $ 0,20 $ 10 $ 1 $ / 5 $
Claude Sonnet 4.6 3 $ 3,75 $ 0,30 $ 15 $ 1,50 $ / 7,50 $
Claude Haiku 4.5 1 $ 1,25 $ 0,10 $ 5 $ 0,50 $ / 2,50 $
  • Claude Fable 5.1: Lectura de caché al 2,5 % del precio de entrada (resto de modelos: 10 %).
  • Claude Opus 5.5: Lectura de caché al 5 % del precio de entrada (el estándar es 10 %). Modo rápido: 8 $ / 40 $. Lanzado el 22 sep 2026.
  • Claude Opus 5: Modo rápido (research preview): 10 $ / 50 $.
  • Claude Sonnet 5: El precio de lanzamiento pasó a ser el estándar: la subida a 3 $ / 15 $ prevista para el 1 sep 2026 no se aplicó.
  • Escritura de caché a 1 hora: 2× el precio de entrada. Todos los modelos 4.6 y posteriores facturan el contexto de 1M tokens al precio estándar, sin tramo largo.
  • Inferencia restringida a EE. UU. (inference_geo: "us"): multiplicador 1,1× sobre todas las categorías.

OpenAI · GPT Fuente oficial ↗

ModeloEntradaEntrada cacheadaSalidaContexto largo (entrada / salida)
GPT-6 Astra 10 $ 1 $ 50 $ 20 $ / 75 $
GPT-5.6 Sol 4 $ 0,40 $ 20 $ 8 $ / 30 $
GPT-5.6 Terra 2 $ 0,20 $ 12 $ 4 $ / 18 $
GPT-5.6 Luna 0,20 $ 0,02 $ 1,20 $ 0,40 $ / 1,80 $
GPT-5.5 5 $ 0,50 $ 30 $ 10 $ / 45 $
GPT-5.4 mini 0,75 $ 0,075 $ 4,50 $
GPT-5.4 nano 0,20 $ 0,02 $ 1,25 $
GPT-5 mini 0,25 $ 0,025 $ 2 $
GPT-5 nano 0,05 $ 0,005 $ 0,40 $
GPT-4.1 2 $ 0,50 $ 8 $
GPT-4.1 mini 0,40 $ 0,10 $ 1,60 $
GPT-4o mini 0,15 $ 0,075 $ 0,60 $
  • GPT-5.6 Sol: Precio promocional vigente hasta el 21 nov 2026.
  • OpenAI publica dos columnas, contexto corto y contexto largo, para los modelos de la serie 5.5 y 5.6; el umbral concreto figura en la ficha de cada modelo. Batch al 50 % en todos.
  • Voz en tiempo real (gpt-realtime, texto): 4 $ / 0,40 $ cacheado / 16 $. Transcripción Whisper: 0,006 $ por minuto de audio. TTS-1: 15 $ por millón de caracteres; TTS-1-HD: 30 $.

Google · Gemini Fuente oficial ↗

ModeloEntradaLectura cachéSalidaPrompt > 200k (entrada / salida)
Gemini 3.1 Pro (preview) 2 $ 12 $ 4 $ / 18 $
Gemini 3.8 Flash 0,75 $ 0,075 $ 3,75 $
Gemini 3.7 Flash 0,75 $ 0,075 $ 3,75 $
Gemini 3.6 Flash 0,75 $ 0,075 $ 3,75 $
Gemini 3.5 Flash 1,50 $ 0,15 $ 9 $
Gemini 3.5 Flash-Lite 0,30 $ 0,03 $ 2,50 $
Gemini 3.1 Flash-Lite 0,25 $ 0,025 $ 1,50 $
Gemini 2.5 Pro 1,25 $ 0,125 $ 10 $ 2,50 $ / 15 $
Gemini 2.5 Flash 0,30 $ 0,03 $ 2,50 $
Gemini 2.5 Flash-Lite 0,10 $ 0,01 $ 0,40 $
  • Gemini 3.1 Pro (preview): Tramo largo a partir de 200k tokens de prompt.
  • Gemini 3.8 Flash: Precio vigente hasta el 31 dic 2026; desde el 1 ene 2027 pasa a 1,50 $ / 7,50 $.
  • Gemini 3.7 Flash: Misma promoción que 3.8 Flash.
  • Gemini 3.6 Flash: Misma promoción que 3.8 Flash.
  • Gemini 2.5 Pro: Tramo largo a partir de 200k tokens de prompt.
  • Todos los modelos de la tabla tienen nivel gratuito con límites de uso; los precios corresponden al nivel de pago. Batch al 50 %.
[ Comparativa a igual franja de precio ]

Quién compite con quién en precio.

Agrupamos los modelos por lo que cuestan, no por lo que rinden: es la forma honesta de ver qué alternativa tienes en cada franja antes de medir calidad. Formato entrada / salida en dólares por millón de tokens.

FranjaAnthropicOpenAIGoogle
FronteraClaude Fable 5.1 · 10 / 50GPT-6 Astra · 10 / 50Gemini 3.1 Pro · 2 / 12
Gama altaClaude Opus 5.5 · 4 / 20GPT-5.6 Sol · 4 / 20 *
Gama mediaClaude Sonnet 5 · 2 / 10GPT-5.6 Terra · 2 / 12Gemini 3.5 Flash · 1,50 / 9
EconómicaClaude Haiku 4.5 · 1 / 5GPT-5.4 mini · 0,75 / 4,50Gemini 3.8 Flash · 0,75 / 3,75 *
VolumenGPT-5.6 Luna · 0,20 / 1,20Gemini 3.5 Flash-Lite · 0,30 / 2,50
Mínimo costeGPT-5 nano · 0,05 / 0,40Gemini 2.5 Flash-Lite · 0,10 / 0,40

* Precio promocional con fecha de fin (Sol: 21 nov 2026 · Gemini 3.x Flash: 31 dic 2026). La franja es una agrupación editorial por precio de lista; el rendimiento en tareas reales lo medimos en el benchmark de coste por tarea.

Precaución al comparar por token: cada proveedor cuenta los tokens con su propio tokenizador. Anthropic documenta que Claude 4.7 y posteriores producen alrededor de un 30 % más de tokens para el mismo texto que sus generaciones anteriores. Un precio por millón de tokens más bajo no garantiza una factura más baja: la única comparación fiable es el coste por tarea completada con la misma calidad.

[ Estimador rápido ]

Cuánto costaría tu volumen con cada modelo.

Introduce el uso mensual y compara la factura de lista (sin descuentos negociados) en todos los modelos del observatorio. El estimador aplica la lectura de caché al porcentaje de entrada que indiques y muestra también el precio Batch.

ModeloProveedorEstándar / mesCon caché / mesBatch / mes
Claude Fable 5.1 Anthropic
Claude Fable 5 Anthropic
Claude Opus 5.5 Anthropic
Claude Opus 5 Anthropic
Claude Opus 4.8 Anthropic
Claude Sonnet 5 Anthropic
Claude Sonnet 4.6 Anthropic
Claude Haiku 4.5 Anthropic
GPT-6 Astra OpenAI
GPT-5.6 Sol OpenAI
GPT-5.6 Terra OpenAI
GPT-5.6 Luna OpenAI
GPT-5.5 OpenAI
GPT-5.4 mini OpenAI
GPT-5.4 nano OpenAI
GPT-5 mini OpenAI
GPT-5 nano OpenAI
GPT-4.1 OpenAI
GPT-4.1 mini OpenAI
GPT-4o mini OpenAI
Gemini 3.1 Pro (preview) Google
Gemini 3.8 Flash Google
Gemini 3.7 Flash Google
Gemini 3.6 Flash Google
Gemini 3.5 Flash Google
Gemini 3.5 Flash-Lite Google
Gemini 3.1 Flash-Lite Google
Gemini 2.5 Pro Google
Gemini 2.5 Flash Google
Gemini 2.5 Flash-Lite Google

Estimación de lista con las tarifas de contexto corto. No incluye tramos de contexto largo, herramientas (búsqueda web, ejecución de código), imágenes ni audio. Para modelos sin caché publicada se asume entrada completa a precio estándar.

[ Método y registro de cambios ]

Cómo verificamos cada cifra.

Reglas del observatorio

  • Solo fuente primaria. Cada precio se lee en la página de precios oficial del proveedor el día de verificación. No usamos agregadores, notas de prensa ni capturas de terceros.
  • Sin estimaciones. Si un dato no está publicado (por ejemplo, la lectura de caché de un modelo), la celda muestra un guion, no una cifra inferida.
  • Fecha visible. La fecha de verificación aparece en la cabecera y en el registro de cambios. Si lees esto semanas después, comprueba la fuente enlazada.
  • Precios de lista. No reflejan descuentos por volumen, créditos ni acuerdos enterprise, que existen en los tres proveedores.

Qué no cubre esta tabla

  • Tokens de imagen, audio y vídeo (tarifas distintas por proveedor).
  • Herramientas de servidor: búsqueda web (Anthropic: 10 $ por 1.000 búsquedas), ejecución de código, uso de ordenador.
  • Plataformas intermedias (Bedrock, Vertex AI, Foundry, Azure): facturan con su propia tarifa y recargos regionales.
  • Modelos abiertos autoalojados (Llama, Mistral, Qwen): su coste es de GPU, no de token. Los tratamos en el benchmark de coste.

Registro de cambios

  • 2026-09-23 · Alta de Claude Opus 5.5 (4 $ / 20 $, caché 0,20 $, batch 2 $ / 10 $, modo rápido 8 $ / 40 $), lanzado el 22 sep. Verificación completa del resto de la tabla: sin cambios en Anthropic, OpenAI ni Google. 30 modelos.
  • 2026-09-11 · Primera edición. 29 modelos de 3 proveedores. Se recogen: precio permanente de Claude Sonnet 5 (2 $ / 10 $), promoción de GPT-5.6 Sol hasta el 21 nov 2026 y promoción de Gemini 3.8 / 3.7 / 3.6 Flash hasta el 31 dic 2026.

Fuentes consultadas

[ Preguntas frecuentes ]

Para leer los precios sin sorpresas.

¿Qué es un millón de tokens y cuánto texto representa?

Un token es un trozo de texto de unos 3-4 caracteres. Un millón de tokens equivale, en castellano, a unas 600.000-700.000 palabras: aproximadamente 1.500 folios. Los precios de la API se expresan siempre por millón de tokens, separando lo que envías (entrada) de lo que el modelo genera (salida).

¿Por qué la salida cuesta 4-6 veces más que la entrada?

Generar texto es secuencial: el modelo produce un token cada vez y cada uno requiere un paso completo de cómputo. Procesar la entrada se hace en paralelo. Por eso una conversación con respuestas largas cuesta mucho más que una con respuestas cortas, aunque el total de tokens sea igual.

¿Qué es la caché de prompts y cuánto ahorra?

Si envías la misma parte de contexto en cada llamada (instrucciones del sistema, base de conocimiento, historial), los tres proveedores permiten cachearla y cobran la relectura al 10 % del precio de entrada (2,5 % en Claude Fable 5.1). En un agente de atención al cliente con 8.000 tokens de contexto fijo, la caché suele reducir el coste de entrada un 60-85 %.

¿Se pueden comparar los precios por token entre proveedores directamente?

Con cuidado. Cada proveedor usa su propio tokenizador: Anthropic documenta que los modelos Claude 4.7 y posteriores generan aproximadamente un 30 % más de tokens para el mismo texto que las generaciones anteriores. El mismo documento puede costar distinto número de tokens en cada API, así que la comparación válida es coste por tarea completada, no precio por token. Ese es precisamente lo que medimos en nuestro benchmark de coste.

¿Estos precios incluyen IVA o son los que pagaré en España?

Son precios de lista en dólares, sin impuestos, tal como los publica cada proveedor para su API directa. Al facturar a una empresa española se aplica la inversión del sujeto pasivo del IVA. Si consumes los modelos a través de Amazon Bedrock, Google Vertex AI o Microsoft Foundry, la tarifa la fija esa plataforma; en Bedrock y Vertex los endpoints regionales llevan un recargo del 10 % sobre los globales.

¿Quieres saber qué modelo te sale a cuenta en tu caso?

En el diagnóstico gratuito modelamos el coste con tu volumen real, tu arquitectura y los precios de esta tabla. Si ya tienes un agente en producción, auditamos la factura y te decimos dónde se va el dinero.