Lo que cobran hoy Anthropic, OpenAI y Google por millón de tokens en su API: entrada, salida, caché y batch. Solo precios de lista publicados en la fuente oficial, con enlace y fecha de verificación. Sin estimaciones ni cifras de terceros.
Precios en dólares por millón de tokens de texto en la API directa de cada proveedor. Los tres aplican un 50 % de descuento en Batch (procesamiento asíncrono) sobre entrada y salida. Las notas al pie recogen promociones, tramos y excepciones tal como las publica la fuente.
| Modelo | Entrada | Escritura caché 5 min | Lectura caché | Salida | Batch (entrada / salida) |
|---|---|---|---|---|---|
| Claude Fable 5.1† | 10 $ | 12,50 $ | 0,25 $ | 50 $ | 5 $ / 25 $ |
| Claude Fable 5 | 10 $ | 12,50 $ | 1 $ | 50 $ | 5 $ / 25 $ |
| Claude Opus 5.5† | 4 $ | 5 $ | 0,20 $ | 20 $ | 2 $ / 10 $ |
| Claude Opus 5† | 5 $ | 6,25 $ | 0,50 $ | 25 $ | 2,50 $ / 12,50 $ |
| Claude Opus 4.8 | 5 $ | 6,25 $ | 0,50 $ | 25 $ | 2,50 $ / 12,50 $ |
| Claude Sonnet 5† | 2 $ | 2,50 $ | 0,20 $ | 10 $ | 1 $ / 5 $ |
| Claude Sonnet 4.6 | 3 $ | 3,75 $ | 0,30 $ | 15 $ | 1,50 $ / 7,50 $ |
| Claude Haiku 4.5 | 1 $ | 1,25 $ | 0,10 $ | 5 $ | 0,50 $ / 2,50 $ |
inference_geo: "us"): multiplicador 1,1× sobre todas las categorías.| Modelo | Entrada | Entrada cacheada | Salida | Contexto largo (entrada / salida) |
|---|---|---|---|---|
| GPT-6 Astra | 10 $ | 1 $ | 50 $ | 20 $ / 75 $ |
| GPT-5.6 Sol† | 4 $ | 0,40 $ | 20 $ | 8 $ / 30 $ |
| GPT-5.6 Terra | 2 $ | 0,20 $ | 12 $ | 4 $ / 18 $ |
| GPT-5.6 Luna | 0,20 $ | 0,02 $ | 1,20 $ | 0,40 $ / 1,80 $ |
| GPT-5.5 | 5 $ | 0,50 $ | 30 $ | 10 $ / 45 $ |
| GPT-5.4 mini | 0,75 $ | 0,075 $ | 4,50 $ | — |
| GPT-5.4 nano | 0,20 $ | 0,02 $ | 1,25 $ | — |
| GPT-5 mini | 0,25 $ | 0,025 $ | 2 $ | — |
| GPT-5 nano | 0,05 $ | 0,005 $ | 0,40 $ | — |
| GPT-4.1 | 2 $ | 0,50 $ | 8 $ | — |
| GPT-4.1 mini | 0,40 $ | 0,10 $ | 1,60 $ | — |
| GPT-4o mini | 0,15 $ | 0,075 $ | 0,60 $ | — |
| Modelo | Entrada | Lectura caché | Salida | Prompt > 200k (entrada / salida) |
|---|---|---|---|---|
| Gemini 3.1 Pro (preview)† | 2 $ | — | 12 $ | 4 $ / 18 $ |
| Gemini 3.8 Flash† | 0,75 $ | 0,075 $ | 3,75 $ | — |
| Gemini 3.7 Flash† | 0,75 $ | 0,075 $ | 3,75 $ | — |
| Gemini 3.6 Flash† | 0,75 $ | 0,075 $ | 3,75 $ | — |
| Gemini 3.5 Flash | 1,50 $ | 0,15 $ | 9 $ | — |
| Gemini 3.5 Flash-Lite | 0,30 $ | 0,03 $ | 2,50 $ | — |
| Gemini 3.1 Flash-Lite | 0,25 $ | 0,025 $ | 1,50 $ | — |
| Gemini 2.5 Pro† | 1,25 $ | 0,125 $ | 10 $ | 2,50 $ / 15 $ |
| Gemini 2.5 Flash | 0,30 $ | 0,03 $ | 2,50 $ | — |
| Gemini 2.5 Flash-Lite | 0,10 $ | 0,01 $ | 0,40 $ | — |
Agrupamos los modelos por lo que cuestan, no por lo que rinden: es la forma honesta de ver qué alternativa tienes en cada franja antes de medir calidad. Formato entrada / salida en dólares por millón de tokens.
| Franja | Anthropic | OpenAI | |
|---|---|---|---|
| Frontera | Claude Fable 5.1 · 10 / 50 | GPT-6 Astra · 10 / 50 | Gemini 3.1 Pro · 2 / 12 |
| Gama alta | Claude Opus 5.5 · 4 / 20 | GPT-5.6 Sol · 4 / 20 * | — |
| Gama media | Claude Sonnet 5 · 2 / 10 | GPT-5.6 Terra · 2 / 12 | Gemini 3.5 Flash · 1,50 / 9 |
| Económica | Claude Haiku 4.5 · 1 / 5 | GPT-5.4 mini · 0,75 / 4,50 | Gemini 3.8 Flash · 0,75 / 3,75 * |
| Volumen | — | GPT-5.6 Luna · 0,20 / 1,20 | Gemini 3.5 Flash-Lite · 0,30 / 2,50 |
| Mínimo coste | — | GPT-5 nano · 0,05 / 0,40 | Gemini 2.5 Flash-Lite · 0,10 / 0,40 |
* Precio promocional con fecha de fin (Sol: 21 nov 2026 · Gemini 3.x Flash: 31 dic 2026). La franja es una agrupación editorial por precio de lista; el rendimiento en tareas reales lo medimos en el benchmark de coste por tarea.
Precaución al comparar por token: cada proveedor cuenta los tokens con su propio tokenizador. Anthropic documenta que Claude 4.7 y posteriores producen alrededor de un 30 % más de tokens para el mismo texto que sus generaciones anteriores. Un precio por millón de tokens más bajo no garantiza una factura más baja: la única comparación fiable es el coste por tarea completada con la misma calidad.
Introduce el uso mensual y compara la factura de lista (sin descuentos negociados) en todos los modelos del observatorio. El estimador aplica la lectura de caché al porcentaje de entrada que indiques y muestra también el precio Batch.
| Modelo | Proveedor | Estándar / mes | Con caché / mes | Batch / mes |
|---|---|---|---|---|
| Claude Fable 5.1 | Anthropic | — | — | — |
| Claude Fable 5 | Anthropic | — | — | — |
| Claude Opus 5.5 | Anthropic | — | — | — |
| Claude Opus 5 | Anthropic | — | — | — |
| Claude Opus 4.8 | Anthropic | — | — | — |
| Claude Sonnet 5 | Anthropic | — | — | — |
| Claude Sonnet 4.6 | Anthropic | — | — | — |
| Claude Haiku 4.5 | Anthropic | — | — | — |
| GPT-6 Astra | OpenAI | — | — | — |
| GPT-5.6 Sol | OpenAI | — | — | — |
| GPT-5.6 Terra | OpenAI | — | — | — |
| GPT-5.6 Luna | OpenAI | — | — | — |
| GPT-5.5 | OpenAI | — | — | — |
| GPT-5.4 mini | OpenAI | — | — | — |
| GPT-5.4 nano | OpenAI | — | — | — |
| GPT-5 mini | OpenAI | — | — | — |
| GPT-5 nano | OpenAI | — | — | — |
| GPT-4.1 | OpenAI | — | — | — |
| GPT-4.1 mini | OpenAI | — | — | — |
| GPT-4o mini | OpenAI | — | — | — |
| Gemini 3.1 Pro (preview) | — | — | — | |
| Gemini 3.8 Flash | — | — | — | |
| Gemini 3.7 Flash | — | — | — | |
| Gemini 3.6 Flash | — | — | — | |
| Gemini 3.5 Flash | — | — | — | |
| Gemini 3.5 Flash-Lite | — | — | — | |
| Gemini 3.1 Flash-Lite | — | — | — | |
| Gemini 2.5 Pro | — | — | — | |
| Gemini 2.5 Flash | — | — | — | |
| Gemini 2.5 Flash-Lite | — | — | — |
Estimación de lista con las tarifas de contexto corto. No incluye tramos de contexto largo, herramientas (búsqueda web, ejecución de código), imágenes ni audio. Para modelos sin caché publicada se asume entrada completa a precio estándar.
Un token es un trozo de texto de unos 3-4 caracteres. Un millón de tokens equivale, en castellano, a unas 600.000-700.000 palabras: aproximadamente 1.500 folios. Los precios de la API se expresan siempre por millón de tokens, separando lo que envías (entrada) de lo que el modelo genera (salida).
Generar texto es secuencial: el modelo produce un token cada vez y cada uno requiere un paso completo de cómputo. Procesar la entrada se hace en paralelo. Por eso una conversación con respuestas largas cuesta mucho más que una con respuestas cortas, aunque el total de tokens sea igual.
Si envías la misma parte de contexto en cada llamada (instrucciones del sistema, base de conocimiento, historial), los tres proveedores permiten cachearla y cobran la relectura al 10 % del precio de entrada (2,5 % en Claude Fable 5.1). En un agente de atención al cliente con 8.000 tokens de contexto fijo, la caché suele reducir el coste de entrada un 60-85 %.
Con cuidado. Cada proveedor usa su propio tokenizador: Anthropic documenta que los modelos Claude 4.7 y posteriores generan aproximadamente un 30 % más de tokens para el mismo texto que las generaciones anteriores. El mismo documento puede costar distinto número de tokens en cada API, así que la comparación válida es coste por tarea completada, no precio por token. Ese es precisamente lo que medimos en nuestro benchmark de coste.
Son precios de lista en dólares, sin impuestos, tal como los publica cada proveedor para su API directa. Al facturar a una empresa española se aplica la inversión del sujeto pasivo del IVA. Si consumes los modelos a través de Amazon Bedrock, Google Vertex AI o Microsoft Foundry, la tarifa la fija esa plataforma; en Bedrock y Vertex los endpoints regionales llevan un recargo del 10 % sobre los globales.
En el diagnóstico gratuito modelamos el coste con tu volumen real, tu arquitectura y los precios de esta tabla. Si ya tienes un agente en producción, auditamos la factura y te decimos dónde se va el dinero.
Es un asistente automático. Los datos que compartas para que te contactemos se tratan según la política de privacidad.