COSTE / CAPACIDAD

Precios y límites, con fecha.

El coste publicado solo es comparable cuando conocemos unidad, modalidad y condiciones.

01

Datos publicados

USD por millón de tokens cuando la fuente utiliza esa unidad.

OpenAI

GPT‑6 Astra

Entrada estándar
10,00 USD / 1 M tokens
Salida estándar
50,00 USD / 1 M tokens
Entrada en caché
1,00 USD / 1 M tokens
Entrada por lotes
5,00 USD / 1 M tokens
Salida por lotes
25,00 USD / 1 M tokens
Contexto
1.050.000 tokens
Salida máxima
128.000 tokens

Las solicitudes con más de 272.000 tokens de entrada aplican multiplicadores de precio; las herramientas pueden añadir cargos por llamada.

Abrir ficha y fuentes →
Anthropic

Claude Opus 5

Entrada estándar
5,00 USD / 1 M tokens
Salida estándar
25,00 USD / 1 M tokens
Entrada en caché
0,50 USD / 1 M tokens
Entrada por lotes
2,50 USD / 1 M tokens
Salida por lotes
12,50 USD / 1 M tokens
Contexto
1.000.000 tokens
Salida máxima
128.000 tokens

El pensamiento se factura como salida. El modo Fast cuesta el doble de la tarifa base.

Abrir ficha y fuentes →
Google

Gemini 3.8 Flash

Entrada estándar
0,75 USD / 1 M tokens
Salida estándar
3,75 USD / 1 M tokens
Entrada en caché
0,075 USD / 1 M tokens
Entrada por lotes
0,375 USD / 1 M tokens
Salida por lotes
1,875 USD / 1 M tokens
Contexto
1.048.576 tokens de entrada
Salida máxima
65.536 tokens de salida

Precios introductorios hasta el 31 de diciembre de 2026; desde 2027 se duplican las tarifas estándar.

Abrir ficha y fuentes →
Coste por tarea

Incluye reintentos, herramientas, recuperación, caché y revisión humana.

Límite operativo

Los límites de cuenta y región pueden diferir de la capacidad teórica del modelo.

Dato ausente

La ausencia se conserva como información relevante, no como un cero.

02

Qué falta en el precio por token

Una tarifa baja puede terminar siendo cara si el flujo repite trabajo o necesita mucha supervisión.

01

Razonamiento y longitud

Los tokens internos o de pensamiento suelen facturarse como salida y dependen de la dificultad y del esfuerzo configurado.

02

Herramientas y grounding

Búsqueda, mapas, ejecución de código y otras herramientas pueden tener precios por llamada además de los tokens.

03

Caché y lotes

Los prefijos repetidos y el procesamiento asíncrono reducen coste, pero exigen diseñar el flujo para aprovecharlos.

04

Coste del error

Mide reintentos, validación humana, incidencias y recuperación: forman parte del coste total de operación.