Uso principal declarado o inferido con cautela desde la documentación oficial.
Claude Sonnet 5
Código, investigación y flujos profesionales con herramientas.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | claude-sonnet-5 |
|---|---|
| Tipo de modelo | Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | 30 JUN 2026 |
| Corte de conocimiento | ENE 2026 |
| Entrada | Texto · Imagen |
| Salida | Texto |
| Ventana de contexto | 1.000.000 tokens |
| Salida máxima | 128.000 tokens |
| Razonamiento | Pensamiento adaptativo · esfuerzo configurable |
| Herramientas publicadas | Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | Compatible · 50 % de descuento |
| Caché de prompts | Compatible · hasta 90 % de ahorro en lecturas |
| Ajuste fino | No publicado |
| Plataformas verificadas | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Código, investigación y flujos profesionales con herramientas.
El coste y el rendimiento dependen del nivel de razonamiento.
Qué puede hacer
Orientación
Código, investigación y flujos profesionales con herramientas.
Contexto
1.000.000 tokens · 128.000 tokens
Herramientas e integración
Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador
Acceso
Claude, Claude API y nubes asociadas
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 2,00 USD / 1 M tokens | Tarifa estándar de API |
| Entrada en caché | 0,20 USD / 1 M tokens | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | 2,50–4,00 USD / 1 M tokens | La condición varía según proveedor |
| Salida estándar | 10,00 USD / 1 M tokens | Puede incluir tokens de razonamiento |
| Entrada por lotes | 1,00 USD / 1 M tokens | Procesamiento asíncrono |
| Salida por lotes | 5,00 USD / 1 M tokens | Procesamiento asíncrono |
Consulta la fuente primaria antes de presupuestar un despliegue.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| OSWorld-Verified | Curva por esfuerzo | Éxito y coste | Ver fuente ↗ |
| BrowseComp | Curva por esfuerzo | Exactitud y coste | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
Claude Sonnet 5
Versión incorporada al catálogo verificado de Inferama.
Análisis relacionados
Claude Sonnet 5: cómo medir el efecto de su nuevo tokenizador antes de migrar
Anthropic indica que el mismo texto puede convertirse en más tokens con Sonnet 5 que con Sonnet 4.6. Un protocolo con corpus propio permite comprobar si eso reduce el contexto útil o modifica el coste por tarea en una integración concreta.
23 sep. 2026 ↗ ANALISISBrowseComp: qué mide un agente que encuentra un dato difícil en la web y por qué su acierto no prueba que haga investigación fiable
BrowseComp evalúa si un agente puede localizar una respuesta factual breve y difícil de encontrar mediante navegación web persistente. Es una señal útil, pero limitada: una puntuación alta no basta para acreditar calidad de investigación, trazabilidad de fuentes ni fiabilidad en tareas abiertas.
22 sep. 2026 ↗ COMPARATIVAClaude Sonnet 5 y Cohere Embed 4 en RAG multimodal: cómo separar un fallo de recuperación de un fallo de respuesta
Claude Sonnet 5 y Cohere Embed 4 ocupan capas distintas de un sistema RAG multimodal. Esta guía propone un experimento factorial, con corpus y condiciones congeladas, para medir por separado si se recuperó la evidencia adecuada y si la respuesta la utilizó con fidelidad.
22 sep. 2026 ↗ GUIAClaude Fable 5.1: cuándo la caché y el lote reducen el coste por tarea —y cuándo solo desplazan la factura
La tarifa por millón de tokens no basta para elegir entre una llamada normal, caché de instrucciones o procesamiento por lotes. Esta guía propone un modelo de coste por tarea completada correctamente para Claude Fable 5.1, con fórmulas, escenarios y telemetría mínima. El resultado depende de reutilizar contexto antes de que expire, controlar los reintentos y aceptar —o no— el plazo asíncrono de Batch API.
22 sep. 2026 ↗ ANALISISAnthropic: cómo comprobar qué cambia al consumir Claude por API, nube asociada o producto
Adoptar Claude no consiste solo en elegir una familia de modelos. El canal de acceso determina qué identificador se usa, qué calendario de retirada rige, qué controles administra cada parte y qué documentación puede respaldar una decisión técnica. Esta guía propone un método para separar esas capas sin convertir políticas públicas o evaluaciones de seguridad en garantías que no contienen.
22 sep. 2026 ↗