A
ANTHROPIC / claude-haiku-4-5-20251001

Claude Haiku 4.5

Alto volumen, subagentes y extracción estructurada.

01 / RESUMEN

Lo esencial

ORIENTACIÓNAlta eficiencia

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO200.000 tokens

Capacidad máxima de entrada cuando la fuente la publica.

SALIDA64.000 tokens

Límite máximo de generación documentado.

ACCESOClaude, Claude API y nubes asociadas

Canales de disponibilidad verificados.

TIPO DE MODELOTexto y razonamiento

Familia funcional principal y especialidades verificadas.

LICENCIAPropietaria

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APIclaude-haiku-4-5-20251001
Tipo de modeloTexto y razonamiento
Modelo de accesoPropietario de pago
LicenciaPropietaria
DespliegueAPI alojada
Lanzamiento15 OCT 2025
Corte de conocimientoFEB 2025
EntradaTexto · Imagen
SalidaTexto
Ventana de contexto200.000 tokens
Salida máxima64.000 tokens
RazonamientoPensamiento extendido
Herramientas publicadasUso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador
Salidas estructuradasCompatible
Procesamiento por lotesCompatible · 50 % de descuento
Caché de promptsCompatible · hasta 90 % de ahorro en lecturas
Ajuste finoNo publicado
Plataformas verificadasClaude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry
ENCAJA MEJOR EN

Alto volumen, subagentes y extracción estructurada.

CONVIENE VIGILAR

El coste y el rendimiento dependen del nivel de razonamiento.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Alto volumen, subagentes y extracción estructurada.

02

Contexto

200.000 tokens · 64.000 tokens

03

Herramientas e integración

Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador

04

Acceso

Claude, Claude API y nubes asociadas

Modalidades de entrada
TextoImagen
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándar1,00 USD / 1 M tokensTarifa estándar de API
Entrada en caché0,10 USD / 1 M tokensLectura de prefijos reutilizados
Escritura o almacenamiento de caché1,25–2,00 USD / 1 M tokensLa condición varía según proveedor
Salida estándar5,00 USD / 1 M tokensPuede incluir tokens de razonamiento
Entrada por lotes0,50 USD / 1 M tokensProcesamiento asíncrono
Salida por lotes2,50 USD / 1 M tokensProcesamiento asíncrono

Consulta la fuente primaria antes de presupuestar un despliegue.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
SWE-bench Verified73,3 %ResueltoVer fuente ↗
Terminal-Bench41,75 %Con pensamientoVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

Claude Haiku 4.5

Versión incorporada al catálogo verificado de Inferama.

ANÁLISIS

Análisis relacionados

Claude Haiku 4.5: cómo calcular el coste por respuesta utilizable
GUIA

Claude Haiku 4.5: cómo calcular el coste por respuesta utilizable

La tarifa por llamada no revela por sí sola cuánto cuesta una respuesta que el equipo acepta. Esta guía presenta una fórmula reproducible para sumar tokens de entrada y salida, reintentos y revisión, con tres escenarios ilustrativos para Claude Haiku 4.5.

23 sep. 2026
Claude Haiku 4.5: cómo operar un carril de baja latencia tras Haiku 3.5 sin confundir conservación mínima con continuidad garantizada
ANALISIS

Claude Haiku 4.5: cómo operar un carril de baja latencia tras Haiku 3.5 sin confundir conservación mínima con continuidad garantizada

Claude Haiku 4.5 puede ser un destino para cargas rápidas tras la retirada de Claude Haiku 3.5, pero una migración segura no se resuelve cambiando un identificador. La disponibilidad mínima documentada hasta el 15 de octubre de 2026 no garantiza permanencia indefinida. El criterio operativo es demostrar, con tráfico y corpus propios, latencia de cola, cumplimiento de esquema, uso de herramientas y una sustitución reversible.

23 sep. 2026
Coste en SWE-bench: cómo calcular el precio por incidencia resuelta sin ocultar fallos, reintentos ni evaluación
ANALISIS

Coste en SWE-bench: cómo calcular el precio por incidencia resuelta sin ocultar fallos, reintentos ni evaluación

Una cifra de coste por incidencia resuelta sólo es útil si revela todo lo que ocurrió antes de obtener el parche: intentos fallidos, consumo de tokens, reglas de parada, selección entre ejecuciones y recursos de evaluación. Este análisis propone una ficha reproducible para leer y comparar resultados de SWE-bench, con especial atención a SWE-bench Verified.

22 sep. 2026
Analizar feedback de clientes con IA: cómo convertir miles de comentarios en prioridades sin confundir frecuencia con impacto
GUIA

Analizar feedback de clientes con IA: cómo convertir miles de comentarios en prioridades sin confundir frecuencia con impacto

Una ruta para equipos de producto, soporte e investigación que necesitan analizar reseñas, tickets, encuestas o transcripciones con IA sin convertir un resumen automático en una decisión sin evidencia.

22 sep. 2026
Claude Haiku 4.5 vs Claude Opus 5: cuándo una prima de coste puede justificar un mejor resultado
COMPARATIVA

Claude Haiku 4.5 vs Claude Opus 5: cuándo una prima de coste puede justificar un mejor resultado

La elección entre Claude Haiku 4.5 y Claude Opus 5 no debería resolverse solo con tarifas por token o benchmarks ajenos. Esta comparativa propone un protocolo reproducible para medir resultados aceptados, reintentos, revisión humana, latencia y coste efectivo en clasificación estructurada, síntesis documental y revisión técnica compleja. Con las fuentes disponibles se pueden fijar condiciones de comparabilidad y límites técnicos, pero no afirmar resultados empíricos sin ejecutar y publicar el ensayo.

22 sep. 2026
Anthropic: cómo comprobar qué cambia al consumir Claude por API, nube asociada o producto
ANALISIS

Anthropic: cómo comprobar qué cambia al consumir Claude por API, nube asociada o producto

Adoptar Claude no consiste solo en elegir una familia de modelos. El canal de acceso determina qué identificador se usa, qué calendario de retirada rige, qué controles administra cada parte y qué documentación puede respaldar una decisión técnica. Esta guía propone un método para separar esas capas sin convertir políticas públicas o evaluaciones de seguridad en garantías que no contienen.

22 sep. 2026
07 / FUENTES

Trazabilidad