Uso principal declarado o inferido con cautela desde la documentación oficial.
Claude Haiku 4.5
Alto volumen, subagentes y extracción estructurada.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | claude-haiku-4-5-20251001 |
|---|---|
| Tipo de modelo | Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | 15 OCT 2025 |
| Corte de conocimiento | FEB 2025 |
| Entrada | Texto · Imagen |
| Salida | Texto |
| Ventana de contexto | 200.000 tokens |
| Salida máxima | 64.000 tokens |
| Razonamiento | Pensamiento extendido |
| Herramientas publicadas | Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | Compatible · 50 % de descuento |
| Caché de prompts | Compatible · hasta 90 % de ahorro en lecturas |
| Ajuste fino | No publicado |
| Plataformas verificadas | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Alto volumen, subagentes y extracción estructurada.
El coste y el rendimiento dependen del nivel de razonamiento.
Qué puede hacer
Orientación
Alto volumen, subagentes y extracción estructurada.
Contexto
200.000 tokens · 64.000 tokens
Herramientas e integración
Uso de herramientas · Búsqueda web · Ejecución de código · Uso de ordenador
Acceso
Claude, Claude API y nubes asociadas
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 1,00 USD / 1 M tokens | Tarifa estándar de API |
| Entrada en caché | 0,10 USD / 1 M tokens | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | 1,25–2,00 USD / 1 M tokens | La condición varía según proveedor |
| Salida estándar | 5,00 USD / 1 M tokens | Puede incluir tokens de razonamiento |
| Entrada por lotes | 0,50 USD / 1 M tokens | Procesamiento asíncrono |
| Salida por lotes | 2,50 USD / 1 M tokens | Procesamiento asíncrono |
Consulta la fuente primaria antes de presupuestar un despliegue.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| SWE-bench Verified | 73,3 % | Resuelto | Ver fuente ↗ |
| Terminal-Bench | 41,75 % | Con pensamiento | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
Claude Haiku 4.5
Versión incorporada al catálogo verificado de Inferama.
Análisis relacionados
Claude Haiku 4.5: cómo calcular el coste por respuesta utilizable
La tarifa por llamada no revela por sí sola cuánto cuesta una respuesta que el equipo acepta. Esta guía presenta una fórmula reproducible para sumar tokens de entrada y salida, reintentos y revisión, con tres escenarios ilustrativos para Claude Haiku 4.5.
23 sep. 2026 ↗ ANALISISClaude Haiku 4.5: cómo operar un carril de baja latencia tras Haiku 3.5 sin confundir conservación mínima con continuidad garantizada
Claude Haiku 4.5 puede ser un destino para cargas rápidas tras la retirada de Claude Haiku 3.5, pero una migración segura no se resuelve cambiando un identificador. La disponibilidad mínima documentada hasta el 15 de octubre de 2026 no garantiza permanencia indefinida. El criterio operativo es demostrar, con tráfico y corpus propios, latencia de cola, cumplimiento de esquema, uso de herramientas y una sustitución reversible.
23 sep. 2026 ↗ ANALISISCoste en SWE-bench: cómo calcular el precio por incidencia resuelta sin ocultar fallos, reintentos ni evaluación
Una cifra de coste por incidencia resuelta sólo es útil si revela todo lo que ocurrió antes de obtener el parche: intentos fallidos, consumo de tokens, reglas de parada, selección entre ejecuciones y recursos de evaluación. Este análisis propone una ficha reproducible para leer y comparar resultados de SWE-bench, con especial atención a SWE-bench Verified.
22 sep. 2026 ↗ GUIAAnalizar feedback de clientes con IA: cómo convertir miles de comentarios en prioridades sin confundir frecuencia con impacto
Una ruta para equipos de producto, soporte e investigación que necesitan analizar reseñas, tickets, encuestas o transcripciones con IA sin convertir un resumen automático en una decisión sin evidencia.
22 sep. 2026 ↗ COMPARATIVAClaude Haiku 4.5 vs Claude Opus 5: cuándo una prima de coste puede justificar un mejor resultado
La elección entre Claude Haiku 4.5 y Claude Opus 5 no debería resolverse solo con tarifas por token o benchmarks ajenos. Esta comparativa propone un protocolo reproducible para medir resultados aceptados, reintentos, revisión humana, latencia y coste efectivo en clasificación estructurada, síntesis documental y revisión técnica compleja. Con las fuentes disponibles se pueden fijar condiciones de comparabilidad y límites técnicos, pero no afirmar resultados empíricos sin ejecutar y publicar el ensayo.
22 sep. 2026 ↗ ANALISISAnthropic: cómo comprobar qué cambia al consumir Claude por API, nube asociada o producto
Adoptar Claude no consiste solo en elegir una familia de modelos. El canal de acceso determina qué identificador se usa, qué calendario de retirada rige, qué controles administra cada parte y qué documentación puede respaldar una decisión técnica. Esta guía propone un método para separar esas capas sin convertir políticas públicas o evaluaciones de seguridad en garantías que no contienen.
22 sep. 2026 ↗