Uso primário declarado ou inferido com cautela a partir da documentação oficial.
Claude Haiku 4.5
Alto volume, subagentes e extração estruturada.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | claude-haiku-4-5-20251001 |
|---|---|
| Tipo de modelo | Texto e raciocínio |
| Modelo de acesso | Proprietário pago |
| Licença | Proprietária |
| Implantação | API alojada |
| Lançamento | 15 OUT 2025 |
| Data de corte do conhecimento | FEV 2025 |
| Entrada | Texto · Imagem |
| Saída | Texto |
| Janela de contexto | 200.000 tokens |
| saída máxima | 64.000 tokens |
| Raciocínio | Pensamento alargado |
| Ferramentas publicadas | Uso de ferramentas · Pesquisa na Web · Execução de código · Utilização de computador |
| Passeios Estruturados | Compatível |
| Processamento em lote | Compatível · 50 % de desconto |
| Cache de prompts | Compatível · até 90 % de poupança em leituras |
| Ajuste fino | Não publicado |
| Plataformas verificadas | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Alto volume, subagentes e extração estruturada.
O custo e o desempenho dependem do nível de raciocínio.
O que pode fazer
Orientação
Alto volume, subagentes e extração estruturada.
Contexto
200.000 tokens · 64.000 tokens
Ferramentas e integração
Utilização de ferramentas · Pesquisa na Web · Execução de código · Utilização do computador
Acesso
Claude, Claude API e nuvens associadas
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | 1,00 USD / 1 M tokens | Tarifa padrão da API |
| Entrada em cache | 0,10 USD / 1 M tokens | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | 1,25–2,00 USD / 1 M tokens | A condição varia consoante o fornecedor |
| Saída padrão | 5,00 USD / 1 M tokens | Pode incluir tokens de raciocínio |
| Entrada por lotes | 0,50 USD / 1 M tokens | Processamento assíncrono |
| Saída por lotes | 2,50 USD / 1 M tokens | Processamento assíncrono |
Consulte a fonte primária antes de orçamentar uma implementação.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| SWE-bench Verified | 73,3 % | Resolvido | Ver fonte ↗ |
| Terminal-Bench | 41,75 % | Com raciocínio | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
Claude Haiku 4.5
Versão incorporada no catálogo verificado da Inferama.
Análises relacionadas
Claude Haiku 4.5: como calcular o custo por resposta utilizável
O preço por chamada, por si só, não revela quanto custa uma resposta que a equipa aceita. Este guia apresenta uma fórmula reproduzível para somar tokens de entrada e saída, novas tentativas e revisão, com três cenários ilustrativos para o Claude Haiku 4.5.
23 set 2026 ↗ ANALISISClaude Haiku 4.5: como operar uma via de baixa latência após o Haiku 3.5 sem confundir preservação mínima com continuidade garantida
O Claude Haiku 4.5 pode ser um destino para cargas rápidas após a descontinuação do Claude Haiku 3.5, mas uma migração segura não se resolve com a troca de um identificador. A disponibilidade mínima documentada até 15 de outubro de 2026 não garante permanência indefinida. O critério operacional é demonstrar, com tráfego e corpus próprios, latência de fila, conformidade com o esquema, uso de ferramentas e uma substituição reversível.
23 set 2026 ↗ ANALISISCusto no SWE-bench: como calcular o preço por incidência resolvida sem ocultar falhas, novas tentativas nem avaliação
Um valor de custo por incidência resolvida só é útil se revelar tudo o que aconteceu antes de obter o patch: tentativas falhadas, consumo de tokens, regras de paragem, seleção entre execuções e recursos de avaliação. Esta análise propõe uma ficha reproduzível para ler e comparar resultados do SWE-bench, com especial atenção ao SWE-bench Verified.
22 set 2026 ↗ GUIAAnalisar o feedback de clientes com IA: como transformar milhares de comentários em prioridades sem confundir frequência com impacto
Um roteiro para equipes de produto, suporte e pesquisa que precisam analisar avaliações, tickets, pesquisas ou transcrições com IA sem transformar um resumo automático em uma decisão sem evidências.
22 set 2026 ↗ COMPARATIVAClaude Haiku 4.5 vs Claude Opus 5: quando um prémio de custo pode justificar um resultado melhor
A escolha entre Claude Haiku 4.5 e Claude Opus 5 não deve ser resolvida apenas com tarifas por token ou benchmarks externos. Esta comparação propõe um protocolo reproduzível para medir resultados aceites, tentativas repetidas, revisão humana, latência e custo efetivo em classificação estruturada, síntese documental e revisão técnica complexa. Com as fontes disponíveis, é possível fixar condições de comparabilidade e limites técnicos, mas não afirmar resultados empíricos sem executar e publicar o ensaio.
22 set 2026 ↗ ANALISISAnthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto
Adotar Claude não consiste apenas em escolher uma família de modelos. O canal de acesso determina qual identificador é usado, qual cronograma de descontinuação se aplica, quais controles cada parte administra e qual documentação pode sustentar uma decisão técnica. Este guia propõe um método para separar essas camadas sem transformar políticas públicas ou avaliações de segurança em garantias que elas não contêm.
22 set 2026 ↗