A
ANTHROPIC / claude-haiku-4-5-20251001

Claude Haiku 4.5

Alto volume, subagentes e extração estruturada.

01 / RESUMO

O essencial

ORIENTAÇÃOAlta eficiência

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO200.000 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDA64.000 tokens

Limite máximo de geração documentado.

ACESSOClaude, Claude API e nuvens associadas

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio

Família funcional principal e especialidades verificadas.

LICENÇAProprietária

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APIclaude-haiku-4-5-20251001
Tipo de modeloTexto e raciocínio
Modelo de acessoProprietário pago
LicençaProprietária
ImplantaçãoAPI alojada
Lançamento15 OUT 2025
Data de corte do conhecimentoFEV 2025
EntradaTexto · Imagem
SaídaTexto
Janela de contexto200.000 tokens
saída máxima64.000 tokens
RaciocínioPensamento alargado
Ferramentas publicadasUso de ferramentas · Pesquisa na Web · Execução de código · Utilização de computador
Passeios EstruturadosCompatível
Processamento em loteCompatível · 50 % de desconto
Cache de promptsCompatível · até 90 % de poupança em leituras
Ajuste finoNão publicado
Plataformas verificadasClaude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry
ADEQUA-SE MELHOR A

Alto volume, subagentes e extração estruturada.

CONVÉM MONITORIZAR

O custo e o desempenho dependem do nível de raciocínio.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Alto volume, subagentes e extração estruturada.

02

Contexto

200.000 tokens · 64.000 tokens

03

Ferramentas e integração

Utilização de ferramentas · Pesquisa na Web · Execução de código · Utilização do computador

04

Acesso

Claude, Claude API e nuvens associadas

Modalidades de entrada
TextoImagem
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrão1,00 USD / 1 M tokensTarifa padrão da API
Entrada em cache0,10 USD / 1 M tokensLeitura de prefixos reutilizados
Escrita ou armazenamento em cache1,25–2,00 USD / 1 M tokensA condição varia consoante o fornecedor
Saída padrão5,00 USD / 1 M tokensPode incluir tokens de raciocínio
Entrada por lotes0,50 USD / 1 M tokensProcessamento assíncrono
Saída por lotes2,50 USD / 1 M tokensProcessamento assíncrono

Consulte a fonte primária antes de orçamentar uma implementação.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
SWE-bench Verified73,3 %ResolvidoVer fonte ↗
Terminal-Bench41,75 %Com raciocínioVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

Claude Haiku 4.5

Versão incorporada no catálogo verificado da Inferama.

ANÁLISE

Análises relacionadas

Claude Haiku 4.5: como calcular o custo por resposta utilizável
GUIA

Claude Haiku 4.5: como calcular o custo por resposta utilizável

O preço por chamada, por si só, não revela quanto custa uma resposta que a equipa aceita. Este guia apresenta uma fórmula reproduzível para somar tokens de entrada e saída, novas tentativas e revisão, com três cenários ilustrativos para o Claude Haiku 4.5.

23 set 2026
Claude Haiku 4.5: como operar uma via de baixa latência após o Haiku 3.5 sem confundir preservação mínima com continuidade garantida
ANALISIS

Claude Haiku 4.5: como operar uma via de baixa latência após o Haiku 3.5 sem confundir preservação mínima com continuidade garantida

O Claude Haiku 4.5 pode ser um destino para cargas rápidas após a descontinuação do Claude Haiku 3.5, mas uma migração segura não se resolve com a troca de um identificador. A disponibilidade mínima documentada até 15 de outubro de 2026 não garante permanência indefinida. O critério operacional é demonstrar, com tráfego e corpus próprios, latência de fila, conformidade com o esquema, uso de ferramentas e uma substituição reversível.

23 set 2026
Custo no SWE-bench: como calcular o preço por incidência resolvida sem ocultar falhas, novas tentativas nem avaliação
ANALISIS

Custo no SWE-bench: como calcular o preço por incidência resolvida sem ocultar falhas, novas tentativas nem avaliação

Um valor de custo por incidência resolvida só é útil se revelar tudo o que aconteceu antes de obter o patch: tentativas falhadas, consumo de tokens, regras de paragem, seleção entre execuções e recursos de avaliação. Esta análise propõe uma ficha reproduzível para ler e comparar resultados do SWE-bench, com especial atenção ao SWE-bench Verified.

22 set 2026
Analisar o feedback de clientes com IA: como transformar milhares de comentários em prioridades sem confundir frequência com impacto
GUIA

Analisar o feedback de clientes com IA: como transformar milhares de comentários em prioridades sem confundir frequência com impacto

Um roteiro para equipes de produto, suporte e pesquisa que precisam analisar avaliações, tickets, pesquisas ou transcrições com IA sem transformar um resumo automático em uma decisão sem evidências.

22 set 2026
Claude Haiku 4.5 vs Claude Opus 5: quando um prémio de custo pode justificar um resultado melhor
COMPARATIVA

Claude Haiku 4.5 vs Claude Opus 5: quando um prémio de custo pode justificar um resultado melhor

A escolha entre Claude Haiku 4.5 e Claude Opus 5 não deve ser resolvida apenas com tarifas por token ou benchmarks externos. Esta comparação propõe um protocolo reproduzível para medir resultados aceites, tentativas repetidas, revisão humana, latência e custo efetivo em classificação estruturada, síntese documental e revisão técnica complexa. Com as fontes disponíveis, é possível fixar condições de comparabilidade e limites técnicos, mas não afirmar resultados empíricos sem executar e publicar o ensaio.

22 set 2026
Anthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto
ANALISIS

Anthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto

Adotar Claude não consiste apenas em escolher uma família de modelos. O canal de acesso determina qual identificador é usado, qual cronograma de descontinuação se aplica, quais controles cada parte administra e qual documentação pode sustentar uma decisão técnica. Este guia propõe um método para separar essas camadas sem transformar políticas públicas ou avaliações de segurança em garantias que elas não contêm.

22 set 2026
07 / FONTES

Rastreabilidade