A
ANTHROPIC / claude-sonnet-5

Claude Sonnet 5

Código, pesquisa e fluxos profissionais com ferramentas.

01 / RESUMO

O essencial

ORIENTAÇÃOEquilíbrio custo/capacidade

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO1.000.000 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDA128.000 tokens

Limite máximo de geração documentado.

ACESSOClaude, Claude API e nuvens associadas

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio

Família funcional principal e especialidades verificadas.

LICENÇAProprietária

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APIclaude-sonnet-5
Tipo de modeloTexto e raciocínio
Modelo de acessoProprietário pago
LicençaProprietária
ImplantaçãoAPI alojada
Lançamento30 JUN 2026
Data de corte do conhecimentoJAN 2026
EntradaTexto · Imagem
SaídaTexto
Janela de contexto1.000.000 tokens
saída máxima128.000 tokens
RaciocínioRaciocínio adaptativo · esforço configurável
Ferramentas publicadasUso de ferramentas · Pesquisa na Web · Execução de código · Utilização de computador
Passeios EstruturadosCompatível
Processamento em loteCompatível · 50 % de desconto
Cache de promptsCompatível · até 90 % de poupança em leituras
Ajuste finoNão publicado
Plataformas verificadasClaude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry
ADEQUA-SE MELHOR A

Código, pesquisa e fluxos profissionais com ferramentas.

CONVÉM MONITORIZAR

O custo e o desempenho dependem do nível de raciocínio.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Código, pesquisa e fluxos profissionais com ferramentas.

02

Contexto

1.000.000 tokens · 128.000 tokens

03

Ferramentas e integração

Utilização de ferramentas · Pesquisa na Web · Execução de código · Utilização do computador

04

Acesso

Claude, Claude API e nuvens associadas

Modalidades de entrada
TextoImagem
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrão2,00 USD / 1 M tokensTarifa padrão da API
Entrada em cache0,20 USD / 1 M tokensLeitura de prefixos reutilizados
Escrita ou armazenamento em cache2,50–4,00 USD / 1 M tokensA condição varia consoante o fornecedor
Saída padrão10,00 USD / 1 M tokensPode incluir tokens de raciocínio
Entrada por lotes1,00 USD / 1 M tokensProcessamento assíncrono
Saída por lotes5,00 USD / 1 M tokensProcessamento assíncrono

Consulte a fonte primária antes de orçamentar uma implementação.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
OSWorld-VerifiedCurva por nível de esforçoSucesso e custoVer fonte ↗
BrowseCompCurva por nível de esforçoExatidão e custoVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

Claude Sonnet 5

Versão incorporada no catálogo verificado da Inferama.

ANÁLISE

Análises relacionadas

Claude Sonnet 5: como medir o efeito do novo tokenizador antes de migrar
ANALISIS

Claude Sonnet 5: como medir o efeito do novo tokenizador antes de migrar

A Anthropic informa que o mesmo texto pode se transformar em mais tokens no Sonnet 5 do que no Sonnet 4.6. Um protocolo com um corpus próprio permite verificar se isso reduz o contexto útil ou altera o custo por tarefa em uma integração específica.

23 set 2026
BrowseComp: o que mede um agente que encontra um dado difícil na web e por que acertar não prova que ele faça pesquisa confiável
ANALISIS

BrowseComp: o que mede um agente que encontra um dado difícil na web e por que acertar não prova que ele faça pesquisa confiável

O BrowseComp avalia se um agente consegue localizar uma resposta factual breve e difícil de encontrar por meio de navegação persistente na web. É um sinal útil, mas limitado: uma pontuação alta não basta para comprovar qualidade de pesquisa, rastreabilidade das fontes ou confiabilidade em tarefas abertas.

22 set 2026
Claude Sonnet 5 e Cohere Embed 4 em RAG multimodal: como separar uma falha de recuperação de uma falha de resposta
COMPARATIVA

Claude Sonnet 5 e Cohere Embed 4 em RAG multimodal: como separar uma falha de recuperação de uma falha de resposta

Claude Sonnet 5 e Cohere Embed 4 ocupam camadas diferentes de um sistema RAG multimodal. Este guia propõe um experimento fatorial, com corpus e condições congelados, para medir separadamente se a evidência adequada foi recuperada e se a resposta a utilizou com fidelidade.

22 set 2026
Claude Fable 5.1: quando o cache e o lote reduzem o custo por tarefa — e quando apenas deslocam a fatura
GUIA

Claude Fable 5.1: quando o cache e o lote reduzem o custo por tarefa — e quando apenas deslocam a fatura

A tarifa por milhão de tokens não basta para escolher entre uma chamada normal, cache de instruções ou processamento em lote. Este guia propõe um modelo de custo por tarefa concluída corretamente para o Claude Fable 5.1, com fórmulas, cenários e telemetria mínima. O resultado depende de reutilizar o contexto antes de ele expirar, controlar as tentativas e aceitar — ou não — o prazo assíncrono da Batch API.

22 set 2026
Anthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto
ANALISIS

Anthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto

Adotar Claude não consiste apenas em escolher uma família de modelos. O canal de acesso determina qual identificador é usado, qual cronograma de descontinuação se aplica, quais controles cada parte administra e qual documentação pode sustentar uma decisão técnica. Este guia propõe um método para separar essas camadas sem transformar políticas públicas ou avaliações de segurança em garantias que elas não contêm.

22 set 2026
07 / FONTES

Rastreabilidade