Uso primário declarado ou inferido com cautela a partir da documentação oficial.
Claude Sonnet 5
Código, pesquisa e fluxos profissionais com ferramentas.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | claude-sonnet-5 |
|---|---|
| Tipo de modelo | Texto e raciocínio |
| Modelo de acesso | Proprietário pago |
| Licença | Proprietária |
| Implantação | API alojada |
| Lançamento | 30 JUN 2026 |
| Data de corte do conhecimento | JAN 2026 |
| Entrada | Texto · Imagem |
| Saída | Texto |
| Janela de contexto | 1.000.000 tokens |
| saída máxima | 128.000 tokens |
| Raciocínio | Raciocínio adaptativo · esforço configurável |
| Ferramentas publicadas | Uso de ferramentas · Pesquisa na Web · Execução de código · Utilização de computador |
| Passeios Estruturados | Compatível |
| Processamento em lote | Compatível · 50 % de desconto |
| Cache de prompts | Compatível · até 90 % de poupança em leituras |
| Ajuste fino | Não publicado |
| Plataformas verificadas | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Código, pesquisa e fluxos profissionais com ferramentas.
O custo e o desempenho dependem do nível de raciocínio.
O que pode fazer
Orientação
Código, pesquisa e fluxos profissionais com ferramentas.
Contexto
1.000.000 tokens · 128.000 tokens
Ferramentas e integração
Utilização de ferramentas · Pesquisa na Web · Execução de código · Utilização do computador
Acesso
Claude, Claude API e nuvens associadas
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | 2,00 USD / 1 M tokens | Tarifa padrão da API |
| Entrada em cache | 0,20 USD / 1 M tokens | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | 2,50–4,00 USD / 1 M tokens | A condição varia consoante o fornecedor |
| Saída padrão | 10,00 USD / 1 M tokens | Pode incluir tokens de raciocínio |
| Entrada por lotes | 1,00 USD / 1 M tokens | Processamento assíncrono |
| Saída por lotes | 5,00 USD / 1 M tokens | Processamento assíncrono |
Consulte a fonte primária antes de orçamentar uma implementação.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| OSWorld-Verified | Curva por nível de esforço | Sucesso e custo | Ver fonte ↗ |
| BrowseComp | Curva por nível de esforço | Exatidão e custo | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
Claude Sonnet 5
Versão incorporada no catálogo verificado da Inferama.
Análises relacionadas
Claude Sonnet 5: como medir o efeito do novo tokenizador antes de migrar
A Anthropic informa que o mesmo texto pode se transformar em mais tokens no Sonnet 5 do que no Sonnet 4.6. Um protocolo com um corpus próprio permite verificar se isso reduz o contexto útil ou altera o custo por tarefa em uma integração específica.
23 set 2026 ↗ ANALISISBrowseComp: o que mede um agente que encontra um dado difícil na web e por que acertar não prova que ele faça pesquisa confiável
O BrowseComp avalia se um agente consegue localizar uma resposta factual breve e difícil de encontrar por meio de navegação persistente na web. É um sinal útil, mas limitado: uma pontuação alta não basta para comprovar qualidade de pesquisa, rastreabilidade das fontes ou confiabilidade em tarefas abertas.
22 set 2026 ↗ COMPARATIVAClaude Sonnet 5 e Cohere Embed 4 em RAG multimodal: como separar uma falha de recuperação de uma falha de resposta
Claude Sonnet 5 e Cohere Embed 4 ocupam camadas diferentes de um sistema RAG multimodal. Este guia propõe um experimento fatorial, com corpus e condições congelados, para medir separadamente se a evidência adequada foi recuperada e se a resposta a utilizou com fidelidade.
22 set 2026 ↗ GUIAClaude Fable 5.1: quando o cache e o lote reduzem o custo por tarefa — e quando apenas deslocam a fatura
A tarifa por milhão de tokens não basta para escolher entre uma chamada normal, cache de instruções ou processamento em lote. Este guia propõe um modelo de custo por tarefa concluída corretamente para o Claude Fable 5.1, com fórmulas, cenários e telemetria mínima. O resultado depende de reutilizar o contexto antes de ele expirar, controlar as tentativas e aceitar — ou não — o prazo assíncrono da Batch API.
22 set 2026 ↗ ANALISISAnthropic: como verificar o que muda ao consumir Claude por API, nuvem associada ou produto
Adotar Claude não consiste apenas em escolher uma família de modelos. O canal de acesso determina qual identificador é usado, qual cronograma de descontinuação se aplica, quais controles cada parte administra e qual documentação pode sustentar uma decisão técnica. Este guia propõe um método para separar essas camadas sem transformar políticas públicas ou avaliações de segurança em garantias que elas não contêm.
22 set 2026 ↗