Uso primário declarado ou inferido com cautela a partir da documentação oficial.
DeepSeek V4.1 Flash
Agentes, código e implantação aberta com baixo custo.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | deepseek-flash |
|---|---|
| Tipo de modelo | Texto e raciocínio |
| Modelo de acesso | Proprietário pago |
| Licença | Proprietária |
| Implantação | API alojada |
| Lançamento | 10 SET 2026 |
| Data de corte do conhecimento | Não publicado |
| Entrada | Texto · Imagem |
| Saída | Texto |
| Janela de contexto | 1.000.000 tokens |
| saída máxima | 384.000 tokens |
| Raciocínio | Modos com e sem raciocínio |
| Ferramentas publicadas | Funções · Responses API · Prefixo de chat · FIM |
| Passeios Estruturados | Compatível |
| Processamento em lote | Não publicado |
| Cache de prompts | Compatível |
| Ajuste fino | Pesos abertos |
| Plataformas verificadas | DeepSeek API · Hugging Face |
Agentes, código e implantação aberta com baixo custo.
As condições de execução variam entre benchmarks; não compare apenas o número.
O que pode fazer
Orientação
Agentes, código e implantação aberta com baixo custo.
Contexto
1.000.000 tokens · 384.000 tokens
Ferramentas e integração
Funcionalidades · Responses API · Prefixo de chat · FIM
Acesso
DeepSeek API · pesos abertos
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | 0,30 USD / 1 M tokens (pico) | Tarifa padrão da API |
| Entrada em cache | 0,006 USD / 1 M tokens (pico) | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | Não publicado | A condição varia consoante o fornecedor |
| Saída padrão | 1,20 USD / 1 M tokens (pico) | Pode incluir tokens de raciocínio |
| Entrada por lotes | Não publicado | Processamento assíncrono |
| Saída por lotes | Não publicado | Processamento assíncrono |
As tarifas fora de pico são reduzidas à metade; os horários são publicados em UTC.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| GPQA Diamond | 90,9 % | Exatidão | Ver fonte ↗ |
| Terminal-Bench 2.1 | 90,6 % | Exatidão | Ver fonte ↗ |
| DeepSWE v1.1 | 74,2 % | Resolvido | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
DeepSeek V4.1 Flash
Versão incorporada no catálogo verificado da Inferama.
Análises relacionadas
DeepSeek V4.1 Flash: como verificar se a cache comprimida reduz o custo real de um agente
A DeepSeek atribui ao V4.1 Flash uma cache KV persistente muito menor do que a do seu antecessor. Esse número descreve uma propriedade de infraestrutura, não o custo nem o tempo de uma tarefa completa. Esta análise propõe um teste controlado para medir ambos.
28 set 2026 ↗ COMPARATIVADeepSeek V4.1 Flash + Eleven v3 versus voz full-duplex: como comparar as arquiteturas
Uma cadeia modular com reconhecimento de voz, DeepSeek V4.1 Flash e Eleven v3 não equivale a um modelo de voz full-duplex. Este guia propõe comparar os dois sistemas de ponta a ponta, sem antecipar um vencedor com base em especificações isoladas.
26 set 2026 ↗ ANALISISDeepSWE v1.1: o que mede um patch que supera o seu verificador e quando o seu pass@1 deixa de demonstrar que o agente resolveu a tarefa
O DeepSWE v1.1 avalia alterações de código produzidas por agentes em tarefas originais e de longo horizonte. O seu resultado pode fornecer um sinal útil, mas uma linha do leaderboard só é interpretável se forem conhecidos o arnês, a política de erros, os rollouts, o verificador e a versão exata do benchmark. Uma revisão da Epoch AI acrescenta um alerta concreto: alguns patches que modificam testes podem receber um falso negativo em determinadas condições.
23 set 2026 ↗