Uso principal declarado o inferido con cautela desde la documentación oficial.
DeepSeek V4.1 Flash
Agentes, código y despliegue abierto con costes bajos.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | deepseek-flash |
|---|---|
| Tipo de modelo | Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | 10 SEP 2026 |
| Corte de conocimiento | No publicado |
| Entrada | Texto · Imagen |
| Salida | Texto |
| Ventana de contexto | 1.000.000 tokens |
| Salida máxima | 384.000 tokens |
| Razonamiento | Modos con y sin razonamiento |
| Herramientas publicadas | Funciones · Responses API · Prefijo de chat · FIM |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | No publicado |
| Caché de prompts | Compatible |
| Ajuste fino | Pesos abiertos |
| Plataformas verificadas | DeepSeek API · Hugging Face |
Agentes, código y despliegue abierto con costes bajos.
Las condiciones de ejecución cambian entre benchmarks; no compares solo la cifra.
Qué puede hacer
Orientación
Agentes, código y despliegue abierto con costes bajos.
Contexto
1.000.000 tokens · 384.000 tokens
Herramientas e integración
Funciones · Responses API · Prefijo de chat · FIM
Acceso
DeepSeek API · pesos abiertos
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 0,30 USD / 1 M tokens (pico) | Tarifa estándar de API |
| Entrada en caché | 0,006 USD / 1 M tokens (pico) | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | No publicado | La condición varía según proveedor |
| Salida estándar | 1,20 USD / 1 M tokens (pico) | Puede incluir tokens de razonamiento |
| Entrada por lotes | No publicado | Procesamiento asíncrono |
| Salida por lotes | No publicado | Procesamiento asíncrono |
Las tarifas valle son la mitad; los horarios se publican en UTC.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| GPQA Diamond | 90,9 % | Exactitud | Ver fuente ↗ |
| Terminal-Bench 2.1 | 90,6 % | Exactitud | Ver fuente ↗ |
| DeepSWE v1.1 | 74,2 % | Resuelto | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
DeepSeek V4.1 Flash
Versión incorporada al catálogo verificado de Inferama.
Análisis relacionados
DeepSeek V4.1 Flash: cómo comprobar si su caché comprimida reduce el coste real de un agente
DeepSeek atribuye a V4.1 Flash una caché KV persistente mucho menor que la de su predecesor. Esa cifra describe una propiedad de infraestructura, no el coste ni el tiempo de una tarea completa. Este análisis propone una prueba controlada para medir ambos.
28 sep. 2026 ↗ COMPARATIVADeepSeek V4.1 Flash + Eleven v3 frente a voz full-duplex: cómo comparar las arquitecturas
Una cadena modular con reconocimiento de voz, DeepSeek V4.1 Flash y Eleven v3 no equivale a un modelo de voz full-duplex. Esta guía propone comparar ambos sistemas de extremo a extremo, sin anticipar un ganador a partir de especificaciones aisladas.
26 sep. 2026 ↗ ANALISISDeepSWE v1.1: qué mide un parche que supera su verificador y cuándo su pass@1 deja de demostrar que el agente resolvió la tarea
DeepSWE v1.1 evalúa cambios de código producidos por agentes en tareas originales y de largo recorrido. Su resultado puede aportar una señal útil, pero una fila del leaderboard solo es interpretable si se conocen el arnés, la política de errores, los rollouts, el verificador y la versión exacta del benchmark. Una revisión de Epoch AI añade una advertencia concreta: algunos parches que modifican pruebas pueden recibir un falso negativo bajo determinadas condiciones.
23 sep. 2026 ↗