ORGANIZACIÓN VERIFICADA

DeepSeek

Consulta los modelos documentados, las evaluaciones publicadas y las fuentes primarias asociadas a esta organización.

01 / MODELOS

Catálogo verificado

02 / EVALUACIONES

Resultados publicados

Las cifras se muestran con el contexto comunicado por su fuente. Un resultado del proveedor no equivale a una comparación independiente ni sustituye una evaluación propia.

ModeloBenchmarkResultadoMétrica
DeepSeek V4.1 FlashGPQA Diamond90,9 %Exactitud
DeepSeek V4.1 FlashTerminal-Bench 2.190,6 %Exactitud
DeepSeek V4.1 FlashDeepSWE v1.174,2 %Resuelto
DeepSeek V3.2Evaluaciones DeepSeek V3.2Nivel GPT‑5 publicadoRazonamiento y agentes
DeepSeek R1AIME 202479,8 %Pass@1 publicado
03 / MÉTODO

Cómo leer el directorio

Una organización, un producto y un modelo no son la misma unidad. Inferama los separa para evitar atribuir capacidades o condiciones comerciales al elemento equivocado.

01

Laboratorio

Entidad que desarrolla o publica el modelo y mantiene su documentación técnica y de seguridad.

02

Modelo

Versión identificable con límites, modalidades y comportamiento que pueden cambiar entre lanzamientos.

03

Canal de acceso

API, aplicación, nube asociada o plan comercial; cada canal puede tener precios, retención y límites distintos.

04

Fuente y fecha

Cada afirmación debe conservar la página oficial consultada y la fecha de verificación.

ANÁLISIS

Análisis relacionados

DeepSeek V4.1 Flash: cómo comprobar si su caché comprimida reduce el coste real de un agente
ANALISIS

DeepSeek V4.1 Flash: cómo comprobar si su caché comprimida reduce el coste real de un agente

DeepSeek atribuye a V4.1 Flash una caché KV persistente mucho menor que la de su predecesor. Esa cifra describe una propiedad de infraestructura, no el coste ni el tiempo de una tarea completa. Este análisis propone una prueba controlada para medir ambos.

28 sep. 2026
DeepSeek V3.2 con herramientas: cómo auditar el estado de razonamiento antes de mantener o migrar un agente
ANALISIS

DeepSeek V3.2 con herramientas: cómo auditar el estado de razonamiento antes de mantener o migrar un agente

Una guía operativa para comprobar que una integración conserva el estado exigido entre DeepSeek, las herramientas y el usuario. Incluye pruebas reproducibles, criterios de registro y límites de lo que puede concluirse a partir de `reasoning_content`.

28 sep. 2026
DeepSeek R1 en producción: cómo probar la plantilla de prompt sin romper la aplicación
ANALISIS

DeepSeek R1 en producción: cómo probar la plantilla de prompt sin romper la aplicación

Las recomendaciones oficiales de prompting para DeepSeek R1 son hipótesis que conviene validar en cada aplicación. Este protocolo permite comparar ubicaciones de instrucciones y el prefijo «<think>» midiendo tanto la calidad de las respuestas como los fallos de integración.

27 sep. 2026
DeepSeek V4.1 Flash + Eleven v3 frente a voz full-duplex: cómo comparar las arquitecturas
COMPARATIVA

DeepSeek V4.1 Flash + Eleven v3 frente a voz full-duplex: cómo comparar las arquitecturas

Una cadena modular con reconocimiento de voz, DeepSeek V4.1 Flash y Eleven v3 no equivale a un modelo de voz full-duplex. Esta guía propone comparar ambos sistemas de extremo a extremo, sin anticipar un ganador a partir de especificaciones aisladas.

26 sep. 2026
DeepSWE v1.1: qué mide un parche que supera su verificador y cuándo su pass@1 deja de demostrar que el agente resolvió la tarea
ANALISIS

DeepSWE v1.1: qué mide un parche que supera su verificador y cuándo su pass@1 deja de demostrar que el agente resolvió la tarea

DeepSWE v1.1 evalúa cambios de código producidos por agentes en tareas originales y de largo recorrido. Su resultado puede aportar una señal útil, pero una fila del leaderboard solo es interpretable si se conocen el arnés, la política de errores, los rollouts, el verificador y la versión exacta del benchmark. Una revisión de Epoch AI añade una advertencia concreta: algunos parches que modifican pruebas pueden recibir un falso negativo bajo determinadas condiciones.

23 sep. 2026
DeepSeek: cómo decidir entre API oficial, pesos publicados y proveedores externos sin confundir apertura con control operativo
ANALISIS

DeepSeek: cómo decidir entre API oficial, pesos publicados y proveedores externos sin confundir apertura con control operativo

La disponibilidad de pesos, una API compatible o el nombre de una familia no resuelven por sí solos una decisión de producción. Este análisis propone separar artefacto, licencia, endpoint, operador y evidencia para evaluar DeepSeek mediante la API oficial, infraestructura propia o un proveedor externo.

22 sep. 2026
04 / FUENTES

Trazabilidad