Uso principal declarado o inferido con cautela desde la documentación oficial.
gpt‑oss‑120b
Modelo de razonamiento con pesos abiertos para ejecución local o privada; cabe en una GPU H100 según OpenAI.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | gpt-oss-120b |
|---|---|
| Tipo de modelo | Texto y razonamiento · Código |
| Modelo de acceso | Pesos abiertos |
| Licencia | Apache 2.0 |
| Despliegue | Local, nube privada o proveedor |
| Lanzamiento | AGO 2025 |
| Corte de conocimiento | No publicado |
| Entrada | Texto |
| Salida | Texto |
| Ventana de contexto | 131.072 tokens |
| Salida máxima | No publicado |
| Razonamiento | Razonamiento ajustable |
| Herramientas publicadas | |
| Salidas estructuradas | No aplica o no publicado |
| Procesamiento por lotes | No publicado |
| Caché de prompts | No publicado |
| Ajuste fino | Pesos descargables |
| Plataformas verificadas | Hugging Face · Proveedores de inferencia |
Razonamiento privado, personalización y despliegues que necesitan control de infraestructura.
Exige hardware y operación propios; el rendimiento depende del runtime y la cuantización.
Qué puede hacer
Orientación
Razonamiento privado, personalización y despliegues que necesitan control de infraestructura.
Contexto
131.072 tokens · No publicado
Herramientas e integración
No publicado
Acceso
Descarga de pesos
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | No publicado | Tarifa estándar de API |
| Entrada en caché | No publicado | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | No publicado | La condición varía según proveedor |
| Salida estándar | No publicado | Puede incluir tokens de razonamiento |
| Entrada por lotes | No publicado | Procesamiento asíncrono |
| Salida por lotes | No publicado | Procesamiento asíncrono |
Consulta la fuente primaria: la unidad de facturación depende del tipo de modelo y del canal de acceso.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| Evaluaciones gpt‑oss | Nivel o4-mini publicado | Razonamiento general | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
gpt‑oss‑120b
Versión incorporada al catálogo verificado de Inferama.