O
OPENAI / gpt-oss-120b

gpt‑oss‑120b

Modelo de razonamiento con pesos abiertos para ejecución local o privada; cabe en una GPU H100 según OpenAI.

01 / RESUMEN

Lo esencial

ORIENTACIÓNRazonamiento abierto

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO131.072 tokens

Capacidad máxima de entrada cuando la fuente la publica.

SALIDANo publicado

Límite máximo de generación documentado.

ACCESODescarga de pesos

Canales de disponibilidad verificados.

TIPO DE MODELOTexto y razonamiento · Código

Familia funcional principal y especialidades verificadas.

LICENCIAApache 2.0

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APIgpt-oss-120b
Tipo de modeloTexto y razonamiento · Código
Modelo de accesoPesos abiertos
LicenciaApache 2.0
DespliegueLocal, nube privada o proveedor
LanzamientoAGO 2025
Corte de conocimientoNo publicado
EntradaTexto
SalidaTexto
Ventana de contexto131.072 tokens
Salida máximaNo publicado
RazonamientoRazonamiento ajustable
Herramientas publicadas
Salidas estructuradasNo aplica o no publicado
Procesamiento por lotesNo publicado
Caché de promptsNo publicado
Ajuste finoPesos descargables
Plataformas verificadasHugging Face · Proveedores de inferencia
ENCAJA MEJOR EN

Razonamiento privado, personalización y despliegues que necesitan control de infraestructura.

CONVIENE VIGILAR

Exige hardware y operación propios; el rendimiento depende del runtime y la cuantización.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Razonamiento privado, personalización y despliegues que necesitan control de infraestructura.

02

Contexto

131.072 tokens · No publicado

03

Herramientas e integración

No publicado

04

Acceso

Descarga de pesos

Modalidades de entrada
Texto
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándarNo publicadoTarifa estándar de API
Entrada en cachéNo publicadoLectura de prefijos reutilizados
Escritura o almacenamiento de cachéNo publicadoLa condición varía según proveedor
Salida estándarNo publicadoPuede incluir tokens de razonamiento
Entrada por lotesNo publicadoProcesamiento asíncrono
Salida por lotesNo publicadoProcesamiento asíncrono

Consulta la fuente primaria: la unidad de facturación depende del tipo de modelo y del canal de acceso.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
Evaluaciones gpt‑ossNivel o4-mini publicadoRazonamiento generalVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

gpt‑oss‑120b

Versión incorporada al catálogo verificado de Inferama.

07 / FUENTES

Trazabilidad