O
OPENAI / gpt-oss-120b

gpt‑oss‑120b

Modelo de raciocínio com pesos abertos para execução local ou privada; cabe numa GPU H100 segundo a OpenAI.

01 / RESUMO

O essencial

ORIENTAÇÃORaciocínio aberto

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO131.072 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDANão publicado

Limite máximo de geração documentado.

ACESSOTransferência de pesos

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio · Código

Família funcional principal e especialidades verificadas.

LICENÇAApache 2.0

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APIgpt-oss-120b
Tipo de modeloTexto e raciocínio · Código
Modelo de acessoPesos abertos
LicençaApache 2.0
ImplantaçãoLocal, nuvem privada ou fornecedor
LançamentoAGO 2025
Data de corte do conhecimentoNão publicado
EntradaTexto
SaídaTexto
Janela de contexto131.072 tokens
saída máximaNão publicado
RaciocínioRaciocínio ajustável
Ferramentas publicadas
Passeios EstruturadosNão aplicável ou não publicado
Processamento em loteNão publicado
Cache de promptsNão publicado
Ajuste finoPesos transferíveis
Plataformas verificadasHugging Face · Proveedores de inferencia
ADEQUA-SE MELHOR A

Raciocínio privado, personalização e implementações que necessitam de controlo da infraestrutura.

CONVÉM MONITORIZAR

Exige hardware e operação próprios; o desempenho depende do runtime e da quantização.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Raciocínio privado, personalização e implementações que necessitam de controlo da infraestrutura.

02

Contexto

131.072 tokens · Não publicado

03

Ferramentas e integração

Não publicado

04

Acesso

Transferência de pesos

Modalidades de entrada
Texto
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrãoNão publicadoTarifa padrão da API
Entrada em cacheNão publicadoLeitura de prefixos reutilizados
Escrita ou armazenamento em cacheNão publicadoA condição varia consoante o fornecedor
Saída padrãoNão publicadoPode incluir tokens de raciocínio
Entrada por lotesNão publicadoProcessamento assíncrono
Saída por lotesNão publicadoProcessamento assíncrono

Consulta a fonte primária: a unidade de faturação depende do tipo de modelo e do canal de acesso.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
Evaluaciones gpt‑ossNível o4-mini publicadoRaciocínio geralVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

gpt‑oss‑120b

Versão incorporada no catálogo verificado da Inferama.

07 / FONTES

Rastreabilidade