O
OPENAI / gpt-oss-120b

gpt‑oss‑120b

Reasoning-Modell mit offenen Gewichten für lokale oder private Ausführung; laut OpenAI passt es auf eine H100-GPU.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGOffenes Reasoning

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT131.072 Tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRTNicht veröffentlicht

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGDownload der Gewichte

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung · Code

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZApache 2.0

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDgpt-oss-120b
ModelltypText und Begründung · Code
ZugangsmodellOffene Gewichte
LizenzApache 2.0
EinsatzLokal, private Cloud oder Anbieter
VeröffentlichungAGO 2025
WissensstichtagNicht veröffentlicht
EingangText
AusfahrtText
Kontextfenster131.072 Tokens
maximale LeistungNicht veröffentlicht
ArgumentationAnpassbares Reasoning
Veröffentlichte Tools
Strukturierte AusflügeNicht zutreffend oder nicht veröffentlicht
StapelverarbeitungNicht veröffentlicht
Prompt-CacheNicht veröffentlicht
FeinabstimmungHerunterladbare Gewichte
Verifizierte PlattformenHugging Face · Proveedores de inferencia
EIGNET SICH BESSER FÜR

Privates Reasoning, Anpassung und Bereitstellungen, die Infrastrukturkontrolle benötigen.

SOLLTE BEOBACHTET WERDEN

Erfordert eigene Hardware und eigenen Betrieb; die Leistung hängt von Runtime und Quantisierung ab.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Privates Reasoning, Anpassung und Bereitstellungen, die Infrastrukturkontrolle benötigen.

02

Kontext

131.072 Tokens · Nicht veröffentlicht

03

Tools und Integration

Nicht veröffentlicht

04

Zugang

Download der Gewichte

Eingabemodalitäten
Text
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
StandardeingabeNicht veröffentlichtStandardtarif der API
Eingabe aus dem CacheNicht veröffentlichtLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
StandardausgabeNicht veröffentlichtKann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
Evaluaciones gpt‑ossVeröffentlichtes o4-mini-NiveauAllgemeines ReasoningQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

gpt‑oss‑120b

In den verifizierten Katalog von Inferama aufgenommene Version.

07 / QUELLEN

Rückverfolgbarkeit