Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
gpt‑oss‑120b
Reasoning-Modell mit offenen Gewichten für lokale oder private Ausführung; laut OpenAI passt es auf eine H100-GPU.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | gpt-oss-120b |
|---|---|
| Modelltyp | Text und Begründung · Code |
| Zugangsmodell | Offene Gewichte |
| Lizenz | Apache 2.0 |
| Einsatz | Lokal, private Cloud oder Anbieter |
| Veröffentlichung | AGO 2025 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text |
| Ausfahrt | Text |
| Kontextfenster | 131.072 Tokens |
| maximale Leistung | Nicht veröffentlicht |
| Argumentation | Anpassbares Reasoning |
| Veröffentlichte Tools | |
| Strukturierte Ausflüge | Nicht zutreffend oder nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Herunterladbare Gewichte |
| Verifizierte Plattformen | Hugging Face · Proveedores de inferencia |
Privates Reasoning, Anpassung und Bereitstellungen, die Infrastrukturkontrolle benötigen.
Erfordert eigene Hardware und eigenen Betrieb; die Leistung hängt von Runtime und Quantisierung ab.
Was es kann
Orientierung
Privates Reasoning, Anpassung und Bereitstellungen, die Infrastrukturkontrolle benötigen.
Kontext
131.072 Tokens · Nicht veröffentlicht
Tools und Integration
Nicht veröffentlicht
Zugang
Download der Gewichte
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| Evaluaciones gpt‑oss | Veröffentlichtes o4-mini-Niveau | Allgemeines Reasoning | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
gpt‑oss‑120b
In den verifizierten Katalog von Inferama aufgenommene Version.