Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
GPT‑4.1
Nicht schlussfolgerndes Modell mit langem Kontext, nützlich als historische Referenz für Code, Instruktionsbefolgung und vorhersehbare Latenz.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | gpt-4.1 |
|---|---|
| Modelltyp | Code · Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 14 ABR 2025 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text · Bild |
| Ausfahrt | Text |
| Kontextfenster | 1.047.576 Tokens |
| maximale Leistung | 32.768 Tokens |
| Argumentation | Ohne konfigurierbares Reasoning |
| Veröffentlichte Tools | Funktionen · Tools der Responses API |
| Strukturierte Ausflüge | Unterstützt |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | OpenAI API |
Code und Instruktionsbefolgung, wenn ein nicht schlussfolgerndes Modell benötigt wird.
OpenAI ordnet es hinter GPT‑5-Generationen ein; prüfe die Aktualität vor einer neuen Integration.
Was es kann
Orientierung
Code und Instruktionsbefolgung, wenn ein nicht schlussfolgerndes Modell benötigt wird.
Kontext
1.047.576 Tokens · 32.768 Tokens
Tools und Integration
Funktionen · Tools der Responses API
Zugang
OpenAI API
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| SWE-bench Verified | 54,6 % | Veröffentlichte gelöste Probleme | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
GPT‑4.1
In den verifizierten Katalog von Inferama aufgenommene Version.