Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
GPT‑5.6 Sol
Komplexe Aufgaben, Code und Agenten mit Werkzeugen.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | gpt-5.6-sol |
|---|---|
| Modelltyp | Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | JUL 2026 |
| Wissensstichtag | 16. FEB 2026 |
| Eingang | Text · Bild |
| Ausfahrt | Text |
| Kontextfenster | 1.050.000 Tokens |
| maximale Leistung | 128.000 Tokens |
| Argumentation | Aufwand none, low, medium, high, xhigh und max |
| Veröffentlichte Tools | Funktionen · Websuche · Dateisuche · Computernutzung |
| Strukturierte Ausflüge | Unterstützt |
| Stapelverarbeitung | Kompatibel · 50 % Rabatt |
| Prompt-Cache | Kompatibel · 90 % Rabatt auf Lesevorgänge |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | OpenAI API |
Komplexe Aufgaben, Code und Agenten mit Werkzeugen.
Kosten und Leistung hängen von der Schlussfolgerungsstufe ab.
Was es kann
Orientierung
Komplexe Aufgaben, Code und Agenten mit Werkzeugen.
Kontext
1.050.000 tokens · 128.000 tokens
Tools und Integration
Funktionen · Websuche · Dateisuche · Computernutzung
Zugang
OpenAI API · Responses und Chat Completions
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | 4,00 USD / 1 M tokens | Standardtarif der API |
| Eingabe aus dem Cache | 0,40 USD / 1 M tokens | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | 5,00 USD / 1 M Tokens | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | 20,00 USD / 1 M tokens | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | 2,00 USD / 1 M tokens | Asynchrone Verarbeitung |
| Batch-Ausgabe | 10,00 USD / 1 M Tokens | Asynchrone Verarbeitung |
Konsultieren Sie die Primärquelle, bevor Sie eine Bereitstellung budgetieren.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| Agents' Last Exam | 52,7 % | Genauigkeit | Quelle öffnen ↗ |
| SWE-Bench Pro | 64,6 % | Gelöst | Quelle öffnen ↗ |
| Terminal-Bench 2.1 | 88,8 % | Genauigkeit | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
GPT‑5.6 Sol
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
AutomationBench: Was ein Agent nachweist, der einen Geschäftsablauf in den richtigen Zustand versetzt – und was nicht
AutomationBench bewertet, ob ein Agent Abläufe zwischen simulierten SaaS-Anwendungen abschließen und sie in einen überprüfbaren Endzustand überführen kann. Dieser Leitfaden erklärt, was diese Evidenz bedeutet, wie die Metriken zu lesen sind und welche zusätzlichen Prüfungen nötig sind, bevor sich ein Ergebnis auf ein reales Unternehmen übertragen lässt.
22 Sep 2026 ↗ PAPERAgents’ Last Exam: Was ein Agent für reale Arbeit misst – und warum seine Erfolgsquote nicht bedeutet, dass er „einen Beruf automatisiert“
Agents’ Last Exam bewertet Agenten bei beruflichen Aufgaben in Betriebssystemumgebungen mit überprüfbaren Ergebnissen. Das Design eignet sich, um die Ausführung von Arbeitsabläufen zu untersuchen. Eine aggregierte Erfolgszahl belegt jedoch nicht, dass sich ein Beruf automatisieren lässt. Für ihre Einordnung sind Details zu Aufgaben, Umgebung, Harness, Modell, Werkzeugen, Budget und der bewerteten Version erforderlich.
22 Sep 2026 ↗