GPT‑6 Astra
- Eignet sich besser für
- Komplexes Reasoning, Recherche, Code, Dokumente und Agenten mit Tools.
- Sollte beobachtet werden
- Höherer Preis pro Token; erfordert minimale Berechtigungen und Überprüfung bei sensiblen Aktionen.
Eine gemeinsame Interpretation von Funktionen, Zugriff, Kontext, Preis und Überprüfungsdatum.
| Kriterium | GPT‑6 Astra | Claude Opus 5 | Gemini 3.8 Flash |
|---|---|---|---|
| Identität und Gültigkeit | |||
| Organisation | OpenAI | Anthropic | |
| API-ID | gpt-6-astra | claude-opus-5 | gemini-3.8-flash |
| Zustand | Verfügbar | Vermögenswert | Stabile GA |
| Veröffentlichung | 3. September 2026 | 24. Juli 2026 | 2. September 2026 |
| Wissensstichtag | 30. April 2026 | Mai 2026 | Nicht in der konsultierten Quelle veröffentlicht |
| Profil | Generalistische Grenze | Wissen und Code | Schnell multimodal |
| Kapazität und Modalitäten | |||
| Eingang | Text · Bild | Text · Bild | Text · Bild · Video · Audio · PDF |
| Ausfahrt | Text | Text | Text |
| Kontextfenster | 1.050.000 Tokens | 1.000.000 Tokens | 1.048.576 Eintrittstoken |
| maximale Leistung | 128.000 Tokens | 128.000 Tokens | 65.536 Ausgabe-Token |
| Argumentation | Aufwand low, medium, high, xhigh und max | Adaptives Denken · konfigurierbarer Aufwand | Stufen low, medium und high |
| Relative Latenz | Moderat; abhängig vom Reasoning-Aufwand | Moderat · Fast-Modus in der API verfügbar | Auf Geschwindigkeit und Effizienz ausgerichtetes Flash-Profil |
| Tools und Integration | |||
| Veröffentlichte Tools | Funktionen · Websuche · Dateisuche · Code-Interpreter · Gehostete Shell · Computernutzung · MCP | Einsatz von Werkzeugen · Websuche · Codeausführung · Computernutzung | Funktionen · Websuche · Google Maps · Codeausführung · Computernutzung (Vorschau) · Dateisuche · URL-Kontext |
| Strukturierte Ausflüge | Kompatibel | Kompatibel | Kompatibel |
| Stapelverarbeitung | Kompatibel · 50 % Rabatt | Kompatibel · 50 % Rabatt | Kompatibel · 50 % Rabatt |
| Prompt-Cache | Kompatibel | Kompatibel · bis zu 90 % Ersparnis bei Lesevorgängen | Kompatibel |
| Feinabstimmung | Nicht kompatibel | Nicht in der konsultierten Quelle veröffentlicht | Nicht in der konsultierten Quelle veröffentlicht |
| Standardpreis der API | |||
| Eintrittspreis | 10,00 USD / 1 M Tokens | 5,00 USD / 1 M Tokens | 0,75 USD / 1 Mio. Token |
| Eingabe aus dem Cache | 1,00 USD / 1 M Tokens | 0,50 USD / 1 M Tokens | 0,075 USD / 1 M Tokens |
| Schreiben oder Speichern im Cache | 12,50 USD / 1 M Tokens | 6,25 USD / 1 M Tokens (5 Min.) · 10,00 USD (1 Std.) | 0,50 USD / 1 M Tokens pro Speicherstunde |
| Startpreis | 50,00 USD / 1 M Tokens | 25,00 USD / 1 M Tokens | 3,75 USD / 1 Mio. Token |
| Batch-Eingabe | 5,00 USD / 1 M Tokens | 2,50 USD / 1 M Tokens | 0,375 USD / 1 M Tokens |
| Batch-Ausgabe | 25,00 USD / 1 M Tokens | 12,50 USD / 1 M Tokens | 1,875 USD / 1 M Tokens |
| Relevante Bedingungen | Anfragen mit mehr als 272.000 Eingabe-Tokens unterliegen Preisaufschlägen; Tools können Kosten pro Aufruf hinzufügen. | Denken wird als Ausgabe abgerechnet. Der Fast-Modus kostet das Doppelte des Grundtarifs. | Einführungspreise bis zum 31. Dezember 2026; ab 2027 verdoppeln sich die Standardtarife. |
| Verfügbarkeit | |||
| Zugangskanäle | OpenAI API · Responses, Chat Completions und Batch | Claude, Claude API, AWS, Google Cloud und Microsoft Foundry | Gemini API · Google AI Studio · stabile Version |
| Verifizierte Plattformen | OpenAI API | Claude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry | Gemini API · Google AI Studio |
| Verifiziert | |||
| Primärquelle | Offizielles Datenblatt von GPT‑6 Astra ↗ | Offizielles Datenblatt der Claude-Modelle ↗ | Offizielles Profil von Gemini 3.8 Flash ↗ |
i «Nicht veröffentlicht» bedeutet, dass die konsultierten Primärquellen diese Angabe nicht bieten. Inferama füllt Lücken nicht durch Schätzungen.
Eine Anfrage mit 1 Million Eingabe-Tokens und 250.000 Ausgabe-Tokens, ohne Cache oder Tools.
i Dies ist ein Rechenbeispiel, keine Kostenschätzung pro Aufgabe. Reasoning, Cache, Tools, Wiederholungsversuche und Kontextstufen können die Rechnung verändern.
Das leistungsfähigste Modell ist nicht immer das passendste System für einen konkreten Ablauf.
Schließe zuerst aus, was deine Modalität, deinen Kontext, dein Tool, deine Region oder dein Höchstbudget nicht unterstützt.
Vergleiche Qualität, Latenz, Fehlerrate und Wiederherstellung anhand realer Fälle und eines stabilen Bewertungsrasters.
Umfasst Tool-Aufrufe, Suchen, Cache, Überwachung, Wiederholungsversuche und die Kosten zur Fehlerbehebung.
Preise und Limits ändern sich. Prüfe das Datum und öffne die Primärquelle, bevor du buchst oder migrierst.
Technische Dokumentation, Preise, Status und Transparenz jedes Anbieters.