ENTSCHEIDUNG / VERGLEICHER

Models von Angesicht zu Angesicht.

Eine gemeinsame Interpretation von Funktionen, Zugriff, Kontext, Preis und Überprüfungsdatum.

Wähle zwei oder drei Modelle
O
Eignet sich besser für
Komplexes Reasoning, Recherche, Code, Dokumente und Agenten mit Tools.
Sollte beobachtet werden
Höherer Preis pro Token; erfordert minimale Berechtigungen und Überprüfung bei sensiblen Aktionen.
A
Anthropic

Claude Opus 5

Eignet sich besser für
Agentischer Code, umfassende Refaktorierungen, Unternehmenswissen und visuelle Arbeit.
Sollte beobachtet werden
Die Antworten fallen tendenziell umfangreich aus, und aktives Denken kann die Ausgabe-Tokens erhöhen.
Eignet sich besser für
Kostengünstige Agenten, langlebige Software und umfassende multimodale Analyse.
Sollte beobachtet werden
Der Preis ist ein Einführungspreis, und die Nutzung von Grounding kann Kosten pro Abfrage verursachen.
KriteriumGPT‑6 AstraClaude Opus 5Gemini 3.8 Flash
Identität und Gültigkeit
OrganisationOpenAIAnthropicGoogle
API-IDgpt-6-astraclaude-opus-5gemini-3.8-flash
ZustandVerfügbarVermögenswertStabile GA
Veröffentlichung3. September 202624. Juli 20262. September 2026
Wissensstichtag30. April 2026Mai 2026Nicht in der konsultierten Quelle veröffentlicht
ProfilGeneralistische GrenzeWissen und CodeSchnell multimodal
Kapazität und Modalitäten
EingangText · BildText · BildText · Bild · Video · Audio · PDF
AusfahrtTextTextText
Kontextfenster1.050.000 Tokens1.000.000 Tokens1.048.576 Eintrittstoken
maximale Leistung128.000 Tokens128.000 Tokens65.536 Ausgabe-Token
ArgumentationAufwand low, medium, high, xhigh und maxAdaptives Denken · konfigurierbarer AufwandStufen low, medium und high
Relative LatenzModerat; abhängig vom Reasoning-AufwandModerat · Fast-Modus in der API verfügbarAuf Geschwindigkeit und Effizienz ausgerichtetes Flash-Profil
Tools und Integration
Veröffentlichte ToolsFunktionen · Websuche · Dateisuche · Code-Interpreter · Gehostete Shell · Computernutzung · MCPEinsatz von Werkzeugen · Websuche · Codeausführung · ComputernutzungFunktionen · Websuche · Google Maps · Codeausführung · Computernutzung (Vorschau) · Dateisuche · URL-Kontext
Strukturierte AusflügeKompatibelKompatibelKompatibel
StapelverarbeitungKompatibel · 50 % RabattKompatibel · 50 % RabattKompatibel · 50 % Rabatt
Prompt-CacheKompatibelKompatibel · bis zu 90 % Ersparnis bei LesevorgängenKompatibel
FeinabstimmungNicht kompatibelNicht in der konsultierten Quelle veröffentlichtNicht in der konsultierten Quelle veröffentlicht
Standardpreis der API
Eintrittspreis10,00 USD / 1 M Tokens5,00 USD / 1 M Tokens0,75 USD / 1 Mio. Token
Eingabe aus dem Cache1,00 USD / 1 M Tokens0,50 USD / 1 M Tokens0,075 USD / 1 M Tokens
Schreiben oder Speichern im Cache12,50 USD / 1 M Tokens6,25 USD / 1 M Tokens (5 Min.) · 10,00 USD (1 Std.)0,50 USD / 1 M Tokens pro Speicherstunde
Startpreis50,00 USD / 1 M Tokens25,00 USD / 1 M Tokens3,75 USD / 1 Mio. Token
Batch-Eingabe5,00 USD / 1 M Tokens2,50 USD / 1 M Tokens0,375 USD / 1 M Tokens
Batch-Ausgabe25,00 USD / 1 M Tokens12,50 USD / 1 M Tokens1,875 USD / 1 M Tokens
Relevante BedingungenAnfragen mit mehr als 272.000 Eingabe-Tokens unterliegen Preisaufschlägen; Tools können Kosten pro Aufruf hinzufügen.Denken wird als Ausgabe abgerechnet. Der Fast-Modus kostet das Doppelte des Grundtarifs.Einführungspreise bis zum 31. Dezember 2026; ab 2027 verdoppeln sich die Standardtarife.
Verfügbarkeit
ZugangskanäleOpenAI API · Responses, Chat Completions und BatchClaude, Claude API, AWS, Google Cloud und Microsoft FoundryGemini API · Google AI Studio · stabile Version
Verifizierte PlattformenOpenAI APIClaude.ai · Claude Code · Claude API · Amazon Bedrock · Google Cloud · Microsoft FoundryGemini API · Google AI Studio
Verifiziert
PrimärquelleOffizielles Datenblatt von GPT‑6 Astra ↗Offizielles Datenblatt der Claude-Modelle ↗Offizielles Profil von Gemini 3.8 Flash ↗

i «Nicht veröffentlicht» bedeutet, dass die konsultierten Primärquellen diese Angabe nicht bieten. Inferama füllt Lücken nicht durch Schätzungen.

02

Beispiel für vergleichbare Kosten

Eine Anfrage mit 1 Million Eingabe-Tokens und 250.000 Ausgabe-Tokens, ohne Cache oder Tools.

OpenAI

GPT‑6 Astra

Standard
22,500 USD
Batch-Verarbeitung
11,250 USD
Anthropic

Claude Opus 5

Standard
11,250 USD
Batch-Verarbeitung
5,625 USD
Google

Gemini 3.8 Flash

Standard
1,688 USD
Batch-Verarbeitung
0,844 USD

i Dies ist ein Rechenbeispiel, keine Kostenschätzung pro Aufgabe. Reasoning, Cache, Tools, Wiederholungsversuche und Kontextstufen können die Rechnung verändern.

03

So triffst du mit dieser Tabelle eine Entscheidung

Das leistungsfähigste Modell ist nicht immer das passendste System für einen konkreten Ablauf.

01

Filtere nach harten Anforderungen

Schließe zuerst aus, was deine Modalität, deinen Kontext, dein Tool, deine Region oder dein Höchstbudget nicht unterstützt.

02

Teste eigene Aufgaben

Vergleiche Qualität, Latenz, Fehlerrate und Wiederherstellung anhand realer Fälle und eines stabilen Bewertungsrasters.

03

Messen Sie das gesamte System

Umfasst Tool-Aufrufe, Suchen, Cache, Überwachung, Wiederholungsversuche und die Kosten zur Fehlerbehebung.

04

Prüfe die Gültigkeit

Preise und Limits ändern sich. Prüfe das Datum und öffne die Primärquelle, bevor du buchst oder migrierst.

04

Verwendete Quellen

Technische Dokumentation, Preise, Status und Transparenz jedes Anbieters.