KOSTEN/KAPAZITÄT

Preise und Limits, mit Datum.

Die veröffentlichten Kosten sind nur dann vergleichbar, wenn wir Einheit, Modalität und Bedingungen kennen.

01

Veröffentlichte Daten

USD pro Million Token, wenn die Quelle diese Einheit verwendet.

OpenAI

GPT‑6 Astra

Standardeingabe
10,00 USD / 1 M Tokens
Standardausgabe
50,00 USD / 1 M Tokens
Eingabe aus dem Cache
1,00 USD / 1 M Tokens
Batch-Eingabe
5,00 USD / 1 M Tokens
Batch-Ausgabe
25,00 USD / 1 M Tokens
Kontext
1.050.000 Tokens
maximale Leistung
128.000 Tokens

Anfragen mit mehr als 272.000 Eingabe-Tokens unterliegen Preisaufschlägen; Tools können Kosten pro Aufruf hinzufügen.

Profil und Quellen öffnen →
Anthropic

Claude Opus 5

Standardeingabe
5,00 USD / 1 M Tokens
Standardausgabe
25,00 USD / 1 M Tokens
Eingabe aus dem Cache
0,50 USD / 1 M Tokens
Batch-Eingabe
2,50 USD / 1 M Tokens
Batch-Ausgabe
12,50 USD / 1 M Tokens
Kontext
1.000.000 Tokens
maximale Leistung
128.000 Tokens

Denken wird als Ausgabe abgerechnet. Der Fast-Modus kostet das Doppelte des Grundtarifs.

Profil und Quellen öffnen →
Google

Gemini 3.8 Flash

Standardeingabe
0,75 USD / 1 Mio. Token
Standardausgabe
3,75 USD / 1 Mio. Token
Eingabe aus dem Cache
0,075 USD / 1 M Tokens
Batch-Eingabe
0,375 USD / 1 M Tokens
Batch-Ausgabe
1,875 USD / 1 M Tokens
Kontext
1.048.576 Eintrittstoken
maximale Leistung
65.536 Ausgabe-Token

Einführungspreise bis zum 31. Dezember 2026; ab 2027 verdoppeln sich die Standardtarife.

Profil und Quellen öffnen →
Kosten pro Aufgabe

Beinhaltet Wiederholungsversuche, Tools, Wiederherstellung, Cache und menschliche Überprüfung.

Betriebsgrenze

Konto- und Regionsgrenzen können von der theoretischen Kapazität des Modells abweichen.

Fehlende Daten

Die Abwesenheit wird als relevante Information und nicht als Null gespeichert.

02

Was im Preis pro Token fehlt

Ein niedriger Tarif kann letztlich teuer werden, wenn der Ablauf Arbeit wiederholt oder viel Überwachung benötigt.

01

Reasoning und Länge

Interne oder Denk-Tokens werden üblicherweise als Ausgabe abgerechnet und hängen von der Schwierigkeit und dem konfigurierten Aufwand ab.

02

Tools und Grounding

Suche, Karten, Codeausführung und andere Tools können zusätzlich zu den Tokens Preise pro Aufruf haben.

03

Cache und Batch-Verarbeitung

Wiederholte Präfixe und asynchrone Verarbeitung senken die Kosten, erfordern jedoch, den Ablauf so zu gestalten, dass sie genutzt werden können.

04

Kosten eines Fehlers

Miss Wiederholungsversuche, menschliche Validierung, Vorfälle und Wiederherstellung: Sie sind Teil der gesamten Betriebskosten.