A
ANTHROPIC / claude-sonnet-5

Claude Sonnet 5

Code, Recherche und professionelle Abläufe mit Werkzeugen.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGAusgewogenes Kosten-Leistungs-Verhältnis

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT1.000.000 Tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRT128.000 Tokens

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGClaude, Claude API und zugehörige Clouds

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZProprietär

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDclaude-sonnet-5
ModelltypText und Begründung
ZugangsmodellKostenpflichtig proprietär
LizenzProprietär
EinsatzGehostete API
Veröffentlichung30. JUN 2026
WissensstichtagJAN 2026
EingangText · Bild
AusfahrtText
Kontextfenster1.000.000 Tokens
maximale Leistung128.000 Tokens
ArgumentationAdaptives Denken · konfigurierbarer Aufwand
Veröffentlichte ToolsEinsatz von Werkzeugen · Websuche · Codeausführung · Computernutzung
Strukturierte AusflügeUnterstützt
StapelverarbeitungKompatibel · 50 % Rabatt
Prompt-CacheKompatibel · bis zu 90 % Ersparnis bei Lesevorgängen
FeinabstimmungNicht veröffentlicht
Verifizierte PlattformenClaude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry
EIGNET SICH BESSER FÜR

Code, Recherche und professionelle Abläufe mit Werkzeugen.

SOLLTE BEOBACHTET WERDEN

Kosten und Leistung hängen von der Schlussfolgerungsstufe ab.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Code, Recherche und professionelle Abläufe mit Werkzeugen.

02

Kontext

1.000.000 tokens · 128.000 tokens

03

Tools und Integration

Tool-Nutzung · Websuche · Codeausführung · Computernutzung

04

Zugang

Claude, Claude API und zugehörige Clouds

Eingabemodalitäten
TextBild
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
Standardeingabe2,00 USD / 1 M tokensStandardtarif der API
Eingabe aus dem Cache0,20 USD / 1 M tokensLesen wiederverwendeter Präfixe
Schreiben oder Speichern im Cache2,50–4,00 USD / 1 M tokensDie Bedingung variiert je nach Anbieter
Standardausgabe10,00 USD / 1 M TokensKann Reasoning-Tokens enthalten
Batch-Eingabe1,00 USD / 1 M TokensAsynchrone Verarbeitung
Batch-Ausgabe5,00 USD / 1 M TokensAsynchrone Verarbeitung

Konsultieren Sie die Primärquelle, bevor Sie eine Bereitstellung budgetieren.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
OSWorld-VerifiedKurve nach AufwandErfolg und KostenQuelle öffnen ↗
BrowseCompKurve nach AufwandGenauigkeit und KostenQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

Claude Sonnet 5

In den verifizierten Katalog von Inferama aufgenommene Version.

ANALYSE

Verwandte Analysen

Claude Sonnet 5: So messen Sie vor der Migration die Auswirkungen des neuen Tokenizers
ANALISIS

Claude Sonnet 5: So messen Sie vor der Migration die Auswirkungen des neuen Tokenizers

Anthropic zufolge kann derselbe Text mit Sonnet 5 in mehr Tokens umgewandelt werden als mit Sonnet 4.6. Mit einem eigenen Testkorpus lässt sich prüfen, ob das in einer konkreten Integration den nutzbaren Kontext oder die Kosten pro Aufgabe verändert.

23 Sep 2026
BrowseComp: Was ein Agent misst, der eine schwer auffindbare Information im Web findet – und warum ein Treffer keine verlässliche Recherche beweist
ANALISIS

BrowseComp: Was ein Agent misst, der eine schwer auffindbare Information im Web findet – und warum ein Treffer keine verlässliche Recherche beweist

BrowseComp bewertet, ob ein Agent durch persistentes Navigieren im Web eine kurze, schwer auffindbare faktische Antwort lokalisieren kann. Das ist ein nützliches, aber begrenztes Signal: Ein hoher Wert reicht nicht aus, um Recherchequalität, Nachvollziehbarkeit der Quellen oder Zuverlässigkeit bei offenen Aufgaben zu belegen.

22 Sep 2026
Claude Sonnet 5 und Cohere Embed 4 im multimodalen RAG: Wie sich ein Retrieval-Fehler von einem Antwortfehler trennen lässt
COMPARATIVA

Claude Sonnet 5 und Cohere Embed 4 im multimodalen RAG: Wie sich ein Retrieval-Fehler von einem Antwortfehler trennen lässt

Claude Sonnet 5 und Cohere Embed 4 besetzen unterschiedliche Schichten eines multimodalen RAG-Systems. Dieser Leitfaden schlägt ein faktorielles Experiment mit eingefrorenem Korpus und eingefrorenen Bedingungen vor, um getrennt zu messen, ob die richtige Evidenz abgerufen wurde und ob die Antwort sie getreu verwendet.

22 Sep 2026
Claude Fable 5.1: Wann Cache und Batch die Kosten pro Aufgabe senken – und wann sie die Rechnung nur verlagern
GUIA

Claude Fable 5.1: Wann Cache und Batch die Kosten pro Aufgabe senken – und wann sie die Rechnung nur verlagern

Der Preis pro Million Tokens reicht nicht aus, um zwischen einem normalen Aufruf, dem Caching von Anweisungen oder der Batch-Verarbeitung zu wählen. Dieser Leitfaden stellt ein Kostenmodell pro korrekt abgeschlossener Aufgabe für Claude Fable 5.1 vor – mit Formeln, Szenarien und einer minimalen Telemetrie. Entscheidend ist, ob Kontext vor Ablauf wiederverwendet wird, Wiederholungsversuche kontrolliert werden und die asynchrone Laufzeit der Batch API akzeptabel ist.

22 Sep 2026
Anthropic: So prüfen Sie, was sich bei der Nutzung von Claude über API, Partner-Cloud oder Produkt ändert
ANALISIS

Anthropic: So prüfen Sie, was sich bei der Nutzung von Claude über API, Partner-Cloud oder Produkt ändert

Die Einführung von Claude bedeutet nicht nur, eine Modellfamilie auszuwählen. Der Zugangskanal bestimmt, welche Kennung verwendet wird, welcher Abkündigungszeitplan gilt, welche Kontrollen die einzelnen Parteien verwalten und welche Dokumentation eine technische Entscheidung stützen kann. Dieser Leitfaden schlägt eine Methode vor, um diese Ebenen zu trennen, ohne öffentliche Richtlinien oder Sicherheitsevaluierungen in Garantien umzudeuten, die sie nicht enthalten.

22 Sep 2026
07 / QUELLEN

Rückverfolgbarkeit