Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
Claude Sonnet 5
Code, Recherche und professionelle Abläufe mit Werkzeugen.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | claude-sonnet-5 |
|---|---|
| Modelltyp | Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 30. JUN 2026 |
| Wissensstichtag | JAN 2026 |
| Eingang | Text · Bild |
| Ausfahrt | Text |
| Kontextfenster | 1.000.000 Tokens |
| maximale Leistung | 128.000 Tokens |
| Argumentation | Adaptives Denken · konfigurierbarer Aufwand |
| Veröffentlichte Tools | Einsatz von Werkzeugen · Websuche · Codeausführung · Computernutzung |
| Strukturierte Ausflüge | Unterstützt |
| Stapelverarbeitung | Kompatibel · 50 % Rabatt |
| Prompt-Cache | Kompatibel · bis zu 90 % Ersparnis bei Lesevorgängen |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | Claude.ai · Claude API · Amazon Bedrock · Google Cloud · Microsoft Foundry |
Code, Recherche und professionelle Abläufe mit Werkzeugen.
Kosten und Leistung hängen von der Schlussfolgerungsstufe ab.
Was es kann
Orientierung
Code, Recherche und professionelle Abläufe mit Werkzeugen.
Kontext
1.000.000 tokens · 128.000 tokens
Tools und Integration
Tool-Nutzung · Websuche · Codeausführung · Computernutzung
Zugang
Claude, Claude API und zugehörige Clouds
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | 2,00 USD / 1 M tokens | Standardtarif der API |
| Eingabe aus dem Cache | 0,20 USD / 1 M tokens | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | 2,50–4,00 USD / 1 M tokens | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | 10,00 USD / 1 M Tokens | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | 1,00 USD / 1 M Tokens | Asynchrone Verarbeitung |
| Batch-Ausgabe | 5,00 USD / 1 M Tokens | Asynchrone Verarbeitung |
Konsultieren Sie die Primärquelle, bevor Sie eine Bereitstellung budgetieren.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| OSWorld-Verified | Kurve nach Aufwand | Erfolg und Kosten | Quelle öffnen ↗ |
| BrowseComp | Kurve nach Aufwand | Genauigkeit und Kosten | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
Claude Sonnet 5
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
Claude Sonnet 5: So messen Sie vor der Migration die Auswirkungen des neuen Tokenizers
Anthropic zufolge kann derselbe Text mit Sonnet 5 in mehr Tokens umgewandelt werden als mit Sonnet 4.6. Mit einem eigenen Testkorpus lässt sich prüfen, ob das in einer konkreten Integration den nutzbaren Kontext oder die Kosten pro Aufgabe verändert.
23 Sep 2026 ↗ ANALISISBrowseComp: Was ein Agent misst, der eine schwer auffindbare Information im Web findet – und warum ein Treffer keine verlässliche Recherche beweist
BrowseComp bewertet, ob ein Agent durch persistentes Navigieren im Web eine kurze, schwer auffindbare faktische Antwort lokalisieren kann. Das ist ein nützliches, aber begrenztes Signal: Ein hoher Wert reicht nicht aus, um Recherchequalität, Nachvollziehbarkeit der Quellen oder Zuverlässigkeit bei offenen Aufgaben zu belegen.
22 Sep 2026 ↗ COMPARATIVAClaude Sonnet 5 und Cohere Embed 4 im multimodalen RAG: Wie sich ein Retrieval-Fehler von einem Antwortfehler trennen lässt
Claude Sonnet 5 und Cohere Embed 4 besetzen unterschiedliche Schichten eines multimodalen RAG-Systems. Dieser Leitfaden schlägt ein faktorielles Experiment mit eingefrorenem Korpus und eingefrorenen Bedingungen vor, um getrennt zu messen, ob die richtige Evidenz abgerufen wurde und ob die Antwort sie getreu verwendet.
22 Sep 2026 ↗ GUIAClaude Fable 5.1: Wann Cache und Batch die Kosten pro Aufgabe senken – und wann sie die Rechnung nur verlagern
Der Preis pro Million Tokens reicht nicht aus, um zwischen einem normalen Aufruf, dem Caching von Anweisungen oder der Batch-Verarbeitung zu wählen. Dieser Leitfaden stellt ein Kostenmodell pro korrekt abgeschlossener Aufgabe für Claude Fable 5.1 vor – mit Formeln, Szenarien und einer minimalen Telemetrie. Entscheidend ist, ob Kontext vor Ablauf wiederverwendet wird, Wiederholungsversuche kontrolliert werden und die asynchrone Laufzeit der Batch API akzeptabel ist.
22 Sep 2026 ↗ ANALISISAnthropic: So prüfen Sie, was sich bei der Nutzung von Claude über API, Partner-Cloud oder Produkt ändert
Die Einführung von Claude bedeutet nicht nur, eine Modellfamilie auszuwählen. Der Zugangskanal bestimmt, welche Kennung verwendet wird, welcher Abkündigungszeitplan gilt, welche Kontrollen die einzelnen Parteien verwalten und welche Dokumentation eine technische Entscheidung stützen kann. Dieser Leitfaden schlägt eine Methode vor, um diese Ebenen zu trennen, ohne öffentliche Richtlinien oder Sicherheitsevaluierungen in Garantien umzudeuten, die sie nicht enthalten.
22 Sep 2026 ↗