Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
Scribe v2
Spracherkennungsmodell für mehr als 90 Sprachen mit Diarisierung, Wortzeitstempeln, Entitäten und Audio-Labels.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | scribe_v2 |
|---|---|
| Modelltyp | Sprache und Audio |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Audio · Video |
| Ausfahrt | Text · Zeitangaben · Sprecherdiarisierung |
| Kontextfenster | Audio- oder Videodatei |
| maximale Leistung | Strukturierte Transkription |
| Argumentation | Nicht zutreffend oder nicht veröffentlicht |
| Veröffentlichte Tools | |
| Strukturierte Ausflüge | Nicht zutreffend oder nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | ElevenLabs API |
Transkription von Meetings, Medien und mehrsprachigen Inhalten.
Miss Fehler nach Sprache, Sprecherzahl, Störgeräuschen und Fachbegriffen.
Was es kann
Orientierung
Transkription von Meetings, Medien und mehrsprachigen Inhalten.
Kontext
Audio- oder Videodatei · Strukturierte Transkription
Tools und Integration
Nicht veröffentlicht
Zugang
ElevenLabs API
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| Evaluación Scribe v2 | 90+ Sprachen | Veröffentlichte ASR-Abdeckung | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
Scribe v2
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
Scribe v2 in Speech-Benchmarks: Was die Bewertungen vergleichen – und was für ihre Reproduzierbarkeit fehlt
Ein WER-Wert beschreibt nicht für sich allein die allgemeine Leistung eines Transkriptionssystems. Wir untersuchen, was sich über Scribe v2 überprüfen lässt, wie Korpus, Normalisierung und Konfiguration die Ergebnisse beeinflussen und welche Angaben nötig sind, um einen Vergleich zu wiederholen.
28 Sep 2026 ↗ NOTICIAGPT-Transcribe: Was ein Team erneut prüfen muss, bevor es seinen Transkriptionsdienst ersetzt
GPT-Transcribe ist als Transkriptionsmodell verfügbar, das über die OpenAI-API genutzt werden kann. Bevor ein bestehendes ASR-System ersetzt wird, sollte nicht nur der resultierende Text geprüft werden, sondern auch der technische Vertrag, auf dem Suche, Zusammenfassungen, Warnungen, Zitate, Prüfungen und Compliance-Aufzeichnungen beruhen.
22 Sep 2026 ↗ ANALISISElevenLabs: Modell, Stimme, Zugriffskanal und Datenaufbewahrung trennen, bevor generatives Audio in Produktion geht
Die Einführung von ElevenLabs für generatives Audio ist keine einzelne Entscheidung: Jeder Ablauf verbindet ein Modell, ein Stimm-Asset, einen Verarbeitungskanal und ein eigenes Aufbewahrungsregime. Dieser Leitfaden schlägt eine operative Matrix vor, um diese Aspekte zu dokumentieren, Annahmen zu begrenzen und nachvollziehbare Migrationen, Zugriffe und Löschungen vorzubereiten.
22 Sep 2026 ↗