Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
GPT‑Live 1
Echtzeit-Sprachmodell für ausdrucksstarke Gespräche, natürliche Unterbrechungen und Workflows mit Tools.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | gpt-live-1 |
|---|---|
| Modelltyp | Sprache und Audio · Text und Begründung |
| Zugangsmodell | Kostenpflichtig proprietär |
| Lizenz | Proprietär |
| Einsatz | Gehostete API |
| Veröffentlichung | 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text · Audio |
| Ausfahrt | Text · Audio |
| Kontextfenster | Echtzeitsitzung |
| maximale Leistung | Streaming-Audio und -Text |
| Argumentation | Nicht zutreffend oder nicht veröffentlicht |
| Veröffentlichte Tools | Funktionen · Sprachsitzungen |
| Strukturierte Ausflüge | Nicht zutreffend oder nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Nicht veröffentlicht |
| Verifizierte Plattformen | OpenAI Realtime API |
Sprachagenten, dialogbasierter Support und interaktive gesprochene Erlebnisse.
Miss Ende-zu-Ende-Latenz, Unterbrechungen, Kosten pro Audio und mehrsprachiges Verhalten.
Was es kann
Orientierung
Sprachagenten, dialogbasierter Support und interaktive gesprochene Erlebnisse.
Kontext
Echtzeitsitzung · Streaming-Audio und -Text
Tools und Integration
Funktionen · Sprachsitzungen
Zugang
OpenAI API
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| Evaluación de conversación GPT‑Live | Hauptmodell | Natürlichkeit und Unterbrechungen | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
GPT‑Live 1
In den verifizierten Katalog von Inferama aufgenommene Version.
Verwandte Analysen
GPT‑Live‑Konversation bewerten: Wie sich Sprecherwechsel, Unterbrechungen und Aufgabenerledigung messen lassen, ohne ein flüssiges Gespräch mit einem zuverlässigen Agenten zu verwechseln
Leitfaden zur Bewertung von GPT‑Live‑1 in Full‑Duplex-Sprachgesprächen, der Turn-Dynamik, Verständnis, Aufgabenerfolg und die Sicherheit delegierter Aktionen voneinander trennt. Vorgestellt wird ein reproduzierbares Protokoll mit kontrolliertem Audio, Traces, zeitlicher Annotation und verblindeter menschlicher Prüfung.
23 Sep 2026 ↗ NOTICIAVoxtral TTS: Was ein Team prüfen muss, bevor es eine synthetische Stimme in der Produktion ersetzt
Mistral AI dokumentiert Voxtral TTS als Dienst zur Sprachsynthese mit Streaming und mehreren Ausgabeformaten. Bevor ein Team einen Anbieter oder ein Modell für Anrufe, Benachrichtigungen oder veröffentlichte Inhalte ablöst, muss es neben der hörbaren Qualität auch die technische, operative und datenbezogene Vertraglichkeit mit einer Regression anhand eigener Skripte prüfen.
22 Sep 2026 ↗ NOTICIAGPT-Transcribe: Was ein Team erneut prüfen muss, bevor es seinen Transkriptionsdienst ersetzt
GPT-Transcribe ist als Transkriptionsmodell verfügbar, das über die OpenAI-API genutzt werden kann. Bevor ein bestehendes ASR-System ersetzt wird, sollte nicht nur der resultierende Text geprüft werden, sondern auch der technische Vertrag, auf dem Suche, Zusammenfassungen, Warnungen, Zitate, Prüfungen und Compliance-Aufzeichnungen beruhen.
22 Sep 2026 ↗ GUIASynthetische Stimmen in der Produktion: Einwilligung nachweisen, Ähnlichkeit kontrollieren und eine Stimme ohne Verlust der Nachvollziehbarkeit zurückziehen
Der verantwortungsvolle Einsatz einer synthetischen Stimme erfordert mehr als ein Kontrollkästchen zur Zustimmung oder eine überzeugende Demo. Dieser Leitfaden schlägt ein Betriebssystem vor, das jede Audiodatei mit einer konkreten Autorisierung verknüpft, das Risiko einer Ähnlichkeit mit identifizierbaren Personen kontrolliert, gegebenenfalls informiert und Assets zurückzieht, wenn sich die Nutzungsbedingungen ändern.
22 Sep 2026 ↗