O
OPENAI / gpt-live-1

GPT‑Live 1

Echtzeit-Sprachmodell für ausdrucksstarke Gespräche, natürliche Unterbrechungen und Workflows mit Tools.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGSprachunterhaltung in Echtzeit

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXTEchtzeitsitzung

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRTStreaming-Audio und -Text

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGOpenAI API

Verifizierte Verfügbarkeitskanäle.

MODELLTYPSprache und Audio · Text und Begründung

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZProprietär

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDgpt-live-1
ModelltypSprache und Audio · Text und Begründung
ZugangsmodellKostenpflichtig proprietär
LizenzProprietär
EinsatzGehostete API
Veröffentlichung2026
WissensstichtagNicht veröffentlicht
EingangText · Audio
AusfahrtText · Audio
KontextfensterEchtzeitsitzung
maximale LeistungStreaming-Audio und -Text
ArgumentationNicht zutreffend oder nicht veröffentlicht
Veröffentlichte ToolsFunktionen · Sprachsitzungen
Strukturierte AusflügeNicht zutreffend oder nicht veröffentlicht
StapelverarbeitungNicht veröffentlicht
Prompt-CacheNicht veröffentlicht
FeinabstimmungNicht veröffentlicht
Verifizierte PlattformenOpenAI Realtime API
EIGNET SICH BESSER FÜR

Sprachagenten, dialogbasierter Support und interaktive gesprochene Erlebnisse.

SOLLTE BEOBACHTET WERDEN

Miss Ende-zu-Ende-Latenz, Unterbrechungen, Kosten pro Audio und mehrsprachiges Verhalten.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Sprachagenten, dialogbasierter Support und interaktive gesprochene Erlebnisse.

02

Kontext

Echtzeitsitzung · Streaming-Audio und -Text

03

Tools und Integration

Funktionen · Sprachsitzungen

04

Zugang

OpenAI API

Eingabemodalitäten
TextAudio
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
StandardeingabeNicht veröffentlichtStandardtarif der API
Eingabe aus dem CacheNicht veröffentlichtLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
StandardausgabeNicht veröffentlichtKann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
Evaluación de conversación GPT‑LiveHauptmodellNatürlichkeit und UnterbrechungenQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

GPT‑Live 1

In den verifizierten Katalog von Inferama aufgenommene Version.

ANALYSE

Verwandte Analysen

GPT‑Live‑Konversation bewerten: Wie sich Sprecherwechsel, Unterbrechungen und Aufgabenerledigung messen lassen, ohne ein flüssiges Gespräch mit einem zuverlässigen Agenten zu verwechseln
ANALISIS

GPT‑Live‑Konversation bewerten: Wie sich Sprecherwechsel, Unterbrechungen und Aufgabenerledigung messen lassen, ohne ein flüssiges Gespräch mit einem zuverlässigen Agenten zu verwechseln

Leitfaden zur Bewertung von GPT‑Live‑1 in Full‑Duplex-Sprachgesprächen, der Turn-Dynamik, Verständnis, Aufgabenerfolg und die Sicherheit delegierter Aktionen voneinander trennt. Vorgestellt wird ein reproduzierbares Protokoll mit kontrolliertem Audio, Traces, zeitlicher Annotation und verblindeter menschlicher Prüfung.

23 Sep 2026
Voxtral TTS: Was ein Team prüfen muss, bevor es eine synthetische Stimme in der Produktion ersetzt
NOTICIA

Voxtral TTS: Was ein Team prüfen muss, bevor es eine synthetische Stimme in der Produktion ersetzt

Mistral AI dokumentiert Voxtral TTS als Dienst zur Sprachsynthese mit Streaming und mehreren Ausgabeformaten. Bevor ein Team einen Anbieter oder ein Modell für Anrufe, Benachrichtigungen oder veröffentlichte Inhalte ablöst, muss es neben der hörbaren Qualität auch die technische, operative und datenbezogene Vertraglichkeit mit einer Regression anhand eigener Skripte prüfen.

22 Sep 2026
GPT-Transcribe: Was ein Team erneut prüfen muss, bevor es seinen Transkriptionsdienst ersetzt
NOTICIA

GPT-Transcribe: Was ein Team erneut prüfen muss, bevor es seinen Transkriptionsdienst ersetzt

GPT-Transcribe ist als Transkriptionsmodell verfügbar, das über die OpenAI-API genutzt werden kann. Bevor ein bestehendes ASR-System ersetzt wird, sollte nicht nur der resultierende Text geprüft werden, sondern auch der technische Vertrag, auf dem Suche, Zusammenfassungen, Warnungen, Zitate, Prüfungen und Compliance-Aufzeichnungen beruhen.

22 Sep 2026
Synthetische Stimmen in der Produktion: Einwilligung nachweisen, Ähnlichkeit kontrollieren und eine Stimme ohne Verlust der Nachvollziehbarkeit zurückziehen
GUIA

Synthetische Stimmen in der Produktion: Einwilligung nachweisen, Ähnlichkeit kontrollieren und eine Stimme ohne Verlust der Nachvollziehbarkeit zurückziehen

Der verantwortungsvolle Einsatz einer synthetischen Stimme erfordert mehr als ein Kontrollkästchen zur Zustimmung oder eine überzeugende Demo. Dieser Leitfaden schlägt ein Betriebssystem vor, das jede Audiodatei mit einer konkreten Autorisierung verknüpft, das Risiko einer Ähnlichkeit mit identifizierbaren Personen kontrolliert, gegebenenfalls informiert und Assets zurückzieht, wenn sich die Nutzungsbedingungen ändern.

22 Sep 2026
07 / QUELLEN

Rückverfolgbarkeit