Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
GPT‑Live 1
Modèle vocal en temps réel pour des conversations expressives, des interruptions naturelles et des flux avec outils.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | gpt-live-1 |
|---|---|
| Type de modèle | Voix et audio · Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Audio |
| Sortie | Texte · Audio |
| Fenêtre contextuelle | Session en temps réel |
| puissance maximale | Audio et texte en streaming |
| Raisonnement | Non applicable ou non publié |
| Outils publiés | Fonctions · Sessions vocales |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Non publié |
| Plateformes vérifiées | OpenAI Realtime API |
Agents vocaux, assistance conversationnelle et expériences parlées interactives.
Mesurez la latence de bout en bout, les interruptions, le coût par audio et le comportement multilingue.
Ce qu’il peut faire
Orientation
Agents vocaux, assistance conversationnelle et expériences parlées interactives.
Contexte
Session en temps réel · Audio et texte en streaming
Outils et intégration
Fonctions · Sessions vocales
Accès
API OpenAI
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Evaluación de conversación GPT‑Live | Modèle principal | Naturel et interruptions | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
GPT‑Live 1
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
Évaluation conversationnelle de GPT‑Live : mesurer les tours de parole, les interruptions et la résolution de tâches sans confondre fluidité et fiabilité
Guide d’évaluation de GPT‑Live‑1 dans des conversations vocales full‑duplex, en séparant la dynamique des tours de parole, la compréhension, le succès des tâches et la sécurité des actions déléguées. Il propose un protocole reproductible fondé sur un audio contrôlé, des traces, une annotation temporelle et une revue humaine en aveugle.
23 sept. 2026 ↗ NOTICIAVoxtral TTS : ce qu’une équipe doit valider avant de remplacer une voix synthétique en production
Mistral AI documente Voxtral TTS comme un service de génération vocale avec streaming et plusieurs formats de sortie. Avant de remplacer un fournisseur ou un modèle pour des appels, des notifications ou du contenu publié, une équipe doit vérifier non seulement la qualité audible, mais aussi la compatibilité du contrat technique, opérationnel et de données, au moyen d’une régression fondée sur ses propres scripts.
22 sept. 2026 ↗ NOTICIAGPT-Transcribe : ce qu’une équipe doit valider à nouveau avant de remplacer son transcripteur
GPT-Transcribe est présenté comme un modèle de transcription accessible via l’API d’OpenAI. Avant de remplacer un système ASR existant, il convient de valider non seulement le texte produit, mais aussi le contrat technique dont dépendent les moteurs de recherche, résumés, alertes, citations, revues et registres de conformité.
22 sept. 2026 ↗ GUIAVoix synthétiques en production : démontrer le consentement, contrôler la ressemblance et retirer une voix sans perdre la traçabilité
Utiliser une voix synthétique de manière responsable exige davantage qu’une case à cocher ou une démonstration convaincante. Ce guide propose un système opérationnel pour relier chaque audio à une autorisation précise, maîtriser le risque de ressemblance avec des personnes identifiables, informer lorsque cela est nécessaire et retirer des actifs lorsque les conditions d’utilisation évoluent.
22 sept. 2026 ↗