Uso principal declarado o inferido con cautela desde la documentación oficial.
GPT‑Live 1
Modelo de voz en tiempo real para conversaciones expresivas, interrupciones naturales y flujos con herramientas.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | gpt-live-1 |
|---|---|
| Tipo de modelo | Voz y audio · Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | 2026 |
| Corte de conocimiento | No publicado |
| Entrada | Texto · Audio |
| Salida | Texto · Audio |
| Ventana de contexto | Sesión en tiempo real |
| Salida máxima | Audio y texto en streaming |
| Razonamiento | No aplica o no publicado |
| Herramientas publicadas | Funciones · Sesiones de voz |
| Salidas estructuradas | No aplica o no publicado |
| Procesamiento por lotes | No publicado |
| Caché de prompts | No publicado |
| Ajuste fino | No publicado |
| Plataformas verificadas | OpenAI Realtime API |
Agentes de voz, soporte conversacional y experiencias habladas interactivas.
Mide latencia extremo a extremo, interrupciones, coste por audio y comportamiento multilingüe.
Qué puede hacer
Orientación
Agentes de voz, soporte conversacional y experiencias habladas interactivas.
Contexto
Sesión en tiempo real · Audio y texto en streaming
Herramientas e integración
Funciones · Sesiones de voz
Acceso
OpenAI API
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | No publicado | Tarifa estándar de API |
| Entrada en caché | No publicado | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | No publicado | La condición varía según proveedor |
| Salida estándar | No publicado | Puede incluir tokens de razonamiento |
| Entrada por lotes | No publicado | Procesamiento asíncrono |
| Salida por lotes | No publicado | Procesamiento asíncrono |
Consulta la fuente primaria: la unidad de facturación depende del tipo de modelo y del canal de acceso.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| Evaluación de conversación GPT‑Live | Modelo principal | Naturalidad e interrupciones | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
GPT‑Live 1
Versión incorporada al catálogo verificado de Inferama.
Análisis relacionados
Evaluación de conversación GPT‑Live: cómo medir turnos, interrupciones y resolución de tareas sin confundir una charla fluida con un agente fiable
Guía para evaluar GPT‑Live‑1 en conversaciones de voz full‑duplex separando dinámica de turnos, comprensión, éxito de tarea y seguridad de acciones delegadas. Propone un protocolo reproducible con audio controlado, trazas, anotación temporal y revisión humana ciega.
23 sep. 2026 ↗ NOTICIAVoxtral TTS: qué debe validar un equipo antes de sustituir una voz sintética en producción
Mistral AI documenta Voxtral TTS como un servicio de generación de voz con streaming y varios formatos de salida. Antes de reemplazar un proveedor o modelo en llamadas, avisos o contenido publicado, un equipo debe comprobar no solo la calidad audible, sino también la compatibilidad del contrato técnico, operativo y de datos mediante una regresión con sus propios guiones.
22 sep. 2026 ↗ NOTICIAGPT-Transcribe: qué debe volver a validar un equipo antes de sustituir su transcriptor
GPT-Transcribe figura como un modelo de transcripción disponible a través de la API de OpenAI. Antes de reemplazar un sistema ASR existente, conviene validar no solo el texto resultante, sino también el contrato técnico que sostiene buscadores, resúmenes, alertas, citas, revisiones y registros de cumplimiento.
22 sep. 2026 ↗ GUIAVoces sintéticas en producción: cómo demostrar consentimiento, controlar el parecido y retirar una voz sin perder trazabilidad
Usar una voz sintética de forma responsable exige más que una casilla de aceptación o una demo convincente. Esta guía propone un sistema operativo para relacionar cada audio con una autorización concreta, controlar el riesgo de parecido con personas identificables, informar cuando proceda y retirar activos al cambiar las condiciones de uso.
22 sep. 2026 ↗