O
OPENAI / gpt-live-1

GPT‑Live 1

Modelo de voz en tiempo real para conversaciones expresivas, interrupciones naturales y flujos con herramientas.

01 / RESUMEN

Lo esencial

ORIENTACIÓNConversación de voz en tiempo real

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTOSesión en tiempo real

Capacidad máxima de entrada cuando la fuente la publica.

SALIDAAudio y texto en streaming

Límite máximo de generación documentado.

ACCESOOpenAI API

Canales de disponibilidad verificados.

TIPO DE MODELOVoz y audio · Texto y razonamiento

Familia funcional principal y especialidades verificadas.

LICENCIAPropietaria

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APIgpt-live-1
Tipo de modeloVoz y audio · Texto y razonamiento
Modelo de accesoPropietario de pago
LicenciaPropietaria
DespliegueAPI alojada
Lanzamiento2026
Corte de conocimientoNo publicado
EntradaTexto · Audio
SalidaTexto · Audio
Ventana de contextoSesión en tiempo real
Salida máximaAudio y texto en streaming
RazonamientoNo aplica o no publicado
Herramientas publicadasFunciones · Sesiones de voz
Salidas estructuradasNo aplica o no publicado
Procesamiento por lotesNo publicado
Caché de promptsNo publicado
Ajuste finoNo publicado
Plataformas verificadasOpenAI Realtime API
ENCAJA MEJOR EN

Agentes de voz, soporte conversacional y experiencias habladas interactivas.

CONVIENE VIGILAR

Mide latencia extremo a extremo, interrupciones, coste por audio y comportamiento multilingüe.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Agentes de voz, soporte conversacional y experiencias habladas interactivas.

02

Contexto

Sesión en tiempo real · Audio y texto en streaming

03

Herramientas e integración

Funciones · Sesiones de voz

04

Acceso

OpenAI API

Modalidades de entrada
TextoAudio
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándarNo publicadoTarifa estándar de API
Entrada en cachéNo publicadoLectura de prefijos reutilizados
Escritura o almacenamiento de cachéNo publicadoLa condición varía según proveedor
Salida estándarNo publicadoPuede incluir tokens de razonamiento
Entrada por lotesNo publicadoProcesamiento asíncrono
Salida por lotesNo publicadoProcesamiento asíncrono

Consulta la fuente primaria: la unidad de facturación depende del tipo de modelo y del canal de acceso.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
Evaluación de conversación GPT‑LiveModelo principalNaturalidad e interrupcionesVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

GPT‑Live 1

Versión incorporada al catálogo verificado de Inferama.

ANÁLISIS

Análisis relacionados

Evaluación de conversación GPT‑Live: cómo medir turnos, interrupciones y resolución de tareas sin confundir una charla fluida con un agente fiable
ANALISIS

Evaluación de conversación GPT‑Live: cómo medir turnos, interrupciones y resolución de tareas sin confundir una charla fluida con un agente fiable

Guía para evaluar GPT‑Live‑1 en conversaciones de voz full‑duplex separando dinámica de turnos, comprensión, éxito de tarea y seguridad de acciones delegadas. Propone un protocolo reproducible con audio controlado, trazas, anotación temporal y revisión humana ciega.

23 sep. 2026
Voxtral TTS: qué debe validar un equipo antes de sustituir una voz sintética en producción
NOTICIA

Voxtral TTS: qué debe validar un equipo antes de sustituir una voz sintética en producción

Mistral AI documenta Voxtral TTS como un servicio de generación de voz con streaming y varios formatos de salida. Antes de reemplazar un proveedor o modelo en llamadas, avisos o contenido publicado, un equipo debe comprobar no solo la calidad audible, sino también la compatibilidad del contrato técnico, operativo y de datos mediante una regresión con sus propios guiones.

22 sep. 2026
GPT-Transcribe: qué debe volver a validar un equipo antes de sustituir su transcriptor
NOTICIA

GPT-Transcribe: qué debe volver a validar un equipo antes de sustituir su transcriptor

GPT-Transcribe figura como un modelo de transcripción disponible a través de la API de OpenAI. Antes de reemplazar un sistema ASR existente, conviene validar no solo el texto resultante, sino también el contrato técnico que sostiene buscadores, resúmenes, alertas, citas, revisiones y registros de cumplimiento.

22 sep. 2026
Voces sintéticas en producción: cómo demostrar consentimiento, controlar el parecido y retirar una voz sin perder trazabilidad
GUIA

Voces sintéticas en producción: cómo demostrar consentimiento, controlar el parecido y retirar una voz sin perder trazabilidad

Usar una voz sintética de forma responsable exige más que una casilla de aceptación o una demo convincente. Esta guía propone un sistema operativo para relacionar cada audio con una autorización concreta, controlar el riesgo de parecido con personas identificables, informar cuando proceda y retirar activos al cambiar las condiciones de uso.

22 sep. 2026
07 / FUENTES

Trazabilidad