8 de julio de 2026

OpenAI lanza GPT-Live, su nueva IA de voz para conversaciones naturales

OpenAI presentó el 8 de julio de 2026 GPT-Live, una nueva generación de modelos de voz que ya impulsa ChatGPT Voice. Su arquitectura es "full-duplex": puede escuchar y hablar a la vez, lo que le permite dar señales breves de que está atento (un "mmh" o un "ya veo"), y quedarse en silencio cuando el usuario necesita un momento para pensar, en vez de turnarse de forma rígida como los asistentes de voz anteriores.

A diferencia de las versiones previas de ChatGPT Voice —que encadenaban un modelo de voz a texto, uno de lenguaje y uno de texto a voz por separado, con la consiguiente pérdida de matices y latencia—, GPT-Live integra el proceso de forma mucho más directa. Para preguntas que requieren búsqueda web o razonamiento complejo, delega en el modelo de frontera de OpenAI en segundo plano sin romper la conversación.

OpenAI afirma haber sometido el modelo a pruebas de seguridad específicas para voz, con salvaguardas capaces de intervenir mientras el modelo está hablando —redirigiendo la respuesta o terminando la conversación en los casos de mayor riesgo—, incluyendo protocolos adaptados para conversaciones sobre autolesión y protecciones adicionales pensadas para usuarios adolescentes.

Fuentes: OpenAI ↗