OpenAI lanza GPT-Live: el nuevo modelo de voz que escucha y habla al mismo tiempo en ChatGPT
OpenAI presentó GPT-Live, una nueva generación de modelos de voz para ChatGPT que permite mantener conversaciones más naturales. La principal novedad consiste en que el sistema escucha y habla al mismo tiempo, por lo que el usuario puede interrumpir la conversación en cualquier momento sin afectar la interacción.
La empresa informó que GPT-Live busca ofrecer una experiencia más fluida. El modelo también incorpora expresiones como “ajá” o “claro” para hacer el diálogo más natural. Además, puede cambiar de tema de inmediato, responder en intercambios rápidos y mostrar tarjetas visuales con información como el tiempo o el comportamiento de la bolsa.
Según OpenAI, GPT-Live representa su modelo de voz más avanzado hasta la fecha. La tecnología utiliza GPT-5.5 como respaldo para ejecutar funciones como búsquedas en la web, razonamiento de mayor complejidad y tareas más exigentes.
La compañía indicó que esta investigación permitirá ampliar el uso de la voz para desarrollar trabajos cada vez más complejos, prolongados y con mayor capacidad de actuación autónoma.
Hasta ahora, la experiencia de voz de ChatGPT utilizaba sistemas en cascada. Esa arquitectura combinaba tres modelos independientes para la transcripción, el procesamiento del texto y la síntesis de voz. Ese proceso generaba respuestas más lentas, pausas prolongadas y pérdida de información. También empleaba modelos por turnos que dependían del silencio del usuario para determinar el momento de responder.
GPT-Live aborda esas limitaciones mediante una interacción continua. En lugar de procesar mensajes separados, el modelo analiza la información mientras genera la respuesta. Esa capacidad le permite hablar y escuchar de forma simultánea, hacer pausas cuando corresponde y responder a las interrupciones del usuario.
La segunda mejora consiste en delegar procesos específicos en otros modelos. Esa estrategia permite que GPT-Live continúe la conversación sin interrumpir el flujo de la interacción mientras ejecuta tareas adicionales.
OpenAI también incorporó nuevas medidas de seguridad en ChatGPT Voz. Cuando el sistema detecta una posible respuesta insegura, puede redirigir la conversación hacia una alternativa más segura, mostrar advertencias adicionales o finalizar el diálogo en situaciones de mayor riesgo.
La empresa agregó funciones de controles parentales. Los padres podrán decidir si los adolescentes tienen acceso a la función de voz. Además, si el sistema detecta posibles señales relacionadas con autolesiones o intención suicida, enviará un aviso a los padres.
OpenAI inició este miércoles el despliegue de GPT-Live en ChatGPT para Android, iOS y la web.
La nueva generación estará disponible en dos versiones. GPT-Live-1 será exclusiva para quienes cuentan con las suscripciones Go, Plus y Pro. Por su parte, GPT-Live-1 mini estará disponible para las cuentas gratuitas.
La compañía también anunció que GPT-Live llegará próximamente a la API. Mientras tanto, las empresas y los desarrolladores ya pueden registrarse para recibir una notificación cuando el servicio esté disponible.
*La creación de este contenido contó con la asistencia de inteligencia artificial. La fuente de esta información es de una agencia de noticias y revisada por un editor para asegurar su precisión. El contenido no se generó automáticamente.