OpenAI ha presentado GPT-Live, una nueva generación de modelos de voz diseñada para hacer más naturales las conversaciones con ChatGPT. La principal novedad de este sistema es su capacidad para escuchar y hablar al mismo tiempo, lo que permite una interacción más fluida y cercana a una conversación real. La compañía ha iniciado el despliegue de esta tecnología en ChatGPT para Android, iOS y web.
La nueva familia de modelos busca superar algunas de las limitaciones habituales en los asistentes de voz. Hasta ahora, muchas experiencias conversacionales funcionaban por turnos, de modo que el sistema esperaba a detectar una pausa o un silencio para interpretar que el usuario había terminado de hablar. Ese enfoque podía generar interrupciones, esperas largas o respuestas poco ajustadas al ritmo natural de una conversación.
GPT-Live introduce una interacción continua. En lugar de procesar mensajes aislados, el modelo sigue la entrada de audio mientras genera una respuesta, lo que permite adaptarse mejor a pausas, interrupciones o cambios de tema. El usuario puede cortar al asistente en cualquier momento, pedirle que rectifique o modificar la instrucción sin tener que esperar a que termine una frase completa.
OpenAI también ha incorporado expresiones breves de acompañamiento, como “ajá” o “claro”, con el objetivo de que la conversación resulte menos rígida. Estas señales permiten al sistema mostrar que sigue escuchando sin interrumpir necesariamente el desarrollo de la idea del usuario. Además, GPT-Live puede realizar intercambios rápidos y mostrar tarjetas visuales relacionadas con información como el tiempo, la bolsa u otros contenidos.
La compañía define GPT-Live como su modelo de voz más inteligente hasta la fecha. Para tareas más complejas, el sistema puede apoyarse en GPT-5.5 en segundo plano, especialmente cuando necesita realizar búsquedas web, razonamientos más profundos o trabajos que requieren mayor capacidad de procesamiento.
El lanzamiento llega acompañado de dos versiones. GPT-Live-1 estará disponible para usuarios con suscripciones Go, Plus y Pro, mientras que GPT-Live-1 mini se ofrecerá a las cuentas gratuitas. La tecnología llegará también próximamente a la API, y empresas y desarrolladores ya pueden registrarse para recibir el aviso cuando esté disponible.
OpenAI ha reforzado además las medidas de seguridad asociadas a ChatGPT Voz. Cuando el sistema detecta una respuesta potencialmente insegura, puede redirigir la conversación hacia una respuesta más segura, mostrar avisos adicionales o finalizar la interacción en los casos de mayor riesgo. La compañía también ha añadido controles parentales para que los padres decidan si sus hijos adolescentes pueden acceder a la función de voz.
En situaciones especialmente delicadas, si el sistema identifica señales de posible autolesión o intención suicida, los padres podrán recibir un aviso. Con estas medidas, OpenAI intenta acompañar la mejora técnica de la voz con mecanismos de protección adaptados a un uso más cotidiano e inmediato.
GPT-Live supone un nuevo paso en la evolución de ChatGPT hacia experiencias más conversacionales. La voz deja de funcionar como un intercambio cerrado de preguntas y respuestas para acercarse a una interacción más dinámica, capaz de seguir el ritmo del usuario y responder en tiempo real.