Lanzado el 8 de julio de 2026, GPT-Live introduce una arquitectura full-duplex que permite escuchar y hablar al mismo tiempo. Esto posibilita interacciones fluidas en tiempo real, donde la IA utiliza señales naturales como «mhmm» o «sí» para mostrar atención, eliminando la rigidez y la latencia propias de los sistemas de voz anteriores, ya fueran en cascada o basados en turnos.

El sistema funciona desacoplando la interacción continua de los procesos de razonamiento profundo. Mientras GPT-Live gestiona la conversación inmediata, delega tareas complejas o búsquedas web a un modelo avanzado —específicamente GPT-5.5 en el lanzamiento—, permitiendo que el diálogo fluya sin interrupciones mientras se procesa la información en segundo plano.

OpenAI ha comenzado el despliegue global de dos versiones, GPT-Live-1 y GPT-Live-1 mini, para los usuarios de ChatGPT, y planea llevarlas próximamente a la API para desarrolladores y empresas. Las evaluaciones indican que GPT-Live-1 supera significativamente al Advanced Voice Mode en fluidez conversacional y razonamiento científico experto (GPQA).