Lancé le 8 juillet 2026, GPT-Live repose sur une architecture full-duplex permettant d'écouter et de parler simultanément. Cette technologie rend les interactions plus fluides et naturelles, utilisant des expressions comme « mhmm » ou « oui » pour manifester l'écoute, tout en corrigeant la rigidité et la latence des anciens systèmes vocaux en cascade ou basés sur des tours de parole.

L'innovation majeure réside dans le découplage entre l'interaction continue et le travail de réflexion approfondie. GPT-Live gère la conversation immédiate, tandis que les requêtes complexes ou les recherches sur le web sont déléguées à un modèle de pointe — GPT-5.5 lors du lancement — assurant ainsi la continuité du dialogue pendant le traitement des données.

Deux versions, GPT-Live-1 et GPT-Live-1 mini, sont actuellement déployées pour les utilisateurs de ChatGPT dans le monde, avec une intégration API prévue pour les développeurs et les entreprises. Les tests montrent que GPT-Live-1 est nettement supérieur au mode Advanced Voice en termes de fluidité conversationnelle et de raisonnement scientifique (GPQA).