OpenAI a lancé la famille de modèles GPT-5.6, composée de trois versions : Sol, le nouveau modèle phare ; Terra, une version équilibrée pour le travail quotidien ; et Luna, optimisée pour le coût. Le modèle Sol excelle dans les domaines de la science, de la cybersécurité et du codage, et introduit un mode « ultra » capable de coordonner plusieurs agents en parallèle pour accélérer les tâches complexes.

Les tests de performance placent GPT-5.6 Sol au-dessus de concurrents tels que Claude Fable 5. Lors de l'examen « Agents’ Last Exam », Sol a obtenu un score de 53,6, surpassant nettement Fable 5 tout en réduisant les coûts. De même, sur l'index Artificial Analysis Coding Agent, Sol a atteint un score record de 80, traitant les requêtes plus rapidement et avec moins de tokens.

Sur le plan technique, OpenAI introduit le « Programmatic Tool Calling » via l'API Responses. Cette fonctionnalité permet au modèle de créer et d'exécuter de petits programmes pour coordonner des outils et filtrer les données, limitant ainsi les allers-retours nécessaires entre l'utilisateur et le modèle.

Le déploiement s'appuie sur une phase d'évaluation rigoureuse incluant du red teaming humain et des tests automatisés. Le système intègre des protections multicouches, comprenant une surveillance en temps réel et des garde-fous entraînés directement dans les modèles pour prévenir les usages malveillants.