OpenAI a lancé la famille de modèles GPT-5.6, composée de trois versions : Sol, le modèle phare ; Terra, une version équilibrée ; et Luna, l'option la plus économique. Sol définit un nouveau standard en matière de cybersécurité, de science et de codage, offrant une densité d'intelligence accrue en obtenant de meilleurs résultats avec moins de tokens et à un coût inférieur aux modèles précédents.

Les tests techniques démontrent des gains d'efficacité majeurs. Lors de l'évaluation Agents’ Last Exam, Sol a obtenu un score de 53,6, dépassant Claude Fable 5 de 13,1 points. En mode de raisonnement maximum, Sol s'approche des performances de Fable 5 tout en accomplissant les tâches en 61 % moins de temps et pour environ la moitié du coût. Pour le codage, Sol a atteint un score de 80 sur l'Artificial Analysis Coding Agent Index, surpassant Fable 5 avec une réduction de plus de moitié du temps et des tokens de sortie.

L'innovation inclut un paramètre « ultra » pour coordonner plusieurs agents sur des flux de travail parallèles, ainsi qu'un mode « max » pour les problèmes complexes. Une avancée technique notable est le « Programmatic Tool Calling » via l'API Responses, qui permet au modèle d'exécuter des programmes légers pour gérer des outils et filtrer les données intermédiaires, limitant ainsi les allers-retours avec le modèle.

Côté sécurité, les modèles ont fait l'objet d'une période d'évaluation intensive combinant red teaming humain et tests automatisés. Le système final superpose des protections intégrées au modèle à des vérifications en temps réel et un contrôle d'accès calibré selon les risques, afin de prévenir les usages malveillants sans entraver le travail légitime.