OpenAI hat die Modellfamilie GPT-5.6 veröffentlicht, die aus drei Versionen besteht: dem Flaggschiff Sol, dem ausgewogenen Modell Terra für den Alltag sowie der kosteneffizienten Variante Luna. Das Modell Sol setzt neue Maßstäbe in den Bereichen Wissenschaft, Cybersicherheit und Programmierung und bietet mit der Einstellung „ultra“ die Koordination mehrerer Agenten zur schnelleren Bewältigung komplexer Aufgaben.
In Benchmarks übertrifft GPT-5.6 Sol Konkurrenten wie Claude Fable 5. Beim „Agents’ Last Exam“ erreichte Sol einen Wert von 53,6 und übertraf Fable 5 deutlich, bei gleichzeitig geringeren Kosten. Auch im Artificial Analysis Coding Agent Index setzte Sol mit einem Wert von 80 einen neuen Standard, wobei Aufgaben schneller und mit weniger Token gelöst wurden.
Eine wesentliche technische Neuerung ist das „Programmatic Tool Calling“ über die Responses API. Diese Funktion ermöglicht es dem Modell, leichtgewichtige Programme zu schreiben und auszuführen, um Tools zu koordinieren und Daten zu filtern, wodurch die Anzahl der erforderlichen Modell-Interaktionen reduziert wird.
Zur Sicherung des Rollouts führte OpenAI eine umfassende Evaluierungsphase durch, die Red Teaming und automatisierte Tests kombinierte. Das System nutzt mehrschichtige Schutzmechanismen, einschließlich Echtzeit-Überwachungen und direkt in die Modelle integrierter Sicherheitsvorkehrungen, um Missbrauch zu verhindern.
Kommentare
Noch keine Kommentare — schreib den ersten.
Starte die Diskussion
Kein Konto, kein Passwort nötig — gib einfach deine E-Mail-Adresse ein, wir senden dir einen einmaligen Anmelde-Link. Beim ersten Mal bist du damit automatisch angemeldet.
Deine Bewertung wird nach der Anmeldung automatisch übernommen.
Schau in dein Postfach
Wir haben einen Anmelde-Link an … gesendet. Öffne ihn auf diesem Gerät — dieser Tab meldet dich automatisch an.
Warte auf deinen Klick …
·