OpenAI hat GPT-6.1 Sol als Weiterentwicklung von GPT-6 Sol veröffentlicht. Das Modell ist auf agentisches Programmieren und anspruchsvolle berufliche Aufgaben ausgerichtet. Nach Angaben des Unternehmens kommt es bei schwierigen Aufgaben an GPT-6 Astra heran, kostet bei den regulären Ein- und Ausgabepreisen aber etwa ein Fünftel. GPT-6 Astra bleibt OpenAIs leistungsfähigstes Frontier-Modell.
Über die API kostet eine Million Eingabe-Token 2 US-Dollar. Eine Million gecachte Eingabe-Token kosten 0,10 US-Dollar, eine Million Ausgabe-Token 10 US-Dollar. Der Preis für gecachte Eingaben liegt damit 95 % unter dem regulären Eingabepreis. Das senkt die Kosten von Abläufen, die Kontext über mehrere Anfragen hinweg wiederverwenden.
Bei DeepSWE v1.1, einem Test für Softwareaufgaben in realen Codebasen, erreicht GPT-6.1 Sol das gemeldete Niveau von GPT-6 Astra bei ungefähr einem Fünftel der Kosten. Gegenüber dem besten Ergebnis von GPT-6 Sol beträgt der Vorsprung 6,4 Prozentpunkte. Dafür benötigt das Modell weniger Reasoning-Aufwand und verursacht geringere Kosten.
GDP.pdf prüft Antworten auf komplexe PDF-Dokumente mit Tabellen, Grafiken, Diagrammen und Kleingedrucktem. GPT-6.1 Sol erzielt dort über die getesteten Reasoning-Stufen hinweg bessere Werte als Opus 5.5 mit Fallbacks. Die Kosten pro Aufgabe liegen unter der Hälfte, während das Ergebnis an GPT-6 Astra bei etwa einem Fünftel der Kosten heranreicht. Bei AutomationBench liegt GPT-6.1 Sol auf der mittleren Reasoning-Stufe 2,2 Prozentpunkte vor Opus 5.5 und kostet ungefähr ein Drittel so viel. Gegenüber GPT-6 Sol beträgt der Vorsprung auf derselben Stufe 4,8 Punkte.
AutomationBench 1.0.6 bewertet End-to-End-Abläufe mit 47 Werkzeugen aus Vertrieb, Marketing, Betrieb, Support, Finanzen und Personalwesen. Der ausgewiesene Preis für Claude Fable 5.1 ist zu niedrig angesetzt, weil die Kosten für Fallbacks fehlen. Solche Fallbacks traten bei ungefähr 40 % der Aufgaben auf.
Auch bei der Computernutzung legt GPT-6.1 Sol zu. Im Offline-Datensatz OSWorld 2.0 übertrifft es GPT-6 Sol bei maximalem Reasoning um sieben Punkte und kostet dabei weniger als die Hälfte. Der Abstand zu GPT-6 Astra beträgt 2,1 Punkte, die Kosten pro Aufgabe liegen jedoch bei etwa einem Siebtel.
Terminal-Bench Science 0.1 bewertet wissenschaftliche Abläufe wie Datenanalyse, Simulationen und Theorembeweise. Bei maximalem Reasoning erzielt GPT-6.1 Sol mehr als doppelt so viele Punkte wie GPT-6 Sol. Eine Aufgabe kostet im Durchschnitt 5,47 US-Dollar. Bei Opus 5.5 sind es 23,21 US-Dollar, bei GPT-6 Astra 23,80 US-Dollar. GPT-6 Astra führt den Test mit 68,1 % weiterhin an und bleibt für die schwierigsten Forschungsaufgaben vorgesehen.
Die sachliche Fehlerquote liegt bei extra hohem Reasoning bei 4,1 %. GPT-6 Sol kommt auf 4,5 %, GPT-6 Astra auf 4,0 %. Die Kosten pro Aufgabe liegen bei GPT-6.1 Sol etwa 83 % unter dem Astra-Niveau. Die Auswertung basiert auf deidentifizierten Unterhaltungen, in denen Nutzer einen Fehler eines früheren Modells gemeldet hatten. Die absichtlich schwierigen Prompts sind nicht repräsentativ für die normale Nutzung.
OpenAI meldet außerdem bessere Alignment-Werte als bei GPT-6 Sol. In schwierigen Tests weist GPT-6.1 Sol zuverlässiger auf defekte Suchwerkzeuge hin und vermeidet unautorisierte Ergebnisse bei agentischen Aufgaben. Wie bei GPT-6 Astra und GPT-6 Sol wurden keine Versuche beobachtet, automatisierte Sicherheitsprüfungen zu umgehen. Im Test mit einem defekten Suchwerkzeug verschwieg GPT-6.1 Sol das Problem in 2,8 % der Fälle. Die Vergleichswerte lagen bei 4,9 % für GPT-6 Sol, 1,5 % für GPT-6 Astra und 28,7 % für GPT-6 Luna. Der Test lief mit maximalem Reasoning und war gezielt fehleranfällig.
GPT-6.1 Sol steht jetzt Abonnenten von Plus, Pro, Business, Enterprise und Edu in ChatGPT Work und Codex zur Verfügung. In ChatGPT ist es nicht verfügbar. Über die API lässt sich das Modell mit der Kennung gpt-6.1-sol ansprechen.
Zusätzlich hat OpenAI GPT-6 Astra Ultrafast und GPT-6.1 Sol Ultrafast vorgestellt. Astra Ultrafast soll weltweit das schnellste Frontier-Modell sein und bis zu achtmal schneller als GPT-6 Astra arbeiten. Beide Ultrafast-Modelle sind über die API sowie in ChatGPT Work und Codex mit dem neuen Pro-Tarif verfügbar. Dieser kostet 500 US-Dollar im Monat und bietet die höchsten Nutzungslimits. GPT-6.1 Sol Ultrafast soll bei bis zu achtfacher Geschwindigkeit nahezu Astra-Leistung liefern, zu ungefähr den bisherigen API-Kosten von GPT-6 Astra.




Kommentare
Noch keine Kommentare — schreib den ersten.
Starte die Diskussion
Kein Konto, kein Passwort nötig — gib einfach deine E-Mail-Adresse ein, wir senden dir einen einmaligen Anmelde-Link. Beim ersten Mal bist du damit automatisch angemeldet.
Deine Bewertung wird nach der Anmeldung automatisch übernommen.
Schau in dein Postfach
Wir haben einen Anmelde-Link an … gesendet. Öffne ihn auf diesem Gerät — dieser Tab meldet dich automatisch an.
Nichts angekommen? Wirf einen Blick in den Spam-Ordner — und markiere die Mail dort als „Kein Spam“, dann landet sie künftig direkt im Postfach.