Ploy hat den KI-Website-Builder von Claude Opus 4.8 auf GPT-5.6 Sol, das neueste Flaggschiff-Modell von OpenAI, umgestellt. Die Entscheidung fiel nach umfassenden Vergleichstests, bei denen GPT-5.6 Sol das bisherige Modell in puncto Geschwindigkeit und Qualität übertraf. Der KI-Agent übernimmt dabei komplexe Aufgaben wie die Seitenplanung, die Analyse des Code-Bestands, das Schreiben von Komponenten sowie die visuelle Überprüfung.

Die Performance-Kennzahlen belegen deutliche Verbesserungen: Die Build-Zeiten sanken um den Faktor 2,2 (von 8 Minuten auf 3 Minuten 42 Sekunden), während die Kosten pro Build um 27 % (von 3,06 $ auf 2,22 $) zurückgingen. Zudem arbeitet GPT-5.6 Sol effizienter bei der Token-Nutzung und schreibt schlankeren Code mit deutlich weniger CSS-Variablen als Claude Opus, ohne dabei die visuelle Qualität zu beeinträchtigen.

Das Team stellte fest, dass die Migration versteckte, anbieter-spezifische Verzerrungen im Evaluierungs-Harness aufdeckte. Erste Fehler resultierten oft daraus, dass das Testsystem auf den sequenziellen Stil von Claude optimiert war, während GPT-5.6 Sol parallele Tool-Aufrufe und gebündelte Dateilesezugriffe nutzt. Dies unterstreicht die Notwendigkeit, Evaluierungsrahmen anzupassen, anstatt neue Modelle lediglich an der Arbeitsweise ihrer Vorgänger zu messen.