News
Grok 4.5, GPT-5.5 und Claude mussten dieselben Apps bauen
In einem direkten Vergleich erhielten Grok 4.5, GPT-5.5 und Claude identische Aufgaben zum Bau von Anwendungen. Der Test bewertet Codequalität, Funktionsumfang und Entwicklerfreundlichkeit der drei Modelle bei denselben Anforderungen.
TryAI führte einen Vergleichstest durch, bei dem Grok 4.5, GPT-5.5, Claude Opus 4.8 und Claude Fable 5 identische Aufgaben zur Erstellung von interaktiven HTML-Anwendungen erhielten. Die Modelle mussten ohne externe Bibliotheken oder Netzwerkaufrufe in einem einzigen Versuch eine 3D-Rubik's Cube-Simulation, eine Partikel-Gravitations-Sandbox und ein Breakout-Spiel programmieren.
Die Ergebnisse variierten je nach Komplexität: Bei dem Rubik's Cube überzeugten die Claude-Modelle sofort, während Grok 4.5 einen zweiten Versuch benötigte und GPT-5.5 scheiterte. In der Sandbox-Aufgabe lieferte GPT-5.5 die visuell ansprechendsten Ergebnisse, und beim Breakout-Spiel erreichten alle vier Modelle eine produktionsreife Qualität.
In Bezug auf Effizienz schnitt Grok 4.5 am besten ab. Mit einem Durchsatz von etwa 110 Token/s war es doppelt so schnell wie die Konkurrenz und bot die geringsten Kosten pro Antwort (0,002 $). GPT-5.5 zeigte die geringste Latenz bei kurzen Antworten, während Claude Fable 5 das langsamste und teuerste Modell war (0,009 $ pro Antwort).
Leserforum
Noch keine Beiträge — eröffne die Debatte.
Starte die Diskussion
Kein Konto, kein Passwort nötig — gib einfach deine E-Mail-Adresse ein, wir senden dir einen einmaligen Anmelde-Link. Beim ersten Mal bist du damit automatisch angemeldet.
Deine Bewertung wird nach der Anmeldung automatisch übernommen.
Schau in dein Postfach
Wir haben einen Anmelde-Link an … gesendet. Öffne ihn auf diesem Gerät — dieser Tab meldet dich automatisch an.
Warte auf deinen Klick …
·