TryAI führte einen Vergleichstest durch, bei dem Grok 4.5, GPT-5.5, Claude Opus 4.8 und Claude Fable 5 identische Aufgaben zur Erstellung von interaktiven HTML-Anwendungen erhielten. Die Modelle mussten ohne externe Bibliotheken oder Netzwerkaufrufe in einem einzigen Versuch eine 3D-Rubik's Cube-Simulation, eine Partikel-Gravitations-Sandbox und ein Breakout-Spiel programmieren.
Die Ergebnisse variierten je nach Komplexität: Bei dem Rubik's Cube überzeugten die Claude-Modelle sofort, während Grok 4.5 einen zweiten Versuch benötigte und GPT-5.5 scheiterte. In der Sandbox-Aufgabe lieferte GPT-5.5 die visuell ansprechendsten Ergebnisse, und beim Breakout-Spiel erreichten alle vier Modelle eine produktionsreife Qualität.
In Bezug auf Effizienz schnitt Grok 4.5 am besten ab. Mit einem Durchsatz von etwa 110 Token/s war es doppelt so schnell wie die Konkurrenz und bot die geringsten Kosten pro Antwort (0,002 $). GPT-5.5 zeigte die geringste Latenz bei kurzen Antworten, während Claude Fable 5 das langsamste und teuerste Modell war (0,009 $ pro Antwort).
Kommentare
Noch keine Kommentare — schreib den ersten.
Starte die Diskussion
Kein Konto, kein Passwort nötig — gib einfach deine E-Mail-Adresse ein, wir senden dir einen einmaligen Anmelde-Link. Beim ersten Mal bist du damit automatisch angemeldet.
Deine Bewertung wird nach der Anmeldung automatisch übernommen.
Schau in dein Postfach
Wir haben einen Anmelde-Link an … gesendet. Öffne ihn auf diesem Gerät — dieser Tab meldet dich automatisch an.
Warte auf deinen Klick …
·