AI · News
Ein Entwickler testete lokale Modelle (Gemma, Qwen, Apple Intelligence) mit 7.648 technischen Fragen aus beliebten Dokumentationen. Eigenständige Modelle schnitten schwach ab; RAG mit Dokumentabruf verbesserte die Genaui…
AI · News
Hy3, ein kostenloses Modell über OpenRouter, zeigte beeindruckende Code-Generierung durch Erstellung eines funktionsfähigen Flugsimulators aus einer Textanweisung in einer einzigen HTML-Datei. Das Ergebnis demonstriert d…
AI · News
Apple hat rechtliche Schritte gegen OpenAI eingeleitet. Die Klage wirft OpenAI vor, vertrauliche Unternehmensinformationen und Betriebsgeheimnisse unrechtmäßig verwendet zu haben. Der Fall zeigt die zunehmenden Spannunge…
AI · News
In einem direkten Vergleich erhielten Grok 4.5, GPT-5.5 und Claude identische Aufgaben zum Bau von Anwendungen. Der Test bewertet Codequalität, Funktionsumfang und Entwicklerfreundlichkeit der drei Modelle bei denselben …
AI · News
OpenAI verweist auf eine neue Analyse, die Zuverlässigkeits- und Genauigkeitsprobleme bei SWE-Bench Pro aufzeigt, einem viel genutzten Coding-Benchmark. Die Ergebnisse werfen Fragen dazu auf, wie gut aktuelle Tests die t…
AI · News
OpenAI hat GPT-5.6 veröffentlicht. Zur Ankündigung gehören ein Bericht zur Deployment-Sicherheit sowie aktualisierte Entwicklerdokumentation zum neuesten Modell. Der Beitrag erreichte auf Hacker News 1500 Punkte und löst…