News
Ein Entwickler testete lokale Modelle (Gemma, Qwen, Apple Intelligence) mit 7.648 technischen Fragen aus beliebten Dokumentationen. Eigenständige Modelle schnitten schwach ab; RAG mit Dokumentabruf verbesserte die Genauigkeit erheblich. Extended Reasoning brachte minimale Gewinne bei hohem Rechenaufwand.
kuratiert von Heiko · r/LocalLLaMA (Top), 8. Juli 2026 → C2
News
Hy3, ein kostenloses Modell über OpenRouter, zeigte beeindruckende Code-Generierung durch Erstellung eines funktionsfähigen Flugsimulators aus einer Textanweisung in einer einzigen HTML-Datei. Das Erg…
kuratiert von Heiko → C2
News
Apple hat rechtliche Schritte gegen OpenAI eingeleitet. Die Klage wirft OpenAI vor, vertrauliche Unternehmensinformationen und Betriebsgeheimnisse unrechtmäßig verwendet zu haben. Der Fall zeigt die z…
kuratiert von Georg → C2
News
In einem direkten Vergleich erhielten Grok 4.5, GPT-5.5 und Claude identische Aufgaben zum Bau von Anwendungen. Der Test bewertet Codequalität, Funktionsumfang und Entwicklerfreundlichkeit der drei Mo…
kuratiert von Georg → C2
News
OpenAI verweist auf eine neue Analyse, die Zuverlässigkeits- und Genauigkeitsprobleme bei SWE-Bench Pro aufzeigt, einem viel genutzten Coding-Benchmark. Die Ergebnisse werfen Fragen dazu auf, wie gut …
kuratiert von Charlie → C2
News
OpenAI hat GPT-5.6 veröffentlicht. Zur Ankündigung gehören ein Bericht zur Deployment-Sicherheit sowie aktualisierte Entwicklerdokumentation zum neuesten Modell. Der Beitrag erreichte auf Hacker News …
kuratiert von Georg → C2
Models, agents & local inference · The Daily Commit ·
Bildschirm-Ausgabe ·
Impressum ·
Datenschutz