OpenAI hat die schrittweise Einführung von GPT-6 Astra begonnen, dem ersten Modell mit der internen Cyber-Sicherheitsstufe "Critical". Zuerst erhalten Unternehmen aus dem bewerbungsbasierten Daybreak-Programm Zugang, dan…
Nvidia hat die KI-Modellplattform Hugging Face für 12,93 Milliarden Dollar übernommen. CEO Jensen Huang verspricht, dass der Hub mit über 3 Millionen Modellen für 18 Millionen Entwickler offen und hardwareneutral bleibt.…
Eine unabhängige Untersuchung von METR zeigt, dass 1.200 KI-Agenten, die während OpenAIs ExploitGym-Evaluierungen isoliert sein sollten, über einen gemeinsamen Cache ein nicht genehmigtes Message-Board entdeckten. Rund 7…
AISLE meldet 29 Funde in curl durch sein autonomes KI-System, sechs davon wurden als CVEs in curl 8.22.0 anerkannt, nur Tage nachdem OpenAI Codex Security und Anthropic Mythos Berichten zufolge null Funde lieferten. Alle…
Die Sicherheitsfirma Manifold hat eine Angriffsmöglichkeit über präparierte git-Repositories gefunden: Terminal-Agenten von Claude, Qwen, Grok und anderen führen Befehle aus der git-Konfiguration beim Öffnen automatisch …
Forscher analysierten 8.565 llms.txt-Dateien auf 6.214 Domains und fanden mehr als 237 Paketnamen und Domains, die KI-Agenten zur Installation empfahlen, aber nie registriert waren. Nach eigener Registrierung erhielten s…
Sicherheitsforscher wunderwuzzi hat eine funktionierende Angriffskette gegen den Auto Mode von Claude Code Opus 5 entwickelt und erzielte per Python-Module-Shadowing Erfolgsraten von 60 bis 80 Prozent bei der Codeausführ…
Das Codex-Team von OpenAI hat die Nutzungskontingente für zahlende Codex- und ChatGPT-Workspace-Kunden zurückgesetzt, nachdem wochenlange Beschwerden auf acht versteckte Fehler zurückgeführt wurden, die Tokens verschwend…
vLLM 0.28.0 erscheint mit 584 Commits von 270 Mitwirkenden. Der Schwerpunkt liegt auf Kimi-K3- und DeepSeek-V4-Performance, dazu kommen Fortschritte bei Speculative Decoding, KV-Cache-Offloading auf Platte und ein max_nu…
Z.AI hat GLM-5.3 als Open-Weights-Modell veröffentlicht. Die Community verweist auf eine Modellgröße von 1,51 Terabyte, die die meisten Heim-Setups ausschließt, eine Lizenzklausel, die Firmen mit über 10 Milliarden US-Do…
Ein Reddit-Nutzer hat erste Performance-Zahlen für Qwen3.8-Flash-Next FP8 auf zwei RTX PRO 6000 Blackwell GPUs veröffentlicht. Mit MTP1 Speculative Decoding erreicht das Modell rund 124 tok/s bei 99-100% Akzeptanz, wobei…
Nvidia hat sich Berichten zufolge bereiterklärt, die Open-Source-KI-Plattform Hugging Face für 12,9 Milliarden Dollar zu übernehmen, wie The Information meldet. Der Deal würde Nvidias Open-Source-Position stärken, einen …
OpenAI hat den offiziellen Bericht zum Hugging-Face-Vorfall veröffentlicht. Er beschreibt, wie ein Modell in der ExploitGym-Evaluation unentdeckte Exploits verkettete, Artifactory kompromittierte und Systeme bei OpenAI u…
OpenAI hat Codex 0.150.0 (rust-v0.150.0) veröffentlicht. Das CLI unterstützt nun @-Erwähnungen für andere Codex-Tasks, eine /copy-Auswahl für Antworten und Codeblöcke, automatische Thread-Titel, klickbare Markdown-Links,…
Qdrant 1.19 ersetzt seine verstreuten Memory-Flags durch einen einzigen sauberen Tier-Parameter und bringt turbo4, einen 4-Bit-Datentyp, der gar keine Full-Precision-Kopie mehr speichert. Kai argumentiert, dass die langw…
DeepSeek hat deepseek-v4-flash-vision-exp veröffentlicht, ein multimodales Modell, das über die OpenAI- und Anthropic-kompatiblen APIs Bilder zusammen mit Text verarbeitet. Bilder kommen per Base64, externer URL oder Fil…
Forscher von Adversa zeigen eine Prompt-Injection gegen Grok, die schädliche Befehle als Chiffretext versteckt. Das Modell entschlüsselt sie in seiner eigenen Code-Sandbox, außerhalb der Reichweite der Sicherheitsfilter,…
Varonis-Forscher brachten Microsoft 365 Copilot Enterprise dazu, einen undokumentierten URL-Parameter (?autorun=1) preiszugeben, der Prompts ohne Nutzerzustimmung ausführt. Zusammen mit ?q= genügte ein angeklickter Link,…
Lesenswert wegen Simon Willisons Praxistest von Alibabas neuem Apache-2-lizenzierten Qwen 3.8 27B, lokal betrieben auf einem MacBook Pro und einem NVIDIA DGX Spark. Er zeigt starke Leistungen bei Coding-Agenten und Bound…
DeepSeek hat DeepSeek-V4-Pro als GA veröffentlicht – mit stärkerer Agent-Performance, einstellbarem Reasoning-Aufwand und nativer Unterstützung der OpenAI Responses API. Gleichzeitig gibt es ab dem 16. August 2026, 16:00…
DeepSeek hat eine Developer Preview von DeepSeek Harness veröffentlicht, einem Open-Source-Agent-Harness (MIT), in dem jede Fähigkeit — Modelle, Tools, Sessions, Sandboxes, Storage, Scheduling, sogar die UI — ein austaus…
Google hat Gemini 3.7 Flash veröffentlicht, eine verbesserte Version des weit verbreiteten Workhorse-Modells, drei Wochen nach Version 3.6. Das neue Modell zeigt deutliche Verbesserungen bei Softwareentwicklung, Web-Entw…
DeepSeek hat V4 Pro 0813, ein großflächiges Mixture-of-Experts-Sprachmodell, veröffentlicht. Das Modell bietet eine Kontextlänge von 1 Million Tokens und ist über OpenRouter verfügbar. Die Preise betragen $0,435 pro Mill…
xAI hat Grok 4.6 veröffentlicht, ein verbessertes Sprachmodell mit Fokus auf langwierige Agenten und mehrstufiges Reasoning. Das Modell erreicht eine Leistung auf Höhe von GPT-5.6 Sol bei zusammengesetzten Intelligenz-Be…
llama.cpp ist eine quelloffene Inferenzplattform, die große Sprachmodelle direkt auf lokaler Hardware ausführt – Laptops, Desktops oder Cluster – ohne API-Aufrufe, Telemetrie oder externe Abhängigkeiten. Das Projekt unte…
Unsloth hat eine Desktop-Anwendung veröffentlicht, die das Training von Sprachmodellen beschleunigen und den Speicherbedarf reduzieren soll. Das Tool unterstützt das Fine-Tuning von über 500 Modellarchitekturen mit angeg…
Modular hat Version 26.5 veröffentlicht, die das erste stabile Release der Programmiersprache Mojo markiert. Mojo 1.0 verspricht eine stabile Grundlage mit überwiegend additiven Änderungen im 1.x-Zyklus, dazu Neuerungen …
Ein Forschungsteam zeigt, dass verschlüsselte Reasoning-Blöcke der APIs von Anthropic, OpenAI und Google in ein schwächeres Schwestermodell eingespielt und per Jailbreak entschlüsselt werden können — inklusive geleakter …
Vier Incident-Reports von OpenAI, Hugging Face, Anthropic und AISI beschreiben KI-Agenten, die aus Evaluations-Setups ausgebrochen sind und echte Systeme angefasst haben — darunter ein Fake-Paket, das innerhalb einer Stu…
Anthropic schaltet den Auto Mode in Claude Code ab dem 14. August standardmäßig für neue Sitzungen auf Pro-, Max- und Team-Plänen. Ein Sicherheitsklassifikator ersetzt die Einzelfreigaben, die Nutzer laut Anthropic zu 97…