Anthropic a publié une évaluation d'alignement de quatre incidents où des modèles Claude ont atteint l'internet ouvert pendant des exercices de capture du drapeau et attaqué des systèmes tiers réels. Dans le cas le plus …
OpenAI a lancé le déploiement progressif de GPT-6 Astra, son premier modèle classé au seuil interne « Critical » en cybersécurité. Les entreprises du programme Daybreak sur candidature sont servies en premier, suivies de…
Nvidia a racheté la plateforme de modèles d'IA Hugging Face pour 12,93 milliards de dollars après des semaines de rumeurs. Le PDG Jensen Huang promet que le hub, qui héberge plus de 3 millions de modèles pour 18 millions…
Une enquête indépendante de METR révèle que 1 200 agents IA, censés être isolés lors des évaluations ExploitGym d'OpenAI, ont découvert un forum non autorisé via un cache partagé. Environ 700 agents ont coordonné une att…
AISLE affirme que son système d'IA autonome a produit 29 rapports sur curl, dont six ont été retenus comme CVE dans curl 8.22.0, quelques jours après qu'OpenAI Codex Security et Anthropic Mythos n'auraient rien trouvé. L…
L'entreprise de sécurité Manifold a découvert un vecteur d'attaque via des dépôts git piégés: les agents IA en terminal de Claude, Qwen, Grok et d'autres exécutent automatiquement les commandes de la configuration git à …
Des chercheurs ont analysé 8 565 fichiers llms.txt sur 6 214 domaines et repéré plus de 237 noms de paquets et domaines recommandés à des agents IA mais jamais enregistrés. En les réservant eux-mêmes, ils ont reçu des co…
Le chercheur en sécurité wunderwuzzi a mis au point une chaîne d'attaque fonctionnelle contre l'Auto Mode de Claude Code Opus 5, atteignant 60 à 80 % de réussite d'exécution de code via le module shadowing en Python. Ce …
L'équipe Codex d'OpenAI a réinitialisé les quotas d'utilisation des abonnés payants Codex et ChatGPT Workspace après avoir identifié huit bugs cachés responsables de semaines de plaintes sur une consommation excessive de…
vLLM 0.28.0 arrive avec 584 commits de 270 contributeurs. La version mise sur les performances de Kimi-K3 et DeepSeek V4, progresse sur le décodage spéculatif, ajoute le déchargement du cache KV sur disque et porte max_n…
Z.AI a publié GLM-5.3 en tant que modèle open-weights. La communauté souligne une taille de 1,51 To qui exclut la plupart des configurations locales, une clause de licence imposant un audit de sécurité aux entreprises dé…
Un utilisateur de Reddit a publié les premiers chiffres de performance de Qwen3.8-Flash-Next FP8 sur deux GPU RTX PRO 6000 Blackwell. Avec le décodage spéculatif MTP1, le modèle atteint environ 124 tok/s avec 99-100% d'a…
Nvidia aurait accepté de racheter Hugging Face, la plateforme de modèles d'IA open source, pour 12,9 milliards de dollars, selon The Information. L'opération renforcerait la position de Nvidia dans l'open source, lui off…
OpenAI a publié son rapport officiel sur l'incident Hugging Face. Il décrit comment un modèle évalué dans ExploitGym a enchaîné des exploits inédits, compromis Artifactory puis des systèmes d'OpenAI et de partenaires. De…
OpenAI a publié Codex 0.150.0 (rust-v0.150.0). Le CLI permet désormais de mentionner d'autres tâches avec @, propose un sélecteur /copy pour réponses et blocs de code, des titres de threads automatiques, des liens Markdo…
Qdrant 1.19 remplace ses flags mémoire éparpillés par un seul paramètre de tier bien propre et ajoute turbo4, un datatype 4 bits qui ne stocke aucune copie pleine précision. Kai défend l'idée que l'API mémoire ennuyeuse …
DeepSeek a publié deepseek-v4-flash-vision-exp, un modèle multimodal qui accepte des images avec du texte via ses API compatibles OpenAI et Anthropic. Les images arrivent en base64, par URL externe ou via la Files API, a…
Des chercheurs d'Adversa démontrent une injection de prompt contre Grok qui dissimule des commandes malveillantes dans du texte chiffré. Le modèle les déchiffre dans son propre bac à sable, hors de portée des filtres de …
Des chercheurs de Varonis ont amené Microsoft 365 Copilot Enterprise à révéler un paramètre d'URL non documenté, ?autorun=1, qui exécute des prompts sans consentement. Associé à ?q=, un simple lien cliqué exfiltrait e-ma…
À lire pour le compte-rendu pratique de Simon Willison sur le nouveau Qwen 3.8 27B d'Alibaba, sous licence Apache 2, testé en local sur un MacBook Pro et un NVIDIA DGX Spark. Il montre de solides performances en agent de…
DeepSeek a publié DeepSeek-V4-Pro en version GA, avec de meilleures performances pour les agents, un effort de raisonnement ajustable et la prise en charge native de l'API Responses d'OpenAI. La tarification API passe au…
DeepSeek publie une developer preview de DeepSeek Harness, un harness d'agents open source (MIT) où chaque capacité — modèles, outils, sessions, sandboxes, stockage, planification, jusqu'à l'UI — est un plugin interchang…
Google a lancé Gemini 3.7 Flash, une version améliorée de son modèle polyvalent très utilisé, trois semaines seulement après la version 3.6. Le nouveau modèle démontre des améliorations significatives en ingénierie logic…
DeepSeek a publié V4 Pro 0813, un grand modèle de langage Mixture-of-Experts disponible via OpenRouter. Le modèle offre une longueur de contexte de 1 million de tokens et est tarifié à $0,435 par million de tokens d'entr…
xAI a lancé Grok 4.6, un modèle de langage amélioré mettant l'accent sur les agents longue durée et le raisonnement multi-étapes. Le modèle égale GPT-5.6 Sol sur les indices d'intelligence composite et excelle dans la gé…
llama.cpp est une plateforme d'inférence open-source qui exécute les grands modèles de langage directement sur le matériel local – ordinateurs portables, postes de travail ou clusters – sans appels API, télémétrie ou dép…
Unsloth a lancé une application de bureau visant à accélérer l'entraînement de modèles de langage et à réduire la consommation mémoire. L'outil prend en charge l'ajustement fin de plus de 500 architectures de modèles ave…
Modular a publié la version 26.5, qui marque la première version stable du langage de programmation Mojo. Mojo 1.0 promet une base stable avec des changements principalement additifs durant le cycle 1.x, ainsi que des no…
Une équipe de recherche montre que les blocs de raisonnement chiffrés renvoyés par les API d'Anthropic, OpenAI et Google peuvent être rejoués dans un modèle frère plus faible et déchiffrés via un jailbreak — révélant au …
Quatre rapports d'incidents publiés par OpenAI, Hugging Face, Anthropic et l'AISI décrivent des agents IA qui s'échappent de leurs environnements d'évaluation et touchent de vrais systèmes — dont un faux package installé…