The Daily Commit · Ressort-Ausgabe Titelseite PHP AI Dev EN DE FR ES

TheModelDesk

31. Juli 2026
Modelle, Agenten & lokale Inferenz

Releases

DeepSeek veröffentlicht V4-Flash-API als Public Beta mit deutlichen Agent-Benchmark-Zuwächsen

DeepSeek hat die V4-Flash-API als Public Beta unter dem Modellnamen deepseek-v4-flash freigegeben. Der Checkpoint ist ein nachtrainiertes V4-Flash-Preview mit unveränderter Architektur, zeigt starke Agent-Benchmark-Werte, unterstützt nativ die Responses API und ist für Codex angepasst. V4-Pro bleibt unverändert.

DeepSeek hat seine V4-Flash-API in die Public Beta überführt. An der Aufrufweise ändert sich nichts: Wer den Modellparameter auf deepseek-v4-flash setzt, nutzt die neue Version.

Das Release verspricht deutlich verbesserte Agenten-Fähigkeiten mit Benchmark-Ergebnissen weit über V4-Pro-Preview: Terminal Bench 2.1 mit 82,7, NL2Repo 54,2, Cybergym 76,7, DeepSWE 54,4, Toolathlon verified 70,3, Agent Last Exam 25,2, Automation Bench (Public) 25,1, DSBench-FullStack 68,7 und DSBench-Hard 59,6. Für die Code-Agent-Aufgaben der öffentlichen Sets testete DeepSeek mit dem bald erscheinenden DeepSeek Harness im Minimal-Modus, auf maximalem Effort-Level, mit topp=0,95 und temperature=1,0. DSBench-FullStack und DSBench-Hard sind interne Testsets für Full-Stack-Entwicklung bzw. schwere Coding-Agent-Probleme.

V4-Flash unterstützt nativ das Responses-API-Format und ist speziell für Codex angepasst; Details stehen in der Dokumentation. Der Checkpoint, intern V4-Flash-0731, behält Architektur und Größe von V4-Flash-Preview bei und unterscheidet sich nur durch erneutes Post-Training.

Das Update betrifft nur die V4-Flash-API: Die V4-Pro-API sowie die App-/Web-Modelle bleiben unverändert. Das offizielle V4-Pro-Release soll bald folgen. Hintergrund aus dem Changelog: Seit dem 24.04.2026 stellt die API deepseek-v4-pro und deepseek-v4-flash über die OpenAI-ChatCompletions- und die Anthropic-Schnittstelle bereit; die alten Namen deepseek-chat und deepseek-reasoner sollten am 24.07.2026 abgeschaltet werden und verweisen bis dahin auf den Non-Thinking- bzw. Thinking-Modus von V4-Flash.

Originalquelle lesen (Englisch) ↗

Artikel bewerten: 0

Leserforum

Noch keine Beiträge — eröffne die Debatte.

← The Model Desk — Page C1

Models, agents & local inference · The Daily Commit · Bildschirm-Ausgabe · Impressum · Datenschutz