DeepSeek hat DeepSeek-V4-Flash-0731 auf Hugging Face veröffentlicht — die Gewichte kamen am selben Tag wie die Ankündigung, ohne Countdown-Kampagne. Das Modell steht unter reiner MIT-Lizenz.

Bemerkenswert ist die Effizienz: Das Modell wird bereits FP4-quantisiert ausgeliefert und ist insgesamt etwa 167GB groß. Community-Berichten zufolge erreicht es GLM-5.2-Niveau bei deutlich geringerem VRAM-Bedarf, und einige Benchmarks zeigen es vor DeepSeek-V4-Pro. Laut Modellkarte wurden die Code-Agent-Benchmarks mit dem Minimalmodus von DeepSeek Harness ausgewertet — einem neuen offiziellen Agent-Framework, das bald erscheinen soll — mit maximalem Reasoning-Aufwand, Temperatur 1.0 und top_p 0.95.

Die Local-AI-Community reagiert begeistert: Gelobt werden die sofortige Open-Weights-Veröffentlichung und die Lauffähigkeit auf Consumer-Hardware. Diskutiert werden GGUF-Builds und Q2–Q4-Quantisierungen für Setups wie einen M5 Max oder 64GB RAM plus 3090. Erste Tester bescheinigen sehr starke Qualität, der Geschmack bei UI-Generierung liege nahe am Opus-Niveau.