DeepSeek hat die allgemeine Verfügbarkeit von V4 Pro 0813, einem großflächigen Mixture-of-Experts-Modell für Produktionsanwendungen, angekündigt.

Das Modell verfügt über ein Kontextfenster von 1 Million Tokens und ist über die OpenRouter-API-Plattform verfügbar. Die Preisgestaltung liegt bei $0,435 pro Million Input-Tokens und $0,87 pro Million Output-Tokens und spiegelt eine wettbewerbsfähige Positionierung auf dem Markt für effiziente Inferenz wider.

V4 Pro 0813 wurde am 12. August 2026 eingeführt. Das Modell unterstützt OpenAI-kompatible API-Aufrufe, was Entwicklern ermöglicht, es mit Standard-SDKs zu integrieren, wobei nur die Basis-URL geändert werden muss. OpenRouter bietet Überwachungsinfrastruktur, Leistungsmetriken (Durchsatz, Latenz, Time-to-First-Token) und Benchmark-Vergleiche mit anderen gehosteten Modellen.

Die Veröffentlichung umfasst Standardfunktionen wie Tool-Aufrufe und strukturierte Output-Unterstützung. Die Mixture-of-Experts-Architektur ermöglicht es dem Modell, die Berechnung zu optimieren, indem für jede Aufgabe nur relevante Expert-Netzwerke aktiviert werden – ein Designmuster, das zunehmend in großen Sprachmodellen für Effizienzgewinne eingesetzt wird.