DeepSeek a annoncé la disponibilité générale de V4 Pro 0813, un grand modèle Mixture-of-Experts conçu pour les charges de travail en production.

Le modèle dispose d'une fenêtre de contexte d'un million de tokens et est accessible via la plateforme API d'OpenRouter. La tarification s'établit à $0,435 par million de tokens d'entrée et $0,87 par million de tokens de sortie, reflétant un positionnement compétitif sur le marché de l'inférence efficace.

V4 Pro 0813 a été lancé le 12 août 2026. Le modèle supporte les appels API compatibles avec OpenAI, permettant aux développeurs de l'intégrer à l'aide de SDK standard en changeant seulement l'URL de base. OpenRouter fournit une infrastructure de surveillance, des métriques de performance (débit, latence, délai d'accès au premier token) et des comparaisons de benchmarks avec d'autres modèles hébergés.

La version inclut des capacités standard telles que l'appel d'outils et le support des sorties structurées. L'architecture Mixture-of-Experts permet au modèle d'optimiser les calculs en activant uniquement les réseaux d'experts pertinents pour chaque tâche – un motif de conception de plus en plus adopté dans les grands modèles de langage pour réaliser des gains d'efficacité.