D’après 36Kr, DeepSeek est sur le point de lancer complètement sa famille de modèles V4 dans les jours à venir, après des déploiements limités de V4 Flash et V4 Pro. La société a indiqué que la version complète arriverait à la mi-juillet.
DeepSeek a annoncé que la tarification de V4 passera à une facturation en heures creuses et en heures de pointe, avec une sortie de V4 Pro facturée 0,87 $ par million de tokens en période normale et 1,74 $ pendant les périodes de pointe, tandis que la sortie de V4 Flash démarre à 0,28 $ par million de tokens. V4 utilise une architecture à experts multiples (mixture-of-experts) avec une fenêtre de contexte de 1 million de tokens et a obtenu 91,2 % sur le benchmark SWE-Bench Verified. Le changelog de l’API de la société indique que deepseek-chat et deepseek-reasoner seront abandonnés le 24 juillet ; la migration nécessite principalement un changement de nom de modèle.