DeepSeek a publié les poids de V4-Flash-Vision-Exp sur Hugging Face le 31 août. Les horodatages du dépôt proviennent directement de l'API de la plateforme : création à 06:16:18 UTC, shards téléversés à partir de 06:57 UTC, fiche modèle à 07:57 UTC. Cela correspond à 14:16 CST — lundi après-midi en Chine.

Pourquoi la date est l'information clé

DeepSeek a annoncé ce modèle le 21 août, et sa propre documentation le décrivait comme accessible via l'API. Les poids n'étaient pas mentionnés. Les suiveurs de modèles le datent donc au 21 août, si bien que la publication d'aujourd'hui est enregistrée comme un doublon de quelque chose datant d'il y a dix jours plutôt que comme ce qui s'est réellement produit — un modèle fermé devenant un modèle à poids ouverts. Pour quiconque ne peut pas envoyer de données à une API, ce ne sont pas les mêmes événements, et un seul d'entre eux change ce qu'il peut déployer.

Ce que contient la publication

Licence MIT. 48 shards, 167,811,372,792 bytes — soit environ 167,8 Go. 43 couches, 256 experts routés plus un partagé, six actifs par token, un contexte de 1,048,576 tokens, des poids FP8 e4m3 avec des experts en FP4, et une tour vision native à 32 couches. Une licence MIT sur un modèle multimodal de type mixture-of-experts de cette taille est exceptionnellement permissive — pas d'annexe sur les usages autorisés, pas de seuil de chiffre d'affaires, pas de clause de revue du type de celles qui apparaissent récemment dans les licences chinoises de poids ouverts.

Ce que le cadrage courant néglige

Le chiffre mis en avant pour le multimodal mérite d'être pris avec prudence. Le gain phare cité pour ce modèle est mesuré par rapport à une base que la propre note de bas de page de DeepSeek indique ne pas recevoir les images — une partie de l'amélioration est donc calculée face à une comparaison textuelle uniquement, qui relève davantage d'un plancher que d'un concurrent. La fiche le dit honnêtement ; les synthèses qui reprennent le chiffre non. Deux autres éléments disparaissent : au moins un benchmark de sécurité du code a régressé par rapport à la version précédente, et le modèle perd la plupart des confrontations directes face au principal modèle frontière occidental. « Performance textuelle comparable » arrondit beaucoup.

Une affirmation qui ne tenait pas

La couverture évoque une publication simultanée sur Hugging Face et ModelScope. ModelScope renvoie record not found pour le modèle. À la publication, les poids ne sont disponibles que sur Hugging Face.