2026-09-08

DeepSeek confirme que V4.1 Flash est une bêta — officiellement, via un questionnaire, toujours sans benchmarks

AIModels🌍 Asia

Le compte officiel de DeepSeek, 深度求索 — le nom chinois de l'entreprise, utilisé comme canal communautaire/support — a confirmé aujourd'hui ce que plusieurs observations indépendantes décrivaient déjà, relayé dans une capture d'écran publiée par le compte @MaxForAI : « La version intermédiaire de DeepSeek V4.1 Flash est entrée en test interne, n'hésitez pas à l'essayer », suivi des mêmes détails techniques déjà rapportés par des comptes tiers — nouvelle architecture, support multimodal natif, « plus capable, plus rapide et moins coûteux » — et d'une demande de retours via un formulaire de questionnaire. Des médias tech chinois couvrant le même test rapportent, de seconde main, que le retour spécifiquement recherché par DeepSeek porte sur une question précise : ce modèle de palier Flash peut-il se substituer entièrement à V4-Pro — l'objectif n'étant pas seulement un modèle moins cher, mais une capacité de niveau Pro au coût et à la vitesse de Flash. Ce n'est pas confirmé directement par la publication de DeepSeek elle-même, mais cela expliquerait pourquoi une entreprise fait évoluer son palier économique avec une affirmation de « nouvelle architecture » plutôt que son modèle phare. Le modèle est accessible en conservant la même URL de base de l'API et en réglant le nom du modèle sur deepseek-v4.1-flash-expires-on-0910, au même tarif que le palier deepseek-v4-flash actuel, plafonné à 20 requêtes simultanées par compte.

Les observations de tiers et le compte officiel de DeepSeek s'accordent désormais, détail pour détail

Avant que la confirmation de DeepSeek elle-même n'apparaisse, au moins trois comptes indépendants avaient déjà décrit les mêmes spécificités techniques exactes — la chaîne de modèle précise, le suffixe « expires-on-0910 », et l'instruction de conserver l'URL de base existante en changeant simplement le nom du modèle — ce qui constituait déjà un signal nettement plus solide qu'une simple publication non vérifiée. La publication du compte communautaire de DeepSeek correspond point par point à ces rapports de tiers : même chaîne de modèle, même mention tarifaire, même plafond de 20 requêtes simultanées, plus le vocabulaire de « nouvelle architecture » et de « support multimodal natif ». Cette concordance rassure sur les faits, mais ne change rien à ce qui manque encore : le tarif n'a pas réellement changé par rapport au palier deepseek-v4-flash actuel, donc toute affirmation de coût réduit à l'exécution doit provenir du fait d'accomplir une tâche donnée avec moins de tokens ou moins d'appels, pas d'une baisse de prix affichée — une affirmation d'efficacité réelle, mais différente de ce que « moins coûteux » suggère à lui seul.

Une bêta officielle, pas un lancement officiel

Un identifiant de modèle à date d'expiration codée en dur, distribué via un compte communautaire accompagné d'un questionnaire de retours, ne correspond toujours pas à la façon dont DeepSeek annonce normalement un produit. À comparer avec le propre lancement de V4-Pro par DeepSeek le mois dernier, qui était arrivé via une publication du compte principal de DeepSeek, accompagné d'un tableau de benchmarks complet face à des rivaux nommés, et avait donné au nouveau point de contrôle un nom permanent que les intégrations existantes n'avaient pas besoin de modifier pour en bénéficier. La confirmation d'aujourd'hui n'a rien de tout cela : aucun tableau de benchmarks, aucun nom permanent, et une fenêtre de test explicite de deux jours. DeepSeek confirme officiellement une bêta, elle ne lance pas officiellement un modèle — une distinction réelle, pas une technicité, puisque tout dans la façon dont cela est distribué (identifiant temporaire, concurrence plafonnée, un questionnaire demandant aux testeurs si le modèle peut remplacer le palier Pro) indique que DeepSeek elle-même ne considère pas encore ce point de contrôle comme achevé.

Si le « multimodal natif » se confirme, c'est là la vraie histoire

La lignée V4 de DeepSeek, comme ce blog l'a couvert lors du lancement de la version Pro, a jusqu'ici rivalisé principalement sur des benchmarks de codage agentique et de raisonnement face à Kimi K3, Claude Fable 5 et Claude Opus 4.8 — un ensemble concurrentiel centré sur le texte et le code. Un support multimodal natif constituerait un véritable basculement architectural pour cette lignée, pas une mise à jour incrémentale, et placerait DeepSeek en concurrence plus directe avec les modèles de pointe à capacités visuelles que ce blog suit tout ce mois-ci. C'est exactement pourquoi il vaut mieux traiter cela comme une affirmation intéressante à vérifier plutôt que comme une capacité confirmée : un « support multimodal natif » attaché à un test bêta de deux jours accompagné d'un questionnaire de retours, et sans le moindre chiffre de benchmark venant de DeepSeek ou de quiconque d'autre, n'équivaut pas encore à une capacité livrée et évaluée.

À surveiller

  • Si le point d'accès disparaît effectivement le 10 septembre, comme son nom l'indique. Si c'est le cas, cela confirme que ce test est resté borné dans le temps ; si DeepSeek le prolonge ou le convertit en nom de modèle permanent, c'est le signe que le test s'est bien passé.
  • La publication de lancement officielle et le tableau de benchmarks à venir. Le lancement de V4-Pro par DeepSeek a fixé le modèle à suivre — une publication du compte principal avec un tableau de comparaison complet face à des rivaux nommés ; c'est le vrai test permettant de savoir si les affirmations de V4.1 Flash tiennent la route, pas la confirmation bêta d'aujourd'hui.
  • Des résultats de benchmark indépendants avant de créditer « plus rapide », « plus capable » ou « moins coûteux ». Les trois affirmations reposent actuellement sur le langage de l'annonce bêta de DeepSeek elle-même, pas sur une quelconque comparaison mesurée par DeepSeek ou par un évaluateur extérieur.
  • Si la question du questionnaire rapportée de seconde main — Flash peut-il remplacer Pro entièrement — reçoit une réponse explicite dans ce que DeepSeek annoncera à la fin de la période de test, puisque c'est une affirmation plus lourde de conséquences que n'importe quel score de benchmark isolé.