Mistral AI a lancé Mistral Large 4 le 6 octobre 2026, un modèle nativement multimodal de 1 000 milliards de paramètres au total dont 49 milliards actifs, soit environ 4,9 % du modèle par jeton. L'annonce le présente ainsi : « Mistral Large 4, alias Le Chonk », avec un logo Mistral orange en pixel art accroché dans un musée, des chats dans les tableaux. Il est accessible à tous dès aujourd'hui via l'API, avec des poids ouverts promis pour la fin octobre. VentureBeat, TNW, CNBC et Euronews ont tous couvert le lancement le jour même ; le titre de CNBC dit que Mistral affirme rivaliser avec les meilleurs systèmes ouverts chinois, et TNW y voit un défi à l'avance de la Chine dans les modèles d'IA ouverts.
Ce que Mistral dit faire de mieux
Mistral qualifie Large 4 de « meilleur modèle à poids ouverts des États-Unis ou d'Europe sur les benchmarks agrégés ». Il le décrit comme l'état de l'art sur les charges de travail critiques, en citant la cyberdéfense, l'industrie manufacturière et la finance.
L'affirmation la plus tranchante concerne l'ancrage visuel, où Mistral dit que Large 4 dépasse les modèles frontière fermés. Il obtiendrait 73 % sur DIOR-RSVG, un benchmark de télédétection, contre 68 % pour GPT-6 Astra, soit cinq points d'écart. Le modèle accepte du texte et des images en entrée et produit du texte.
Comment il est déployé
L'API est ouverte à tous dès aujourd'hui via l'API de Mistral et Mistral Studio. Pour le volet cyber, Mistral indique travailler en privé avec des partenaires en cybersécurité. Selon la presse, une API privée distincte, avec moins de restrictions et davantage de fonctions cyber, est destinée à des entreprises de cybersécurité triées sur le volet et à des partenaires de défense ou étatiques, le ministère français des Armées étant, selon certaines informations, cité parmi eux.
Les poids ouverts sont attendus le 27 octobre, après environ trois semaines de tests avec des développeurs, des responsables de la cybersécurité et des autorités gouvernementales. Ils seront proposés aux formats FP8 et FP4 ; le titre d'AlphaSignal affirme que la publication « fait tenir 1 000 milliards de paramètres sur 4 GPU ». À cette taille, le problème de mémoire décrit dans Ces poids ouverts que vous ne pouvez pas faire tourner est précisément ce que les formats de basse précision visent à atténuer.
Mistral insiste sur le fait que le modèle a été « forgé en Europe de bout en bout » et qu'il peut être déployé depuis l'Europe sur sa propre infrastructure Mistral Cloud, l'activité d'inférence régionale détaillée dans Mistral arrête de vendre du calcul et commence à vendre de la confiance. Selon la presse, il a été entraîné de zéro en environ deux mois sur quelque 4 000 GPU Nvidia Grace Blackwell dans les propres centres de données européens de Mistral.
Contexte
Large 4 fait suite à Mistral Large 3, un modèle mixture d'experts de 675 milliards de paramètres publié en poids ouverts sous licence Apache 2.0 en décembre 2025. Mistral Small 4, également sous Apache 2.0, est arrivé en mars 2026. Le nombre total de paramètres a été multiplié par environ 1,5 par rapport à Large 3, tandis que les paramètres actifs s'établissent à 49 milliards.
Le lancement intervient un mois après la clôture par Mistral de sa série D d'environ 3 milliards d'euros pour une valorisation supérieure à 21 milliards d'euros, menée par Samsung, que l'entreprise a présentée dans son annonce de financement comme le socle d'une IA souveraine à poids ouverts à la frontière. C'est la deuxième publication européenne à poids ouverts de la semaine, après Kolibri d'Aleph Alpha, un modèle de 78 milliards de paramètres dont 3,46 milliards actifs.
Le positionnement cyber fait écho à d'autres lancements récents. Google a restreint Gemini 4 Argon à des testeurs de confiance et à des défenseurs cyber la semaine dernière, et l'analyse de GLM-5.3 par Anthropic a montré que des capacités cyber avancées se diffusent déjà dans les modèles à poids ouverts. La réponse de Mistral consiste à scinder la publication : un accès API large dès maintenant, un niveau privé moins restreint pour des partenaires triés sur le volet, et des poids ouverts seulement après une fenêtre de tests avec des développeurs, des responsables de la sécurité et des gouvernements.