2026-08-13

Mistral OCR 4.1 : aucun benchmark, aucun classement, juste six choses qui étaient agaçantes

AIModels🌍 Europe

Mistral a publié OCR 4.1 aujourd'hui, une mise à jour de son modèle OCR de documents, et l'annonce est inhabituelle par ce qu'elle ne contient pas : pas de table de benchmarks, pas de score OlmOCRBench, pas de comparaison directe avec un rival. Juste six corrections nommées et précises — le genre qui n'apparaît que quand de vrais clients font passer de vrais documents désordonnés dans un pipeline de production plutôt que dans un jeu de benchmarks.

Les six corrections sont toutes de la justesse de longue traîne, pas de la capacité

Les boîtes englobantes s'alignent désormais sur le contenu qu'elles marquent, sans images imbriquées et sans dérive — un défaut qui n'apparaît pas dans un pourcentage de précision mais qui apparaît absolument quand un système en aval essaie de recadrer une image à partir d'une coordonnée que le modèle a rapportée. Les pages de référence conservent leur structure, renvoyant une boîte par citation au lieu d'effondrer une liste numérotée en un seul bloc indifférencié — exactement le mode de défaillance qui rend la bibliographie d'un mémoire juridique ou d'un article académique inutilisable à analyser programmatiquement. Le modèle manque moins de blocs sur les pages complexes. Les guillemets doubles restent tels qu'écrits, ne se convertissant plus silencieusement en guillemets simples — un bug de justesse qui corromprait tout document où la distinction porte un sens sémantique (échantillons de code, langage juridique cité). Un éventail plus large de styles de cases à cocher est reconnu. Les tableaux de droite à gauche sont analysés plus précisément — la seule correction qui se lit comme un véritable écart de capacité comblé, puisque la mise en page de tableau RTL est un problème d'analyse structurellement différent, pas une simple retouche de fine-tuning.

Chacune de ces corrections a le profil d'un élément de suivi de bugs, pas d'un écart de benchmark. Comparez cela aux sorties menées par une table de benchmarks dont ce mois-ci a été plein — Grok 4.6, DeepSeek-V4-Pro, Qwen3.8-Max ont tous ouvert avec un graphique comparatif face à des rivaux nommés. OCR 4.1 ouvre avec une liste de choses qui n'allaient pas pour de vrais clients payants. Ce n'est pas un genre de sortie inférieur ; l'OCR de documents est un domaine où « la liste de citations ne s'effondrait plus en une seule boîte » compte plus pour la mise en production d'un produit qu'un point de pourcentage sur un score agrégé.

La partie discrète : l'alias vient de bouger sous vos pieds

L'alias mistral-ocr-latest pointe désormais vers OCR 4.1, ce qui signifie que toute intégration construite contre latest plutôt qu'un numéro de version épinglé obtient ces six corrections sans aucun changement de code — et, moins discuté, aurait obtenu de la même façon toute régression. C'est un vrai choix opérationnel qui mérite d'être nommé : pointer un alias latest vers une nouvelle version de modèle est un changement de comportement silencieux pour tout système en aval qui faisait confiance à l'alias pour rester stable au sein d'une famille de sorties. C'est pratique jusqu'au jour où l'une de ces six corrections s'avère casser un flux de travail qui dépendait de l'ancien comportement, bogué — le changement d'analyse des tableaux RTL, par exemple, pourrait plausiblement altérer la sortie pour tout document qui était analysé « mal mais de façon cohérente » jusqu'à aujourd'hui.

Le contexte tarifaire, pour ceux qui rattrapent leur retard

Ça vaut la peine de le répéter puisque c'est facile à perdre de vue : la tarification de l'API OCR de Mistral a doublé le 23 juin, au lancement d'OCR 4 lui-même — de 2 $ à 4 $ par 1 000 pages pour l'OCR, avec Document AI à 5 $. OCR 3 reste disponible à l'ancien tarif de 2 $ pour qui ne veut pas migrer. Ce n'est pas nouveau aujourd'hui, mais cela signifie que les six corrections d'OCR 4.1 arrivent par-dessus une hausse de prix déjà vieille de six semaines, pas aux côtés d'une hausse fraîche — l'amélioration et la hausse de prix sont décalées dans le temps, ce qui mérite d'être su avant de supposer que cette sortie est ce qui justifiait la hausse de prix de juin.

À surveiller

  • Si « pas de table de benchmarks » devient le motif de Mistral pour les mises à jour OCR incrémentales, plutôt qu'un cas isolé pour une sortie aussi étroite. Une catégorie de modèle définie par la justesse de l'analyse de documents pourrait simplement ne pas bien se benchmarker en un chiffre de classement, ce qui ferait de ceci le choix honnête plutôt qu'une omission.
  • Les rapports de régression suite au déplacement de l'alias. Quiconque avait un pipeline dépendant silencieusement des particularités spécifiques d'OCR 4 — y compris celles qui viennent d'être corrigées — est la population la plus susceptible de remarquer que cette sortie a eu lieu.

Références : annonce d'OCR 4.1 de Mistral (texte direct fourni ; aucune URL indépendamment accessible à la publication de cet article — mistral.ai est inaccessible depuis cet environnement et la page spécifique 4.1 n'est pas apparue dans les recherches) · Mistral — lancement d'OCR 4, pour le contexte et la tarification · couverture liée : Mistral arrête de vendre du calcul et commence à vendre de la confiance · DeepSeek-V4-Pro comble un écart et en ouvre un nouveau · Frontier Arcade : tendances et prédictions