Avec un jeu de données organisé — 205 sorties de modèles de février 2022 à juillet 2026 (211 entrées arcade en comptant les 6 événements sectoriels), chacune étiquetée par laboratoire, continent, modalité et accès ouvert/fermé. Est-ce suffisant pour arrêter de deviner et commencer à ajuster des courbes ? C'est ce que j'ai fait… avec Fable 5. Seul le temps nous dira si les prédictions sont justes.
Le rythme des sorties est exponentiel (et juillet a cassé la courbe)
Ajuster une exponentielle aux sorties par trimestre donne une croissance de +16 % par trimestre — un doublement environ tous les quatre à cinq trimestres — avec un R²=0,85 sur l'échelle logarithmique. Cela serait déjà remarquable en soi. Mais les 23 premiers jours de juillet 2026 comptent déjà 23 sorties — une par jour — un rythme annualisé d'environ 92 par trimestre : 3× au-dessus de la courbe ajustée.
Une réserve honnête s'impose : une partie de cela tient à un artefact de curation. Le jeu de données consigne 2026 avec une granularité plus fine que 2022 — les variantes, les préversions et les paliers de tarification comptent désormais d'une manière que « GPT-4 est sorti » ne le faisait pas (et l'audit de la semaine dernière a réintégré rétroactivement une douzaine de sorties open-weight précoces, ce qui explique justement pourquoi la référence 2022 a bougé depuis la première version de cet article). Le temps de doublement exact est incertain. Ce qui n'est pas incertain, c'est le graphique suivant.
Un jour et demi entre deux sorties
L'écart médian entre deux sorties consécutives dans le secteur est passé de 23 jours en 2022 à 1,5 jour en 2026 — une compression de 15×. Notez l'échelle logarithmique : sur un axe linéaire, les barres 2023-2026 seraient des filets indiscernables.
Et le calendrier n'a rien d'aléatoire. En passant en revue les sorties phares à la recherche de lancements rivaux dans les 48 heures, on trouve douze paires depuis mi-2025, avec une tendance à converger vers le même jour : GPT-5.3-Codex a atterri le même jour que Claude Opus 4.6, DeepSeek v4 est sorti le lendemain de GPT-5.5, GLM-5.2 a été lancé le lendemain de la suspension de Fable 5, Qwen3.8-Max-Preview est arrivé deux jours après Kimi K3 — et cette semaine, FLUX 3 est sorti deux jours après Qwen Image 3.0. Les dates de sortie sont devenues de la contre-programmation.
L'Asie prend la deuxième place — grâce aux poids ouverts
L'Asie est passée d'une seule sortie en 2022 (GLM-130B) à 32 % de tout ce qui est sorti en 2026, dépassant l'Europe en 2025 et ne revenant jamais en arrière.
La répartition la plus intéressante concerne la manière dont chaque région publie ses modèles. En 2026, seulement 16 % des sorties nord-américaines sont en poids ouverts, contre 58 % pour l'Asie et 75 % pour l'Europe. La part globale de l'ouvert a en réalité chuté (de 73 % en 2024 à 38 % en 2026) à mesure que la frontière américaine se refermait — mais les plus grands modèles ouverts sont désormais à l'échelle de la frontière : Kimi K3, avec 2,8 T de paramètres, est le plus grand modèle en poids ouverts jamais publié, et les modèles ouverts chinois représenteraient environ 61 % des tokens d'OpenRouter. L'ouvert n'a pas perdu en qualité ; il a perdu en nombre tout en s'emparant du sommet du classement.
La vague des spécialistes
Le changement le plus récent : des modèles conçus pour une seule tâche. En comptant les sorties spécialisées en code, cybersécurité, OCR, mathématiques formelles, voix, modèles du monde et agents par semestre :
Au plus un par semestre jusqu'au premier semestre 2025, trois au second semestre 2025, puis 13 au premier semestre 2026, et 8 dans les 23 premiers jours du second semestre 2026 — un rythme qui projette environ 64. Ils se regroupent aussi de manière suspecte : deux modèles OCR à deux jours d'intervalle (Baidu Unlimited-OCR, Mistral OCR 4), et deux modèles de cybersécurité le même jour (Fugu-Cyber et Gemini 3.5 Flash Cyber, le 21 juillet). Chaque modèle cyber de 2026 est verrouillé derrière un accès réservé aux partenaires de confiance — spécialisation et contrôle d'accès arrivent de pair.
Prédictions
Deux se sont déjà réalisées — la même semaine
La première version de cet article signalait une anomalie : Black Forest Labs était silencieux depuis six mois, alors que son propre rythme de sortie laissait prévoir quelque chose vers mars. Le pari, tel qu'écrit alors : « soit FLUX.3 est majeur, soit quelque chose de l'ordre de l'entreprise se prépare ». Deux jours plus tard, le 23 juillet, FLUX 3 a atterri — et il a tranché en faveur du majeur : non pas un modèle d'image incrémental, mais un virage vers une « intelligence visuelle » multimodale couvrant la vidéo, l'audio et la prédiction d'actions robotiques, avec une variante déjà en fonctionnement sur les chaînes de production Audi.
Puis c'est arrivé une seconde fois. Cet article signalait qu'Anthropic était en retard — projeté au 12 juillet selon son propre rythme — et désignait son dépassement comme « celui à surveiller » si le schéma de BFL se confirmait. Le 24 juillet, douze jours après la projection, Claude Opus 5 a atterri : non pas une hausse incrémentale, mais un modèle qui a débuté à la première place de l'index Artificial Analysis, devant le propre Fable 5 de classe Mythos d'Anthropic, à moitié prix. En retard, et majeur — conforme au schéma, deux fois dans la même semaine.
Il vaut la peine de préciser ce que cela valide réellement. Les calculs de rythme ne peuvent pas dire ce que publiera un laboratoire — rien dans les statistiques d'écarts ne prédisait des robots, ni un modèle de milieu de gamme surpassant un modèle phare. Ce qu'ils peuvent faire, c'est signaler qu'il se prépare quelque chose : un laboratoire au rythme établi qui devient silencieux au-delà de son intervalle habituel est soit en train de ralentir, soit en train de préparer un coup — et pour BFL comme pour Anthropic, « ralentir » était improbable. C'est le vrai schéma à retenir : le silence d'un laboratoire au rythme établi est en soi un signal, et plus le silence se prolonge au-delà de la date projetée, plus la sortie éventuelle a tendance à être importante — ils n'ont pas sauté une sortie, ils l'ont mise en réserve. Prochain test de la règle : Google, projeté à la mi-août.
Les calculs sur lesquels je parierais vraiment
- Le rythme de sortie par laboratoire. En prenant la médiane des cinq derniers intervalles entre sorties de chaque laboratoire : Google projette la mi-août, Z.ai la mi-août, xAI fin septembre, DeepSeek novembre — et l'écart médian d'Alibaba est descendu à deux jours, ce qui relève moins d'une projection que d'un rendez-vous permanent. (L'entrée d'Anthropic s'est résolue le 24 juillet — voir ci-dessus.)
- Le T3 atteindra 40 à 55 sorties. L'ajustement dit 31, mais 23 sont déjà sorties rien qu'en juillet ; la saturation dit pas 92. Une fois que l'écart médian atteindra environ 1 jour, les sorties discrètes n'auront plus de sens et les laboratoires basculeront vers des canaux à versionnage continu — les incréments mensuels de GPT-5.x y sont déjà à mi-chemin.
- Les poids ouverts remonteront vers environ 50 % d'ici 2027. Les poids de Kimi K3 sont sortis le 27 juillet, la sortie ouverte de Qwen3.8 est promise, l'Europe publie à 75 % en ouvert, et la part trimestrielle d'ouvert s'est déjà redressée de 33 % (T1) à 43 % (T3 à ce jour).
- La cybersécurité deviendra une catégorie durablement verrouillée. Trois sur trois verrouillées en 2026, plus le cadre de gravité post-suspension que les grands laboratoires proposent conjointement. Attendez-vous à ce que « réservé au gouvernement et aux partenaires de confiance » devienne un palier de sortie standard, et non une exception.
- Les modèles du monde perceront en 2027. Cosmos 3 est sorti avec plus de 20 partenaires industriels, HY-World 2.0 vise les jeux vidéo, et le résultat de Qwen-AgentWorld — un RL simulé surpassant le RL en environnement réel sur certains benchmarks — est le genre de résultat habilitant qui précède une vague.
- Des orchestrateurs plutôt que des monolithes. Fugu Ultra bat Opus 4.8 sur SWE-Bench Pro en composant d'autres modèles ; Kimi K2.6 fait tourner des essaims de 300 agents ; Muse Spark est entraîné à orchestrer des sous-agents. L'unité de capacité passe d'« un modèle » à « un système qui aiguille des modèles » — ce qui, accessoirement, rend des jeux de données comme celui-ci plus difficiles à mettre à jour chaque mois.
L'arcade tiendra les comptes, quoi qu'il arrive.
Sources au-delà du jeu de données arcade : la rétrospective S1 2026 sur le rythme des sorties de Digital Applied, Interconnects sur l'escalade des poids ouverts de Kimi K3, Data Gravity sur la part des poids ouverts chinois, et les perspectives 2026 d'EY sur la souveraineté et l'économie des agents. Analyse : exclusion des 6 événements ne constituant pas des sorties (données arrêtées au 23 juillet 2026), ajustement par moindres carrés log-linéaires sur les trimestres complets uniquement, médianes pour les statistiques d'écarts ; le décompte des spécialistes repose sur une liste établie manuellement, légèrement resserrée depuis la première version de cet article.