Article complet du Daily Podcast
Mistral dévoile Le Chonk, son modèle à 1 000 milliards de paramètres
Mistral Large 4, surnommé « Le Chonk », combine un nom pensé pour Internet avec une fiche technique de modèle frontière : environ 1 000 milliards de paramètres, une architecture mixture-of-experts, un entraînement en Europe et des poids ouverts annoncés après une phase de préversion. Le vrai test sera moins le clin d’œil félin que la capacité du modèle à justifier son coût de calcul.

Un très gros chat dans la course à l’IA
Mistral a présenté Mistral Large 4, surnommé « Le Chonk », comme son modèle le plus puissant à ce jour et comme une nouvelle tentative européenne de revenir dans la course aux modèles d’IA de pointe . L’entreprise a ouvert une préversion publique le 6 octobre 2026, tout en indiquant que les poids du modèle seraient publiés à la fin du mois plutôt que mis à disposition immédiatement . Dans sa documentation, Mistral décrit Large 4 comme un modèle multimodal généraliste à poids ouverts, fondé sur une architecture mixture-of-experts granulaire, avec 1,05 billion de paramètres au total, 52 milliards de paramètres actifs et un encodeur visuel de 1,6 milliard de paramètres .
Cette précision est essentielle. Dans les titres, Le Chonk est le modèle « 1T » de Mistral. En pratique, il ne fonctionne pas comme un modèle dense activant un billion de paramètres à chaque jeton. VentureBeat rapporte que Mistral présente la configuration de lancement avec environ 49 milliards de paramètres actifs, après un entraînement depuis zéro pendant près de deux mois sur 4 000 GPU Nvidia Grace Blackwell dans les centres de données européens de Mistral . Axios donne le même cadrage: 1 000 milliards de paramètres au total, 49 milliards actifs, 4 000 GPU Grace Blackwell et deux mois d’entraînement . L’enjeu n’est donc pas seulement la taille, mais la promesse d’un modèle très large dont l’activation sparse pourrait rendre l’inférence exploitable.
Préversion maintenant, poids plus tard
Le Chonk n’est pas encore un modèle que chacun peut simplement télécharger et exécuter. Mistral indique que l’API de préversion est disponible dès maintenant et que les poids seront publiés à la fin octobre . VentureBeat donne une échéance plus précise: l’entreprise prévoit de publier les poids le 27 octobre, après une période de test avec des développeurs, des responsables cybersécurité et des autorités publiques . Axios rapporte également que Mistral commence par une API modérée, avec une version moins restreinte fournie à certains partenaires, avant la publication prévue des poids le 27 octobre .
Ce lancement par étapes illustre la tension centrale des modèles ouverts de très grande capacité. Côté promesse, les entreprises et administrations peuvent inspecter, adapter et potentiellement déployer le modèle sur une infrastructure qu’elles contrôlent. Côté risque, une fois les poids diffusés, certains garde-fous peuvent être modifiés ou retirés. Axios souligne que Mistral et d’autres défenseurs des poids ouverts présentent l’ouverture comme un levier de sécurité, alors que leurs critiques rappellent qu’elle limite le contrôle du développeur sur les usages ultérieurs . Le Chonk est donc à la fois un lancement technique et un test de gouvernance.
Le pari européen de la souveraineté
Mistral ne vend pas Le Chonk comme un simple candidat de plus aux classements de benchmarks. Dealroom présente le modèle comme un jalon lié à la série D de 3 milliards d’euros de Mistral, un financement que l’entreprise destine à l’extension de sa capacité de calcul dans des centres de données européens . Dealroom insiste aussi sur la dimension souveraine: Mistral entraîne et sert le modèle sur une infrastructure opérée de bout en bout par l’entreprise et placée sous droit européen .
Pour des organisations européennes, cet argument peut compter autant qu’un score brut. Le Monde rapporte que Mistral utilise Large 4 pour répondre aux doutes sur son retard en performance et pour réaffirmer une stratégie fondée sur l’infrastructure européenne, le déploiement maîtrisé par les clients et les modèles ouverts . Le journal indique également que l’entreprise compte sur des puces progressivement mises en service au cours des six prochains mois, grâce à ses récentes levées de fonds, dont 3 milliards d’euros début septembre .
C’est le cœur stratégique du lancement. Mistral veut prouver que l’Europe peut encore produire de grands modèles de fondation compétitifs, et ne pas se contenter d’acheter, de réguler ou d’envelopper des systèmes américains et chinois. L’entreprise ne prétend pas avoir dépassé les meilleurs modèles fermés américains. Axios rapporte même que Pierre Stock, chez Mistral, reconnaît que la société n’a pas encore rejoint le sommet absolu des modèles fermés . La revendication est plus ciblée: proposer un très grand modèle à poids ouverts, construit hors de Chine, entraîné et servi depuis l’Europe.
Des benchmarks encourageants, mais à confirmer
Mistral affirme que Large 4 repousse la frontière des modèles à poids ouverts et se montre compétitif avec les meilleurs modèles open source mondiaux . Les éléments de lancement mettent en avant le codage, les mathématiques, le travail de connaissance, la finance, le juridique, la cybersécurité et la compréhension multimodale . L’entreprise indique aussi que des évaluateurs tiers de vals.ai ont testé le modèle sur des tâches juridiques et financières, avec des résultats supérieurs à GPT-6-Astra dans les deux cas; sur le benchmark Legal Agent de HarveyAI, Mistral affirme que ML4 dépasse tous les modèles open source .
La sécurité est un autre axe important. Mistral affirme que Large 4 résiste à 93,3 % des attaques sur le benchmark public B3 de Lakera et obtient son meilleur score mesuré parmi les modèles open source sur KORABench . L’entreprise indique également que le modèle refuse davantage les requêtes de cybersécurité malveillantes que les autres modèles open source testés à partir de JailbreakBench, StrongREJECT et AgentHarm . Ces éléments comptent parce que Le Chonk est promu pour la cyberdéfense et les usages professionnels, pas seulement pour la conversation.
La lecture la plus solide reste toutefois prudente. Le Monde écrit que Large 4 « réduit l’écart » avec les meilleurs modèles, tout en rappelant que les chiffres avancés par Mistral sont préliminaires et devront être confirmés dans des classements indépendants mis à jour régulièrement . Le même article rapporte que Mistral donne à Large 4 un score de 63 % sur Deep SWE 1.1, un benchmark de longues tâches de codage, soit un niveau comparable à GLM 5.3 de Z.AI mais inférieur aux meilleurs modèles, qui atteignent environ 74 % . Autrement dit, Le Chonk semble sérieux, mais son véritable examen viendra des évaluations indépendantes, des charges de travail réelles et du checkpoint final publié avec les poids.
L’économie d’un modèle « chonky »
Un billion de paramètres constitue un titre spectaculaire, mais cette taille rend l’infrastructure décisive. Même avec une fraction de paramètres actifs par jeton, un modèle de 1,05 billion de paramètres n’est pas un système que la plupart des équipes pourront faire tourner sur du matériel ordinaire . La documentation tarifaire de Mistral pour Large 4 affiche en préversion un prix promotionnel de 0,68 dollar par million de jetons en entrée, 0,07 dollar par million de jetons en cache et 2,09 dollars par million de jetons en sortie, avec des prix initiaux plus élevés barrés . Ces tarifs ouvrent la porte à l’expérimentation via API, mais ils ne font pas disparaître la complexité d’un auto-hébergement à l’échelle frontière.
L’architecture sparse n’est donc pas un détail technique; elle est au centre du modèle économique. Si Le Chonk livre des résultats de haut niveau tout en activant environ 49 à 52 milliards de paramètres par jeton, Mistral pourra défendre l’idée d’une capacité proche de la frontière avec un coût d’inférence plus raisonnable qu’un modèle dense de taille équivalente . Si ce compromis échoue, le surnom survivra probablement mieux que l’équation économique.
Le signal est aussi important côté entraînement. VentureBeat rapporte que Mistral a entraîné Large 4 depuis zéro en Europe sur environ 4 000 GPU Nvidia Grace Blackwell . Le Monde indique que Mistral présente ces 4 000 puces comme deux à trois fois moins nombreuses que les ressources accessibles à certaines start-up chinoises et très loin des « centaines de milliers » de puces utilisées par les leaders américains . Le Chonk est donc à la fois ambitieux et contraint: une démonstration de capacité par un laboratoire qui dispose de moins de ressources que les géants qu’il défie.
Pourquoi Le Chonk compte
Le nom humoristique joue un rôle réel. Il rend le lancement mémorable dans un marché où chaque laboratoire revendique une nouvelle frontière. VentureBeat relie ce surnom au mème « Le Chaton Fat », qui imaginait un modèle français absurdement gigantesque; Mistral semble avoir transformé cette blague en récit de produit . Mais l’humour ne doit pas masquer le mouvement stratégique.
Le Chonk cherche à réunir trois idées: poids ouverts, souveraineté européenne et performance haut de gamme. Si les poids arrivent à la date prévue et si les tests indépendants confirment les meilleures revendications, Mistral donnera aux entreprises une raison supplémentaire d’envisager un déploiement ouvert plutôt qu’un recours automatique aux API fermées américaines ou aux modèles ouverts chinois. Si le modèle se révèle trop coûteux, trop lent ou seulement « bon pour l’Europe », il restera un symbole plus qu’un basculement de plateforme.
Pour l’instant, Le Chonk remet Mistral au centre de la conversation. Le nom est drôle; la facture GPU, elle, ne l’est pas. La suite se jouera le 27 octobre, dans les benchmarks indépendants, les pilotes d’entreprise et une question très concrète: qui peut vraiment se permettre de faire travailler un chat de 1 000 milliards de paramètres?
Sources des dernières 72 heures
- [1]Introducing Mistral Large 4 | Mistral6 oct. 2026, 02:00
- [2]Mistral Large 4 - Mistral AI | Mistral Docs6 oct. 2026, 02:00
- [3]Mistral debuts Large 4 ‘Le Chonk', a 1-trillion parameter text output model with high benchmarks planned for open weights release6 oct. 2026, 15:00
- [4]Mistral Says Its New AI Model ‘Le Chonk’ Is the Best Open-Weight Offering Outside of China6 oct. 2026, 15:15
- [5]Mistral's €3B-backed "Le Chonk" is a 1-trillion-parameter open model7 oct. 2026, 12:45
- [6]Mistral AI unveils new AI model aimed at 'narrowing the gap' with top Chinese competitors6 oct. 2026, 16:48
- [7]Western AI labs challenge China's open-model lead6 oct. 2026, 15:05
Article généré par IA à partir d’une recherche web récente, puis conservé comme instantané éditorial daté.

Commentaires
Sois le premier à commenter.