Mistral Large 4
Modèle MoE de Mistral (1 000 Md de paramètres, 49 Md actifs), en preview API depuis le 6 octobre 2026 ; poids promis fin octobre, licence non annoncée.
SFEIR AI · Publié le 6 octobre 2026
Fiche technique et calendrier d'une preview
Mistral Large 4 est un modèle de langage de Mistral, mis en preview publique par API sur Mistral Studio le 6 octobre 2026, sous le surnom « Le Chonk ». C'est un Mixture-of-Experts hybride, instruct et raisonnement, nativement multimodal : 1 000 milliards de paramètres au total, 49 milliards actifs par token. L'entrée accepte texte et image, la sortie reste du texte. Le modèle couvre plus de 160 langues, dont toutes les langues officielles de l'Union européenne.
Mistral l'a entraîné à partir de zéro sur 3 800 GPU NVIDIA Grace Blackwell installés dans ses datacenters européens, en deux mois environ selon VentureBeat et Euronews ; NVIDIA parle de « près de 4 000 » GPU et le Journal du Net d'un cluster d'environ 10 MW en France. Le prix de la preview est de 1,36 $ par million de tokens en entrée et 4,18 $ en sortie. La fenêtre de contexte de 512 000 tokens et la sortie maximale de 256 000 tokens viennent de la fiche Vals AI, l'annonce de Mistral ne les mentionnant pas.
Le calendrier compte. L'annonce du 6 octobre promet les poids ouverts « fin octobre » ; VentureBeat et Euronews donnent le 27 octobre 2026. Le run d'apprentissage par renforcement derrière la preview est encore en cours : Mistral écrit que le modèle « is showing no signs of saturation », et Guillaume Lample annonce une version finale avant la fin du mois, livrée avec les poids. La licence des poids reste à annoncer au 6 octobre 2026 : le billet de Mistral, VentureBeat et The Next Web la passent sous silence.
Scores annoncés et mesures tierces
Les chiffres publiés par Mistral le 6 octobre sont des scores d'éditeur, issus de ses propres graphiques. En code agentique : 61,7 % sur DeepSWE v1.1, 28,3 % sur Terminal-Bench 4, 59,4 % sur SWE-Atlas-QnA, 49,8 % au Coding Agent Index. En agents : 59,9 % sur AutomationBench. Les graphiques repris par The Next Web placent Mistral Large 4 à 62 % sur DeepSWE contre 61 % pour GLM 5.3 et 57 % pour DeepSeek-V4-Pro, à 67 % sur Finch/FinWorkBench (à égalité avec DeepSeek-V4-Pro, GLM 5.3 à 65 %), à 15 % sur Harvey Legal Agent contre 13 % pour Kimi K3 et 5 % pour GPT-6 Astra, et à 42 % sur Dense 200 (grounding visuel) contre 41 % pour GPT-6 Astra, un écart d'un point que The Next Web lit à 42/42. Mistral résume sa position par un modèle « significantly outperforming any open-weight model developed in the US or Europe ».
Les mesures tierces du même jour sont plus modestes. Sur le leaderboard public DeepSWE, qui retient la meilleure configuration modèle plus agent, VentureBeat relève GLM 5.3 et Kimi K3 vers 69 %, GPT-6 Astra, Gemini 3.8 Flash et Claude Opus 5 vers 74 % : les 62 % de Mistral Large 4 sont compétitifs sans établir d'avance en code. Chez Vals AI, le modèle obtient 48,05 % (± 1,11) au Vals Index, 32e sur 44 ; 15,83 % sur Harvey Legal Agent, 6e sur 75 ; 54,68 % sur Finance Agent v2, 22e sur 75 ; 22,73 % sur Terminal-Bench 4.0, 20e sur 44, contre les 28,3 % annoncés par Mistral ; 30,56 % en Code Migration (38e sur 74) et 78,40 % sur Vibe Code Bench v1.1 (25e sur 109). Sur le leaderboard Legal Agent de Vals, Kimi K3 est à 12,92 %, MiMo V2.6 Pro à 10,83 % et GLM 5.3 à 8,33 %.
Les dirigeants de Mistral calibrent eux-mêmes la lecture. Pierre Stock, vice-président science et premier salarié, dit à Euronews que Mistral est « definitely closing the gap », et sur certains aspects « basically stronger than China's models from this summer ». Guillaume Lample décrit à VentureBeat une « initial version of the idea, with still larger models to come ».
Cyberdéfense, refus et red teaming
Le terrain que Mistral met en avant est la cybersécurité. L'éditeur annonce 82 % sur la reproduction de vulnérabilité de l'Artificial Analysis Cyber Index, et affirme que « several leading closed models, including Claude Opus 5.5 and GPT-6 Astra, score near zero on the same test because they refuse to perform the task ». Il annonce 93 % sur Cybench, et se place parmi les cinq premiers modèles de l'AA Cyber Index, loin devant les modèles open-weight développés hors de Chine. Le raisonnement est donné dans le billet : « defending software often starts with proving that a flaw is real, exactly the kind of work safety filters in closed models can block ».
La capacité offensive est encadrée par des refus. Mistral annonce 93,3 % de résistance sur le benchmark B3 de Lakera, et un taux de refus moyen sur les prompts cyber de JailbreakBench, StrongREJECT et AgentHarm supérieur à celui de tous les modèles open source. En preview publique, les requêtes malveillantes sont bloquées. Une version à modération réduite et capacités cyber étendues est réservée à un red teaming en conditions réelles avec des responsables cybersécurité, des partenaires vérifiés et des autorités étatiques, par API privée, pendant une fenêtre de trois semaines avant la publication des poids selon Euronews. Un dirigeant de Mistral le formule ainsi au Journal du Net : « on leur donne un modèle qu'ils possèdent et qu'ils pourront utiliser de manière illimitée ».
Guillaume Lample en donne l'usage visé à Euronews : « The cyber defence capabilities will enable enterprises and governments to defend themselves against threat actors that are jailbreaking closed models to perform cyber attacks. »
Filiation, nom et souveraineté relative
Mistral Large 4 succède à Mistral Large 3, publié le 2 décembre 2025 : un MoE de 675 milliards de paramètres dont 41 milliards actifs, sous licence Apache 2.0, entraîné sur 3 000 GPU H200. Large 4 fait passer le total à 1 000 milliards et les paramètres actifs à 49 milliards, sur 3 800 Grace Blackwell. Rien ne garantit que la licence suive : au 6 octobre 2026, celle de Large 4 reste à annoncer. Le surnom « Le Chonk » répond au mème « Le Chaton Fat » de juin 2026, auquel Arthur Mensch avait répliqué « It's actually le gros chaton ».
Le modèle s'inscrit dans la lecture de souveraineté que porte Mistral depuis sa Series D du 8 septembre 2026 (3 milliards d'euros, valorisation post-money supérieure à 21 milliards, tour mené par Samsung Electronics). L'entraînement a eu lieu dans des datacenters européens, sur des GPU NVIDIA, avec un budget de calcul qu'un dirigeant de Mistral situe au Journal du Net « entre deux et trois fois moins que la plupart des labos chinois ». La comparaison utile, côté open-weights, se fait avec Kimi K3 et GLM 5.3, dont les licences maison portent des conditions commerciales : pour Large 4, cette case reste vide jusqu'à la publication des poids.
Questions fréquentes
Sous quelle licence Mistral Large 4 est-il publié ?
Aucune licence n'a été annoncée au 6 octobre 2026. Le billet de Mistral promet des poids ouverts pour fin octobre sans en préciser les termes. Le prédécesseur, Mistral Large 3 (décembre 2025), était sous Apache 2.0 ; rien n'indique encore si Large 4 suivra.
Mistral Large 4 est-il open source ?
Au 6 octobre 2026, non : seul un accès API en preview existe. Mistral annonce des poids ouverts pour fin octobre 2026. Open-weights ne signifie pas open source : la réponse dépendra de la licence, toujours inconnue, et de ce que Mistral publie au-delà des poids.
Peut-on auto-héberger Mistral Large 4 ?
Pas encore. Jusqu'à la publication des poids, annoncée pour le 27 octobre 2026 par VentureBeat et Euronews, le modèle n'est accessible que par l'API de Mistral Studio, à 1,36 $ par million de tokens en entrée et 4,18 $ en sortie. Un MoE de 1 000 milliards de paramètres exigera par ailleurs une infrastructure dimensionnée en conséquence.
Que valent les benchmarks de Mistral Large 4 ?
Les scores du 6 octobre sont ceux de l'éditeur. Les mesures tierces du même jour sont plus basses : Vals AI relève 22,73 % sur Terminal-Bench 4.0 contre 28,3 % annoncés, et classe le modèle 32e sur 44 à son index général. Sur le leaderboard public DeepSWE, GLM 5.3 et Kimi K3 sont vers 69 %, les modèles fermés de pointe vers 74 %, Mistral Large 4 à 62 %. Il reste un run d'apprentissage par renforcement en cours.
Quand les poids seront-ils publiés ?
Mistral écrit « fin octobre » ; VentureBeat et Euronews donnent le 27 octobre 2026. Guillaume Lample annonce une version finale, entraînée au bout de son run de RL, livrée avec les poids avant la fin du mois. D'ici là, des partenaires vérifiés et des autorités étatiques testent une version à modération réduite.
Sources
- Mistral AI — annonce de Mistral Large 4 (preview, fiche technique, scores d'éditeur, red teaming) · 2026-10-06
We are red-teaming the model in real-world settings with cybersecurity leaders, vetted partners, and state authorities
- Vals AI — mesures indépendantes de Mistral Large 4 (Vals Index, Terminal-Bench 4.0, Legal, Finance) · 2026-10-06
- Mistral AI — annonce de Mistral 3 et Mistral Large 3 (675 Md / 41 Md actifs, Apache 2.0) · 2025-12-02
- Orrick — Series D de 3 Md€ de Mistral à plus de 21 Md€ post-money, menée par Samsung Electronics · 2026-09-08
Mistral Large 4 dans vos projets
Échanger avec SFEIRArticles liés
Mistral Large 4 : 1 000 milliards de paramètres en open-weights, une souveraineté qui se jugera sur la licence
Le 6 octobre 2026, Mistral ouvre en preview API Mistral Large 4 : 1 000 milliards de paramètres, 49 milliards actifs, poids promis pour le 27 octobre. Au niveau des meilleurs open-weights chinois, pas des modèles fermés. Son vrai écart : la cyberdéfense, et une licence encore inconnue.
Mistral × Microsoft : un accord souverain, une stratégie industrielle encore illisible
Le 21 juillet 2026, Mistral et Microsoft dévoilent un accord de plusieurs milliards de dollars : compute Azure en Europe, GPU NVIDIA Vera Rubin, modèles jusqu'au mode déconnecté d'Azure Local. Une avancée réelle pour la souveraineté. Mais quelle est, au juste, la stratégie industrielle de Mistral ?