Mistral a lancé mardi la préversion publique de Mistral Large 4, un modèle d'IA de 1 000 milliards de paramètres entraîné en Europe. Les poids de ce modèle open-weight seront publiés le 27 octobre.

Mistral Large 4, dit ML4, est là, et la start-up française n'a pas fait les choses à moitié, en indiquant que son nouveau modèle d'IA open-weight, ouvert en préversion ce mardi 6 octobre, aligne tout simplement… 1 000 milliards de paramètres. Mistral, qui lui a même donné un petit surnom, « le Chonk », le dit taillé pour la cyberdéfense, la finance ou l'industrie, et ose le mesurer à GPT-6 Astra sur quelques épreuves soigneusement choisies. Surtout, quand Google et Anthropic rationnent l'accès à leurs modèles les plus sensibles, Mistral s'apprête à distribuer les poids du sien d'ici trois semaines.
Mistral Large 4, un mastodonte de l'IA forgé en Europe
Le surnom du nouveau modèle de Mistral n'est pas volé. Dans l'argot d'Internet, un « chonk » désigne un chat bien en chair, et on peut dire que ML4 affiche un sacré tour de taille, avec ses 1 000 milliards de paramètres. Ces paramètres, qu'on appelle aussi « poids », sont les valeurs que le modèle ajuste pendant son entraînement. ML4 ne les sollicite pourtant jamais tous à la fois, car pour chaque mot qu'il lit ou écrit, seuls 49 milliards entrent en jeu, comme une rédaction de 50 journalistes où l'on ne mobiliserait que cinq personnes sur le sujet. Le modèle garde ainsi la culture d'un géant, sans réclamer la puissance de calcul qui va avec, et c'est plutôt bien vu. Une fois ses poids publiés, Mistral le place en tout cas parmi les meilleurs modèles ouverts de la planète, et nettement devant tous ceux conçus hors de Chine.
Pour façonner ce poids lourd, Mistral est parti de zéro, sans recycler un modèle existant. L'entraînement a été bouclé en deux mois. Il a mobilisé environ 4 000 puces NVIDIA Grace Blackwell, du matériel taillé pour l'IA, installées dans les propres datacenters européens de Mistral, là où tourne aussi la préversion. Dans cette zone d'hébergement européenne, la start-up maîtrise toute la chaîne, des serveurs jusqu'au modèle, sans dépendre d'aucun autre prestataire numérique. Multimodal, ML4 sait aussi bien lire un texte qu'analyser une photo ou un schéma. Il a été entraîné sur plus de 160 langues, dont toutes celles de l'Union européenne, et répond directement dans chacune, du luxembourgeois au coréen.
Pour l'essayer, il faudra prendre la direction Mistral Studio, la plateforme de Mistral destinée aux développeurs. Le modèle y est accessible via une API, qui permet de le brancher à ses propres logiciels. Et il est facturé à l'usage. Comptez 0,68 dollar par million de tokens envoyés, et 2,09 dollars par million de tokens générés. C'est moins cher que Mistral Medium 3.5, pourtant bien plus petit, facturé 1,50 et 7,50 dollars. ML4 peut en outre avaler jusqu'à un million de tokens d'un coup, de quoi lui confier plusieurs romans d'affilée. Les poids, ces fameux paramètres évoqués plus haut, seront publiés le 27 octobre, confirme la firme française. Toute personne qui dispose du matériel adéquat pourra alors les télécharger pour faire tourner ML4 sur ses serveurs.
D'ici là, le Chonk va continuer de s'affûter par apprentissage par renforcement, une méthode où l'IA progresse en étant « récompensée » pour ses bonnes réponses. La version testée aujourd'hui n'est donc pas tout à fait la version finale. Mistral promet aussi de détailler son architecture, ses tests de sécurité et son post-entraînement, c'est-à-dire la phase de finition qui transforme un modèle brut en assistant utilisable. Enfin, des partenaires (développeurs, responsables cybersécurité, autorités étatiques) pourront éprouver en conditions réelles une version moins bridée, plus permissive et aux capacités cyber étendues.

Cyberdéfense et benchmarks : Mistral Large 4 joue les trouble-fêtes
La cybersécurité est au cœur de l'annonce de Mistral, et on peut même dire que tout ça prend une tournure politique. Les modèles d'IA les plus avancés sont devenus si doués pour manipuler du code et des systèmes informatiques que leurs créateurs marchent sur des œufs. Google réserve pour l'instant Gemini 4 Argon à des experts de la cyberdéfense triés sur le volet, et Anthropic cantonne Mythos 5.1 à des organisations vérifiées. C'est pour ça que Mistral publiera les poids de son modèle, que chacun pourra installer et faire tourner chez soi. La société estime qu'une IA fermée ne fonctionne que sur les serveurs de son éditeur, qui en fixe seul les règles. S'il décide un jour d'en restreindre l'usage ou d'en couper l'accès, les entreprises et les États qui s'en servent pour se protéger des cyberattaques se retrouvent démunis du jour au lendemain. Guillaume Lample, le cofondateur et directeur scientifique de Mistral, rappelle que des pirates parviennent déjà à piéger ces modèles fermés pour contourner leurs garde-fous et mener des attaques. Avec ML4, les défenseurs auraient à leur disposition une arme comparable.
Pour ce qui est des performances, Mistral prévient lui-même que ses chiffres sont préliminaires. En code agentique, sur le test DeepSWE, ML4 atteint 62 %, un point seulement devant le chinois GLM-5.3, et l'éditeur parle de réduire l'écart avec les modèles de pointe, pas de les doubler. Il affiche plus d'ambition en vision. Il dit ainsi surpasser GPT-6 Astra et Claude Fable 5.1 en grounding, l'art de pointer précisément un élément dans une image, même si l'un de ses propres graphiques montre une égalité avec GPT-6 Astra. Sur les vues satellites et aériennes, il se hisse parmi les meilleurs modèles ouverts, de quoi aider par exemple un assureur à évaluer les dégâts d'une tempête ou un agriculteur à surveiller ses cultures.
Le reste du bulletin de Mistral vise les métiers. En finance, ML4 atteint 67 % sur le test Finch, contre 37 % pour Mistral Medium 3.5, à égalité avec DeepSeek-V4-Pro. En droit, il signe le meilleur score des modèles ouverts sur le banc d'essai d'Harvey, avec 15 %, preuve que l'exercice reste coriace pour tout le monde.
Ce lancement est en tout cas le premier gros coup de Mistral après sa levée de fonds historique menée le mois, de 3 milliards d'euros lors de sa Série D, le plus gros tour de table jamais bouclé par une entreprise tech européenne. L'annonce fut faite avec la promesse d'investir dans la recherche et la puissance de calcul. ML4 en est le résultat concret, et il vise pour le moment les entreprises. Mistral en compte déjà plus de 125 parmi ses clients, comme Airbus ou HSBC. Ces firmes pourront bientôt installer le modèle sur leurs propres serveurs, ou l'utiliser à distance depuis la région du monde de leur choix. Cela inclut une zone européenne où leurs données restent soumises au seul droit de l'Union.