Mistral sort l’artillerie lourde pour rester dans la course à l'IA. L'entreprise française vient de présenter Mistral Large 4, surnommé « Le Chonk », son plus imposant modèle à ce jour. L'entreprise vante une nouvelle génération comptant environ 1 000 milliards de paramètres, dont 49 milliards sont activés pour chaque requête. Si elle n'est pas encore au niveau d'OpenAI ou d'un Alibaba, son co-fondateur Guillaume Lample a expliqué au Monde que Large 4 était « essentiellement au même niveau que les meilleurs modèles chinois d’il y a un mois ou deux ».

Le bond est conséquent par rapport à Mistral Large 3, dévoilé fin 2025 et qui ne comptait « que » 675 milliards de paramètres au total pour 41 milliards actifs. Mistral affirme avoir entraîné cette révision de zéro pendant environ deux mois dans ses propres centres de données européens, et a fait appel à 4 000 GPU Nvidia Grace Blackwell. Le modèle a par ailleurs été entraîné sur plus de 160 langues, dont toutes les langues officielles de l’Union européenne, et prend en charge aussi bien les alphabets latins que non latins.
Large 4 est toujours multimodal et peut donc travailler aussi bien sur du texte que sur des images. Sa fenêtre de contexte monte à un million de tokens, ce qui lui permet de pouvoir ingérer de très gros volumes de documents ou de code en une seule fois. Mistral met surtout l’accent sur les usages professionnels, dans des domaines comme le développement logiciel, l'analyse financière, la gestion de documents techniques ou encore la cybersécurité. Sur plusieurs tests publiés par l’entreprise, Large 4 se rapproche des meilleurs modèles propriétaires et se place parmi les modèles à poids ouverts les plus performants. On prendra ces résultats avec les pincettes d'usage (d’autant plus que le modèle est encore en préversion), mais les promesses sont là.
La cybersécurité occupe une place importante dans cette annonce, et Mistral explique avoir conçu Large 4 pour pouvoir analyser des vulnérabilités, reproduire certaines attaques ou aider à préparer des correctifs. Pendant la phase de préversion, des spécialistes de la sécurité et des développeurs auront accès à une variante moins restrictive que celle proposée au grand public via l’API. L’entreprise dit vouloir profiter de cette période pour observer le comportement du modèle en conditions réelles et le renforcer.

Mistral prévoit de publier les poids de Large 4 d’ici la fin du mois d’octobre. Le modèle pourra alors être déployé sur l’infrastructure de ses clients, en plus de l’offre hébergée par Mistral. L’entreprise insiste sur cette possibilité de garder le contrôle du modèle et des données, notamment en les faisant tourner sur une infrastructure européenne. Large 4 deviendra également le modèle « par défaut » de Vibe, l’assistant de l’entreprise (anciennement Le Chat).














