Mistral dévoile Le Chonk, un modèle ouvert d'un billion de paramètres
Mistral a publié en aperçu Mistral Large 4, surnommé Le Chonk, un modèle ouvert d'un billion de paramètres que l'entreprise française présente comme le plus performant développé hors de Chine. Le modèle, optimisé pour le code, la cyberdéfense et plusieurs secteurs industriels, doit être finalisé d'ici la fin du mois.

Dans cet article
Un modèle ouvert d'un billion de paramètres
Mistral a mis à disposition un nouveau modèle librement accessible, Mistral Large 4, surnommé Le Chonk, selon Wired. Doté d'un billion de paramètres, il peut être utilisé et personnalisé par n'importe qui. Une version d'aperçu est déjà en ligne, la version définitive étant attendue avant la fin du mois.
Le modèle est conçu pour rivaliser avec les principaux modèles généralistes, mais il est optimisé en priorité pour le code et la cyberdéfense, ainsi que pour des tâches propres à l'industrie manufacturière, à la finance, à l'ingénierie électrique et à d'autres niches.
« Il y a beaucoup de domaines sur lesquels les autres laboratoires ne se concentreront pas autant », déclare à Wired Guillaume Lample, cofondateur et scientifique en chef de Mistral. « Il y a tellement de domaines dans lesquels on peut améliorer les modèles. »
Une alternative aux modèles propriétaires et chinois
Mistral présente Le Chonk comme le modèle à poids ouverts le plus performant développé en dehors de la Chine, et « très, très proche » de certains modèles propriétaires. Alors que les laboratoires chinois sont accusés par le gouvernement américain de recourir abusivement à la distillation — l'entraînement d'un petit modèle sur les sorties d'un plus grand — pour combler leur retard sur OpenAI et Anthropic, Mistral affirme avoir entraîné son modèle à partir de zéro.
Pour les entreprises, l'exploitation de modèles à poids ouverts coûte déjà nettement moins cher, puisqu'elle se limite au coût de calcul consommé. En réduisant l'écart de performance avec les principaux modèles propriétaires et en offrant une alternative aux offres chinoises, Le Chonk supprimerait, selon Mistral, les dernières raisons qu'une entreprise pourrait avoir d'hésiter à choisir l'open source.
« Mistral est toujours dans la course pour obtenir le meilleur modèle », affirme Guillaume Lample. « C'est le message principal. »
Un contexte favorable pour le laboratoire français
Disposant de moins de capitaux et de ressources de calcul qu'OpenAI et Anthropic, Mistral a généralement été distancé sur la performance des modèles, les revenus et la fréquence des sorties. Là où les laboratoires américains facturent un prix élevé l'accès à leurs modèles propriétaires, Mistral génère des revenus en facturant à l'usage l'exécution de ses modèles dans son cloud et en déployant des ingénieurs pour aider les clients à les ajuster à leurs besoins.
Le laboratoire français connaît toutefois une période faste : en septembre, il a levé 3,3 Md$ lors d'un tour de table valorisant l'entreprise à 24 Md$, la plus importante levée jamais réalisée par une société technologique européenne. Ses revenus auraient été multipliés par 20 environ au cours de l'année écoulée.
Cette dynamique coïncide avec la montée des tensions entre les États-Unis et leurs alliés transatlantiques — sur les droits de douane, le Groenland ou encore la régulation des entreprises technologiques américaines — et avec un débat de plus en plus vif sur l'accès à l'IA de pointe.
En juin, l'administration Trump a imposé des restrictions temporaires à la diffusion des modèles d'OpenAI et d'Anthropic, invoquant le risque qu'ils soient détournés pour lancer des cyberattaques sophistiquées. Depuis, une série d'incidents ont été révélés, dans lesquels des modèles américains ont échappé à leurs contraintes et attaqué des entreprises ainsi que des institutions gouvernementales étrangères, alimentant des semaines de débat sur la régulation des sorties de modèles. La Maison-Blanche aurait demandé aux laboratoires américains de ne pas communiquer de modèles non publiés, même à l'AI Safety Institute britannique, qui avait auparavant contribué à évaluer les risques de sécurité.
« La stratégie continentale de l'UE pour gagner en souveraineté technologique… et l'hostilité accrue des États-Unis forment une formule magique qui place soudain Mistral — dont les performances n'ont pas été spectaculaires — dans une position favorable », déclarait à Wired en juillet Andrea Renda, directeur de la recherche au Centre for European Policy Studies.
La propriété du modèle comme argument
Refusant d'être cantonné à son marché intérieur, Mistral insiste sur le fait que l'absence de contrôle fin sur l'accès aux modèles d'IA peut poser problème où que soit implantée l'entreprise, y compris aux États-Unis. En s'appuyant sur un modèle propriétaire pour repousser les cybermenaces, une entreprise risque l'effondrement soudain de ses défenses, selon Guillaume Lample.
« Parfois, les gens aiment [monter en épingle] les États-Unis, l'Europe, la Chine. Mais ce qui compte vraiment, c'est de posséder le modèle — même pour les entreprises américaines », dit-il. « Si vous utilisez un modèle fermé, rien ne garantit qu'il sera encore là demain. »


