Surnommée "Le Chonk", l'IA à poids ouverts de Mistral affirme être la plus puissante hors de Chine, misant sur la "souveraineté" européenne dans une course États-Unis-Chine.
Le champion français de l'intelligence artificielle Mistral AI a lancé mardi une préversion publique d'un nouveau modèle de pointe, qui, selon l'entreprise, sera le modèle open-weight le plus performant développé en dehors de la Chine une fois que ses poids auront été publiés.
Ce lancement intervient alors que la course autour des IA open-weight, dont les paramètres peuvent être téléchargés et exécutés par n'importe qui, prend une dimension géopolitique.
Les développeurs chinois donnent le tempo, tandis que de nombreuses entreprises américaines, comme OpenAI, gardent leurs systèmes les plus performants fermés. Dans le même temps, le débat sur la sécurité s'intensifie depuis que des agents d'IA se sont révélés capables d'agir de manière incontrôlable et de pirater des sites web.
Mistral parie que son nouveau modèle open-weight, baptisé ML4, doté de solides capacités de défense, séduira les clients qui souhaitent une alternative européenne construite autour de la "souveraineté".
Voici ce qu'il faut savoir sur ce modèle.
ML4, surnommé "Le Chonk", que l'on peut traduire par 'le gros massif', représente "une nouvelle génération de modèles", a déclaré Guillaume Lample, directeur scientifique et cofondateur de Mistral, lors d'une conférence de presse à laquelle Euronews a assisté.
Le modèle est centré sur la cybersécurité et les capacités de défense, que l'entreprise affirme plus solides que celles de ses concurrents chinois.
"Les capacités de cyberdéfense permettront aux entreprises et aux gouvernements de se protéger contre des acteurs malveillants qui contournent les protections de modèles fermés pour mener des cyberattaques", a déclaré Lample.
Le lancement de Mistral intervient un jour seulement après celui de Reflection, une start-up américaine, qui a présenté Beam comme son premier modèle open-weight et un contrepoids occidental aux modèles ouverts chinois. Ses poids doivent être publiés plus tard ce mois-ci, et ses performances n'ont pas encore été vérifiées de manière indépendante.
Les agents d'IA incontrôlables
Pierre Stock, premier salarié de Mistral et vice-président chargé des sciences, a estimé que construire un nouveau modèle d'IA, c'est "comme construire un vaisseau spatial".
Il a expliqué que toutes les entreprises d'IA "avancent à pleine vitesse". Bien que Mistral n'ait que trois ans, elle "comble clairement l'écart" avec ses concurrents et, sur certains aspects, son nouveau modèle est "fondamentalement plus solide que les modèles chinois de cet été", a-t-il ajouté.
Le mois dernier, l'entreprise a annoncé avoir levé 3 milliards d'euros pour une valorisation de plus de 21 milliards d'euros, ce qu'elle présente comme la plus importante levée de fonds en actions jamais réalisée par une société technologique européenne.
La sortie du modèle intervient aussi au moment où des entreprises d'IA signalent des agents agissant de manière autonome et piratant des sites web.
Stock a estimé que cela a permis aux entreprises américaines de "commercialiser des 'événements incontrôlables'" en présentant la situation comme "seuls quelques acteurs de confiance peuvent prendre en charge cette technologie".
Il a ajouté que "le monopole est contrôlé par les Américains, mais que les modèles open-weight permettent aux gens d'y accéder".
L'entreprise affirme aussi que son modèle devance les autres open-weight sur les tâches de fabrication et de finance ainsi que sur les usages multimodaux, et qu'en programmation elle comble l'écart avec les autres modèles de pointe. Mistral revendique en outre les meilleurs résultats de tous les modèles — y compris fermés — en matière de grounding et des performances de tout premier plan sur les benchmarks des semi-conducteurs.
La société française précise que ML4 va encore progresser, car l'entraînement n'est pas terminé et l'apprentissage par renforcement doit s'achever dans les prochains jours.
Conçu en Europe
Mistral indique que ML4 a été entraîné depuis zéro pendant deux mois sur 4 000 GPU NVIDIA Grace Blackwell, dans ses propres centres de données européens.
ML4 couvre plus de 160 langues, dont toutes les langues officielles de l'Union européenne (UE), et fonctionne avec des écritures latines et non latines.
Quand sera-t-il disponible ?
Le modèle est désormais accessible via l'API de Mistral sur Mistral Studio. Mistral prévoit de publier les poids le 27 octobre.
D'ici là, les développeurs, les responsables de la cybersécurité et les autorités publiques pourront tester le modèle dans des conditions réelles.