« Avec une avance considérable » : le Français Mistral envoie du lourd avec son nouveau modèle d’IA

En France, on n'a pas de pétrole, mais on a Mistral ! Malgré l'apparence lilliputienne de l'entreprise d'intelligence artificielle face aux géants américains, Mistral fait beaucoup avec peu. En dévoilant, hier, son nouveau modèle Mistral Large 4, alias Le Chonk, la société montre qu'elle peut rivaliser avec les grands, en déplaçant le débat vers l'efficacité, l'ouverture et la souveraineté technologique.
Avec plus de 1 000 milliards de paramètres, Mistral Large 4 peut désormais jouer dans la catégorie des monstres de l’IA. Mais à la différence de ses concurrents, le modèle n'a pas besoin de mobiliser une puissance de calcul colossale pour chaque requête.
L'astuce : malgré son gros cerveau, l'IA ne mobilise que seulement 49 milliards de paramètres pour les requêtes grâce à une architecture baptisée « Mixture of Experts ». Avec elle, plutôt que de faire travailler l'ensemble du modèle à chaque question, le système sélectionne « les experts » les plus pertinents en fonction de la demande. Ainsi, une question sur du code informatique n'activera pas exactement les mêmes experts qu'une question sur le droit ou l'analyse d'une image.
À l’occasion de la publication d’une nouvelle version de son modèle d’IA, l’un des cofondateurs de l’entreprise française Mistral IA s’est exprimé dans The New York Times sur la course à l’intelligence artificielle générale et la domination du secteur par les géants américains.... Lire la suite
Autre exploit : l'entraînement a été réalisé dans les data centers européens à partir de 3 800 GPU Nvidia Grace Blackwell. Une infrastructure considérable, mais minuscule comparée aux moyens mobilisés par les géants américains qui font tourner leur IA sur des capacités de calcul se comptant en gigawatts.
Selon l'Artificial Analysis Cyber Index, Mistral Large 4 est l'un des modèles d'IA les plus puissants en cybersécurité. © MistralLe meilleur des deux mondes
À défaut de disposer des légions de puces de la Silicon Valley, Mistral a cherché à compenser par l'efficacité de son modèle. Mais ce n'est pas la seule prouesse de la pépite française. La société a décidé de concilier deux univers pourtant difficiles à réunir.
D'un côté, les modèles propriétaires et très performants d'OpenAI ou d'Anthropic, accessibles essentiellement comme des services en ligne, mais dont les rouages restent sous le contrôle total de leurs créateurs. De l'autre, les modèles ouverts, notamment chinois, que les entreprises peuvent télécharger, installer et adapter sur leurs propres infrastructures. Entre les deux, il y a maintenant Mistral avec un modèle de très haut niveau dont les poids, c'est-à-dire les données numériques qui permettent au modèle de fonctionner et de restituer ce qu'il a appris, seront accessibles.
Après avoir été chercheur en intelligence artificielle, Arthur Mensch a cofondé Mistral AI, avec l'objectif de concurrencer les poids lourds américains et chinois dans la mise au point de grands modèles de langage.... Lire la suite
Une entreprise pourra ainsi télécharger le modèle, le faire tourner sur ses propres serveurs et garder la maîtrise de ses données, sans dépendre entièrement de l'infrastructure de Mistral. C'est plutôt rassurant. Autrement dit, Mistral propose le meilleur des deux mondes disponibles actuellement et c'est du « made in France ».
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.