ModèlesPopulaire

Mistral Large 4 (Le Chonk) : la preview du modèle 1T aux poids ouverts

Mistral présente son nouveau modèle amiral, un modèle multimodal de 1 000 milliards de paramètres. Pour l'instant, seule l'API d'aperçu est accessible : les poids ne seront publiés qu'à la fin du mois.

Julien MartinJulien Martin
Popularité : 1,600
Mistral Large 4 (Le Chonk) : la preview du modèle 1T aux poids ouverts

Mistral dévoile en avant-première son modèle le plus imposant : un milliard de milliards de paramètres, entraîné en Europe, dont les poids seront publiés avant la fin du mois. Un pari autant technique que politique.

Mistral Large 4 : ce que contient réellement « Le Chonk »

La société parisienne a présenté le 6 octobre Mistral Large 4, son nouveau modèle amiral, livré pour l'instant sous forme d'aperçu public. Son nom de code interne, « Le Chonk », poursuit une blague qui traînait sur les réseaux depuis juin autour d'un chaton obèse imaginaire. Cette fois, le clin d'œil recouvre un vrai modèle.

Les chiffres donnent le vertige : 1 000 milliards de paramètres (certains décomptes parlent de 1 050 milliards), dont 49 milliards seulement sont activés à chaque token généré. Autrement dit, une immense capacité dormante, dont une infime part travaille à chaque réponse. Cette architecture dite « mixture of experts » garde le gros du réseau en réserve. Et le modèle encaisse du texte comme des images en entrée, mais ne rend que du texte.

L'entraînement a mobilisé environ 4 000 GPU Nvidia Grace Blackwell, installés dans les propres centres de données européens de Mistral. La société insiste sur ce point : elle veut faire la démonstration qu'un laboratoire du continent peut viser la frontière technologique sans les moyens des géants américains. Un vrai pari. À titre de comparaison, le précédent modèle de la gamme, Mistral Large 3, avait utilisé 3 000 GPU H200.

Mistral met aussi en avant la couverture linguistique. Le modèle a été entraîné sur plus de 160 langues, dont toutes les langues officielles de l'Union européenne. Une manière de rappeler son ancrage européen au moment où la question de la souveraineté numérique revient dans le débat politique.

Le pari des poids ouverts, et pourquoi il compte

Le point qui distingue Mistral Large 4 de la plupart des modèles frontière : ses poids seront publiés. Pas immédiatement, mais à la fin du mois d'octobre, après une période de test de quelques semaines avec des développeurs, des responsables de la cybersécurité et des autorités publiques. La page Hugging Face fait état du 31 octobre comme date visée.

Rendre les poids accessibles change la donne pour les entreprises. Concrètement, elles téléchargent le modèle, l'hébergent sur leurs propres serveurs et l'adaptent à leurs besoins, au lieu de dépendre d'une API étrangère. Mistral positionne explicitement cette option pour les organisations qui veulent des infrastructures souveraines, avec la possibilité de zéro rétention de données. Un vrai argument pour une administration ou un hôpital, qui évitent ainsi d'envoyer des documents sensibles chez un fournisseur tiers.

La société annonce par ailleurs que Mistral Large 4 atteint les meilleurs résultats parmi les modèles à poids ouverts d'Europe et des États-Unis sur des benchmarks agrégés, et qu'il dépasse même certains modèles frontière fermés sur des tâches précises, comme le repérage visuel d'objets. Ces comparaisons restent toutefois des revendications de l'éditeur, pas des mesures validées de façon indépendante.

Où Mistral Large 4 se place face à la concurrence

Le modèle vise d'abord les usages professionnels exigeants : la cybersécurité, la finance, le droit et l'industrie manufacturière. Mistral affirme y atteindre l'état de l'art parmi les modèles ouverts pendant la phase d'aperçu. Sur le papier, cela le met en concurrence directe avec les grandes familles chinoises récemment dévoilées, que les observateurs citent souvent pour situer le niveau réel du modèle.

Dimension

Mistral Large 4

Paramètres totaux

1 000 milliards

Paramètres actifs

49 milliards

Type d'entrée

texte et images

Type de sortie

texte

Langues couvertes

plus de 160

Poids ouverts

attendus fin octobre

Entraînement

environ 4 000 GPU Grace Blackwell

Le tarif de l'API d'aperçu, disponible dans Mistral Studio, reste la principale inconnue pour les équipes qui voudraient tester le modèle dès maintenant. Mistral n'a pas communiqué de grille publique lors de l'annonce.

Deux lectures s'affrontent à ce stade. Ses partisans y voient exactement ce qui manquait : un modèle frontière réellement ouvert, entraîné en Europe, qui permettrait au continent de maîtriser sa propre pile technologique. Ses détracteurs pointent l'inverse. Mille milliards de paramètres, ça reste lourd à héberger. Le cercle de ceux qui pourront l'exploiter en local est donc étroit, et les performances annoncées attendent une confirmation hors des tests de l'éditeur.

Ce qu'il faut retenir avant fin octobre

Mistral Large 4 n'est donc pas un produit fini. C'est une mise sur la table. Le modèle frappe par ses chiffres et par son orientation : un laboratoire européen qui vise la frontière, avec une promesse de poids ouverts et un discours sur la souveraineté. Les prochaines semaines diront si les performances tiennent quand des tiers les mesureront, et si la date de publication des poids est respectée.

D'ici là, la seule chose réellement utilisable pour un développeur passe par l'API d'aperçu dans Mistral Studio. Les équipes qui attendent la version téléchargeable doivent surveiller l'échéance de fin octobre, sachant qu'une licence maison, plutôt qu'open source classique, encadrera probablement l'usage des poids. Une chose est sûre : le suspense durera jusqu'au bout.

Partager cet article

Sources

Actualités liées à l’IA

GPT-6 débarque sur ChatGPT avec Intelligent UI, gratuit compris
Modèles

GPT-6 débarque sur ChatGPT avec Intelligent UI, gratuit compris

OpenAI déploie GPT-6 auprès de tous les utilisateurs de ChatGPT, y compris la version gratuite, avec Intelligent UI qui transforme les réponses en interfaces manipulables.

Popularité : 1,700
Claude Haiku 5.5 : Anthropic divise la facture du petit modèle par quatre
Modèles

Claude Haiku 5.5 : Anthropic divise la facture du petit modèle par quatre

Anthropic lance Claude Haiku 5.5, son petit modèle le plus rapide à ce jour. Son exploitation coûte environ 75 % moins cher que Haiku 4.5, et Sonnet 5.5 voit aussi son cache baisser de moitié.

Popularité : 1,500
Nano Banana 2.1 : moitié prix, 23 jours pour migrer
Modèles

Nano Banana 2.1 : moitié prix, 23 jours pour migrer

Google lance Nano Banana 2.1 et divise presque par deux le tarif de ses images générées, mais augmente le coût des entrées. L'ancien modèle disparaît le 29 octobre.

Popularité : 1,300
Beam de Reflection AI : le modèle ouvert de 501 B pensé pour le code
Modèles

Beam de Reflection AI : le modèle ouvert de 501 B pensé pour le code

Beam est le premier modèle à poids ouverts de Reflection AI : 501 milliards de paramètres qui frôlent des systèmes chinois bien plus gros sur les tests de code. Les poids et la pile d'affinage sont annoncés pour la fin du mois.

Popularité : 1,250