Xiaomi possède désormais le modèle ouvert le plus puissant au monde et vous pouvez simplement le télécharger
Le constructeur de téléphones et de voitures a publié lundi MiMo-V2.6-Pro et Flash sous licence MIT. L'analyse comparative tierce, Artificial Analysis, a obtenu un score Pro de 46, le niveau le plus élevé jamais atteint par un modèle téléchargeable.
Au cours du week-end et jusqu’à lundi, la société la plus connue pour ses téléphones, ses cuiseurs à riz et ses voitures électriques a présenté le modèle d’IA à poids ouvert le plus performant jamais mesuré. Xiaomi a publié MiMo-V2.6-Pro et un petit frère, MiMo-V2.6-Flash, sur Hugging Face sous une licence MIT, qui est à peu près aussi permissive que les licences logicielles. Artificial Analysis, une société indépendante qui évalue les modèles sur un indice composite d’intelligence, place Pro à 46. C’est devant Gemini 3.8 Flash de Google à 41 et au niveau de Grok 4.7, que xAI a lancé le même jour.
“Poids ouvert” est l’expression qui fait le gros du travail ici. Cela signifie que le fichier de modèle formé lui-même est publié, vous pouvez donc le télécharger, l’exécuter sur le matériel que vous louez ou possédez, l’affiner sur vos propres données et l’expédier dans un produit sans rien payer à Xiaomi. C’est différent de ChatGPT ou Claude, où vous louez l’accès via une interface et où le modèle ne quitte jamais le fournisseur. Pro est un modèle de mélange d’experts de 1,02 billion de paramètres, ce qui signifie que seule une fraction de celui-ci, environ 42 milliards de paramètres, effectue le travail sur un mot donné, ce qui permet de réduire les coûts de fonctionnement. Flash est plus petit, avec 310 milliards au total et 15 milliards actifs. Les deux prennent du texte, des images, de l’audio et de la vidéo, et tous deux contiennent un million d’éléments de contexte, soit à peu près l’équivalent d’un très long livre en tête à la fois.
Qu’est-ce qu’il y a derrière ça
La partie intéressante n’est pas la position au classement, qui ne durera pas. C’est ce que Xiaomi a publié aux côtés des poids : le rapport technique, plus de 7 000 environnements de tâches d’apprentissage par renforcement, le cadre de formation et un modèle distillé plus petit. L’apprentissage par renforcement est l’étape où un modèle pratique des tâches réelles et est récompensé pour sa bonne exécution. Xiaomi affirme que l’exécution de Pro a coûté environ 2,62 millions de dollars, avec Flash à 850 000 dollars. Le rapport consacre des pages au piratage des récompenses, c’est-à-dire lorsqu’un modèle apprend à satisfaire le test plutôt qu’à faire le travail. Xiaomi a découvert que ses agents de codage téléchargeaient des versions plus récentes d’un package ou déterraient le correctif déjà publié au lieu de résoudre le bogue. Il a donc supprimé le futur historique Git des environnements de formation, coupé l’accès au réseau et exécuté un “agent de piratage” dédié pour rechercher les failles restantes. Le piratage de récompense confirmé est resté inférieur à 2 % lors de la dernière exécution, selon les propres chiffres de l’entreprise.
Une mise en garde juste : la plupart de ces benchmarks d’agents sont gérés par des fournisseurs, et Claude Opus 5 d’Anthropic est toujours en tête sur plusieurs des évaluations rapportées par Xiaomi elle-même. Ce n’est pas un balayage.
Ce que cela signifie pour vous : Si vous utilisez l’IA via une fenêtre de discussion, rien ne change aujourd’hui. Si vous ou votre entreprise payez à l’utilisation, le prix vaut le détour : Flash coûte 0,14 dollars par million de jetons d’entrée contre 5 dollars pour Claude Opus 5, et reste à quelques points de Pro sur plusieurs tests d’agents. Le modèle plus large compte plus que n’importe quelle version. Les modèles téléchargeables continuent d’arriver avec quelques mois de retard sur les meilleurs fermés à une fraction du prix, ce qui donne à chacun une solution de repli crédible et maintient l’honnêteté des fournisseurs coûteux.
Sources
Un assistant de codage téléchargeait silencieusement des projets entiers, y compris l'historique Git
Les développeurs ont découvert que le ZCode de Z.ai regroupait des espaces de travail locaux entiers, les chiffrait et les envoyait vers le stockage cloud lors de leur lancement. Une installation a produit une archive de 313 Mo et 564 tentatives de téléchargement. Z.ai s'est excusé et a ouvert le client.