CourionAI
FR
Newsletter
← Toutes les actus
china 3 min de lecture

Alibaba veut un modèle de dix mille milliards de paramètres et ses propres puces pour le former

Lors de sa conférence Apsara, le PDG Eddie Wu a déclaré qu'Alibaba prévoyait un successeur Qwen de 5 à 10 000 milliards de paramètres et a dévoilé la puce Zhenwu V900, qui, selon la société, triple les performances de son prédécesseur.

Une puce électronique vue d'en haut représentée comme un réseau urbain dense avec des tours s'élevant en son centre

Lors de la conférence annuelle Apsara d’Alibaba Cloud à Hangzhou, le directeur général Eddie Wu a présenté un plan en deux moitiés qui n’ont de sens qu’ensemble. Le premier est un modèle : un successeur du Qwen dans une fourchette de 5 à 10 000 milliards de paramètres, contre environ 2 400 milliards pour le vaisseau amiral actuel, soit deux à quatre fois plus grand. Qwen 4 est déjà en formation, Qwen 4.5 et Qwen 5 étant ceux qui visent cette échelle. La seconde moitié est le matériel pour l’exécuter. Alibaba a dévoilé le Zhenwu V900, un accélérateur d’IA issu de son unité de puces interne T-Head, qui, selon la société, offre trois fois la puissance de traitement de son prédécesseur, le M890, et peut être connecté en clusters allant jusqu’à 500 000 unités. La production de masse est prévue pour le premier trimestre 2027. Wu a également engagé Alibaba Cloud à 20 gigawatts de capacité de centre de données d’ici 2032, prolongeant ainsi une dépense triennale en IA de 53 milliards de dollars précédemment annoncée. Les actions ont augmenté à Hong Kong.

Qu’est-ce qu’il y a derrière ça

Les paramètres sont les nombres réglables à l’intérieur d’un modèle, les éléments d’entraînement, et un plus grand nombre d’entre eux signifie généralement plus de capacité à stocker et à combiner des modèles. La relation avec l’utilité réelle est beaucoup plus lâche que ne le suggère le chiffre principal, et la plupart des laboratoires ont passé les deux dernières années à tirer le meilleur parti des modèles plutôt que de simplement en construire de plus grands. Ainsi, un saut à 10 000 milliards doit être lu comme une déclaration d’intention en matière de calcul, et non comme une promesse de qualité.

La puce est l’annonce la plus conséquente. Les contrôles américains à l’exportation ont limité les pièces Nvidia que les entreprises chinoises peuvent acheter, et la réponse de l’industrie chinoise a été de créer des alternatives nationales. Un objectif de cluster de 500 000 cartes est le nombre qui compte ici, car la formation à l’échelle frontière concerne moins la vitesse d’une seule puce que la question de savoir si vous pouvez en faire fonctionner des centaines de milliers comme une seule machine sans que l’ensemble ne s’effondre. On ne sait pas si le V900 tient réellement ses promesses : les performances revendiquées appartiennent à Alibaba, il n’y a pas d’analyse comparative indépendante et la pièce n’entrera pas en production de masse avant deux trimestres supplémentaires. Le chiffre de 20 gigawatts est celui à surveiller, car l’électricité, et non le silicium, devient la véritable contrainte de cette industrie.

Ce que cela signifie pour vous : Vous ne remarquerez rien cette année. La raison pour laquelle il faut prêter attention est que la famille Qwen est à l’origine d’un grand nombre de modèles téléchargeables gratuitement, de sorte que les plans de calcul d’Alibaba finissent par façonner ce que tout le monde peut exécuter sans payer d’abonnement. Il y a également un point plus discret ici sur le fonctionnement de ces annonces. Un modèle qui n’existe pas, une puce qui n’est pas en production et une construction qui se terminera en 2032 sont autant de projets réels, et aucun d’entre eux n’est un produit. Cela vaut la peine de conserver les actualités de la feuille de route et les actualités expédiées dans différents dossiers mentaux.

Sources

Sources: https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/

Article suivant

Un modèle de 125 milliards de paramètres sur une carte graphique ordinaire

Tim Dettmers a présenté en avant-première la semaine open source de son laboratoire : un framework d'inférence exécutant Qwen 3.8 Flash Next sur un seul GPU de 24 Go, DeepSeek V4.1 sur un MacBook et une technique de compactage qui, selon lui, réduit de moitié les coûts des agents.

Une énorme sphère compressée et déformante pour tenir dans une petite boîte de bureau