Alibaba will ein Modell mit zehn Billionen Parametern und eigene Chips, um es zu trainieren
Auf seiner Apsara-Konferenz sagte CEO Eddie Wu, Alibaba plane einen Qwen-Nachfolger mit 5 bis 10 Billionen Parametern und stellte den Zhenwu V900-Chip vor, der nach Angaben des Unternehmens die Leistung seines Vorgängers verdreifacht.
Auf der jährlichen Apsara-Konferenz von Alibaba Cloud in Hangzhou stellte CEO Eddie Wu einen Plan mit zwei Hälften vor, die nur zusammen Sinn ergeben. Das erste ist ein Modell: ein Nachfolger von Qwen im Bereich von 5 bis 10 Billionen Parametern, gegenüber rund 2,4 Billionen beim aktuellen Flaggschiff, also zwei- bis viermal größer. Qwen 4 befindet sich bereits im Training, wobei Qwen 4.5 und Qwen 5 auf diese Größenordnung abzielen. Die zweite Hälfte ist die Hardware, um es auszuführen. Alibaba stellte den Zhenwu V900 vor, einen KI-Beschleuniger seiner hauseigenen Chipeinheit T-Head, der nach Angaben des Unternehmens die dreifache Rechenleistung seines Vorgängers M890 liefert und in Clustern von bis zu 500.000 Einheiten verkabelt werden kann. Die Massenproduktion ist für das erste Quartal 2027 geplant. Wu hat Alibaba Cloud außerdem bis 2032 eine Rechenzentrumskapazität von 20 Gigawatt zugesagt und damit die zuvor angekündigten dreijährigen KI-Ausgaben von 53 Milliarden Dollar verlängert. In Hongkong stiegen die Aktien.
Was steckt dahinter
Parameter sind die einstellbaren Zahlen innerhalb eines Modells, die Dinge, die das Training abstimmt, und mehr davon bedeuten im Allgemeinen mehr Kapazität zum Speichern und Kombinieren von Mustern. Der Zusammenhang mit der tatsächlichen Nützlichkeit ist viel lockerer, als die Schlagzeile vermuten lässt, und die meisten Labore haben in den letzten zwei Jahren mehr aus den Modellen herausgeholt, anstatt einfach nur größere zu bauen. Ein Sprung auf 10 Billionen lässt sich also am besten als Absichtserklärung zur Rechenleistung und nicht als Qualitätsversprechen lesen.
Der Chip ist die konsequentere Ankündigung. Die US-Exportkontrollen haben eingeschränkt, welche Nvidia-Teile chinesische Unternehmen kaufen dürfen, und die Reaktion der gesamten chinesischen Industrie bestand darin, inländische Alternativen zu entwickeln. Ein 500.000-Karten-Cluster-Ziel ist die Zahl, die hier zählt, denn beim Training im Grenzbereich geht es weniger um die Geschwindigkeit eines einzelnen Chips als vielmehr darum, ob man Hunderttausende davon als eine Maschine arbeiten lassen kann, ohne dass das Ganze umfällt. Ob der V900 tatsächlich liefert, ist unbekannt: Der Leistungsanspruch liegt bei Alibaba, es gibt kein unabhängiges Benchmarking und das Teil geht erst in zwei Quartalen in die Massenproduktion. Man sollte die 20-Gigawatt-Zahl im Auge behalten, denn Strom und nicht Silizium wird zum eigentlichen Hemmnis für diese Branche.
Was das für Sie bedeutet: Dieses Jahr werden Sie nichts bemerken. Der Grund, darauf zu achten, besteht darin, dass viele der kostenlosen, herunterladbaren Modelle aus der Qwen-Familie stammen, sodass die Rechenpläne von Alibaba letztlich bestimmen, was jeder nutzen kann, ohne ein Abonnement zu zahlen. Es gibt hier auch einen ruhigeren Punkt darüber, wie diese Ankündigungen funktionieren. Ein Modell, das es nicht gibt, ein Chip, der nicht produziert wird, und ein Ausbau, der im Jahr 2032 abgeschlossen sein wird, sind alles echte Pläne, und keines davon ist ein Produkt. Es lohnt sich, Roadmap-News und versendete News in verschiedenen mentalen Ordnern aufzubewahren.
Quellen
Ein 125-Milliarden-Parameter-Modell auf einer gewöhnlichen Grafikkarte
Tim Dettmers gab einen Ausblick auf die Open-Source-Woche seines Labors: ein Inferenz-Framework, auf dem Qwen 3.8 Flash Next auf einer einzelnen 24-GB-GPU läuft, DeepSeek V4.1 auf einem MacBook und eine Komprimierungstechnik, die seiner Meinung nach die Agentenkosten halbiert.