CourionAI
DE
Newsletter
← Alle News
ai-basics 2 Min. Lesezeit

AMD kauft Taalas, ein Startup, das ein komplettes KI-Modell in den Chip integriert

Taalas ätzt die Architektur und Gewichte eines Modells direkt in Silizium. Das macht es extrem schnell und völlig unflexibel. AMD möchte die Technologie neben seinen Instinct-GPUs haben.

Ein von oben gesehener Siliziumwafer mit einem dichten Schaltkreislabyrinth, der dauerhaft darin eingraviert ist, und einem einzigen Weg durch ihn hindurch, der in Korallen markiert ist

AMD kauft Taalas, ein kleines kanadisches Chip-Startup mit einer ungewöhnlichen Idee: Anstatt einen allgemeinen Chip zu bauen, der jedes KI-Modell ausführen kann, bauen Sie einen Chip, der genau eines davon ausführen kann, indem Sie dieses Modell direkt in die Hardware eingravieren. Der Deal wurde am Freitag bekannt gegeben und unterliegt den üblichen behördlichen Genehmigungen.

Zuerst ein bisschen Vokabular, denn dann ergibt der Rest einen Sinn. Wenn Ihnen ein KI-Modell antwortet, spricht man von Inferenz, im Gegensatz zum Training, bei dem es sich um den teuren einmaligen Prozess der Erstellung des Modells handelt. Inferenz geschieht millionenfach am Tag und verursacht daher den größten Teil der laufenden Kosten. Normalerweise lädt eine GPU die Gewichte des Modells, die Milliarden von Zahlen, die kodieren, was das Modell gelernt hat, aus dem Speicher und führt die Berechnungen durch. Das Hin- und Hermischen dieser Zahlen ist ein großer Teil dessen, was es langsam und leistungshungrig macht.

Taalas überspringt diesen Schritt, indem er die Architektur und die trainierten Gewichte in den Chip selbst einfügt. Das Unternehmen kam im Februar 2026 mit einem Demo-Chip mit Llama 3.1-8B mit mehr als 16.000 Token pro Sekunde und Benutzer aus der Tarnung heraus, was um ein Vielfaches schneller ist als konkurrierende Inferenzhardware. Ein Token ist ungefähr ein Wortfragment. Diese Zahl bedeutet also, dass Text viel schneller erscheint, als jeder ihn lesen kann. Der Haken liegt genau im Design: Auf diesem Chip läuft Llama 3.1-8B und nichts anderes, für immer. Neues Modell, neues Silizium.

Dieser Handel ist weniger seltsam, als er klingt. Chip-Design und -Herstellung dauern viele Monate, und bis vor Kurzem war ein Modell veraltet, bevor sein Chip eintraf. Da Spitzenmodelle nun länger im Einsatz sind und dieselben wenigen Modelle ein enormes Verkehrsaufkommen abdecken, beginnt die Bindung an die Hardware immer schwächer zu werden. Berichten zufolge arbeitet Google an demselben Trick mit einem Chip, der in die Architektur von Gemini integriert ist. AMD sagt, dass es die Technologie in seine Beschleuniger-Roadmap integrieren und sie zusammen mit seinen Instinct-GPUs als Produkt auf Systemebene anbieten wird. AMD AI-Chef Vamsi Boppana nannte es eine Stärkung des Portfolios, und Taalas-Mitbegründerin Ljubisa Bajic sagte, AMD bringe die Größe, die dem Startup fehlte.

Was das für dich bedeutet: Sie können nichts kaufen und nichts, was Ihren Chatbot diese Woche verändert. Was sich in den nächsten Jahren ändert, ist der Preis. Die Chips hinter den KI-Diensten werden im Stillen pro Antwort billiger und effizienter, und das ist der Hauptgrund dafür, dass die von Ihnen genutzten kostenlosen Kontingente immer großzügiger statt weniger werden. Es ist auch ein kleiner Hinweis darauf, in welche Richtung „KI auf Ihrem eigenen Gerät“ geht: kein Allzweck-Gehirn in Ihrem Telefon, sondern bestimmte Modelle, die in bestimmte Hardware integriert sind. Ein fairer Vorbehalt: Dies ist eine Akquisition, kein Produkt. Die Aufsichtsbehörden müssen es noch genehmigen, und morgen wird nichts versendet.

Quellen

Quellen: https://ir.amd.com/news-events/press-releases/detail/1296/amd-acquires-taalas-to-advance-compute-solutions-for-rapidly-growing-ai-inference-market

Nächster Artikel

TikTok-Besitzer ByteDance trainiert Berichten zufolge Chinas bisher größtes KI-Modell

Drei Insider sagten der Financial Times, dass ByteDance ein Modell mit bis zu zehn Billionen Parametern im Vortraining hat, dreimal so groß wie Kimi K3.

Eine riesige Gitterkuppel aus miteinander verbundenen Knotenpunkten im Bau, die die Kräne und Gerüste um sie herum winzig erscheinen lässt