Taalas
Une start-up de puces de Toronto qui grave un modèle d'IA précis directement dans le silicium, rachetée par AMD en août 2026.
Taalas a été fondée à Toronto en 2023 et est sortie de l’ombre en février 2026 avec une proposition à contre-courant. Plutôt que de construire une puce généraliste capable d’exécuter n’importe quel modèle, elle grave l’architecture et les poids entraînés d’un seul modèle directement dans le matériel. Le gain, c’est la vitesse: une puce de démonstration faisant tourner Llama 3.1-8B a dépassé 16 000 tokens par seconde et par utilisateur, bien au-delà du matériel d’inférence classique. Le prix à payer, c’est une rigidité totale, puisque cette puce ne pourra jamais exécuter autre chose.
AMD a annoncé son rachat en août 2026, avec l’intention d’intégrer la technologie à sa feuille de route d’accélérateurs et de la vendre aux côtés de ses GPU Instinct. Le pari derrière l’opération: les meilleurs modèles restent désormais en service assez longtemps, et traitent assez de trafic, pour justifier qu’on leur consacre du silicium physique. Google poursuivrait la même idée pour Gemini.