GPU
Un puissant processeur conçu à l'origine pour le graphisme, aujourd'hui la puce de travail de l'IA moderne.
Un GPU, ou processeur graphique, est une puce conçue à l’origine pour afficher les graphismes des jeux vidéo. Sa capacité à effectuer de nombreux calculs en parallèle correspond exactement aux besoins de l’entraînement et de l’exécution des modèles d’IA, faisant des GPU le matériel de travail de l’IA moderne.
La demande ayant explosé, les GPU puissants sont chers et souvent rares ; en obtenir assez est une priorité stratégique de chaque grand laboratoire. Ils expliquent en partie pourquoi l’IA exige autant de capital et pourquoi exécuter des modèles sur son propre matériel, même un bon portable ou un Mac, offre une alternative attrayante et maîtrisée pour les petites charges.
Avec des puces spécialisées comme le TPU de Google, les GPU forment la base physique de la puissance de calcul qui alimente tout le secteur.
-
Réponse de Meta au temps GPU perdu : demandez à un modèle quelle expérience exécuter
-
Nvidia investit 3,5 milliards de dollars dans MediaTek pour conserver les puces personnalisées dans ses propres racks
-
Les poids du GLM-5.3 sont sortis, avec deux semaines de retard et après un examen de sécurité
-
Granite 4.2 d'IBM est gratuit, suffisamment petit pour fonctionner localement et conçu pour penser avant tout
-
Le GLM-5.3-Flash de Z.ai se rapproche d'Opus à un dixième du prix
-
Les nouvelles puces Mac d'Apple sont conçues pour une IA qui s'exécute sur votre bureau
-
OpenAI a construit sa propre puce et les premiers benchmarks sont bons
-
Anthropic a embauché l'homme qui a construit les puces IA de Google, et la raison n'est pas subtile
-
Le même modèle a obtenu 30 % seul et 100 % dans le système d'agent de Nvidia
-
Anthropic a laissé Claude seul avec 15 cibles protéiques pendant 48 heures, et les résultats du laboratoire sont revenus
-
Microsoft a dépensé 280 milliards de dollars en IA. Le Guardian a demandé où se trouvent les puces.
-
Une start-up de puces a doublé sa valeur en un mois en étant délibérément inflexible
-
Stop Asking Whether AI Is a Bubble. Start Reading the Lease Agreements.
-
Le créateur de Redis a créé un modèle vidéo chinois sur un Mac. Les Européens ne sont pas autorisés à l'utiliser
-
Mojo a atteint la version 1.0, trois ans après avoir promis de rendre Python rapide
-
Nvidia couvrira une partie de la perte si ses propres puces perdent de la valeur. C'est ainsi que vous récoltez 500 milliards de dollars.
-
Claude Code active l'Auto Mode par défaut et les numéros de sécurité ne sont pas ceux que vous devineriez
-
AMD achète Taalas, une startup qui intègre un modèle d'IA complet dans la puce
-
Meta livre Muse Code, un agent de codage qui continue de fonctionner après un crash
-
Quelqu'un a fait fonctionner DeepSeek V4 Flash en production sur une seule carte AMD et a publié tous les correctifs nécessaires
-
Qwen3.8-Max d'Alibaba a passé 16 jours à écrire un outil par lui-même, et les poids seront rendus publics la semaine prochaine
-
Le laboratoire de Mira Murati réduit son modèle aux trois dixièmes de sa taille et ne perd qu’un point
-
Microsoft renonce à courir après la frontière et mise sur de petits modèles spécialisés
-
OpenAI baisse de 80 % le prix de GPT-5.6 Luna sur fond de guerre tarifaire
-
Les poids de Kimi K3 sont enfin publics, et ils occupent 1,4 téraoctet
-
Avec 500 dollars d’entraînement, un modèle 9B surpasse tous les ténors sur une tâche ingrate
-
Ollama améliore discrètement l’exécution des modèles ouverts sur Mac
-
Microsoft et Mistral s’allient pour construire l’IA en Europe et y conserver les données
-
AMD et Cerebras s’associent pour accélérer les réponses de l’IA
-
Selon OpenAI, GPT-5.6 Sol a entraîné seul son petit frère Luna
-
Grok 4.5 arrive pour un tiers du prix, et cela pourrait compter davantage que les évaluations
-
Claude Science : Anthropic crée un atelier d’IA qui conserve les données de recherche sur vos propres machines