Granite 4.2 d'IBM est gratuit, suffisamment petit pour fonctionner localement et conçu pour penser avant tout
Trois modèles ouverts à 3B, 8B et 30B sous licence Apache 2.0, plus un modèle vocal de 470 millions de paramètres qui transcrit trois heures d'audio en une seconde environ.
IBM a publié Granite 4.2, une famille de modèles de langage ouvert avec des tailles de paramètres de 3 milliards, 8 milliards et 30 milliards, sous une licence Apache 2.0. Cette licence compte plus que le tableau de référence : elle signifie que vous pouvez télécharger les modèles, les adapter et les exécuter dans un produit sans demander d’autorisation ni payer de frais. Ils sont sur Hugging Face, Ollama, LM Studio, GitHub et OpenRouter depuis mardi.
Le changement principal est le raisonnement natif. Ces modèles réfléchissent étape par étape avant d’agir, ce qui signifie en pratique planifier une séquence d’appels d’outils plutôt que de les lancer et d’espérer. Les paramètres, en gros, sont les nombres internes qu’un modèle apprend pendant la formation, et le nombre est un indicateur décent de la quantité de matériel dont vous avez besoin : un modèle 3B fonctionne confortablement sur un ordinateur portable, un modèle 8B veut une carte graphique raisonnable et 30B est une station de travail ou un petit serveur.
Pour y arriver, il a fallu des changements de formation plutôt qu’une plus grande échelle. IBM a ajouté un programme d’apprentissage par renforcement en plusieurs étapes, qui consiste en une formation dans laquelle le modèle est récompensé pour ses bons résultats plutôt que pour les réponses correctes, en commençant par une étape fondamentale couvrant les mathématiques, les sciences, le codage et l’appel d’outils. Les modèles 8B et 30B sont ensuite passés par une phase de « RL agent » sur des tâches de type entreprise : ingénierie logicielle, travail sur terminal, workflows pilotés par la recherche. Les modèles se sont également entraînés sur un billion de jetons de code synthétique provenant du pipeline CodeAlchemy d’IBM, et ils sont livrés avec une couche de décodage spéculatif, une astuce qui devine plusieurs mots à l’avance et les vérifie en un seul passage, afin que le texte sorte plus rapidement.
Deux modèles vocaux, Granite Speech 5.0 Turbo CTC et une variante non commerciale, sont livrés discrètement avec seulement 470 millions de paramètres. Ils n’ont aucun modèle de langage en eux, ce qui les rend minuscules. IBM rapporte un score de débit d’environ 12 600 sur un seul GPU H200, contre environ 6 000 pour les leaders actuels en matière de vitesse dans le classement Open ASR de Hugging Face, et affirme que le modèle transcrit trois heures de voix enregistrée en une seconde environ.
Que se passe-t-il réellement ici : IBM n’essaie pas de battre GPT-5.6 ou Claude. Il vise le milieu ennuyeux du marché, où une entreprise veut un agent qui effectue de manière fiable la même tâche en plusieurs étapes dix mille fois, sur ses propres serveurs, sans facture par jeton ni données qui quittent le bâtiment. Il s’agit d’un besoin réel et mal satisfait, et les poids ouverts et les petites tailles constituent une réponse sensée. Les tableaux de concurrence publiés par IBM sont les siens, par rapport à des modèles de taille similaire, alors lisez-les comme une affirmation plutôt que comme un verdict.
Ce que cela signifie pour vous : si vous souhaitez essayer un modèle d’IA performant sur votre propre ordinateur, les versions 3B et 8B constituent un point de départ particulièrement simple. ollama run granite4.2 et vous partez hors ligne, sans rien envoyé nulle part. Ne vous attendez pas à une qualité frontière ; attendez-vous à quelque chose d’utile pour résumer, rédiger et utiliser des outils simples, qui ne coûte rien et ne peut être interrompu sous vos ordres.
Sources
Sources: https://research.ibm.com/blog/introducing-granite-4-2
120 entreprises signent une lettre annonçant que la cyber-fenêtre se ferme
OpenAI, Anthropic, Google, Microsoft, Visa et plus d’une centaine d’autres avertissent que les attaques basées sur l’IA contre les hôpitaux et les services d’eau seront dans des mois et demandent une action défensive coordonnée.