Grand modèle de langage
Le type d'IA entraîné sur d'immenses volumes de texte qui alimente ChatGPT et Claude.
Un grand modèle de langage, ou LLM, est le type d’intelligence artificielle derrière des assistants comme ChatGPT, Claude et Gemini. Entraîné sur d’immenses quantités de texte, il apprend les motifs statistiques de la langue, c’est-à-dire quels mots et idées tendent à se suivre.
Cet entraînement lui permet d’accomplir une gamme étonnante de tâches : répondre, rédiger et modifier, traduire, résumer et même produire du code fonctionnel. Il le fait en prédisant, un token après l’autre, ce qui devrait suivre tout ce qui précède.
Il est utile de se rappeler ce qu’un LLM n’est pas. Il n’a ni connexion directe à la vérité ni compréhension réelle ; il génère du texte plausible, généralement juste mais parfois faux avec assurance, un échec appelé hallucination. Le savoir est essentiel pour bien utiliser ces outils.
-
Avec 500 dollars d’entraînement, un modèle 9B surpasse tous les ténors sur une tâche ingrate
-
Un tribunal indien qualifie l’entraînement de l’IA d’« usage privé » : les éditeurs doivent lire les petites lignes
-
OpenAI analyse 800 000 échanges professionnels et découvre que chacun empiète discrètement sur le métier des autres
-
Samsung discute d’un soutien à Mistral, poussant le champion européen de l’IA vers une valorisation de 20 milliards d’euros
-
Apple lance son IA en Chine, avec un modèle chinois aux commandes
-
Starting With AI, Part 1: An Honest Map for Your First Week