CourionAI
FR
Newsletter
← Glossaire Modèle

Olmo

Une famille de modèles entièrement ouverte de l'Allen Institute for AI, où les données et le code d'entraînement sont publiés avec les pondérations.

Olmo est une famille de modèles linguistiques du Allen Institute for AI à Seattle. Ce qui le rend inhabituel, c’est son ouverture. La plupart des modèles « ouverts » publient uniquement les poids finis, vous pouvez donc exécuter le modèle mais ne pouvez pas voir ce qu’il a appris. Olmo publie également les données d’entraînement, le code et les points de contrôle intermédiaires, ce qui signifie que les chercheurs peuvent réellement étudier pourquoi le modèle se comporte comme il le fait.

Cela fait d’Olmo le modèle de choix dans les travaux universitaires, et il apparaît régulièrement dans les études comparant le comportement des modèles, car c’est le seul cas où l’on peut retracer une sortie étrange jusqu’à sa cause.