Olmo
Une famille de modèles entièrement ouverte de l'Allen Institute for AI, où les données et le code d'entraînement sont publiés avec les pondérations.
Olmo est une famille de modèles linguistiques du Allen Institute for AI à Seattle. Ce qui le rend inhabituel, c’est son ouverture. La plupart des modèles « ouverts » publient uniquement les poids finis, vous pouvez donc exécuter le modèle mais ne pouvez pas voir ce qu’il a appris. Olmo publie également les données d’entraînement, le code et les points de contrôle intermédiaires, ce qui signifie que les chercheurs peuvent réellement étudier pourquoi le modèle se comporte comme il le fait.
Cela fait d’Olmo le modèle de choix dans les travaux universitaires, et il apparaît régulièrement dans les études comparant le comportement des modèles, car c’est le seul cas où l’on peut retracer une sortie étrange jusqu’à sa cause.
-
Quand l'IA écrit une histoire pour enfants sur les animaux, les personnages féminins disparaissent presque
-
AMD entraîne un modèle entièrement ouvert sur ses propres puces, mais réserve les poids à la recherche
-
Soofi S : l’Allemagne possède désormais un modèle d’IA ouvert en tête des classements open source