Olmo
Eine vollständig offene Modellfamilie des Allen Institute for AI, bei der die Trainingsdaten und der Code zusammen mit den Gewichten veröffentlicht werden.
Olmo ist eine Familie von Sprachmodellen vom Allen Institute for AI in Seattle. Was es ungewöhnlich macht, ist seine Offenheit. Die meisten „offenen“ Modelle veröffentlichen nur die fertigen Gewichte, sodass Sie das Modell ausführen können, aber nicht sehen können, woraus es gelernt hat. Olmo veröffentlicht auch die Trainingsdaten, den Code und die Zwischenkontrollpunkte, was bedeutet, dass Forscher tatsächlich untersuchen können, warum sich das Modell so verhält, wie es sich verhält.
Das macht Olmo zum Modell der Wahl in der akademischen Arbeit, und es taucht regelmäßig in Studien zum Vergleich des Modellverhaltens auf, weil es der einzige Fall ist, in dem man eine merkwürdige Ausgabe auf ihre Ursache zurückführen kann.