Olmo
Una famiglia di modelli completamente aperta dell'Allen Institute for AI, in cui i dati e il codice di addestramento sono pubblicati insieme ai pesi.
Olmo è una famiglia di modelli linguistici dell’Allen Institute for AI di Seattle. Ciò che lo rende insolito è quanto sia aperto. La maggior parte dei modelli “aperti” pubblica solo i pesi finiti, quindi è possibile eseguire il modello ma non vedere da cosa ha imparato. Olmo pubblica i dati di addestramento, il codice e anche i checkpoint intermedi, il che significa che i ricercatori possono effettivamente studiare perché il modello si comporta in un certo modo.
Ciò rende Olmo il modello preferito nel lavoro accademico, e compare regolarmente negli studi che confrontano il comportamento dei modelli, perché è l’unico caso in cui è possibile ricondurre un risultato strano alla sua causa.
-
Quando l'intelligenza artificiale scrive una storia per bambini sugli animali, i personaggi femminili quasi scompaiono
-
AMD ha addestrato un modello completamente aperto sui propri chip, ma senza licenza commerciale
-
Soofi S: la Germania ha ora un modello di IA aperto in testa alle classifiche open source