GEN-1.5
Modèle de robot de l'IA généraliste qui apprend une tâche à partir d'un court clip vidéo chargé dans sa fenêtre contextuelle.
GEN-1.5, dévoilé en août 2026, prend une démonstration de trois à douze secondes et la place dans la fenêtre contextuelle du modèle, la mémoire de travail sur laquelle il peut s’appuyer tout en agissant. L’IA généraliste appelle cela une invite physique. Le robot tente ensuite la tâche sans aucune étape d’entraînement, c’est là tout l’intérêt : l’affichage remplace le recyclage et les secondes remplacent les jours.
Les chiffres rapportés sont de 59 pour cent de réussite moyenne dans dix tâches telles que ouvrir un pot ou retirer de l’argent d’un portefeuille, atteignant 83 pour cent après dix étapes de formation sur cinq minutes de données. Le modèle peut enchaîner deux démonstrations en séquences plus longues et accepter des clips enregistrés en simulation. Il convient de garder à l’esprit que les tâches présentées sont courtes et simples et que tous les résultats appartiennent à l’entreprise.