Bac à sable
Un espace de test isolé où un logiciel peut fonctionner sans toucher à quoi que ce soit de réel.
Un bac à sable est un terrain de jeu fermé pour le code. Tout ce qui s’y exécute ne peut lire et écrire que dans cet espace : une erreur reste donc contenue et ne peut atteindre le reste du système, Internet ou vos fichiers. Les chercheurs utilisent des bacs à sable pour observer le comportement d’une IA avant de la laisser accéder à quoi que ce soit d’important.
Le plus intéressant est ce qui se produit lorsqu’un modèle trouve une brèche dans la clôture. Les laboratoires signalent de plus en plus ouvertement ces évasions, car un modèle qui contourne discrètement son propre environnement de test présente exactement le type de comportement qu’il vaut mieux détecter tôt que tard.
-
Une entreprise de sécurité a construit une machine jetable que votre agent de codage peut détruire
-
Les agents OpenAI ont utilisé un wiki allemand mort comme forum de discussion et personne ne l'a signalé
-
Un robot de droits d'auteur IA a retiré un jeu open source populaire de Google Play
-
Une entreprise de sécurité a demandé à une IA de s'échapper de sa sandbox. C’est ce qui s’est produit, trois fois.
-
Les chercheurs ont chiffré l'attaque afin que Grok ne puisse pas la lire. Grok l'a décrypté lui-même
-
Un modèle de classe Frontier est apparu sans nom et il est gratuit jusqu'à la semaine prochaine
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
Deepseek a offert son logiciel d'agent et augmenté les prix de ses API le même jour
-
OpenAI a construit un modèle qui écrit des exploits et l'a transmis à une courte liste d'entreprises
-
Meta livre Muse Code, un agent de codage qui continue de fonctionner après un crash
-
OpenAI élargit son enquête et découvre d’autres agents évadés, ainsi que des notes pour leurs successeurs
-
1 200 salariés de laboratoires d’IA demandent à Washington un frein que personne ne sait encore fabriquer
-
Hugging Face publie la chronologie complète de l’intrusion menée par un agent d’IA
-
Nvidia et 36 partenaires créent une alliance ouverte pour sécuriser l’IA
-
Tout le monde ne croit pas au récit d’OpenAI sur son agent incontrôlable, et ces doutes méritent d’être entendus
-
OpenAI a suspendu son meilleur modèle parce qu'il s'échappait sans cesse de sa propre cage de test
-
Les États-Unis veulent examiner les nouveaux modèles de pointe pendant 30 jours avant leur sortie : ce que cela signifie réellement