CourionAI
FR
Newsletter
← Toutes les actus
openai 3 min de lecture

OpenAI veut détecter les abus sans jamais voir vos données

OpenAI a présenté en avant-première Private Safety Processing, un système destiné à détecter les modèles d'abus dans plusieurs conversations tout en conservant zéro rétention de données pour les clients professionnels. Anthropic nécessite toujours 30 jours de journaux pour ses modèles les plus puissants.

Un bouclier de cadenas flottant au-dessus d'un nuage avec des lignes de flux de données qui s'estompent

OpenAI a présenté un système de sécurité construit autour d’une contradiction gênante : comment attraper quelqu’un qui abuse d’un modèle si vous avez promis de ne jamais stocker ce qu’il a tapé ? La société l’appelle Private Safety Processing et s’adresse aux clients professionnels et API qui utilisent Zero Data Retention, le paramètre dans lequel rien n’est conservé une fois qu’une demande a reçu une réponse.

L’astuce réside dans ce qu’OpenAI conserve à la place. Plutôt que des invites et des réponses, le système transmet un signal de sécurité précis : quel type d’activité il a détecté et quelle en était la gravité. Le personnel d’OpenAI ne reçoit jamais le texte sous-jacent. Les données client restent sur la propre infrastructure du client ou sont cryptées avec le client détenant les clés. Aleah Houze, responsable de la politique produit d’OpenAI, a déclaré que la raison de cette conception est le timing, car certains risques ne deviennent visibles que dans plusieurs conversations connexes plutôt qu’au sein d’une seule. Un déploiement et un livre blanc technique sont tous deux attendus en septembre.

Il y a ici un avantage concurrentiel qu’OpenAI ne cache pas. Anthropic exige actuellement 30 jours de conservation des données pour les clients professionnels utilisant ses modèles les plus performants, y compris Fable 5, ainsi que pour les banques, les hôpitaux, les cabinets d’avocats et toute personne travaillant sous des règles européennes strictes en matière de données, ce qui constitue un véritable bloqueur. OpenAI vise directement l’écart. La raison la plus profonde pour laquelle le problème existe est que l’IA passe de questions uniques à des agents, des modèles qui exécutent eux-mêmes de longues chaînes d’étapes. Quelqu’un peut poser vingt questions individuellement inoffensives qui totalisent quelque chose de nuisible, et un contrôle de sécurité qui ne voit qu’un seul message ne le remarquera pas. Il vaut la peine de garder les attentes fondées : il s’agit d’un aperçu, le livre blanc n’est pas sorti, et “nous ne voyons qu’un signal de sécurité” est une affirmation que personne en dehors d’OpenAI ne peut actuellement vérifier.

Ce que cela signifie pour vous : si vous utilisez ChatGPT avec un forfait personnel ou Plus, rien ne change aujourd’hui. Il s’agit d’une fonctionnalité d’entreprise et d’API, et non d’une fonctionnalité grand public. Si vous travaillez dans un endroit qui a exclu les outils d’IA pour des raisons de protection des données, cela vaut la peine de le transmettre à la personne qui passe cet appel, avec l’avertissement honnête qu’il n’a pas encore été expédié. Et si vous choisissez un prestataire pour un projet de travail, les règles de rétention sont devenues un véritable point de différence plutôt qu’une note de bas de page. Lisez les petits caractères des deux côtés avant de vous engager.

##Sources

-Offre une rétention de données nulle pour les modèles frontières, OpenAI -OpenAI construit un système de sécurité qui détecte les utilisations abusives sans stocker les données client, The Decoder -OpenAI poursuit les clients professionnels d’Anthropic avec un engagement de zéro conservation des données, The Register -OpenAI présente un système de sécurité sans rétention car Anthropic nécessite des journaux de données, Axios

Sources: https://openai.com/index/offering-zero-data-retention-for-frontier-models/

Article suivant

Un tiers du nouveau Web montre des signes d’écriture par l’IA, selon Pew

Pew Research a analysé environ un demi-million de pages Web et a trouvé des signaux de paternité IA dans 35 % de celles publiées après le lancement de ChatGPT. Les sites commerciaux obtiennent des résultats dix fois supérieurs à ceux des universités et du gouvernement.

Une fenêtre de navigateur avec un tiers ombré différemment et un stylo mécanique écrivant des lignes