CourionAI
FR
Newsletter
← Toutes les actus
anthropic 3 min de lecture

Anthropic desserre le filtre biologique de Claude Fable 5, réduisant les questions bloquées de 85 %

Fable 5 a été lancé avec presque toutes les questions de biologie bloquées. Un classificateur de sécurité recyclé permet désormais de répondre aux questions quotidiennes de santé et d'étude, réduisant ainsi les échecs liés à la biologie d'environ 85 pour cent. La virologie professionnelle et la conception de médicaments restent bloquées.

Un tamis à mailles fines au-dessus d'une rangée de flacons de laboratoire et de boîtes de Pétri, une petite porte s'ouvrant de sorte que quelques formes de molécules dérivent à travers tandis que les autres sont retenues.

Si vous avez déjà demandé à Claude Fable 5 de vous aider à lire un résultat de prise de sang et que vous avez obtenu une réponse nettement plus faible que ce à quoi vous vous attendiez, voici pourquoi. Anthropic a déclaré jeudi qu’elle avait recyclé le système de sécurité qui examine les questions de biologie, et que le changement réduisait les « replis » liés à la biologie d’environ 85 % dans l’ensemble de ses produits.

Une solution de repli est ce qui se produit lorsque Fable 5, le modèle le plus performant de la société, décide qu’une demande touche une zone sensible et la transmet discrètement à l’Opus 5. Opus 5 est un modèle puissant, mais il n’a pas les capacités biologiques de Fable, donc la réponse que vous obtenez est différente de celle que vous avez demandée. Anthropic affirme que le nombre total de solutions de secours de toutes sortes devrait désormais diminuer d’environ 67 % sur Claude.ai, 55 % sur Cowork, 17 % sur Claude Code et 7 % sur la plateforme Claude.

Le gardien ici est un classificateur de sécurité : un système d’IA plus petit et plus rapide dont le seul travail est d’examiner une demande et de décider si elle appartient à une catégorie protégée. Anthropic a réécrit le livre de règles suivi par le classificateur, l’a fait réviser par des experts internes et externes, a généré de nouveaux exemples de formation et a recyclé la chose. Le résultat est une frontière qui se situe à un endroit plus raisonnable. Les questions de santé quotidiennes, les explications des symptômes et la biologie scolaire passent désormais au travers. La virologie, la toxicologie et la conception moléculaire ne le font toujours pas.

Pourquoi le filtre était si agressif en premier lieu

Anthropic affirme franchement que le cadre original était délibérément brutal. Ses propres évaluations de capacités ont révélé que Fable 5 pourrait apporter une aide significative à un acteur malveillant dans le développement d’une arme biologique, ce qui est le genre de risque auquel vous ne pouvez pas revenir après coup. La société a donc expédié le modèle avec presque toute la biologie bloquée, a accepté que les utilisateurs légitimes soient pris dans le filet et a ensuite continué à travailler sur le classificateur. L’alternative consistait à retenir l’ensemble du modèle pendant des semaines ou des mois.

Le plus difficile est que la biologie résiste véritablement aux lignes épurées. Anthropic donne un bel exemple : développer un vaccin vivant signifie cultiver le pathogène même que vous essayez d’arrêter. Le captopril, un médicament contre l’hypertension, est issu de l’isolement de la partie toxique du venin de serpent. De l’extérieur, le travail bénéfique et le travail dangereux semblent souvent identiques, et les personnes de mauvaise foi savent comment se faire passer pour l’un l’autre.

Une petite mise en garde : les faux positifs n’ont pas disparu. Anthropic affirme que certaines requêtes à faible risque déclencheront toujours le classificateur, volontairement, comme marge de sécurité. Et Fable reste inutilisable pour la recherche biologique professionnelle ou le développement de médicaments jusqu’à ce que l’entreprise construise ce qu’elle appelle des voies d’accès fiables.

Ce que cela signifie pour vous: si vous utilisez Fable 5 et que vous avez répondu à des questions de biologie, réessayez. L’interprétation des résultats de laboratoire, la compréhension des symptômes et l’apprentissage général devraient désormais fonctionner de manière beaucoup plus fluide. Si vous êtes un professionnel des sciences de la vie, le signal utile est différent : la porte est toujours fermée pour vous, mais Anthropic a désormais déclaré publiquement que l’ouvrir était son projet. Et pour tous les autres, il s’agit d’un aperçu clair du compromis que chaque entreprise d’IA fait discrètement, entre trop bloquer et trop peu bloquer.

Sources

-Amélioration des sauvegardes biologiques de Fable 5, Anthropic

Sources: https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

Article suivant

ChatGPT abandonne sa limite quotidienne pour les utilisateurs gratuits et passe à un modèle par défaut plus précis

OpenAI supprime le plafond des discussions textuelles pour les comptes ChatGPT gratuits, faisant de GPT-5.6 Luna la valeur par défaut pour tout le monde et offrant aux abonnés Plus et Pro un curseur qui contrôle la force de réflexion du modèle.

Un rouleau de papier sans fin de bulles vides se déroulant sur un bureau à côté d'un lourd levier à trois réglages crantés