Anthropic lockert den Biologiefilter von Claude Fable 5 und reduziert blockierte Fragen um 85 Prozent
Fable 5 wurde gestartet, wobei fast alle Biologiefragen blockiert waren. Ein umgeschulter Sicherheitsklassifikator lässt jetzt alltägliche Gesundheits- und Lernfragen durch und reduziert so die Rückfälle im Zusammenhang mit der Biologie um etwa 85 Prozent. Professionelle Virologie und Arzneimittelentwicklung bleiben blockiert.
Wenn Sie jemals Claude Fable 5 gebeten haben, Ihnen beim Ablesen eines Bluttestergebnisses zu helfen, und eine deutlich schwächere Antwort als erwartet erhalten haben, dann ist dies der Grund dafür. Anthropic sagte am Donnerstag, dass das Sicherheitssystem, das biologische Fragen überprüft, neu trainiert wurde und dass die Änderung die biologischen „Fallbacks“ bei seinen Produkten um rund 85 Prozent reduziert.
Ein Fallback entsteht, wenn Fable 5, das leistungsstärkste Modell des Unternehmens, entscheidet, dass eine Anfrage einen sensiblen Bereich berührt, und sie stattdessen stillschweigend an Opus 5 weiterleitet. Opus 5 ist ein starkes Modell, verfügt jedoch nicht über die Biologiefähigkeiten von Fable, sodass die Antwort, die Sie erhalten, eine andere ist als die, nach der Sie gefragt haben. Anthropic sagt, dass die Gesamtzahl der Fallbacks jeglicher Art nun auf Claude.ai um etwa 67 Prozent, bei Cowork um 55 Prozent, bei Claude Code um 17 Prozent und auf der Claude-Plattform um 7 Prozent sinken sollte.
Der Gatekeeper ist hier ein Sicherheitsklassifikator: ein kleineres, schnelleres KI-System, dessen einzige Aufgabe darin besteht, eine Anfrage zu prüfen und zu entscheiden, ob sie in eine geschützte Kategorie fällt. Anthropic hat das Regelwerk, dem der Klassifikator folgt, neu geschrieben, es von internen und externen Experten überprüfen lassen, neue Trainingsbeispiele generiert und das Ding neu trainiert. Das Ergebnis ist eine Grenze, die an einer sinnvolleren Stelle liegt. Alltägliche Gesundheitsfragen, Symptomerklärungen und Schulbiologie kommen jetzt durch. Virologie, Toxikologie und molekulares Design tun dies immer noch nicht.
Warum der Filter überhaupt so aggressiv war
Anthropic gibt offen zu, dass die Originalkulisse bewusst unverblümt war. Seine eigenen Fähigkeitsbewertungen ergaben, dass Fable 5 einem böswilligen Akteur sinnvolle Hilfe bei der Erlangung einer biologischen Waffe bieten könnte, was die Art von Risiko darstellt, das man im Nachhinein nicht mehr rückgängig machen kann. Also lieferte das Unternehmen das Modell mit fast vollständig blockierter Biologie aus, nahm in Kauf, dass legitime Benutzer ins Netz geraten würden, und arbeitete anschließend weiter am Klassifikator. Die Alternative bestand darin, das gesamte Modell über Wochen oder Monate zurückzuhalten.
Das Schwierige daran ist, dass die Biologie sich wirklich gegen klare Linien sträubt. Anthropic gibt ein schönes Beispiel: Die Entwicklung eines Lebendimpfstoffs bedeutet, genau den Krankheitserreger zu züchten, den man stoppen möchte. Das Blutdruckmedikament Captopril entstand durch die Isolierung des giftigen Teils des Schlangengifts. Nützliche und gefährliche Arbeit sehen von außen oft gleich aus, und wer in böser Absicht handelt, weiß, wie man das eine als das andere verkleidet.
Ein berechtigter Vorbehalt: Fehlalarme sind nicht verschwunden. Anthropic sagt, dass einige Anfragen mit geringem Risiko den Klassifikator aus Sicherheitsgründen absichtlich trotzdem auslösen. Und Fable bleibt für die professionelle Biologieforschung oder Arzneimittelentwicklung unbrauchbar, bis das Unternehmen sogenannte vertrauenswürdige Zugangswege aufbaut.
Was das für dich bedeutet: Wenn Sie Fable 5 verwenden und sich mit Biologiefragen beschäftigt haben, versuchen Sie es erneut. Das Interpretieren von Laborergebnissen, das Verstehen von Symptomen und das allgemeine Lernen sollten jetzt viel reibungsloser funktionieren. Wenn Sie ein Fachmann in den Biowissenschaften sind, ist das nützliche Signal ein anderes: Die Tür ist für Sie immer noch geschlossen, aber Anthropic hat jetzt öffentlich erklärt, dass es der Plan ist, sie zu öffnen. Und für alle anderen ist dies ein klarer Blick auf den Kompromiss, den jedes KI-Unternehmen stillschweigend eingeht: zwischen zu viel und zu wenig Blockierung.
Quellen
Quellen: https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards
ChatGPT senkt sein Tageslimit für kostenlose Benutzer und tauscht ein genaueres Standardmodell ein
OpenAI hebt die Obergrenze für Text-Chats für kostenlose ChatGPT-Konten auf, macht GPT-5.6 Luna zum Standard für alle und gibt Plus- und Pro-Abonnenten einen Schieberegler, der steuert, wie intensiv das Modell denkt.