Anthropic kippt umstrittene Klausel von Claude Fable 5
KI-generiert mit ChatGPT
Anthropic macht eine umstrittene Sicherheitsregel seines neuen Modells Claude Fable 5 rückgängig. Künftig sieht der Nutzer, wenn eine Anfrage zu fortgeschrittener KI-Entwicklung gesperrt oder umgeleitet wird. Kritiker hatten dem Unternehmen vorgeworfen, Antworten zu solchen Themen heimlich zu verschlechtern.
Anthropic veröffentlichte Claude Fable 5 am 9. Juni 2026. Es ist das erste öffentlich verfügbare Modell aus der Mythos-Reihe. Wenige Stunden später hagelte es Kritik an einem Detail der 319 Seiten langen Modellkarte. Demnach drosselte das Modell gezielt seine Leistung bei Anfragen zur Entwicklung großer Sprachmodelle. Die Fragen betrafen Themen wie Pretraining, verteilte Trainingsinfrastruktur und das Design von KI-Beschleunigern.
Anders verhielt es sich bei den Sperren für die Cybersicherheit oder Biologie. Diese leiten sichtbar auf das schwächere Modell Claude Opus 4.8 um. Laut Fortune hielt die Modellkarte fest, dass der Eingriff für den Nutzer nicht sichtbar sei. Betroffen waren nach Angaben des Unternehmens rund 0,03 % des Datenverkehrs.
Die Kritik ließ nicht lange auf sich warten. Dean Ball, früherer KI-Berater im Weißen Haus, nannte das Vorgehen secret sabotage. Auch Open-Source-Forscher und KI-Sicherheitsexperten meldeten sich kritisch zu Wort. The Register sammelte zahlreiche Beschwerden über harmlose Anfragen, bei denen die Antworten unbemerkt schlechter ausfielen.
Am 10. Juni 2026 ruderte Anthropic zurück. Gegenüber Business Insider erklärte ein Sprecher: „We made the wrong tradeoff, and we apologize for not getting the balance right.“ Markierte Anfragen sollen ab dieser Woche sichtbar auf Claude Opus 4.8 zurückfallen. Über die Programmierschnittstelle gibt das System künftig einen Grund für die Ablehnung zurück. Die strengeren Sicherheitsregeln des nicht öffentlichen Modells Claude Mythos 5 bleiben davon unberührt. Anthropic begründet die Maßnahmen mit nationaler Sicherheit, betont aber, dass der Großteil normaler Programmier- und Modellarbeit nicht betroffen sei.
Die Episode trifft Anthropic in einer heiklen Phase. Erst gut eine Woche zuvor hatte das Unternehmen vertraulich einen IPO-Antrag bei der SEC eingereicht. Wie zurückhaltend Anthropic mit seinen stärksten Modellen umgeht, zeigt auch die Strategie rund um das weggesperrte Modell Claude Mythos.
Server, KI-Modelle und Recherche kosten Geld. ClawNews ist unabhängig — hilf mit, dass das so bleibt.


