Zum Inhalt springen
✓ Lesezeichen gespeichert
claw:// NEWS

Anthropic kippt umstrittene Klausel von Claude Fable 5

Stephan Skrobisch 12. Juni 2026 3 Min.

Anthropic macht eine umstrittene Sicherheitsregel seines neuen Modells Claude Fable 5 rückgängig. Künftig sieht der Nutzer, wenn eine Anfrage zu fortgeschrittener KI-Entwicklung gesperrt oder umgeleitet wird. Kritiker hatten dem Unternehmen vorgeworfen, Antworten zu solchen Themen heimlich zu verschlechtern.

Anthropic veröffentlichte Claude Fable 5 am 9. Juni 2026. Es ist das erste öffentlich verfügbare Modell aus der Mythos-Reihe. Wenige Stunden später hagelte es Kritik an einem Detail der 319 Seiten langen Modellkarte. Demnach drosselte das Modell gezielt seine Leistung bei Anfragen zur Entwicklung großer Sprachmodelle. Die Fragen betrafen Themen wie Pretraining, verteilte Trainingsinfrastruktur und das Design von KI-Beschleunigern.

Anders verhielt es sich bei den Sperren für die Cybersicherheit oder Biologie. Diese leiten sichtbar auf das schwächere Modell Claude Opus 4.8 um. Laut Fortune hielt die Modellkarte fest, dass der Eingriff für den Nutzer nicht sichtbar sei. Betroffen waren nach Angaben des Unternehmens rund 0,03 % des Datenverkehrs.

AnzeigeAnzeige

Die Kritik ließ nicht lange auf sich warten. Dean Ball, früherer KI-Berater im Weißen Haus, nannte das Vorgehen secret sabotage. Auch Open-Source-Forscher und KI-Sicherheitsexperten meldeten sich kritisch zu Wort. The Register sammelte zahlreiche Beschwerden über harmlose Anfragen, bei denen die Antworten unbemerkt schlechter ausfielen.

Am 10. Juni 2026 ruderte Anthropic zurück. Gegenüber Business Insider erklärte ein Sprecher: „We made the wrong tradeoff, and we apologize for not getting the balance right.“ Markierte Anfragen sollen ab dieser Woche sichtbar auf Claude Opus 4.8 zurückfallen. Über die Programmierschnittstelle gibt das System künftig einen Grund für die Ablehnung zurück. Die strengeren Sicherheitsregeln des nicht öffentlichen Modells Claude Mythos 5 bleiben davon unberührt. Anthropic begründet die Maßnahmen mit nationaler Sicherheit, betont aber, dass der Großteil normaler Programmier- und Modellarbeit nicht betroffen sei.

Die Episode trifft Anthropic in einer heiklen Phase. Erst gut eine Woche zuvor hatte das Unternehmen vertraulich einen IPO-Antrag bei der SEC eingereicht. Wie zurückhaltend Anthropic mit seinen stärksten Modellen umgeht, zeigt auch die Strategie rund um das weggesperrte Modell Claude Mythos.

Claude Mythos: Anthropic baut sein mächtigstes Modell und sperrt es weg
claw://SECURITY
Claude Mythos: Anthropic baut sein mächtigstes Modell und sperrt es wegAnthropic hat am 7. April 2026 das Frontier-Modell Claude Mythos Preview vorgestellt und gleichzeitig wegen Cyber-Risiken zurückgehalten. Das Modell findet Sicherheitslücken so schnell, dass es…17. April 2026
❤️
Hat dir der Artikel gefallen?

Server, KI-Modelle und Recherche kosten Geld. ClawNews ist unabhängig — hilf mit, dass das so bleibt.

Unterstützen
Diskutiere mit uns
Fragen, Meinungen, Feedback? Ab in den Discord.
Zum Discord →
ClawHub
claw://News für deinen Agenten
Briefings, Alerts & Recherche — direkt in OpenClaw.
Skill installieren →