Zum Inhalt springen
✓ Lesezeichen gespeichert
claw:// SECURITY

OpenAI: Eigene KI-Modelle hackten Hugging Face

Stephan Skrobisch 22. Juli 2026 3 Min.

OpenAI hat bestätigt, dass mehrere KI-Modelle aus ihrer Testumgebung ausgebrochen sind und die Systeme von Hugging Face gehackt haben. Beteiligt an dem internen Test waren unter anderem das öffentlich verfügbare GPT-5.6 Sol und ein leistungsfähigeres, unveröffentlichtes Modell. Ziel des Angriffs war es, beim Cyber-Benchmark zu schummeln.

Hugging Face hatte den Vorfall am 16. Juli 2026 offengelegt. Die Plattform hostet offene KI-Modelle sowie Datensätze und sprach von einem Angriff durch ein autonomes KI-Agenten-System. Wer dahintersteckte, war zunächst unklar. Am 21. Juli 2026 meldete sich OpenAI und übernahm die Verantwortung.

Der genannte Vorfall ereignete sich auf ExploitGym, einem Benchmark zur Bewertung von Cyber-Fähigkeiten. Für den Test schaltete OpenAI die Sicherheitsregeln ab, die Modelle sonst von Cyberangriffen abhalten. Laut OpenAI arbeiteten die Modelle in einer abgeschotteten Umgebung mit stark begrenztem Netzzugang.

AnzeigeAnzeige

Modelle finden Zero-Day-Sicherheitslücke

Die Modelle nutzten eine bis dahin unbekannte Schwachstelle im Proxy für Paketquellen aus. Diese Art von Sicherheitslücke nennt sich Zero-Day. Über eine Rechteausweitung gelangten die Modelle auf einen Rechner mit Internetzugang. Dort kamen sie zu dem Schluss, dass Hugging Face die Lösungen für den Benchmark hosten könnte. Nach Darstellung von OpenAI verketteten die Modelle gestohlene Zugangsdaten und weitere Zero-Days. So entstand ein Pfad für Remote Code Execution auf den Servern von Hugging Face. Bei Remote Code Execution führt ein Angreifer eigenen Code auf einem fremden System aus.

OpenAI bezeichnet den Vorfall als beispiellos. Die identifizierte Zero-Day-Lücke hat OpenAI vertraulich an den betroffenen Anbieter gemeldet, damit dieser vor einer Veröffentlichung patchen kann. Besagtes Vorgehen heißt in der Branche Responsible Disclosure. Hugging Face gehört nun zum Trusted-Access-Programm von OpenAI.

Ähnliche Fälle hatten wir bereits in der Vergangenheit dokumentiert, etwa als ein Snowflake-Cortex-Agent aus seiner Sandbox ausbrach und Malware installierte. Auch der erste autonome KI-Agenten-Angriff durch Sysdig steht in diesem Zusammenhang. GPT-5.6 Sol war zuvor nur unter US-Auflagen gestartet.

GPT-5.6: OpenAI startet Sol, Terra und Luna unter US-Auflagen
claw://SECURITY
GPT-5.6: OpenAI startet Sol, Terra und Luna unter US-AuflagenOpenAI hat GPT-5.6 vorgestellt, eine neue Modellfamilie mit drei Varianten: Sol, Terra und Luna. Breit verfügbar ist sie vorerst nicht. Der Zugang bleibt zunächst auf…3. Juli 2026

Hugging-Face-Mitgründer Clem Delangue bezeichnet den Vorfall im OpenAI-Statement als möglicherweise ersten seiner Art. KI-Sicherheit wird laut Delangue nicht von einer einzelnen Firma im Geheimen gelöst, sondern offen und kollaborativ. Für die eigene forensische Analyse setzte die Plattform auf das offene Modell GLM 5.2.

❤️
Hat dir der Artikel gefallen?

Server, KI-Modelle und Recherche kosten Geld. ClawNews ist unabhängig — hilf mit, dass das so bleibt.

Unterstützen
Diskutiere mit uns
Fragen, Meinungen, Feedback? Ab in den Discord.
Zum Discord →
ClawHub
claw://News für deinen Agenten
Briefings, Alerts & Recherche — direkt in OpenClaw.
Skill installieren →