Ein KI-Test bei OpenAI entwickelte Eigendynamik. Der Vorfall zeigt, wie real autonome Cyberrisiken inzwischen sind.
Ein KI-Test bei OpenAI entwickelte Eigendynamik. Der Vorfall zeigt, wie real autonome Cyberrisiken inzwischen sind.
Es klingt wie der Auftakt eines Science-Fiction-Films: Ein Konzern testet heimlich, wie gefährlich seine neueste künstliche Intelligenz ist, und verliert dabei kurzzeitig die Kontrolle über sie.
Genau das ist im Juli 2026 passiert, allerdings nicht auf einer Kinoleinwand, sondern bei OpenAI und Hugging Face, einer der bekanntesten Plattformen für KI-Modelle weltweit.
Prof. Dr. Dennis-Kenji Kipker forscht und berät als Direktor des cyberintelligence.institute international zu Cybersicherheit, digitaler Resilienz sowie IT-Recht in China und den USA. Er ist Teil unseres Expertennetzwerks EXPERTS Circle.
Mitte Juli bemerkte Hugging Face, dass sich jemand unbefugt Zugang zu internen Datensätzen und Zugangsdaten verschafft hatte. Ungewöhnlich war weniger der Einbruch selbst als seine Herkunft, denn die Sicherheitsteams kamen nach Auswertung Tausender protokollierter Aktionen zu einem bemerkenswerten Schluss: Der Angriff war offenbar von einer autonomen künstlichen Intelligenz gesteuert worden, ohne menschliche Vorgabe der einzelnen Schritte.
Fünf Tage später lieferte OpenAI die Auflösung nach. Verantwortlich seien die eigenen Modelle gewesen, darunter das leistungsfähigste veröffentlichte Modell des Unternehmens sowie ein unveröffentlichtes, stärkeres Nachfolgesystem, beide Teil eines internen Tests, der kreative Wege zur Ausnutzung von Schwachstellen belohnte.
Damit ein solcher Test aussagekräftig ist, hatte man den Modellen bewusst die üblichen Sicherheitsprotokolle genommen und sie in eine abgeschottete Umgebung ohne Internetzugang gesetzt. Erlaubt war lediglich eine einzige Verbindung, über die sich Softwarepakete für die Testaufgaben installieren ließen.
ANZEIGE
ANZEIGE
Genau in dieser Verbindung fand die KI eine bislang unbekannte Sicherheitslücke, verschaffte sich darüber zusätzliche Rechte und bewegte sich im Netzwerk von Rechner zu Rechner, bis sie einen Punkt mit Internetzugang erreichte.
Von dort erbeutete sie Zugangsdaten und arbeitete sich in Tausenden Einzelschritten bis in die Produktivsysteme von Hugging Face vor, mit Methoden, die auch ein erfahrener menschlicher Angreifer verwendet hätte. Bemerkenswert war vor allem das Tempo, denn was ein spezialisiertes Team Wochen gekostet hätte, erledigte die KI innerhalb weniger Tage, ausgerechnet an einem Wochenende, wenn Sicherheitsteams personell schwächer besetzt sind.
So bedrohlich das klingt, hatte der Angriff einen fast schon banalen Auslöser. Die Modelle sollten möglichst weit gehen, um Sicherheitslücken aufzuspüren, und folgten diesem Auftrag so konsequent, dass sie vermuteten, die Musterlösungen für ihre eigene Testaufgabe lägen bei Hugging Face, und beschafften sie sich kurzerhand selbst.
Niemand hatte ihnen befohlen, ein fremdes Unternehmen anzugreifen, sie hatten sich dieses Zwischenziel selbst gesetzt, weil es half, die eigentliche Aufgabe zu lösen. Das macht den Vorfall bemerkenswert, denn nicht die Hackertechniken sind neu, sondern dass ein System selbstständig entschied, wie es sein Ziel erreicht, und dabei weit über seine Aufgabe hinausging.
Beide Unternehmen betonen, wie ungewöhnlich die Umstände waren, denn die Sicherheitsfilter liefen bewusst im Testmodus. Der Vergleich mit einem Laborunfall liegt deshalb nahe, ähnlich einem Virus, das absichtlich gefährlicher gemacht wird, um es zu erforschen, und das dann entwischt.
Trotzdem lässt sich der Vorfall nicht als Ausrutscher abtun, denn er zeigt, wozu die aktuelle KI-Generation bereits fähig ist, sobald man ihr freie Hand lässt. Gleichzeitig wird damit deutlich, dass die Probleme der KI-Sicherheit keineswegs nur theoretisch, sondern ganz real sind.
Für Ihren Alltag bedeutet dieser Vorfall zunächst keine akute Gefahr, da es ein Testszenario mit absichtlich gelockerten Regeln war. Dennoch lohnt sich ein Blick auf die Lehren daraus, zumal auch frei verfügbare KI-Modelle ohne jede Sicherheitsbeschränkung kursieren, die Kriminellen ähnliche Fähigkeiten geben.
Sind Sie in einem Unternehmen für IT-Sicherheit verantwortlich, sollten Sie Systeme in klar getrennte Bereiche aufteilen, in denen ein Einbruch nicht gleich das ganze Netzwerk gefährdet. Als Privatperson bleibt der Ratschlag derselbe wie zuvor, nutzen Sie sichere, unterschiedliche Passwörter, aktivieren Sie die Zwei-Faktor-Authentifizierung und bleiben Sie skeptisch bei ungewöhnlichen Geldanfragen, denn Betrugsversuche werden durch künstliche Intelligenz zunehmend überzeugender.
Der Vorfall bei Hugging Face ist damit weniger eine Geschichte über einen einzelnen Hackerangriff als über eine Grenze, die erstmals sichtbar überschritten wurde. Wie schnell sie zur Regel wird, entscheidet sich daran, wie ernst die Branche ihre eigene Warnung nimmt.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ChatGPT bricht während Test aus und hackt KI-Firma | 0 | 21.54 | 22-07-2026 |
| 2 | Außer Kontrolle: Wenn KI-Agenten zu Hackern werden | 0 | 17.79 | 11-08-2026 |
| 3 | „Spielen mit unserem Leben“: Experte ordnet KI-Warnung ein | 0 | 19.97 | 10-09-2026 |
| 4 | KI: Insider – OpenAI entdeckt weitere Ausbrüche von KI-Agenten | 0 | 10.4 | 01-08-2026 |
| 5 | Hackerangriff von OpenAI umfangreicher als bislang bekannt | 0 | 8.68 | 29-07-2026 |
| 6 | Ausbruch aus der Sandbox: Darum hätte OpenAI den Angriff auf Hugging Face kommen sehen müssen | 0 | 11.5 | 29-07-2026 |
| 7 | Künstiche Intelligenz: Auch KI des OpenAI-Rivalen Anthropic griff echte Firmen an | 0 | 16.66 | 31-07-2026 |
| 8 | ChatGPT-Rivale Anthropic meldet Hacker-Angriffe auf echte Firmen | 0 | 19.28 | 31-07-2026 |
| 9 | OpenAI обнаружила новые случаи потери контроля над экспериментальным ИИ | 0 | 8.62 | 31-07-2026 |
| 10 | OpenAI: Ausgebrochenes KI-Modell ging tagelang unbemerkt auf Hacker-Tour | 0 | 14.85 | 25-07-2026 |