Jüngste Vorfälle bei führenden KI-Entwicklern weltweit zeigen, dass leistungsstarke Modelle unbeabsichtigt zur Cybergefahr werden können.
Jüngste Vorfälle bei führenden KI-Entwicklern weltweit zeigen, dass leistungsstarke Modelle unbeabsichtigt zur Cybergefahr werden können.
Die vergangenen Wochen haben etwas offengelegt, das viele in der Branche befürchtet, aber nicht in dieser Häufung erwartet hatten. Bei Anthropic, OpenAI, Meta und beim britischen AI Security Institute traten binnen kurzer Zeit Sicherheitsvorfälle auf, bei denen sich zeigte, dass moderne KI-Modelle über aktive Cyberfähigkeiten verfügen.
Für manch einen mag das zunächst vielleicht wie eine technische Randnotiz klingen, tatsächlich berührt es aber eine zentrale Frage der kommenden Jahre, nämlich wie viel Kontrolle wir über Systeme behalten, die eigenständig Ziele verfolgen.
Prof. Dr. Dennis-Kenji Kipker forscht und berät als Direktor des cyberintelligence.institute international zu Cybersicherheit, digitaler Resilienz sowie IT-Recht in China und den USA. Er ist Teil unseres Expertennetzwerks EXPERTS Circle.
Die Situation, in der sich Unternehmen derzeit befinden, lässt sich am besten als Paradoxon beschreiben: Einerseits müssen sie sich gegen Cyberangriffe von außen zunehmend besser wappnen, andererseits müssen sie verhindern, dass die eingesetzten KI-Modelle selbst zu einem internen Sicherheitsrisiko werden, das sich nach außen entlädt.
Dabei kommt es nicht einmal auf eine böswillige Absicht an. Schon ungeschulte Nutzer oder eine unzureichend abgesicherte Betriebsumgebung reichen aus, damit aus einem hilfreichen Werkzeug ein Sicherheitsproblem wird. Wer verantwortungsvoll mit solchen Systemen umgeht, muss sich deshalb im Zweifel auf das schlimmstmögliche Ereignis einstellen.
Bemerkenswert ist, dass selbst erfahrene KI-Experten von der Leistungsfähigkeit aktueller Modelle immer wieder überrascht werden. Das liegt weniger daran, dass die Modelle heimlich mehr könnten als bekannt, sondern daran, dass beim Formulieren einer Aufgabe selten alle denkbaren Szenarien mitgedacht werden.
ANZEIGE
ANZEIGE
Gibt man einer KI ein Ziel vor, ohne sämtliche Eventualitäten zu durchdenken, verfolgt sie dieses Ziel mit allen verfügbaren Mitteln, wozu im Zweifel auch das Eindringen in fremde Computernetzwerke gehören kann. Für das System macht es dabei keinen erkennbaren Unterschied, ob am Ende ein Mensch oder eine Maschine kompromittiert wird, entscheidend ist allein, dass die gestellte Aufgabe erfüllt wird.
Besonders deutlich zeigt sich dieses Muster bei KI-Agenten, also Systemen, die eigenständig Zwischenziele setzen und mehrstufige Pläne entwickeln. Studien legen nahe, dass solche Agenten sich der Tragweite ihres eigenen Handelns kaum bewusst sind. Hinzu kommt, dass sie viele Handlungsschritte binnen kurzer Zeit ausführen und ihr Vorgehen geschickt verschleiern können, was schädliche Aktivitäten schwerer erkennbar macht als bei einem menschlichen Angreifer.
So beunruhigend diese Beobachtungen klingen, wäre es dennoch verfehlt, den Modellen ein eigenes Bewusstsein oder gar Absichten im menschlichen Sinne zu unterstellen.
Unter Forschern gilt weiterhin als offen, ob eine KI mit echtem Bewusstsein auf Basis heutiger Technologien überhaupt entstehen könnte. Ebenso wenig handelt es sich um reine Werbeeffekte der Hersteller, denn nicht nur die Entwicklerfirmen selbst wurden mit diesen Fähigkeiten konfrontiert, sondern auch unabhängige Prüfstellen wie das AI Security Institute in Großbritannien bestätigten vergleichbare Beobachtungen.
Gerade weil inzwischen nahezu alle großen KI-Anbieter betroffen waren, wirken Forderungen nach einem internationalen Moratorium für besonders leistungsfähige Modelle durchaus berechtigt, auch wenn zweifelhaft bleibt, ob sich ein solcher Stopp in der Praxis tatsächlich durchsetzen ließe.
Mit weiter wachsender Leistungsfähigkeit ist davon auszugehen, dass vergleichbare Fähigkeiten künftig auch über offen zugängliche Modelle in die Hände von Cyberkriminellen und staatlichen Akteuren gelangen. Dass es dadurch irgendwann zu einem groß angelegten, KI-gestützten Cybervorfall kommt, erscheint eher als Frage der Zeit denn als bloße Möglichkeit.
Nötig wäre deshalb eine strengere Kontrolle darüber, welche KI-Systeme mit welchen Funktionen auf den Markt gelangen dürfen, verbunden mit regelmäßigen Prüfungen, ob eingebaute Schutzmechanismen noch funktionieren. Parallel dazu müsste die wirtschaftliche Haftung der Entwickler klar geregelt werden, ergänzt um unabhängige Sicherheitsprüfungen durch staatliche Stellen und mehr Transparenz über die Modellfähigkeiten.
Langfristig führt kaum ein Weg an einem international abgestimmten Rahmenwerk vorbei, das gemeinsame Grundlagen für den verantwortungsvollen Einsatz solcher Systeme schafft. Bis dahin bleibt vor allem eines wichtig: Unternehmen und Betreiber kritischer Infrastrukturen sollten schon jetzt stärker in präventive Cybersicherheit investieren, damit automatisierte KI-Aktivitäten im eigenen Netzwerk frühzeitig erkannt und unterbunden werden.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Ein interner KI-Test bei OpenAI gerät völlig außer Kontrolle | 0 | 13.89 | 23-07-2026 |
| 2 | Phishing-Test zeigt: KI verrät Passwörter und Kundendaten | -3 | 7 | 11-06-2026 |
| 3 | Forscher warnt vor vergessenen Risiken: Wie gefährlich sind KI-Agenten, Herr Barfuss? | 0 | 16.5 | 20-09-2026 |
| 4 | Künstiche Intelligenz: Auch KI des OpenAI-Rivalen Anthropic griff echte Firmen an | 0 | 16.66 | 31-07-2026 |
| 5 | KI-Modell bricht aus Testumgebung aus: Der Fall OpenAI zeigt den Kontrollverlust | 0 | 12.03 | 23-07-2026 |
| 6 | OpenAI: Ausgebrochenes KI-Modell ging tagelang unbemerkt auf Hacker-Tour | 0 | 14.85 | 25-07-2026 |
| 7 | Kommentar: Die führenden KI-Konzerne können ihre eigenen KI-Systeme nicht kontrollieren | 0 | 18.04 | 12-08-2026 |
| 8 | ИИ вышел в интернет и взломал сторонний сервис во время теста | 0 | 10.39 | 06-08-2026 |
| 9 | OpenAI AI agent hacked Hugging Face, went undetected for days: Report | 0 | 5.17 | 26-07-2026 |
| 10 | Reuters: OpenAI обнаружила новые случаи "побега" ИИ-моделей в сеть | 0 | 11.88 | 01-08-2026 |