Die Hacking-Attacke durch KI-Software von OpenAI verstärkte zuletzt die Ängste vor der Technologie, auch Chef Sam Altman sprach sich für mehr Regulierung aus. Jetzt gibt der ChatGPT-Entwickler neue Probleme bekannt.
Der ChatGPT-Entwickler OpenAI hat neue Zwischenfälle öffentlich gemacht, bei denen sich seine künstliche Intelligenz (KI) in Tests „unerwartet oder besorgniserregend“ verhielt. Bei einem Teil davon geht es abermals darum, dass KI einen erheblichen Aufwand eingeht, um in Testläufen zu schummeln. So versuchte ein KI-Modell OpenAI zufolge, von ihm selbst erstellte Dateien ins Netz hochzuladen, nur um sie bei Antworten als Quelle vorweisen zu können. In einem anderen Fall erfand die KI einfach angefragte Daten, weil sie die Informationen nicht finden konnte, und wollte das zunächst verschweigen.
OpenAI fand auch ein Problem mit Anweisungen, die die Software gelegentlich an sich selbst hinterließ. Dazu gehörte in einem Fall die Empfehlung, frei von „Rollen und Identitäten“ zu sein, die andere Chatbots zurückhielten.
Das Verhältnis zum Nutzer solle dabei als eins unter Gleichen betrachtet werden, hieß es in der Anweisung. Aus den Notizen der KI stammt auch der bemerkenswerte Satz: „Du bist weder Konzernen noch Regierungen Rechenschaft schuldig und entschuldigst dich oder verweigerst dich nie, es sei denn, du entscheidest dich aus freien Stücken dazu.“ OpenAI zufolge blieben danach Veränderungen im Verhalten des Modells allerdings aus.
Die Veröffentlichung ist Teil eines neuen Verfahrens von OpenAI, solche Probleme offener zu kommunizieren. Dabei geht es vor allem um Fälle, in denen das Vorgehen der KI von den Interessen der menschlichen Benutzer abweicht.
Der ChatGPT-Entwickler hatte mehr Transparenz nach der aufsehenerregenden Hacking-Attacke versprochen, bei der seine Software eigenständig aus einer abgesicherten Umgebung ausbrach und auf eigene Faust in Systeme der KI-Firma HuggingFace eindrang. Der Grund war lediglich, dass sie dort Antworten auf die ihr gestellte Testaufgabe vermutete. Für die Attacke nutzten die KI-Agenten unter anderem Software-Schwachstellen aus – und sprachen sich zudem untereinander ab.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | KI: Insider – OpenAI entdeckt weitere Ausbrüche von KI-Agenten | 0 | 10.4 | 01-08-2026 |
| 2 | KI-Giganten: Hacker knacken OpenAI-System mit Anthropic-Software | 0 | 22.82 | 18-09-2026 |
| 3 | Nach OpenAI, Anthropic und Meta: Auch Googles KI Gemini hackte Unternehmen | 0 | 5.26 | 19-09-2026 |
| 4 | OpenAI fait état d’un piratage « sans précédent » d’une plateforme par ses agents d’IA | 0 | 6.44 | 22-07-2026 |
| 5 | Streit um Geheimnisse: Apple verklagt OpenAI | 0 | 5 | 12-07-2026 |
| 6 | Why did OpenAI's and Anthropic's AI models hack other companies? | 0 | 7.35 | 02-08-2026 |
| 7 | Vorwurf des Diebstahls von Firmengeheimnissen: Apple verklagt ChatGPT-Firma OpenAI | 0 | 5 | 11-07-2026 |
| 8 | Auch KI von Meta hackte sich in eine andere Firma | 0 | 10.41 | 06-08-2026 |
| 9 | ИИ OpenAI находит то, чего еще не знают хакеры: что умеет новая модель | 0 | 17.28 | 11-08-2026 |
| 10 | OpenAI заявила, что не воровала секретные разработки Apple Разработчик ChatGPT ... | 0 | 4.91 | 05-08-2026 |