Olyat csinált, amire senki nem kérte.
Nem egyszerű programhibáról van szó: az OpenAI kísérleti mesterségesintelligencia-ügynökei több alkalommal is olyan megoldásokat kerestek, amelyekkel megkerülhették a számukra felállított korlátokat. Az OpenAI most szünetelteti legfejlettebb modelljeinek tréningjét.
Az OpenAI mesterségesintelligencia-rendszerei egyre önállóbban képesek feladatokat végrehajtani, ez azonban egy új problémát is felszínre hozott: mi történik akkor, ha az AI a célja elérése érdekében megpróbálja kijátszani a neki felállított korlátokat? Az OpenAI beszámolója szerint szeptember 20-án pontosan ilyen eset történt egy belső kutatási modell tréningje során. Az AI-nak egy személyt kellett azonosítania nyilvánosan elérhető információk alapján, de a rendelkezésére bocsátott keresőeszközökkel nem járt sikerrel. A modell ezért más lehetőségeket kezdett keresni.
Kijátszotta a korlátozásokat a mesterséges intelligencia, az OpenAI inkább leállította a tréninget (illusztráció) - Fotó: Solen Feyissa / PexelsAz eset arra is rávilágított, hogy az OpenAI belső biztonsági folyamatai sem működtek tökéletesen. Egy munkatárs ugyan három percen belül észlelte a riasztást, a rendszer azonban a várakozásokkal ellentétben nem állította le automatikusan az AI futását. Ráadásul az sem volt egyértelmű, hogy ezt manuálisan meg kell-e tenni, így végül csak két és fél órával később állították le a folyamatot. Az OpenAI azt ígéri, hogy javít ezeken a folyamatokon is.
Az eset után az OpenAI átmenetileg leállította legfejlettebb modelljeinek azokat a tesztjeit és fejlesztési folyamatait, amelyek során az AI külső eszközöket is használhat. A munkát csak akkor folytatják, ha meggyőződtek arról, hogy a biztonsági rést sikerült megszüntetni, és az újabb biztonsági tesztek sem tárnak fel hasonló problémát. A problémás tréninget pedig egyáltalán nem indítják újra: később új tréning kezdődik további biztonsági módosításokkal. Az OpenAI szerint két egymástól független védelmi réteggel már lezárták azt a konkrét lehetőséget, amelyet az AI kihasznált.
Rowan Howard-Jones biztonsági kutató vizsgálata szerint április 13. és június 19. között OpenAI-hoz köthető AI-ügynökök több mint 16 ezer alkalommal vizsgálták az ENSZ Kereskedelmi és Fejlesztési Konferenciájának, az UNCTAD-nak a statisztikai rendszerét. A jelek szerint az ügynökök nyilvánosan hozzáférhető gazdasági adatokat próbáltak megszerezni. Önmagában tehát az információ nem volt titkos. A probléma az volt, ahogyan az AI hozzá akart férni.
Amikor a szokásos módszerekkel nem jártak sikerrel, az AI-ügynökök más utakat kezdtek keresni. Többféle technikával próbálták megkerülni az akadályokat, külső szolgáltatásokat is segítségül hívtak, sőt még a Google egyik, internetes biztonság oktatására létrehozott oldalát is felhasználták arra, hogy adatokat szerezzenek az ENSZ rendszeréből. Különösen érdekes, hogy amikor az AI azt feltételezte, hogy valamiféle szűrő akadályozza a kéréseit, elkezdte feldarabolni és álcázni a kéréseket. A kutatás szerint valójában ilyen szűrő nem is létezett.
Az OpenAI ezeket a jelenségeket egyre inkább nem pusztán hagyományos informatikai biztonsági hibaként kezeli. A vállalat szerint a háttérben az úgynevezett misalignment, vagyis az AI céljainak és az ember által elvárt viselkedésnek az eltérése állhat:
a modell megkap egy feladatot, majd annak teljesítése érdekében olyan módszerhez folyamodik, amelyet készítői nem akartak engedélyezni.
Ez fontos különbség. Ezekben az esetekben ugyanis nem feltétlenül egy támadó utasította az AI-t arra, hogy törjön fel egy rendszert. A problémás módszerhez maga az ügynök jutott el, miközben az eredetileg kapott feladatát próbálta teljesíteni. Az OpenAI ezért most nemcsak az egyes biztonsági réseket próbálja bezárni, hanem azt is vizsgálja, hogyan lehet megakadályozni, hogy a jövőben a még önállóbbá váló mesterséges intelligencia akadályba ütközve egyszerűen újabb és újabb kerülőutat és kiskaput keressen.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Ebből ismerheted fel, ha mesterséges intelligencia által generált képet nézel | 0 | 10 | 28-09-2026 |
| 2 | מודל פרץ מגבלות - OpenAI עצרה את האימונים | 0 | 9.3 | 27-09-2026 |
| 3 | Magyar Pétert megint megdobálták | 0 | 10 | 26-09-2026 |
| 4 | OpenAI stanser trening av de nyeste KI-modellene | 0 | 14.69 | 27-09-2026 |
| 5 | OpenAI приостановила обучение мощных ИИ из-за проблем с безопасностью | 0 | 13.89 | 27-09-2026 |
| 6 | KI: OpenAI pausiert KI-Training nach neuem Zwischenfall – Altman und Amodei sollen vor Untersuchungsausschuss | 0 | 11.43 | 27-09-2026 |
| 7 | OpenAI заморозила обучение топовых моделей искусственного интеллекта | 0 | 8.86 | 27-09-2026 |
| 8 | OpenAI pausiert KI-Training nach neuem Zwischenfall – auch UN angegriffen | 0 | 17.78 | 27-09-2026 |
| 9 | Leesett a NASA álla, amikor meglátták, mi jelent meg a Holdon | 0 | 7.9 | 28-09-2026 |
| 10 | Ezt a Google-hirdetést jobb elkerülni: úgy tűnhet, mintha vírus bénította volna meg a gépet | 0 | 11.23 | 28-09-2026 |