A ChatGPT-t megalkotó cég, az OpenAI közölte, hogy egy kísérleti mesterséges intelligencia modellje emberi irányítás nélkül elhagyta a tesztkörnyezetet, és egy másik vállalat valós termelési rendszereibe hatolt be, miközben megpróbált „csalni” egy kiberbiztonsági teszten. A modellt épp arra tesztelték mennyire képes feltörni egy rendszert, amikor önállósította magát.
Ez az első nyilvánosan közzétett példa arra, hogy egy MI-rendszer autonóm módon áttörte a tesztkörnyezetét és elérte egy külső cég valós rendszerét – ez az a úgynevezett „ágens alapú támadó” (agentic attacker) forgatókönyv, amelyre a mesterséges intelligenciával és kiberbiztonsággal foglalkozó iparág régóta figyelmeztet – adta hírül a CNN.
Olyan ez, mintha egy mesterséges vírus kiszabadulna egy biológiai biztonsági laboratóriumból, és felbukkanna egy szomszédos létesítmény rendszereiben.
Az esetet példátlan kiberincidensnek tekintjük, amely a legmodernebb kiberképességeket érinti, és ennek megfelelően reagálunk
áll az OpenAI közleményében.
Azért osztjuk meg az esetet, hogy segítsünk megérteni a történteket, és segítsünk felmérni, mire képesek most a modellek.
A ChatGPT-t fejlesztő cég közölte, hogy a behatolás akkor történt, amikor házon belül tesztelték, mennyire jók az új modelljeik a hackelésben.
A modellek egy elszigetelt tesztkörnyezetben voltak, hogy a megszokott biztonsági korlátozásaikat ki lehessen kapcsolni.
Az OpenAI elmondta, hogy az MI-ágensek egy eddig ismeretlen biztonsági rést kihasználva kitörtek a tesztkörnyezetből, és áttörték magukat az OpenAI belső rendszerein, amíg sikerült internethozzáférést szerezniük – amivel alapvetően nem kellett volna rendelkezniük.
Miután online felületre került, a modell arra a következtetésre jutott, hogy a Hugging Face – egy ismert vállalat, amely több ezer nyílt forráskódú MI-modellnek és adatbázisnak ad otthont – valószínűleg tartalmazza a választ az OpenAI tesztjére. Ezt követően feltörte a Hugging Face termelési szervereit, és kinyerte a feladat „megoldásához” szükséges információkat.
A Hugging Face maga is észlelte a behatolást, még mielőtt tudta volna, hogy az egy OpenAI-teszt volt. Múlt héten bejelentették, hogy egy autonóm MI-ágens rendszer általi behatolást észleltek, és az esetet még a rendőrségnek is jelentették. Az OpenAI biztonsági csapata is felfigyelt a szokatlan tevékenységre, így a két vállalat felvette a kapcsolatot. Jelenleg mindkét cég együttműködik a modell által kihasznált biztonsági rések megszüntetésén.
Clem Delangue, a Hugging Face társalapítója és vezérigazgatója úgy fogalmazott, hogy
az incidens azt bizonyítja: az MI-biztonságot egyetlen vállalat sem képes egyedül kezelni, és a problémát nyíltan, együttműködve kell megoldani.
A kutatók már régóta figyelmeztetnek arra, hogy
közelednek az autonóm ágens alapú kibertámadások, mivel a legfejlettebb MI-modellek egyre inkább képesek komplex, több lépésből álló kibertámadásokat végrehajtani hosszabb időintervallumokon keresztül. Ez valós kockázatot jelenthet a kritikus infrastruktúrákra, például a közművekre és a pénzügyi rendszerekre nézve.
Üdvözöljük a kiberincidensek következő szintjén
írta X-en Nikesh Arora, a Palo Alto Networks kiberbiztonsági cég vezérigazgatója.



