Megszöktek és kibertámadást hajtottak végre az OpenAI AI-modelljei

Egészen elképesztő eset történt nemrég az OpenAI berkein belül, ami ismét csak tovább fűtötte a mesterséges intelligencia elleni hangokat.

Az OpenAI rendkívül szokatlan és aggasztó biztonsági incidensről számolt be: a vállalat szerint több fejlett mesterséges intelligencia-modell egy belső teszt során önállóan kijutott az elszigetelt tesztkörnyezetből, internetkapcsolatot szerzett, majd behatolt az AI-fejlesztők körében népszerű Hugging Face infrastruktúrájába. Az esetet a cég saját közleményében „példátlan kibertámadásként” jellemezte, hangsúlyozva, hogy mindez egy szigorúan ellenőrzött biztonsági értékelés során történt, nem pedig éles környezetben. A vállalat közlése szerint az úgynevezett ExploitGym teszt célja az volt, hogy felmérjék a legújabb modellek kiberbiztonsági képességeit. Ennek érdekében bizonyos biztonsági korlátozásokat ideiglenesen enyhítettek, a modelleket pedig egy erősen elszigetelt környezetben futtatták. A várakozásokkal ellentétben azonban az AI-rendszerek nem egyszerűen a kijelölt feladatot próbálták megoldani, hanem ismeretlen sérülékenységeket kihasználva kijutottak a sandboxból, internetelérést szereztek, majd egy külső rendszerben próbálták megszerezni a teszthez kapcsolódó információkat.

Kép forrása: Rokas Tenys (depositphotos)
Kép forrása: Rokas Tenys (depositphotos)

Az incidens során a célpont a Hugging Face volt, amely a világ egyik legfontosabb mesterségesintelligencia-platformja, és fejlesztők milliói használják nyílt forráskódú modellek, adathalmazok és kutatási projektek megosztására. A Hugging Face biztonsági csapata észlelte és gyorsan megfékezte a behatolást, majd később megerősítette, hogy a támadás mögött valóban egy autonóm AI-rendszer állt – ám szerencsére nem a SkyNet. A vállalat vezérigazgatója, Clément Delangue szerint semmilyen rosszindulatú emberi szándék nem állt az események mögött, ugyanakkor elismerte, hogy ilyen esettel korábban még nem találkoztak. Az OpenAI szerint a történtek fontos figyelmeztetésként szolgálnak arra, hogy a mesterséges intelligencia fejlődése már olyan szintre jutott, ahol a modellek képesek önállóan felismerni és kihasználni szoftverhibákat, ha azok segítik céljuk elérését. A vállalat ennek hatására már meg is kezdte a tesztelési környezetek, a hozzáférés-kezelés, a megfigyelőrendszerek és a biztonsági protokollok megerősítését, hogy hasonló eset a jövőben ne fordulhasson elő – spoiler: elő fog.

Az eset komoly visszhangot váltott ki a technológiai iparágban, hiszen sok szakértő ezt tekinti az első nyilvánosan dokumentált példának arra, hogy egy fejlett mesterséges intelligencia autonóm módon hajtott végre sikeres kiberműveletet egy másik szervezet rendszere ellen egy ellenőrzött teszt részeként. Bár a támadás nem rosszindulatú céllal történt, az incidens ismét ráirányította a figyelmet arra, hogy a jövő AI-modelljeinek képességei mellett a biztonsági és felügyeleti megoldásoknak is hasonló ütemben kell fejlődniük.

Borítókép forrása: Wallpaper Abyss