Már saját alkotói is félnek az AI-tól: végzetes következménye lehet a fejlesztési versenynek

Tíz százaléknál is nagyobb lehet az esélye, hogy az AI lesz az emberiség végzete.

Mi történik, amikor már azok emberek is megkongatják a vészharangot, akik naponta dolgoznak a világ legerősebb mesterséges intelligenciájával? Jacob Coxon is közéjük tartozik, ám mostanra otthagyta az Anthropict, és egyenesen azt állítja, hogy az AI-ipar vezető szereplői pontosan tudják, milyen veszélyes játékba kezdtek. A legijesztőbb rész azonban csak ezután következett, miközben jelenlegi Anthropic-kutatók lényegében igazat adtak neki.

Jacob Coxon kedden jelentette be, hogy távozik az Anthropic kötelékéből. A 27 éves brit kutató az elmúlt három évben az OpenAI-nál és az Anthropicnál foglalkozott a mesterséges intelligenciák előtanításával, most azonban arra jutott, hogy egyik vállalat sem kezeli kellő felelősséggel a technológia fejlődését. Coxon szerint a cégek egy önmagát továbbfejlesztő szuperintelligencia létrehozásáért versenyeznek, és közben az életünkkel játszanak. Úgy véli, az AI-modelleket építő szakemberek közül sokan őszintén tartanak attól, hogy a technológia akár az évtized végéig az emberiség pusztulását okozhatja. Hangsúlyozta, hogy ezt nem marketingfogásnak szánta, mivel állítása szerint a vezetők a nyilvánosság előtt gyakran jóval óvatosabban fogalmaznak, mint a céges falakon belül. A történet igazán nyugtalanító fordulata az volt, hogy Evan Hubinger, az Anthropic AI-összehangolási kutatások vezetője nyilvánosan egyetértett vele. Hubinger személyes becslése alapján 10 százaléknál nagyobb az esélye annak, hogy az AI a következő tíz évben minden ember halálát okozza. Azt is elismerte, hogy jelenleg nincs kész megoldásuk egy szuperintelligencia emberi célokkal való biztonságos összehangolására. Később ugyanakkor pontosította, hogy nem a ma elérhető modelleket tartja közvetlen veszélyesnek, hanem egy jövőbeli, önmagát egyre gyorsabban fejlesztő rendszert.

Samuel Marks, az Anthropic skálázható felügyelettel foglalkozó kutatási vezetője szintén megszólalt. Szerinte sok fejlesztő lassítana, ám a pénzügyi érdekek és a kevésbé óvatos versenytársaktól való félelem tovább hajtják az iparágat. Éppen ezért mindenki attól tart, hogy ha leveszi a lábát a gázról, valaki más akkor is padlóig nyomja. Az Anthropic hivatalos anyaga sem söpri félre a problémát. A vállalat szerint a teljes rekurzív önfejlesztés még nem valósult meg, és nem is elkerülhetetlen, de hamarabb bekövetkezhet, mint amire az intézmények felkészültek. A cég ezért olyan ellenőrizhető nemzetközi együttműködést sürget, amely szükség esetén lehetővé tenné a legerősebb AI-modellek fejlesztésének lassítását vagy ideiglenes szüneteltetését. Hasonló hangok már az OpenAI felől is érkeznek. Jakub Pachocki vezető kutató szerint jelenleg egyetlen labor sem oldotta meg annyira az AI összehangolását és megfigyelését, hogy még sokáig felelősen folytathassa a maximális tempójú fejlesztést. Ez különösen érdekes a GPT–6 Astra bemutatása után, ugyanis az OpenAI saját besorolása szerint ez az első széles körben bevezetett modellje, amely elérte a kritikus kiberbiztonsági képességszintet.

A lassítás azonban politikai falba ütközhet. Scott Bessent amerikai pénzügyminiszter szerint az Egyesült Államok nem engedheti meg, hogy Kína megelőzze az AI-versenyben. Így állt elő a technológiai kor egyik legfurcsább patthelyzete: a kutatók fékeznének, a geopolitika gyorsítana, a pedálok fölött pedig egyelőre senki sem látja tisztán, merre vezet az út.

Borítókép: Terminator 2