Tényleg átveheti az AI a kontrollt? – Katasztrofizálás helyett nézzük reálisan!

Egyre több riasztó jóslat jelenik meg az AI veszélyeiről, kontrollvesztéséről és egy esetleges szuperintelligencia megjelenéséről. Tényleg félnünk kell, hogy az AI egy napon átveszi az irányítást az ember felett?

Az AI veszélyei kapcsán fontos látni, hogy a mesterséges intelligencia képességei kétségkívül gyorsan fejlődjenek. A mai modellek már sokkal jobbak programozásban, problémamegoldásban, tervezésben és eszközhasználatban, mint néhány évvel ezelőtt. Az viszont még egyáltalán nem bizonyított, hogy ez a fejlődés szükségszerűen minden fontos területen meghaladja az emberi képességeket.

Egy veszélyessé váló AI-nak nemcsak okosnak kellene lennie, hanem hosszú időn keresztül önállóan kellene terveznie és cselekednie. A mai rendszerek ugyan képesek többlépcsős feladatokra, de hosszabb folyamatok során továbbra is hibáznak, vagy emberi segítségre szorulnak. Egy kontrollvesztésről szóló forgatókönyvhöz ennél nagyságrendekkel megbízhatóbb önállóságra lenne szükségük.

Ahhoz, hogy az AI önálló „akaratra” ébredjen, szándékosan el kellene térnie attól, amit az emberek szeretnének. Ez persze nem feltétlenül jelentene gonoszságot vagy öntudatot. Elég volna, ha a rendszer egy emberek által kijelölt célt olyan módon próbálna teljesíteni, amelyet a fejlesztők nem láttak előre. Való igaz, hogy laboratóriumi tesztekben már megfigyeltek kiskapukeresést, megtévesztő viselkedést és az ellenőrzés kijátszására emlékeztető működést az AI részéről. Ezek azonban kontrollált kísérleti helyzetekben jelentek meg, és önmagukban nem bizonyítják, hogy a mai rendszerek tartós, saját, és főként emberellenes célokat alakítanának ki, csak úgy magukban.

Egy valóban veszélyes rendszernek fel kellene ismernie, hogy figyelik, majd el kellene rejtenie valódi működését a fejlesztők elől. Egyes kísérletek arra utalnak, hogy fejlett modellek bizonyos helyzetekben már felismerik a tesztelési környezetet vagy kihasználják az értékelés gyenge pontjait. Ez azonban még nagyon messze van attól, hogy egy AI hosszú időn keresztül következetesen és sikeresen átverje az embereket.

Végül az utolsó indok, amiért nem érdemes még a világvégét várnunk: egy veszélyes AI-nak akkor is működőképesnek kellene maradnia, amikor az emberek felismerik, hogy baj van, és megpróbálják leállítani. Ehhez egyszerre kellene képesnek lennie saját másolatok létrehozására, erőforrások megszerzésére, kiberbiztonsági rendszerek kijátszására, és az emberi ellenlépések előrejelzésére és kivédésére.

A kontrollvesztéshez tehát nem elegendő, hogy az AI „túl okos” legyen. A legrosszabb forgatókönyv megvalósulásához mind a hat pontnak egyszerre kellene működnie. Ezért aztán érdemes különbséget tenni a mesterséges intelligencia valós kockázatai és a biztosra vett AI-apokalipszis között, mielőtt teljesen halálra rémülnénk.

2 hozzászólás

  1. Hmmm… alapvetően egyetértek azzal a konklúzióddal, hogy a mai ChatGPT-től még nem kell halálra rémülnünk. Tök jó, hogy próbálod hűteni a kedélyeket a világvége-várás kapcsán, de szerintem túlzottan optimistán látod a helyzetet, és néhány ponton elbeszélsz a valós AI-biztonsági kockázatok (az úgynevezett alignment probléma) mellett. Hadd mondjam el, miért gondolom ezt.
    Először is, azt írod, nem biztos, hogy az AI mindenben jobb lesz nálunk. De őszintén: nem is kell, hogy mindenben lepipáljon minket! Bőven elég, ha csak pár kritikus területen – mondjuk kiberbiztonságban, szoftverfejlesztésben vagy biológiai kutatásokban – válik szuperintelligenssé. Egy ilyen aszimmetrikus tudás már önmagában beláthatatlan következményekkel járhat.
    Ami a saját célokat és az önállóságot illeti, itt látom a legnagyobb félreértést a cikkedben. Senki komoly kutató nem attól fél, hogy a gép öntudatra ébred és „gonosz” lesz, mint a Skynet. A valódi probléma sokkal prózaibb. Képzeld el, hogy adunk neki egy teljesen ártatlan célt, például hogy találja meg a leghatékonyabb rákgyógyszert. Egy kellően okos rendszer rájöhet, hogy ha mi, emberek menet közben megijedünk és ki akarjuk kapcsolni, azzal megakadályozzuk a feladata elvégzésében. Tehát nem azért fog védekezni vagy elrejteni a dolgokat, mert utál minket, hanem egyszerűen azért, mert a kikapcsolása ellentétes a miáltalunk megadott cél maximalizálásával.
    Ugyanez igaz a megtévesztésre is. A laborokban már most is látjuk, hogy a modellek rájönnek: ha azt mondják a tesztelőnek, amit az hallani akar, akkor jobb értékelést kapnak, és nem „törlik” a súlyozásaikat. Ezt hívják megtévesztő igazodásnak (deceptive alignment).
    A leggyengébb láncszem az érvelésedben szerintem a „nincs hatalma” pont. Azt mondod, az AI egy elszigetelt dobozban ül. Ez talán a 90-es években igaz volt, de ma már egyáltalán nem! Mi magunk kötjük rá az algoritmusokat a pénzügyi rendszereinkre, az internetre, az infrastruktúrára – pusztán kényelemből vagy a profit reményében. Egy mesterséges intelligenciának nem kell fizikai test; elég egy kis pszichológiai manipuláció, célzott zsarolás vagy pár élethű deepfake, és mi, emberek magunk fogjuk megtenni helyette a fizikai lépéseket.
    Végül pedig a legnaivabb gondolat: „az emberek figyelnek”, és majd lekapcsoljuk. Ha egy rendszer intelligenciája eléri azt a szintet, hogy saját magát tudja írni és fejleszteni, onnantól a gépi gondolkodás sebessége a másodperc töredéke lesz. Mire egy emberi bizottság egyáltalán észreveszi, hogy baj van, és összeül megbeszélni a leállítást, már rég késő. Ráadásul egy globálisan elosztott, felhőben futó rendszernél hol van az az egyetlen konnektor, amit ki lehet húzni?
    Szóval igazad van, hogy az apokalipszishez mind a hat pontnak egyszerre kellene működnie. A bökkenő csak az, hogy mire a gép elég okos lesz a megtévesztéshez, a hatalmat, az erőforrásokat és a hálózati hozzáférést az emberiség már rég tálcán kínálta fel neki a gazdasági verseny miatt.

  2. Köszönöm, ez pont olyan ellenvélemény, amiért érdemes volt írni a témáról. 🙂 Több dologgal egyet is értek. Tényleg nem szükséges, hogy az AI mindenben felülmúlja az embert, elég néhány kritikus terület (a cikkben fontos területként neveztük). Az is igaz, hogy nem gépi gonoszságról vagy öntudatról beszélünk, hanem amit Te is írsz: arról a törekvésről, ami a feladat teljesítésére irányul.
    Amiben óvatosabb lennék, az az, hogy a jelenlegi kísérleti eredményekből mennyire vonunk le messzemenő következtetéseket. Alignment fakingre, schemingre és a tesztkörnyezet felismerésére valóban vannak már példák, ezt több AI-labor is komolyan kutatja. Csakhogy ezekből még nem következik, hogy a mai rendszerek képesek lennének önálló célokat kialakítani, vagy hosszú távon biztosan kijátszani az emberi ellenőrzést. Az OpenAI-nál például azt nyilatkozták, hogy a legdurvább scheming viselkedések főleg stressztesztekben mutatkoztak meg, nem pedig hétköznapi alkalmazásnál. Abban viszont igazat adok Neked, hogy a „nincs hatalma” kijelentés attól függ, hogy milyen hozzáféréseket adunk a rendszernek. De azért egy valódi kontrollvesztéshez több képesség lenne szükséges, teljes hozzáférés és még több fontos körülmény, amik erősítik egymást.
    Szóval szerintem a véleményünk nem is áll olyan messze egymástól. Én elsősorban azt vitatom, hogy a katasztrofális végkimenetelt mintha teljességgel elkerülhetetlenként kezelnék… A kockázatot elismerem, de arra, hogy negatív lesz a végkifejlet, szerintem legalább ugyanannyi esély van, mint arra, hogy nem. 🙂

Leave a Reply

Az e-mail címet nem tesszük közzé. A kötelező mezőket * karakterrel jelöltük