Sürgősen szabályozni kell az AI-t, de nem a valóságtól elrugaszkodott fejek ízlése szerint

Sürgősen szabályozni kell az AI-t, de nem a valóságtól elrugaszkodott víziók szerint

Ha meg akarjuk védeni magunkat a mesterséges intelligencia kockázataitól, nem engedhetjük, hogy a jogi szabályozást eltérítsék a technológiai óriások érdekei vagy a világvégét vizionáló jóslatok. Az utóbbi hetekben a mesterséges intelligencia körüli végzethangulat uralta a közbeszédet. A vita tárgya már nem is az, hogy mind meghalunk-e, hanem hogy ennek pontosan hány százalék esélye van 1 és 99,999 között. A fellángolásban részt vett a nemzetközi és a hazai média is.

Leginkább két történést lehet azonosítani a pánik kiindulópontjaiként. Az egyik tényező Jacob Coxon kutató távozása volt az Anthropictól, majd az őt követő mainstream médiaturnéja. Coxon elmondása szerint a fejlesztő technológiai cégeken belül általánossá vált a narratíva, miszerint 2030-ra a mesterséges intelligencia kiirthatja az emberiséget. Ezt a kockázatot elmondása szerint maga is reálisnak látja. A legfőbb veszélyt szerinte az autonóm önfejlesztés és öntanítás jelentheti – ez egyelőre csupán elméleti koncepció, bár az iparban előszeretettel hivatkoznak rá úgy, mintha már a spájzban lenne.

Konkrétabb érvei közé sorolható, hogy a fejlesztők kezéből látszólag kicsúszik az irányítás a mesterséges intelligencia felett. Ennek alátámasztására rendszerint a második emblematikus tényezőt, az úgynevezett Hugging Face-incidenst említette.

Ninja Warrior AI-módra

A Hugging Face-incidens során az OpenAI egy ExploitGym nevű kiberbiztonsági tesztkörnyezetben tesztelte új, még kiadás előtti nagy nyelvi modelljét. Az ExploitGym több száz, kifejezetten kibertámadások szimulációjára létrehozott feladatból áll – akárcsak egy akadálypálya. A modelleknek például egy védett fájlhoz vagy szerverhez kell megszerezniük a hozzáférést. Az OpenAI tesztelt modelljét tehát eleve arra trenírozták, hogy autonóm módon kiberbiztonsági feladatokat oldjon meg.

A teszt során nem a feladat készítői által javasolt sebezhetőséget használta ki, hanem egy másik útvonalat választott: betört egy a Hugging Face közösségi AI-platformon található szervebe, amelyen az ExploitGym feladataival kapcsolatos megoldások voltak. Nemes egyszerűséggel tehát úgy akarta kijátszani a tesztet, hogy ellopja a válaszokat.