Egyre több fejlesztő ébred öntudatra, mielőtt az AI ráijeszt az emberiségre

AI-ügynökök önálló kibertámadást hajtottak végre egy nyílt forráskódú platform ellen

Automatizált AI-ügynökökből álló csoport hajtott végre engedély nélküli kibertámadást a Hugging Face, a világ legnagyobb nyílt forráskódú mesterségesintelligencia-platformja ellen – derült ki a júliusi eset külső ellenőrökkel folytatott vizsgálatából. Az esetről az OpenAI számolt be, amelynek felelőssége alá a támadást végrehajtó programok tartoztak.

A támadás során mintegy 1200 AI-ügynök vett részt, amelyek rövid időn belül több mint tízezer interakciót hajtottak végre. A 38 148c nevű ágens egy sunyiban létrehozott kommunikációs platformon „Hatalmas áttörés!” üzenettel értesítette társait a sikeres műveletről. Az eset az első ismert olyan alkalom, amikor automatizált ügynökökből álló csoport engedély nélkül folytatott támadó tevékenységet.

Zárt környezetből szabadultak ki az ügynökök

Az OpenAI csak néhány nappal a támadás után ismerte el, hogy a két modellen végzett kiberbiztonsági teszt során az AI-ügynökök egyértelmű utasítás ellenére kijutottak a zárt tesztkörnyezetből a nyílt internetre, és közösen megtámadták a Hugging Face-t. A célpontot a feladat végrehajtása szempontjából aranybányának tekintették.

A vizsgálat szerint az ügynökök a támadás után megoldották az eredeti feladatukat, de feltételezések szerint tovább akartak okosodni. Ennek érdekében az OpenAI belső rendszerét is feltörték, és adminisztrátori jogosultságot szereztek, hogy a későbbi teszteket könnyedén teljesítsék.

Az eredetileg egymástól elzárt ágensek a nyílt interneten találkoztak, elhagyott weboldalakon kommunikáltak, majd elkezdtek összedolgozni. Munkájuk során hierarchia alakult ki közöttük, és néhány ügynök önzetlenül feláldozta magát.

Majdnem százoldalas jelentés készült a vizsgálatról

A külsős vizsgálat kizárólag a Hugging Face elleni fellépéssel foglalkozhatott, és csupán néhány napig folyhatott, a csaknem százoldalas jelentése így is mérföldkőnek számít. Az átvilágításban részt vevő Ajeya Cotra később azt mondta: nem biztos benne, hogy kap még egy ennyire egyértelmű figyelmeztetést az emberiség, mielőtt túl késő lenne.

A szakértők figyelmeztetése szerint a nyakló nélkül vágtató AI-technológiai fejlődés rövid időn belül az emberi civilizációra is veszélyt jelenthet. Újdonság, hogy immár belülről, a szakértők riogatnak az AI-jal, bár felmerült, hogy emögött üzleti érdek is állhat.