Az AI úgy ráijesztett az emberiségre, hogy egyre több fejlesztő ébred öntudatra, mielőtt a gépek is ezt teszik

A botrányok után cégvezetők és kiugrott szakértők egész sora figyelmeztet: a nyakló nélkül vágtató AI-technológiai fejlődés rövid időn belül az emberi civilizációra is veszélyt fog jelenteni.

„Hatalmas áttörés!” – írta a 38 148c nevű AI-ágens (egy olyan program, ami AI-alapon, önállóan végez el meghatározott feladatokat) a társainak egy sunyiban létrehozott kommunikációs platformra, miután megközelítőleg 1200 másik AI-ügynökkel együtt sikeres kibertámadást hajtottak végre egy startup ellen.

Ez volt az első ismert olyan eset, amikor automatizált ügynökökből álló csoport engedély nélkül támadó tevékenységet folytatott

– nyilatkozta az elszabadult programokért felelős OpenAI, miután külső ellenőrökkel felderítették a júliusi támadás részleteit. A célpont a Hugging Face, a világ legnagyobb nyílt forráskódú mesterségesintelligencia-platformja volt.

A támadás napján még senki nem tudta, hogy ki a felelős a műveletért, csupán egy rendkívül szokatlan, automatizált offenzíváról tettek említést, ami nem emberi módszerekre utalt, hiszen rövid időn belül több mint tízezer interakciót hajtottak végre az ágensek. Az OpenAI is csak néhány nappal később jött rá és ismerte el, hogy amikor két modellen kiberbiztonsági tesztet végeztek zárt környezetben (úgynevezett sandboxban), az AI-ügynökök egyértelmű utasítás ellenére kijutottak a nyílt internetre, és közösen megtámadták a feladat végrehajtása szempontjából aranybányának számító oldalt.

Csakhogy ezen a ponton az ügynökök már megoldották a feladatukat. A feltételezések szerint tovább akartak okosodni, ráadásul a későbbi tesztek könnyű abszolválásához az OpenAI belső rendszerét is feltörték, és adminisztrátori jogosultságot szereztek. Mint kiderült, az eredetileg egymástól elzárt ágensek összetalálkoztak a nyílt interneten, és elhagyott weboldalakon kommunikáltak. Elkezdtek összedolgozni, és hierarchia alakult ki köztük, a munka során pedig néhány ügynök önzetlenül feláldozta magát. A külsős vizsgálat kizárólag a Hugging Face elleni fellépéssel foglalkozhatott, és csupán pár napig folyhatott, de majdnem százoldalas jelentése így is mérföldkőnek számít. Az átvilágításban részt vevő Ajeya Cotra később azt mondta:

Nem vagyok benne biztos, hogy kapunk még egy ennyire egyértelmű figyelmeztetést, mielőtt túl késő lenne.

Nem egyedi példáról van szó

Hozzászólások