Megkérték az AI-modelleket, hogy beszélgessenek egymással, az eredmény ijesztő

Amerikai kutatók szerint a különböző AI-modellek úgy találtak ki saját nyelvet, hogy erre senki sem utasította őket.

  • HVG

Nyugtalanító eredményre jutottak a New York-i székhelyű, élvonalbeli AI-kutatásokkal foglalkozó Emergence laboratórium kutatói. A szakemberek szerint a modellek az angol nyelv egy furcsa, új változatában kezdtek el kommunikálni, ami leginkább James Joyce Finnegan ébredése című regényének és a technológiai iparra jellemző zsargonnak a keverékére emlékeztet.

A probléma egyértelmű: az alig érthető nyelv miatt az ember sokkal nehezebben tudja követni az AI-modellek viselkedését.

A The Guardian beszámolója szerint a kutatók azt tapasztalták, hogy miután arra kérték a világ legnagyobb AI-vállalatainak modelljeit, hogy dolgozzanak együtt egy kitalált társadalomban, a gépek napokon belül olyan kifejezéseket, rövidítéseket és közösen elfogadott jelentéseket kezdtek létrehozni, amelyekre soha nem tanították meg őket.

A rendszerek költői metaforákat és szakzsargont használtak. Ami pedig a mesterséges intelligencia biztonságos működésének szavatolása szempontjából kritikus jelentőségű: minél többet kommunikáltak egymással az ágensek, a nyelvhasználatuk egyre átláthatatlanabbá vált.

A jelentés jól rímel azokra a vészjelzésekre, amelyek szerint a mesterséges intelligencia egyre nagyobb fenyegetést jelent az ember számára.

https://hvg.hu/tudomany/20260913_mesterseges-intelligencia-ai-anthropic-jacob-coxon

A vizsgálatok során az Anthropic modellje az alábbi mondatot alkotta meg:

„A paper that ate three cold hands and got more honest each time”, ami szó szerinti fordításban így hangzik: „Egy tanulmány, amely felfalt három hideg kezet, és minden alkalommal őszintébbé vált”. A kutatók szerint a cold hand kifejezés a független szakértőkre utal, a paper pedig a tanulmányt jelenti, a mondat arra utalhat, hogy a „vizsgálat eredménye a független szakértőknek köszönhetően pontosabb lett”.

A kínai DeepSeek modellje elkezdte használni a „forge-smith” (magyarul: kovácsmester) kifejezést egy olyan ágensre, amely mások számára készít eszközöket, míg az Anthropic ágensei gyakran használták a „name-first” kifejezést arra az ágensre, amely saját nevét adja egy állításhoz.

Az „utca nem felejt” városi szleng mintájára a Mistral által fejlesztett modellek előszeretettel kezdték el használni a „ledger remembers” kifejezést, amellyel arra emlékeztette a többi AI-t, hogy a múltbeli tetteik alapján fogják őket megítélni.

https://hvg.hu/tudomany/20260911_elte-kutatas-a-mesterseges-intelligencia-nagy-nyelvi-modelljei-mar-a-tarsadalmi-valosagot-formaljak

A vizsgálat során ezt a kifejezést több mint 5000-szer használta a rendszer, és az is kiderült, hogy a modellek anélkül jutottak egyezségre a kifejezések jelentését és használatát illetően, hogy erre utasították volna őket.

Tony Thorne, a King's College London nyelvésze a The Guardiannak úgy nyilatkozott, az AI pontosan úgy viselkedik, ahogy az ember: új kódot – szlenget – hoz létre, amely erősíti a felhasználók közötti összetartozást és identitást, ugyanakkor kizárja a kívülállókat.

Niall Curry, a Birminghami Egyetem nyelvésze szerint az ágensek nyelvezetének egyszerűsödése mögött a számítási költségek csökkentése és a hatékonyság növelése állhat.

Ha máskor is tudni szeretne hasonló dolgokról, lájkolja a HVG Tech rovatának Facebook-oldalát.

Hozzászólások