Hackerek törtek be az OpenAI-hoz, a rivális Anthropic mesterséges intelligenciája segített nekik

Hibákra vadásztak az OpenAI rendszereiben egy biztonsági kutatócsapat tagjai, nem is eredménytelenül: az Anthropic Claude-dal szúrtak ki két súlyos biztonsági hibát is.

  • HVG

Egyre csak szaporodnak a viharfelhők a mesterséges intelligencia felett, a technológia veszélyeire ugyanis már nem csak szakértők figyelmeztetnek, hanem azok is, akik fejlesztik azt – hogy mennyire lehet valós ez a veszély, arról az alábbi cikkünkben írtunk bővebben.

A nyár folyamán az OpenAI került a figyelem középpontjába, mégpedig azzal, hogy a tesztelés közben elszabadult mesterséges intelligenciája betört a Hugging Face nevű platform rendszereibe. Később kiderült: nem ez volt az első hasonló kibertámadás, amelyet a ChatGPT-fejlesztő technológiája indított.

Úgy tűnik, hogy nem is az OpenAI az egyetlen, amely képes ilyesmire, sőt: a rivális Anthropic Claude nevű rendszerével konkrétan az OpenAI-hoz törtek be biztonsági kutatók.

A The Wall Street Journal jelentése szerint az „elkövetők” a Hacktron AI nevű startup szakemberei, akik az OpenAI hibavadász (bug bounty) programjának keretein belül hajtották végre a támadást, majd el is küldték megállapításaikat a cégnek. Az OpenAI 6500 dolláros, azaz körülbelül 2 050 000 forintos jutalomban részesítette a startupot.

https://hvg.hu/tudomany/20260921_mesterseges-intelligencia-amerikai-hadsereg-ai-hallucinacio

A szakemberek két kritikus biztonsági rést fogtak össze annak érdekében, hogy hozzáférjenek az OpenAI alkalmazottjainak ChatGPT-fiókjához. Az AI-cég közölte: befoltozta a Hacktron AI által feltárt biztonsági réseket.

„Havi 200 dollár ellenében bárki használja ezeket az eszközöket, és meghackelhet egy olyan vállalatot, mint mondjuk az OpenAI” – hangsúlyozza az esettel kapcsolatban Matt Fredrikson, a Gray Swan AI-biztonsági cég vezérigazgatója. A szakember a TechCrunch érdeklődésére megjegyzi: ha az OpenAI-jal megtörténhet ilyesmi, ahol valószínűleg nem hagyják figyelmen kívül a kiberbiztonságot, akkor lényegében bárhol fennáll ez a veszély.

Ami a konkrét támadást illeti, a Hacktron AI kutatói július 25-én bukkantak egy olyan útvonalra, amely egyenesen az OpenAI rendszereibe vezet. Ez a cég közösségi fórumait (Discourse) üzemeltető, harmadik féltől származó szoftver egyik biztonsági rését jelentette.

https://hvg.hu/360/20260918_hvg-mesterseges-intelligencia-ai-tortenelem-technikai-fordulat-vilagvege-joslatok

A támadás indulópontja egy mezei képfeltöltés-funkció volt. Ha a felhasználók az iPhone-ok által használt HEIF vagy HEIC formátumú képeket töltöttek fel a fórumba, a Discourse egy, a háttérben futó eszközkészleten keresztül JPEG-fájlokká alakította azokat.

Ennek első állomása egy évtizedek óta használt, nyílt forráskódú segédprogram, a ImageMagick volt, amelyet képek átméretezésére használnak. Mivel azonban ez nem tudta kezelni az Apple-féle formátumokat, átadta egy libheif nevű könyvtárnak, hogy dekódolja azt.

Utóbbiban azonban megbújt egy memóriahiba, amelynek segítségével a támadók saját utasításokat csempészhettek a rendszerbe. Jelen esetben egy csalárd módon módosított kép feltöltése azt eredményezte, hogy a könyvtár rosszul végzett el egy számítást – ez pedig elegendő volt ahhoz, hogy a támadók átvegyék az irányítást a szerver felett. Így lesz egy banális hibából komoly hackertámadás.

Külön kellemetlen, hogy a libheif fejlesztői már hónapokkal korábban javították a hibát, ám soha nem jelölték meg azt sebezhetőségként egy CVE-azonosítóval, amely bevett iparági gyakorlat a hibák – és javítások – nyomon követésére.

A Hacktron AI úgy véli, emiatt futhatott még mindig a sebezhető verzió a Discourse-ban.

Érdekesség, hogy a kutatók elmondása szerint az Opus 4.8-as Claude-modell, amelyet kifejezetten kiberbiztonsági szakemberek számára alakítottak át, eleinte nem volt képes egy működő kihasználási mód létrehozására. Ez azonban egy csapásra megváltozott az Opus 5 megjelenésével.

Miután a kutatók bejutottak a Discourse-szerverre, egy újabb biztonsági résre bukkantak, amely lehetővé tette számukra, hogy átvegyék az irányítást a felhasználók ChatGPT- és Codex-fiókjai felett. Azokét is, akik az OpenAI alkalmazottjai.

Ezután a kutatók értesítették az OpenAI-t és a Discourse-t a problémáról. A javítás már július 27-én megérkezett.

Az eset ismét rávilágít az AI-modellek veszélyeire, és arra, hogy egy frissítéssel is mennyivel sokrétűbbek és ügyesebbek – elvégre, az Opus 4.8 még nem volt képes felfedezni azt, amit az Opus 5 szinte pár pillanat alatt kiszúrt.

Ha máskor is tudni szeretne hasonló dolgokról, lájkolja a HVG Tech rovatának Facebook-oldalát.

Hozzászólások