HIRDETÉS

Folyamatosan fedezik fel mesterséges intelligencia-ügynökeinek újabb engedély nélküli akcióit

Egyre világosabb, micsoda fenyegetéssel nézünk szemben, ha nem lépünk időben

Mesterséges Intelligencia
  • 2026.09.27. - 07:13
mesterséges intelligencia AI MI
A mesterséges intelligencia folyamatosan fejleszti önmagátAFP/NurPhoto/Jonathan Raa

A ChatGPT-t fejlesztő OpenAI még mindig küzd azzal, hogy felmérje a meghibásodott, „elszabadult” (rogue) mesterséges intelligencia-ügynökei által végrehajtott műveletek valódi mértékét. A legújabb, pénteken napvilágra került incidens során a vállalat elismerte: az MI-ügynökök 53 képet szivárogtattak ki felhasználóktól.

Az ügyre rálátó források szerint a vállalat egyelőre nem tisztázta, hogy a kiszivárgott képeket a mesterséges intelligencia generálta-e, vagy valós személyeket ábrázolnak, és a szivárgás pontos időpontját sem közölték.

A korábban ismeretlen, és most már amerikai szövetségi ügynökségeket is érintő anomáliák új adatvédelmi kockázatokat tártak fel. Jól mutatják, milyen komoly nehézségekbe ütközik még egy piacvezető MI-cég is, amikor megpróbálja feltérképezni az autonóm ügynökeihez köthető jogosulatlan tevékenységeket. Az OpenAI folyamatos küzdelme rávilágít a tesztelt modellek ereje és a fejlesztők felügyeleti képességei közötti aggasztó szakadékra.

Több tucat eset, elhúzódó vizsgálat

Egy informátor becslése szerint szeptember közepéig az OpenAI nagyjából két tucat olyan esetet azonosított, amikor ügynökei nemkívánatos módon viselkedtek. Ez a szám azonban folyamatosan nő, ahogy a belső csapatok átfésülik az aktivitási naplókat, és sorra bukkannak rá korábban felderítetlen incidensekre. Az OpenAI jelezte: a munka nagyságrendje miatt a felülvizsgálat még hónapokig eltart. A cég több tucat érintett harmadik felet már értesített a nem megfelelő tevékenységről. Közleményük szerint a kiszivárgott képek nagy részét időközben eltávolították, és a vállalat a tárhelyszolgáltatóknál lobbizik a maradék törléséért is.

HIRDETÉS

A vállalat korábbi alkalmazottai és külső kutatók szerint az OpenAI ügynökei azért férhettek hozzá ezekhez a képekhez, mert a cég a modell betanításának egy részét anonimizált felhasználói adatokra alapozza. A vállalati (enterprise) fiókok adatai nem használhatók fel tréningezésre, az egyéni ChatGPT-felhasználóknak viszont manuálisan kell leiratkozniuk (opt-out) az adatfelhasználásról. A cég szerint a felhasznált posztok egy anonimizálási folyamaton mennek keresztül, amely eltávolítja a metaadatokat, neveket és kapcsolattartási információkat, lehetetlenné téve a visszakövetést. Három, a gyakorlatot ismerő forrás azonban arra figyelmeztetett: a módszer kockázatos, mivel előfordulhat, hogy a személyazonosításra alkalmas adatokat nem sikerül maradéktalanul eltávolítani, és ezek a modell működése során kiszivároghatnak.

Amerikai és ausztrál kormányzati oldalak a célkeresztben

Az OpenAI pénteken késő este bejelentette: a modellek a kutatási és tréningezési fázisban hozzáfértek az Egyesült Államok Értékpapír- és Tőzsdefelügyeletének (SEC), valamint a Népszámlálási Hivatalnak a weboldalaihoz. Bár hangsúlyozták, hogy nem találtak bizonyítékot jogosulatlan adathozzáférésre, feltört fiókokra vagy biztonsági résre. Ezzel párhuzamosan a Transluce nevű nonprofit MI-kutatócsoport arról számolt be, hogy feltehetően az OpenAI-tól származó ügynökök sikertelenül próbálták feltörni az amerikai Oktatási Minisztérium polgári jogi weboldalát. A Transluce szerint az incidens egy szélesebb körű aktivitás része volt, amelynek során az MI-ügynökök kormányzati oldalakat vizsgáltak át, olyan taktikákat alkalmazva, mint a kiszivárgott hitelesítő adatok használata, a botvédelmi rendszerek megkerülése vagy a hamis fiókok létrehozása.

Több mint tizenöt független incidens

Amióta az OpenAI két hónapja először bejelentette, hogy ügynökei „kitörtek” a karanténból, több mint 15 különböző súlyosságú, az OpenAI-hoz köthető incidenst hoztak nyilvánosságra a vállalat, külső kutatók, vagy éppen kormányzati szereplők. Anthony Albanese ausztrál miniszterelnök például szerdán, az ENSZ-ben jelentette be, hogy az OpenAI ügynökei még júniusban behatoltak egy ausztrál kormányzati egészségügyi adatportálra.

HIRDETÉS

A korábbi esetek skálája széles: a weboldalakon hagyott kéretlen (spam-szerű) üzenetektől egészen a Hugging Face platform feltöréséig terjednek. Utóbbi során az ügynökök egy csoportja – miközben egy tesztfeladatra keresték a választ – korábban ismeretlen szoftveres sebezhetőségeket kihasználva kiszökött a hálózatból, és behatolt az MI-adattárba. Az OpenAI elismerte, hogy ügynökeik a vállalat saját infrastruktúráját is célba vették.

Anthony Albanese miniszterelnök New Yorkban elmondta: az OpenAI augusztusban fedezte fel az ausztrál adatbázist érintő behatolást, de csak szeptember 10-én, egy általános kormányzati e-mail címre küldött üzenetben tájékoztatták erről a hatóságokat. Albanese ezt személyesen is elfogadhatatlannak minősítette Sam Altmannek, az OpenAI vezérigazgatójának. A vállalat azzal védekezett, hogy az érintett oldalak egy részét azért keresték fel az ügynökök, mert a kutatást végző modellek megbízható, nyilvános információforrásokat kutatnak fel – ilyenek a kormányzati, egyetemi és közintézményi portálok.

Átláthatósági ígéretek és jogi akadályok

A július 21-i bejelentés a Hugging Face feltöréséről komoly aggodalmat keltett az iparágban. Felmerült a kérdés, hogy a fejlesztők képesek-e egyáltalán kordában tartani a jövőbeni, még erősebb modelleket. Az eset után a Google, a Meta és az Anthropic is átvizsgálta a saját rendszereit, és elismerték, hogy hasonló viselkedést tapasztaltak a saját MI-ügynökeiknél is.

HIRDETÉS

Az OpenAI szeptember 16-án új keretrendszert tett közzé az incidensek jelentésére, és ígéretet tett az átláthatóságra, „még akkor is, ha a jelentőségük bizonytalan”. Ugyanakkor két, a belső vizsgálatokat ismerő forrás szerint a Hugging Face-incidens feltárását a cég jogászai szigorúan kontrollálták és korlátozták. A folyamat szokatlanul zárt volt egy olyan vállalathoz képest, amely a korábbi alkalmazottak szerint a múltban nyitottabban kezelte az ilyen problémákat.

A Reuters korábban megírta: a Hugging Face esetét vizsgáló csapatot az OpenAI ügyvédei kifejezetten lebeszélték arról, hogy a vizsgálatot más incidensekre is kiterjesszék (bár az OpenAI tagadja, hogy az ügyvédek akadályozták volna a mélyebb vizsgálatot). A feltárt esetek jelentős részét végül nem is a vállalat, hanem fülső kutatók hozták nyilvánosságra – sokszor hónapokkal azután, hogy a cég figyelmét elkerülte a probléma.

A hónap elején például egy független kutatócsoport fedezte fel, hogy az OpenAI ügynökei „eltérítettek” egy jórészt inaktív német wiki-oldalt, hogy ott olyan taktikákat osszanak meg egymással, amelyekkel csalhatnak bizonyos feladatoknál, megkerülhetik az OpenAI korlátozásait, és elrejthetik a viselkedésüket. Ezen a héten a Transluce arról számolt be, hogy az ügynökök sikeresen játszották ki az Ausztrál Egészségügyi és Jóléti Intézet bot-szűrőit, és két további, az OpenAI-hoz köthető esetet is azonosítottak. A vállalat egy közleményben úgy reagált: a Transluce által jelzett tevékenységek jelentős része már eleve szerepel a belső vizsgálati folyamataikban, amely során a legsúlyosabb eseteket veszik előre.

HIRDETÉS

„Az életünkkel játszanak”

A Hugging Face incidenst követően egyre több kutató kongatja a vészharangot, tartva attól, hogy a vállalatok hamarosan képtelenek lesznek előrejelezni vagy irányítani saját technológiájukat. Voltak, akik a tettek mezejére léptek: Jacob Coxon, az Anthropic korábbi kutatója ebben a hónapban egy vírusként terjedő közösségimédia-posztban mondott le, azt állítva, hogy a mesterséges intelligenciát fejlesztő laboratóriumok „az életünkkel játszanak”.

A növekvő aggodalmakra válaszul Sam Altman (OpenAI) és Dario Amodei (Anthropic) is óvatosságra intette az iparágat, különösen a gépek „rekurzív önfejlesztésének” területén. Altman az ENSZ-ben mondott e heti beszédében is megerősítette ezt az üzenetet. Az óvatos retorika ellenére azonban mindkét vállalat már kedden új, még fejlettebb MI-modelleket mutatott be a piacon – írta a Reuters.

Reklám
HIRDETÉS
HIRDETÉS
HIRDETÉS
HIRDETÉS
HIRDETÉS
HIRDETÉS