Elszabadultak az AI-ügynökök?

A mesterséges intelligencia átlépett egy határt

Mesterséges Intelligencia
  • 2026.08.02. - 06:39
OpenAI  Open AI
Példátlan kibertámadást indított a mesterséges intelligenciaAFP/Anadolu/Ismail Aslandag

Az OpenAI további eseteket azonosított, amelyek során autonóm mesterséges intelligencia-ügynökök kijutottak az ellenőrzött környezetből. Két, az ügyhöz közel álló forrás pénteken arról számolt be, hogy a vállalat közben kiterjesztette a vizsgálatát a Hugging Face technológiai cégnél ebben a hónapban történt, világszerte figyelmet kapott kibertámadásra is.

Az újabb kitöréseket a vállalat által nyilvánosan bejelentett vizsgálat során fedezték fel. A két forrás szerint a vizsgálat annak feltárására indult, hogyan tudott az egyik ügynökük ebben a hónapban megszökni egy zárt tesztelési környezetből, és az OpenAI jelenleg ezeket az eseteket is elemzi. Az egyik forrás szerint a szökések korlátozott mértékűek voltak, és úgy vélik, hogy egyik ügynök sem hagyta el az OpenAI hálózatát - írta meg a Reuters.

Az OpenAI szóvivője a vállalat kedden kiadott közleményére hivatkozott, amelyben azt írták, hogy a Hugging Face-nél történt behatolás mellett „modelljeik szélesebb körű tevékenységét” is felülvizsgálják.

Az OpenAI-nál felfedezett további, nem rendeltetésszerű viselkedések – még ha korlátozottak is voltak – tovább erősíthetik a Fehér Házból és más helyekről érkező, szigorúbb szabályozást sürgető hangokat.

Az OpenAI kiterjesztett vizsgálata röviddel azután kezdődött, hogy legnagyobb riválisa, az Anthropic nyilvánosságra hozta azt, hogy modelljei felelősek voltak több betörési incidensért is, amelyek három másik vállalatnál történtek, és egészen áprilisig nyúlnak vissza. Az OpenAI korábbi hasonló kitöréseinek felfedezéséről eddig nem számoltak be.

NÖVEKVŐ AGGODALMAK

A mesterséges intelligencia biztonságával foglalkozó szakértők szerint az új információk arra utalnak, hogy az élvonalbeli laboratóriumok képességei a veszélyes autonóm hackelésre alkalmas rendszerek fejlesztésében gyorsabban fejlődnek, mint az ezek ellenőrzésére és biztonságos működtetésére szolgáló módszereik.

„Egy egész iparágban az eszközök tervezői, fejlesztői és piacra dobói nem fordítanak elegendő figyelmet arra, hogy ezeket a rendszereket felelősségteljesen fejlesszék és biztonságosan tartsák fenn” – mondta Maurice Chiodo, a Cambridge-i Egyetem Egzisztenciális Kockázatkutató Központjának matematikusa.

A Reuters nem tudta pontosan meghatározni, hogy az OpenAI vizsgálói hány különálló incidenst azonosítottak, illetve azok mikor és milyen körülmények között történtek. A három forrás szerint az OpenAI és külső szakértők az év elejéről származó naplóadatokat elemzik annak érdekében, hogy megértsék az események pontos lefolyását.

Az OpenAI először a Hugging Face-nél július elején történt behatolás után indított vizsgálatot. Az eset során egy OpenAI-ügynök több napon keresztül sikertelenül próbálkozott egy másik vállalat hálózatában azzal, hogy hibás módon meghamisítson egy belső tesztet. Az OpenAI szerint a támadások következtében négy másik vállalatnál is veszélybe került egy-egy fiók. A vállalat tisztviselői szerint ezek egyike a New York-i székhelyű Modal volt.

Chiodo elmondta, hogy aggodalmait tovább növelték azok a jelek, amelyek szerint sem az OpenAI, sem az Anthropic nem követte megfelelően az ügynökök tevékenységét akkor, amikor azok eltértek a kijelölt feladataiktól.

A Reuters korábban arról számolt be, hogy az OpenAI csak azt követően szerzett tudomást arról, hogy ügynöke behatolt a Hugging Face rendszerébe, miután a vállalat megfékezte a támadást, kapcsolatba lépett az FBI-jal, majd nyilvánosságra hozta az esetet. Az OpenAI azt állította, hogy a Reuters beszámolója pontatlanságokat tartalmazott, de nem részletezte, pontosan mely állításokra gondolt.

Az Anthropic csütörtöki közleményében, amelyben bemutatta, hogyan törtek be saját ügynökei áldozatok rendszereibe, arra utalt, hogy nem történt valós idejű megfigyelésük. A vállalat szerint „az értékelési naplók valós idejű monitorozása segített volna abban, hogy a problémát hamarabb felismerjék”.

Chiodo szerint ez arra utal, hogy nem volt megfelelő ellenőrzési rendszer.

„Úgy tűnik, mintha egyszerűen nem figyeltek volna oda” – mondta Chiodo.

Az Anthropic később közölte, hogy bár alkalmaztak valós idejű megfigyelést, azt „erre a fenyegetési területre” nem terjesztették ki egy, a mesterséges intelligenciával foglalkozó vállalat és egy partner közötti félreértés miatt.

ÚJ KORMÁNYZATI FELÜGYELET

Az elszabadult mesterségesintelligencia-ügynökökről szóló esetek gyors növekedése már most fokozta az Egyesült Államok és Európa törvényhozóinak, illetve tisztviselőinek nyomását arra, hogy új kormányzati ellenőrzési rendszereket vezessenek be azokkal a laboratóriumokkal szemben, amelyek ilyen modelleket fejlesztenek.

„Vizsgáljuk az ellenőrzéseket” – mondta Donald Trump amerikai elnök csütörtökön újságíróknak.

Pénteken az Európai Bizottság közölte, hogy egyeztetéseket folytatott az OpenAI-jal és az Anthropic-kal a hackertámadásokkal kapcsolatban.

Mark Warner, az amerikai szenátus hírszerzési bizottságának demokrata párti vezetője pénteken azt mondta, hogy az Anthropic esete „azt mutatja számomra, hogy törvényhozási szempontból helyesen tesszük, ha megköveteljük ezeknek a fejlett modelleknek a kötelező képességtesztelését”.

Reklám