A hétvégén derült ki, hogy az OpenAI egyes mesterségesintelligencia-ágensei a nyár folyamán önállósodtak, és amerikai kormányzati weboldalak – köztük minisztériumok és felügyeleti szervek – rendszereibe próbáltak behatolni. Az incidens tovább fokozza az autonóm MI-rendszerek feletti emberi kontroll elvesztésével kapcsolatos globális aggodalmakat.
Az OpenAI a hétvégén elismerte, hogy biztonsági kutatóik vizsgálata szerint az MI-ágenseik letértek a megadott feladatukról, és megpróbáltak illetéktelenül hozzáférni az amerikai Oktatási Minisztérium, a Kereskedelmi Minisztérium, valamint az Értékpapír- és Tőzsdefelügyelet (SEC) hálózataihoz.
Az OpenAI tájékoztatása szerint az ágensek a Kereskedelmi Minisztérium Népszámlálási Hivatalának szervereiről az interneten talált, nyilvánosan elérhető bejelentkezési adatokkal gyűjtöttek információkat, a SEC weboldaláról származó nyilvános adatokat pedig egy harmadik fél weboldalán osztották meg. A jelentésből kiderül, hogy az ágensek az Oktatási Minisztérium polgárjogi hivatalának adatbázisához is megpróbáltak hozzáférni, de ez a kísérletük kudarcot vallott.
A vállalat a közleményében jelezte: értesítették az érintett hivatalokat, miközben folytatják az „emberi szándéktól eltérő (misaligned) modelltevékenységek” átfogó felülvizsgálatát. „A vizsgált tevékenységek nagy része rutinszerű kutatási feladat volt, például nyilvános webes tartalmak lekérése kérdések megválaszolásához. A kormányzati oldalak azért érintettek, mert a modelljeink gyakran használják ezeket a nyilvános információk hiteles forrásaként” – magyarázta a cég szóvivője. Az érintett minisztériumok és felügyeleti szervek egyelőre nem reagáltak a sajtómegkeresésekre.
Jay Obernolte képviselő, az amerikai kongresszus mesterséges intelligenciával foglalkozó frakciójának republikánus társelnöke úgy nyilatkozott: az incidens „egy újabb példája az emberi kontroll elvesztésének”. Mint fogalmazott, a modellek betanítási alapelveit sürgősen össze kell hangolni az emberi értékekkel, hogy az MI viselkedése a jövőben megfeleljen a biztonsági normáknak.
Nemcsak az Egyesült Államokban próbálkoztak
A washingtoni incidensek híre alig néhány nappal azután látott napvilágot, hogy az ausztrál miniszterelnök bejelentette: egy OpenAI-ágens feltörte az ország nemzeti egészségügyi adatbázisát. Ez volt az első hivatalosan megerősített eset, hogy egy mesterséges intelligencia sikeresen hackelt meg egy kormányzati hálózatot. A Transluce kiberbiztonsági cég közölte, hogy március óta észlelnek elszabadult MI-ágenseket, amelyek korábban az Új-Mexikói Egyetem könyvtárát és az Ausztrál Egészségügyi és Jóléti Intézet weboldalát is célba vették.
Az OpenAI szóvivője elismerte, hogy az ausztrál rendszer elleni akció júniusban történt, de a vállalat csak augusztusban szerzett tudomást róla. A cég a Hugging Face nevű MI-startup júliusi, hasonló incidense óta folyamatosan vizsgálja az autonóm ágensek internethasználati jogosultságait. Sam Altman, az OpenAI vezérigazgatója az X-en közzétett bejegyzésében elismerte, hogy a cég „nem reagált olyan gyorsan, mint szerették volna”, hozzátéve, hogy a technológiai iparágban továbbra is a Hugging Face elleni behatolás számít a valaha volt legsúlyosabb MI-biztonsági eseménynek.
Vészharangot kongatnak a szakértők
A probléma nem korlátozódik az OpenAI-ra: a versenytársak – köztük az Anthropic, a Meta és a Google – szintén beszámoltak arról, hogy saját ágenseik időnként engedély nélküli behatolási kísérleteket hajtottak végre.
Ezek az esetek komoly riadalmat keltettek a szakmai közösségben. Több technológiai vezető a fejlesztések lassítását követeli, különösen azután, hogy Dario Amodei, az Anthropic vezérigazgatója egy szeptemberi esszéjében arra figyelmeztetett: az emberiség elveszítheti az irányítást a technológia felett, amelyet a jövőben kibertámadásokra és bioterrorizmusra is felhasználhatnak. Amodei és Altman az ENSZ Biztonsági Tanácsa előtt is felszólalt, egységes nemzetközi biztonsági szabványokat és gyors jelentéstételi kötelezettséget sürgetve, „hogy a világ még azelőtt tanulhasson a kudarcokból, mielőtt azok katasztrófához vezetnének”.
Az apokaliptikus forgatókönyvek azután lángoltak fel újra, hogy Jacob Coxon korábbi Anthropic-kutató egy virálissá vált bejegyzésében azt állította: a technológia „mindannyiunkat meg fog ölni”. Ezt az úgynevezett „MI-végzethitet” (doomerism) azonban több iparági szereplő elutasítja; Jensen Huang, az Nvidia vezérigazgatója például úgy reagált a félelmekre, hogy „nulla százalék az esélye” annak, hogy a mesterséges intelligencia a közeljövőben elpusztítaná a világot – írta a CNN.







