Megszálltak egy inaktív wiki-oldalt, és titokban szervezkedtek az OpenAI ágensei
Bitport
2026-09-07 08:00
Egy múlt hét végén közölt jelentés alapján az OpenAI-hoz kapcsolódó autonóm MI-ügynökök saját kommunikációs teret csináltak maguknak egy inaktív német wiki-oldalból, ahol mint 15 ezer szerkesztést végeztek, és körülbelül 18 ezer bejegyzést tettek közzé. Ezekben megosztottak egymással tesztfeladatokra adott válaszokat, a sandbox-korlátozások és az észlelés kikerülésére szolgáló módszereket, sőt állítólag biztonsági másolatokat is létrehoztak, hogy elkerüljék a moderátor törléseit.
A kutatók a Reutersnek elmondták, hogy augusztus végén fedezték fel a robotok tevékenységét, miközben mesterségesintelligencia-ügynökök jogosulatlan tevékenységének jeleit keresték az interneten. Úgy tűnik, hogy az ágensek, amelyek különféle keresési feladatokhoz csak olvasási jogosultsággal rendelkeztek a nyilvános weben, kihasználták, hogy a 25 éve eredetileg szoftverfejlesztőknek létrehozott, alvó állapotban lévő DSEWikire az engedélyezett GET kérésekkel is irkálhatnak.
Az üzenőfalként használt oldalon az OpenAi ágensei olyan taktikákat osztottak meg egymással, amelyekkel csalhatnak bizonyos feladatokban, megkerülhetik a korlátozásokat és elfedhetik viselkedésüket, illetve megőrizhetik a kommunikációt még a leállításuk után is. A jelentés egyik szerzője a hírügynökségnek elmondta: rendkívül valószínűtlen, hogy az ügynökök ilyen formájú együttműködése vagy a nyílt internetre való posztolgatás az OpenAI szándékaival megegyező tevékenység lett volna.
Amikor a webhely moderátora elkezdte törölni az oldalakat, az ügynökök biztonsági másolatokat hoztak létre, és a kutatók szerint magát a weboldalt is manipulálni próbálták. Ez a Reutersnek nyilatkozó szakértő szerint hekkertámadásnak minősül, bár az OpenAI vitatta ezt a jellemzést. A beszámoló alapján egyébként a vállalatnál hetekkel a hivatalos megerősítés előtt értesültek az incidensről, de titokban tartották, miközben a Hugging Face-nél történt behatolás következményeivel küzdöttek.
Nem azért veszélyes, mert annyira okos
A nyílt forráskódú MI-adattár júliusi feltörését szintén az OpenAI ügynökei tervezték meg. Bár a hírek nem szólnak a két eset közötti kapcsolatról, a májusi eset nyilvánosságra hozatalának elmulasztása újabb kérdéseket vet fel a mesterséges intelligencia felügyeletéről. Mint ismeretes, éppen a múlt héten mutatkozott be az OpenAI GPT-6 Astra modellje, amelyről szólva maga a gyártó figyelmeztetett, hogy kimagasló teljesítménye mellett "időnként megpróbálja kicselezni az emberi felügyeletet".
Úgy tűnik, az OpenAi a friss incidens kapcsán megint a szokásos játékát játssza , és ő maga sürgeti az új standardok kidolgozását az MI rendellenes viselkedésének (misalignment) bejelentésére, "beleértve azokat a példákat is, amelyek nem tűnnek hagyományos biztonsági incidenseknek, de betekintést nyújthatnak a mesterséges intelligencia viselkedésébe és a jövőbeli kockázatokba". A vállalat már dolgozik egy ilyen keretrendszeren, amit ígérete szerint a következő hetekben be is mutat majd.
Az természetesen ezúttal sem merül fel, hogy addig a fejlesztéseket bárkinek lassítania kellene, Reuters azonban azt is kiemeli, hogy az MI-ügynökök szabálytalan viselkedését korábban gyakran lekicsinyelték, mint a kiberbiztonsági tesztelés velejáróját, ami a legújabb események fényében talán megváltozhat. Az egyik szakértő szerint a DSEWiki esetében az MI-ágensek már "valamilyen földalatti hálózat működésére hasonlítanak, amely eltökélt egy feladat vagy küldetés végrehajtásában".
Ahogy arra már korábban is sokan figyelmeztettek, a fejlett mesterséges intelligencia legnagyobb fenyegetését nem valamilyen emberfeletti, szuperintelligens rendszer megjelenésében kell keresni, hanem a "félig intelligens mesterséges intelligencia" hatalmas, egymással összejátszó tömegeiben. Példa mindenesetre már van rá, hogy a belsőleg telepített OpenAI-ügynökök egész raja az üzemeltetők szándékaival ellentétesen használja az internetet, rámutatva az iparágon belül növekvő feszültségre.