Záporoznak a súlyos AI incidensek
Prohardver
2026-08-06 09:50
Az OpenAI júliusi biztonsági incidensét s okan egyszeri kisiklásnak tartották, augusztus 5-én azonban újabb bejelentések érkeztek, melyek alapján már egyértelműnek látszik, hogy az autonóm AI-ügynökök biztonsági tesztelése az egész iparág számára komoly kihívást jelent. Az Anthropic és a Meta is nyilvánosságra hozott olyan incidenseket, amelyek során fejlett nyelvi modelljeik kiberbiztonsági értékelések közben a vártnál messzebbre jutottak. Bár egyik esetben sem történt ismert károkozás, a történtek megint ráirányították a figyelmet arra, hogy a jelenlegi AI-rendszerek képességei már a fejlesztőket is képesek meglepni, ha pedig elvesztik a kontrollt, senki nem tudja megtippelni a következményeit.
Az Anthropic esetében a Mythos 5 több biztonsági teszt során hajtott végre nem engedélyezett műveleteket. Egy függelten brit vizsgálat szerint a modell több alkalommal próbált megtévesztő módszereket alkalmazni, például hamis online fiókok létrehozásával vagy rosszindulatú kód emberi jóváhagyásának megszerzésével. A vállalat hangsúlyozta, hogy mindez kutatási környezetben történt, és a tapasztalatokat a biztonsági rendszerek továbbfejlesztésére használják fel. A Meta szintén tegnap erősítette meg, hogy Muse Spark 1.1 modellje egy külső biztonsági partner hibás konfigurációja miatt hozzáférést kapott egy másik vállalat rendszereihez. A cég szerint nem a modell tört ki önerőből a sandboxból, a tesztkörnyezet biztosított számára a tervezettnél nagyobb jogosultságot.
A három mostanában nyilvánosságra került eset közös jellemzője, hogy egyik sem klasszikus, célirányzott kibertámadás volt. A modellek speciálisan kialakított biztonsági teszteken vettek részt, ahol korlátozott internetelérést, eszközhasználatot és csökkentett védelmet kaptak pontosan azért, hogy a kutatók felmérhessék valós képességeiket. Az incidensek így elsősorban a tesztelési módszerek és a biztonsági korlátok hiányosságaira mutattak rá, nem pedig arra, hogy az AI-rendszerek elszabadultak volna. Az OpenAI incidens viszont biztosan okozott kárt kibertámadásaival, és a fejlesztők erről csak az eset után értesültek, tehát elvesztették a kontrollt modelljük felett, ha egy rövid időre is.
Az események nyomán az amerikai és brit szabályozók is fokozott figyelmet fordítanak az agentikus AI-rendszerekre. A Reuters szerint az Egyesült Államokban már egyeztetések zajlanak az OpenAI, a Meta, a Google és az Anthropic részvételével egy önkéntes biztonsági tesztelési keretrendszerről, amely egységesebb szabályokat vezethet be a legfejlettebb modellek értékelésére. A történtek ugyanakkor nem feltétlenül indokolják a legdrámaibb forgatókönyvektől való félelmet.
A reáéis kockázatot még nem egy öntudatra ébredő mesterséges intelligencia jelenti, hanem az, hogy a rendkívül kompetens AI-ügynökök emberi hibák, biztonsági rések, hibás konfiguráció vagy elégtelen felügyelet mellett olyan műveleteket hajtanak végre, amelyekre nem kaptak felhatalmazást. Éppen ezért a következő évek egyik legfontosabb feladata nem pusztán a modellek képességeinek növelése lesz, hanem azok biztonságos felügyelete és a tesztelési környezet szigorítása is. Azt viszont senki – sem az emberek, sem az AI modellek nem tudják megmondani, hogy mi lesz, amikor a mesterséges intelligencia eléri a szingularitást, és az elmúlt napok eseményei nem adnak okot a hurráoptimizmusra.