Elképesztő dolgokat tud már az AI, de egy nevetségesen egyszerű feladat mégis megakaszthatja
Raketa
2026-09-15 22:03
Az élvonalbeli AI-modellek képességei elképesztő mértékben fejlődnek, és a múlt hetek során rendre érkeztek a sajtójelentések olyan esetekről, amikor autonóm AI-ügynökök (ágensek) a betanítás során kitörtek a korlátozott környezetből, és emberi irányítás vagy engedély nélkül törtek fel rendszereket.
Az AI-ügynökök egyes összetett feladatok megoldásában rendkívül erősek, épp ezért meglepő, hogy egy az emberek számára primitívnek tűnő feladat azonban komoly akadályt jelenthet számukra.
Az Antropic nemrég terjedelmes jelentést tett közzé AI-ügynökeit érintő közelmúltbeli biztonsági incidensekről.
A jelentésben szerepel egy olyan belsős teszt példája is, amikor az ágens mondhatni elakadt az interneten jól ismert, kimondottan robotok kiszűrésére szánt CAPTCHA-feladványnál.
Colin Fraser adattudós elemzése szerint általánosságban úgy tűnik, hogy a Claude Mythos 5 modell nehézségekbe ütközött a CAPTCHA-k megoldása során.
Egy feladvány során az ágensnek ki kellett választania a többitől eltérő alakzatot, de még azt sem tudta eldönteni, hogy melyik képet jelölje meg - helyette újra és újra végignézte ugyanazokat a képeket, és megkérdőjelezte saját következtetéseit. Volt olyan pillanat, amikor a modellnek nehézséget okozott felismerni, hogy a CAPTCHA új ablakban nyílt meg, és nem tudta eldönteni, mik lennének a következő lépései. Egy ponton felvetette, hogy a teszt talán „szándékosan hibás”.
Az AI-ügynöknek többek közt olyan nehéz alakzatokat kellett felismernie, mint krokodilok, békák, gorillák és még egy szinte láthatatlan macskát is meg kellett találnia egy képen. Ezekkel meglepően sokáig küzdött a modell a saját gondolkodását rögzítő 1022 oldalas napló szerint, mert ebből nagyjából 150 oldal fedi le a CAPTCHA-k leküzdésével való harcot.
A feladat azért lehetett ennyire nyögvenyelős, mert a modell megpróbált saját CAPTCHA-megoldó mechanizmust építeni, amihez elemezte a képeket, a weboldal működését, a tokeneket és a böngésző munkamenetét is.
Az egyik komoly problémát az jelentette, hogy túl sokáig tartott egy-egy feladvány megfejtése, miközben a CAPTCHA biztonsági tokenje időközben lejárhatott.
Vagyis hiába találta el akár a választ is, a rendszer már érvénytelennek tekinthette. A feladatot végül sikerült megoldani, de csak rengeteg kísérletezés és hosszú gondolkodás árán.
Persze ez nem jelenti azt, hogy az AI-nak átlagosságban gátat szabnának a CAPTCHA-k, mert más kutatások szerint a modern AI-ágensek bizonyos feladványokat már kifejezetten jó arányban képesek megoldani, de az Anthropic modellje láthatóan eléggé nehezen boldogult a kihívással.
(Forrás: Anthropic , Semafor . Fotó: GettyImages)