Így lopja el Kína a nyugati frontier modelleket
Prohardver
2026-09-11 15:54
Az Anthropic friss jelentése szerint kínai AI-laborok hónapok óta folyamatosan és egyre kifinomultabb módszerekkel próbálják kinyerni a Claude modellek legértékesebb képességeit, írja a TechCrunch . A cég közel 200 millió gyanús interakciót azonosított, amelyek célja a frontier modellek belső gondolkodási láncának ellopása volt, hogy azzal saját modelljeiket tanítsák.
A legagresszívebb kampány az Alibaba nevéhez kötődik: május és július között 151 millió kérést regisztráltak az Anthropicnál, amelyek naponta akár hárommillió tranzakciót is elértek. A támadók több ezer fiókon keresztül ugyanazt a speciális promptot használták, amellyel rávették a Claude-ot, hogy árulja el rejtett gondolkodási folyamatát. Az Anthropic szerint ez a legnagyobb volumenű „desztillációs” támadás, amit valaha láttak, és célja egyértelműen a Qwen modellek fejlesztése volt.
A Moonshot AI kampánya még aggasztóbb részleteket tartalmaz: az Anthropic szerint a kérések egy része közvetlenül a kínai hadsereg hálózatáról érkezett. Egy tíznapos időszakban közel 300 ezer kérést küldtek több ezer fiókon keresztül, elsősorban az Opust megcélozva. Az egyik kérés például zárt láncú kamerafelvételek elemzését kérte azzal a céllal, hogy megállapítsák, „rendellenesen viselkedik-e” a megfigyelt személy.
A támadók egyre ügyesebb trükkökkel kerülik meg a védelmet. Az egyik ilyenben fordítási kérésnek álcázták a modell saját gondolkodásmódjának részletezését: az Opus feladata teljes munkamemóriája katakana japánra történő fordítása volt, és ez árulkodott a modell logikájáról. Az Anthropic hangsúlyozza: a kérdések a modellek legérdekesebb képességei iránt érdeklődek, az agentikus működést, az eszközhasználatot, a kódolást, az adatelemzést és a logikai érvelést beleértve.
A cég már februárban figyelmeztetett hasonló kínai próbálkozásokra, az OpenAI pedig korábban kifejezetten a DeepSeeket vádolta meg hasonló tevékenységgel. Az új jelentés szerint azonban a támadások volumene és agresszivitása jelentősen nőtt. Az Anthropic szerint ezek a desztillációs kampányok közvetlenül a legfejlettebb amerikai modellek képességeit célozzák, és egyre kifinomultabbak.
A jelentés világosan mutatja, hogy a frontier modellek védelme ma már nem csak technikai, hanem geopolitikai kérdés is. A kínai laborok – az Alibaba, a Moonshot AI és a korábban is említett DeepSeek – nyilvánvalóan a legfejlettebb nyugati AI-rendszerek tudását akarják átültetni saját modelljeikbe, akár a legagresszívebb módszerekkel is.