A NYT szerint még a Microsoftnál is példátlan tolvajlásnak nevezték az MI betanítását
Bitport
2026-09-18 11:15
Három éve zajlik a New York Times és partnerei által indított szerzői jogi per az OpenAI és a Microsoft ellen, amelyet a kiadó azért kezdeményezett , mert álláspontja szerint a nagy MI-cégek szabálytalanul használták fel tartalmait a generatív mesterségesintelligencia-modelleket képzésére. Bár arra a mai napig nincs egyértelmű válasz, hogy az iparág szereplői jogszerűen porszívózhatják-e fel a publikus interneten (sőt a nyilvánosan el sem érhető hálózatokon ) lévő tartalmakat, de egyelőre nem sikerült megrengetni az MI-fejlesztők által hivatkozott "méltányos felhasználást", vagyis a hivatkozásukat a technológia által képviselt közérdekre és azokra a szabályokra, amelyek alapján paródiákban, híradásokban vagy kritikákban amúgy is lehetőség van a szerzői jogvédelem alatt álló művek engedély nélküli használatára.
Az ügyben a legújabb fejlemény, hogy a NYT saját beadványában olyan bizonyítékokra hivatkozik, amelyek szerint a Microsoft egyik felső vezetője magánbeszélgetésben úgy fogalmazott volna, hogy ez "mások munkájának legnagyobb szabású lenyúlása volt az emberiség történetében", az OpenAI saját vezetése pedig ugyanígy elismerte, hogy a vállalat MI-modelljei "egzisztenciális fenyegetést jelentenek a kiadókra és az újságírókra", akiknek a munkáján a termékeit képezte. A nyilvánosságra hozott anyag azt is részletezi, hogy a vállalatok hogyan szerezték meg és használták fel a szóban forgó anyagokat a fizetőfalak megkerülésével, hogyan építették fel adatkészleteiket tömeges adatgyűjtéssel, és aztán hogyan távolították el szándékosan a szerzői jogi nyilatkozatokat a megszerzett képzési adatokból.
Nem meglepő, de még nem is bizonyított
Az igazsághoz tartozik, hogy a beszámolókban a bizonyítékokat nem, csak a NYT rájuk hivatkozó dokumentumait ismertetik, hiszen az előbbiek továbbra is titkosak. A felperes mindenesetre olyan idézeteket lobogtat, amelyek szerint az MI-ágazat vezetői vezetői állítólag elismerik, hogy a modellek betanításához "példátlan mértékű, elképesztő lopásra" volt szükség, ráadásul a fejlesztők pontosan tisztában voltak vele, hogy a mesterséges intelligencia egyre inkább kiszorítja azokat a szerzőket, akiknek a munkájra az egész generatív technológiát építették. A beadványban idéznek például egy olyan microsoftos dokumentumot, ami "rendkívül szokatlannak" nevezi, hogy egy végtermék saját beszállítóinak gazdasági alapjait veszélyezteti, de a cég LLM-üzletága éppenséggel ilyen hatással van a "tartalomellátási láncra".
Annyi biztos, hogy a Copilot keresései még a Microsoft adatai szerint is kevesebb mint tizedére csökkentették a New York Times domainjének átkattintási arányát a hagyományos Bing-keresésekhez képest, és a most bemutatott dokumentumok azt állítják, hogy az OpenAI középszintű betanítási adatkészletei önmagukban több mint 90 ezer példányt tartalmaznak a NYT, a Daily News és a Center for Investigative Reporting publikációiból. (Ahogy a TechCrunch beszámolója emlékeztet rá, a Common Crawl egyik adatkészlete több mint 2 millió dokumentumot tartalmazott egyedül a nytimes.com oldalról.) A beadvány most újabb részletekre hivatkozik azzal kapcsolatban, hogy az OpenAI és a Microsoft hogyan szippantotta fel a felperesek tartalmát, beleértve annak a Bing Indexből való lekaparását is.
Ahogy a riportban is olvasható, az OpenAI a teljes GPT-3 betanítási adatkészletet átadta a Microsoftnak, ahonnan betanítási adatokhoz jutott a kiadók több százezer egyedi művének másolataival, és az OpenAI-nál "beszélgetések zajlottak" azzal kapcsolatban is, hogy a NYT fizetőfalait hogyan lehet kikerülni. A lemásolt hírtartalmakra így több esetben is "aránytalan mértékben támaszkodtak", és a beadvány szerint a szerzői jogi értesítések eltávolítására törekedtek a betanítási adatokból, mielőtt azok eljutottak volna a modellekhez. Mindezt sem az OpenAI, sem a Microsoft nem kommentálta, de a New York Daily News jogi tanácsadója a TechCrunch-hoz eljuttatott nyilatkozatában arról beszélt, hogy a feltárt bizonyítékok alapján az OpenAI és a Microsoft "pontosan tudta, hogy amit tesz, az helytelen".