2026-09-11 | Adatvédelem

A szöveg- és adatbányászat szerzői jogi korlátai
A mesterséges intelligencia betanításának alapja az úgynevezett szöveg- és adatbányászat, amelynek során digitális formában lévő szövegeket és adatokat elemeznek automatizált analitikai módszerekkel. Bár a technológia az innováció motorja, komoly szerzői jogi akadályokba ütközik. Az uniós jogalkotás különbséget tesz a felhasználás célja között: a kutatóhelyek és kulturális örökségvédelmi intézmények számára tudományos kutatás céljából végzett szöveg- és adatbányászathoz kötelező erejű kivételt biztosít az irányelv. Az általános, kereskedelmi célú adatbányászat azonban szigorúbb feltételekhez kötött. Ez az általános kivétel ugyanis csak akkor alkalmazható, ha a jogosultak a felhasználást kifejezetten nem zárták ki. Az interneten nyilvánosan hozzáférhetővé tett tartalmak esetében a szerzők, kiadók és jogtulajdonosok a jogaikat géppel olvasható módszerek – például metaadatok vagy a weboldal felhasználási feltételei – révén is fenntarthatják. Ha a jogosultak élnek ezzel a tiltási lehetőséggel, az AI laborok engedély nélkül nem használhatják fel a műveket a modelljeik betanításához.
Személyes adatok kezelése és az elfeledtetéshez való jog
A nyelvi modellek azonban nemcsak jogvédett műveket, hanem rengeteg személyes adatot is feldolgoznak. A betanítási folyamat és a felhasználói interakciók során az általános adatvédelmi rendelet (GDPR) szigorú szabályai is érvényesülnek. Az alapelvek megkövetelik, hogy a személyes adatok kezelését minden esetben jogszerűen, tisztességesen és az érintett számára teljesen átlátható módon kell végezni. A személyes adatok kezelése kizárólag akkor minősül jogszerűnek, ha az érintett ahhoz önkéntes, konkrét, tájékoztatáson alapuló és egyértelmű hozzájárulását adta, vagy az adatkezelésnek egyéb rögzített jogalapja van (például az adatkezelő jogos érdeke). A fejlesztők számára a legnagyobb technológiai rémálmot az „elfeledtetéshez való jog”, vagyis a törléshez való jog jelenti: az érintett jogosult kérni a rá vonatkozó adatok törlését és a további adatkezelés megszüntetését. Ez a jog kiemelten érvényesül akkor, ha az érintett visszavonja az adatkezeléshez adott hozzájárulását, vagy ha a személyes adatok kezelése egyéb szempontból nem felel meg a rendelet előírásainak. Egy betanított neurális hálózatból azonban egy konkrét személyes adatot visszamenőleg „kifelejtetni” mérnöki szempontból szinte megoldhatatlan feladat.
Vállalati kockázatok: Mire figyeljenek a cégek a mindennapi használat során?
A ChatGPT nemcsak a fejlesztőknek, hanem a felhasználó vállalatoknak is rejt jogi buktatókat. A mindennapi üzleti működés során a munkavállalók gyakran töltenek fel üzleti titkokat, ügyféladatokat vagy szerződéstervezeteket az AI platformokra, hogy a program segítsen a szövegezésben, fordításban vagy az elemzésben. Ezzel azonban a cég – mint adatkezelő – könnyen megsértheti a GDPR célhoz kötöttségre és adatbiztonságra vonatkozó elveit, a platformok egy része ugyanis a bevitt adatokat a rendszer saját tanulására is felhasználhatja. Az adatvédelmi incidensek és a titoktartási kötelezettségek (NDA) megsértésének elkerülése érdekében elengedhetetlen egy belső céges AI-szabályzat megalkotása, amely pontosan rögzíti, milyen adatok tölthetők fel a nyílt mesterséges intelligencia rendszerekbe.

