adozona.hu
Webes adatkinyerés a generatív AI kapcsán – itt az EDPB iránymutatása
//adozona.hu/gdpr_adatvedelem/EDPB_GDPR_webes_adat_generativ_AI_730VNX
Webes adatkinyerés a generatív AI kapcsán – itt az EDPB iránymutatása
Több jelentős iránymutatást is kiadott az Európai Adatvédelmi Testület (EDPB), amelyek a személyes adatok kezelését és védelmét szabályozó 2016/679. számú Általános Adatvédelmi Rendelet (GDPR) kötelező értelmezésének szerepét töltik be az Európai Unióban. Cikkünkben a webes adatkinyerésről kiadott iránymutatást ismertetjük.
Mit jelent a web scraping (webes adatkinyerés)?
A web scraping olyan automatizált technikai eljárás, amelynek során egy program (crawler, scraper vagy bot) weboldalakat látogat meg, azok tartalmát letölti, majd a számára releváns adatokat strukturált formában kinyeri és eltárolja. Egy ár-összehasonlító oldal például automatikusan összegyűjti a webáruházak árait vagy egy kutatóprogram több millió internetes cikkből gyűjt szöveget. Ide tartozik az is, amikor egy generatív AI fejlesztője nyilvánosan elérhető weboldalakról gyűjt adatokat modellje betanításához.
| Olvassa el „EDPB-iránymutatás a személyes adatok anonimizálásáról” című írásunkat! |
A web scraping önmagában nem jogellenes, ha azonban a kinyert adatok személyes adatokat tartalmaznak, akkor a GDPR alkalmazandó. Ilyenkor vizsgálni kell többek között:
- van-e megfelelő jogalap az adatgyűjtésre,
- teljesülnek-e az átláthatósági követelmények,
- tiszteletben tartják-e az érintettek jogait,
- milyen célra használják fel az összegyűjtött adatokat stb.
Ez tehát különösen aktuális a generatív mesterséges intelligencia fejlesztése során, amikor nagy mennyiségű internetes adatot használnak a modellek tanítására.
OLVASSA TOVÁBB cikkünket, amelyből megismerheti
- az EDPB-iránymutatás célját,
- a web scraping formáit és működését,
- alkalmazásának adatvédelmi feltételeit, továbbá azt, hogy
- mit mond az iránymutatás a harmadik országok vállalkozásainak adatkinyeréséről.
Ez engem is érdekel
Hozzászólások (0)