Web scraping a generatív mesterséges intelligencia korában: a jogszerű adatgyűjtés határai az AI Act és a GDPR tükrében
A generatív MI-modellek fejlesztése nagy mennyiségű, változatos adat felhasználását igényli. A fejlesztők ezek jelentős részét nyilvánosan hozzáférhető weboldalakról, közösségi platformokról, fórumokról, híroldalakról és adatbázisokból automatizált adatgyűjtési technikákkal szerzik meg. Az Európai Adatvédelmi Testület 2026. július 7-én fogadta el a 3/2026. számú iránymutatását a generatív MI kontextusában végzett web scraping tevékenységhez fűződő adatkezelésekről. Ez jelenleg a nyilvános konzultációra elfogadott, még nem végleges változat. A nyilvánosan hozzáférhető arcképek automatizált, nagy volumenű begyűjtése nem pusztán adatgyűjtési kérdés, hanem az arcfelismerő adatbázis létrehozásának módjára tekintettel önálló AI Act szerinti tilalmat is felvet.

