Mesterséges intelligencia cégek tömeges mennyiségben vásárolnak fel régi könyveket betanításhoz
Az AI-vállalatok nagy mennyiségben vásárolnak fel régebbi könyveket, hogy azokkal nyelvi modelleket tanítanak be, majd a beszkennelés után megsemmisítik azokat. A gyakorlat jogi szürkezónában működik az amerikai szerzői jogi ítéletek után.
Az AI-ipar körül terjedő hír szerint a mesterséges intelligencia fejlesztő cégei antik és régi könyveket vásárolnak fel tömeges mennyiségben, hogy azokat beszkenneljék és utána megsemmisítsék. A német sajtó az alexandriai könyvtár legendás pusztulásához hasonlította az esetet, amely azonban történelmileg nem pontos analógia.
Valójában nem antik vagy értékes műről van szó, hanem az 1972 óta létező ISBN-számmal rendelkező régebbi könyvekről, amelyeket az antikvár kereskedésben »raktárkészletnek« tekintik. Az AI-cégek ezeket a könyveket nagy mennyiségben vásárolják fel, hogy azokkal a nagy nyelvi modelleket (LLM-eket) tanítsák be.
Az amerikai bíróság szerzői jogi döntése után az AI-vállalatok már nem tölthetnek le könyveket az internetről képzéshez. Azonban a jogi értelmezés szerint a fizikai könyvek beszkennelése nem jelent szerzői jogi megsértést, ha azokat előzetesen legálisan megvásárolták, és a beszkennelés után megsemmisítik.
A gyakorlat mögött azonban nem áll szándékos kulturális ellenállás: az AI-rendszerek matematikai alapon működnek, és a »raktárkészletből« való tanítás ugyanúgy erősíti az adatbázis meglévő torzításait, mint bármely más forrás. Az elemzők szerint ez végül az »öreg fehér férfiak mesterséges intelligenciáját« eredményezi.
A történelem tanulsága szerint a nagy birodalmak – akárcsak az ókori Róma – végül szintén megsemmisülnek, így a jelenlegi tech-platformok monopolisztikus hatalma sem lesz örök.