NoézisMI-hírek magyarul
Szabályozás · theguardian.com

Az Anthropic destruktív könyvbeolvasással képezte az AI-modelljét

Az amerikai bíróság által nyilvánosságra hozott dokumentumok szerint az Anthropic mesterséges intelligencia-cég raktárakat telt meg könyvekkel, amelyeket fizikailag megsemmisített, hogy azok tartalmát felhasználja Claude nyelvi modelljének tanítására.

Az Anthropic a »Project Panama« elnevezésű projektben szisztematikusan beszerzett és destruktív beolvasással digitalizált könyveket, hogy magas minőségű szöveges adatokhoz jusson az AI-modell tanításához. A kaliforniai bíróság által vizsgált Bartz v Anthropic ügyben kiderült, hogy a cég erre azért választotta ezt a módszert, mert a szerzői jogok kezelése »jogi és üzleti nehézségnek« tűnt számára. Bár az Anthropic először kalóz forrásokat használt, később a szerzői jogi aggályok miatt a destruktív beolvasásra váltott.

A módszer lényege, hogy a cég könyveket vásárolt, azok gerincét és lapjait felszeletelték, majd beolvasták őket digitális formátumra, végül az eredeti nyomtatott példányokat megsemmisítették. A bíróság szerint ez az eljárás az amerikai szerzői jogi törvény »fair use« (tisztességes felhasználás) doktrínája alá tartozik, mivel az eredeti szövegeket »transzformatív« módon, új elektronikus formátumba konvertálták.

A szerző felhívja a figyelmet arra, hogy az eljárás precedenst teremthet más mesterséges intelligencia-cégek számára. Aggályként merül fel, hogy az Egyesült Államoknak szinte nincsenek jogi rendelkezései az amerikai kulturális örökség védelméről vagy a könyvek kezeléséről. A 2022 után az AI-generált szövegek tömeges megjelenésével párhuzamosan felvetődik a kérdés: szükséges-e az emberi szerzőket és az eredeti szöveges műveket a kulturális örökség részének tekinteni és védeni.