In het kort
- AI-ontwikkelaars kopen en vernietigen fysieke boeken om zeldzame trainingsgegevens te verzamelen.
- Uitgeputte digitale bronnen dwingen bedrijven tot destructief scannen op industriële schaal.
- Juridische verschillen tussen de auteursrechtwetten van de VS en de EU wakkeren dit conflict rond intellectueel eigendom aan.
Het snijvlak van kunstmatige intelligentie en intellectueel eigendom heeft een nieuw hoogtepunt bereikt nu AI-ontwikkelaars naar verluidt enorme hoeveelheden fysieke literatuur kopen en ontmantelen om hun trainingsmodellen te voeden.
Berichten van verschillende nieuwsmedia in de VS, Duitsland en Zwitserland wijzen op een sterke stijging in de aankoop van tweedehandsboeken, met name academische en non-fictieboeken uit de jaren 70. Europese boekhandels hebben een ongewoon groot aantal bestellingen opgemerkt van een Canadese onderneming genaamd Zoom Books, die deze boeken naar verluidt verzamelt voor digitalisering.
Opkomst van destructief scannen
Het beschreven proces wordt vaak ‘destructief scannen’ genoemd. Bij deze methode worden boeken naar verwerkingscentra gestuurd waar de ruggen worden verwijderd en de pagina’s door industriële scanners worden gehaald, waarna het fysieke papier wordt gerecycled.
Er zijn aanwijzingen dat Anthropic, via een initiatief genaamd ‘Project Panama’, miljoenen dollars in deze strategie heeft geïnvesteerd, waarbij experts zijn ingezet die eerder betrokken waren bij de grootschalige digitaliseringsinspanningen van Google. Hoewel Zoom Books de beweringen dat het teksten vernietigt voor AI-doeleinden heeft ontkend, hebben deze berichten de wereldwijde discussie over het auteursrecht weer aangewakkerd.
Jacht op uitgeputte data
Volgens Jannis Lennartz van de Humboldt-universiteit is de verschuiving naar fysieke boeken het gevolg van het feit dat AI-bedrijven de beschikbare digitale data hebben uitgeput. Deze trend benadrukt een aanzienlijke juridische kloof tussen de VS en Europa. In de Verenigde Staten hebben rechtbanken vaak de kant van AI-bedrijven gekozen door zich te beroepen op de ‘fair use’-doctrine, hoewel dit geen volledige immuniteit biedt voor al het auteursrechtelijk beschermde materiaal.
De Europese Unie daarentegen hanteert de richtlijn inzake de digitale eengemaakte markt, die datamining toestaat maar makers de mogelijkheid biedt om zich hiertegen te verzetten. Dit zorgt voor een juridisch grijs gebied voor oudere publicaties waarvoor geen duidelijke instructies voor verzet bestaan of waarvan de oorspronkelijke auteurs zijn overleden.
Eerdere juridische strijd
Deze huidige controverse weerspiegelt de eerdere juridische strijd rond de digitalisering van miljoenen boeken door Google, die de Amerikaanse rechtbanken uiteindelijk als transformatief en legaal beschouwden.
De literaire gemeenschap blijft echter weerstand bieden. In een symbolische daad van verzet brachten duizenden auteurs onlangs een leeg boek uit met de titel ‘Don’t Steal This Book’ om te protesteren tegen het ongeoorloofde gebruik van hun intellectuele eigendom.
Digitale grenzen
De spanning is ook overgeslagen naar digitale platforms. Amazon kwam onlangs onder vuur te liggen na de introductie van een AI-gestuurde interactieve functie voor de Kindle.
Ondanks de verzekering van het bedrijf dat de tool dient als een geavanceerde zoekfunctie en geen boekinhoud gebruikt voor het trainen van modellen, blijven veel schrijvers sceptisch over hoe hun auteursrechtelijk beschermde werken worden ingezet in het AI-tijdperk.
