Wie schreef de boeken die uw chatbot las?

Eva
Van Remoortel

Elke dag stellen miljoenen mensen vragen aan ChatGPT en andere AI-chatbots. Binnen enkele seconden verschijnt een antwoord. Maar waar halen die systemen eigenlijk hun kennis vandaan? Achter de vlotte antwoorden schuilt een ongemakkelijke realiteit die steeds vaker tot juridische discussies leidt. Sommige generatieve AI-modellen werden getraind met miljoenen illegaal verkregen boeken.

Die vaststelling raakt aan een fundamentele vraag. Mag technologische innovatie bouwen op illegaal verkregen kennis?

In een recente masterproef aan de KU Leuven Van Kunst naar Kunstmatigheid onderzocht Eva Van Remoortel wat het auteursrecht in Europa hierover zegt. De conclusie is opvallend duidelijk: commerciële AI-bedrijven mogen auteursrechtelijk beschermde boeken uit illegale online bibliotheken niet gebruiken om hun modellen te trainen. Wordt de rechtsgrond waarop AI-bedrijven zich beroepen daarmee drijfzand?

De weg van roman naar algoritme

Het scenario is eenvoudig. Een auteur werkt jarenlang aan een boek. Vervolgens duikt dat boek op in een illegale online bibliotheek, waar het gratis kan worden gedownload, zonder toestemming van de schrijver of uitgever. Niet gekocht, niet geleend. Gestolen. Daarna belandt het in de enorme datasets waarmee een AI-model leert schrijven, denken en redeneren.

Dergelijke websites, schaduwbibliotheken genoemd, bestaan al jaren. Het bekendste voorbeeld is Library Genesis of LibGen. Miljoenen auteursrechtelijk beschermde boeken zijn er met enkele muisklikken te downloaden.

In recente Amerikaanse rechtszaken tegen AI-bedrijven, zoals Meta en Anthropic, kwam aan het licht dat illegale boeken uit dit soort bibliotheken werden gebruikt om taalmodellen te trainen – ook boeken van Belgische auteurs.

Dat raakt een gevoelige snaar. Generatieve AI mag dan razendsnel teksten produceren, maar draait op boeken die ooit door mensen zijn geschreven. Zonder auteurs, geen taalmodel.

Wat zegt het Europese auteursrecht?

Een uitgebreide juridische analyse van het Europese auteursrecht geeft een verrassend helder antwoord. Het auteursrecht geeft auteurs het exclusieve recht om hun werk te laten reproduceren. Tegelijk bestaat er echter een uitzondering voor commerciële tekst- en datamining. Die techniek laat toe grote hoeveelheden tekst automatisch te analyseren om patronen, verbanden en structuren te ontdekken. Maar daar hangt wel een belangrijke voorwaarde aan vast: de gebruikte werken moeten rechtmatig toegankelijk zijn.

Daar gaat het mis. Dat een boek publiek beschikbaar is op het internet, betekent niet automatisch dat het legaal beschikbaar is. Een werk dat zonder toestemming van de auteur online staat, blijft een illegale bron.

Volgens de thesis van Van Remoortel vallen boeken uit dergelijke schaduwbibliotheken daarom buiten de bestaande Europese uitzondering voor commerciële tekst- en datamining. Voor de betrokken AI-bedrijven vormt dat een belangrijke juridische beperking.

De economische inzet

De discussie gaat inmiddels echter over veel meer dan een technische interpretatie van auteursrechten. De Europese boekensector vertegenwoordigt een markt van meer dan 36 miljard euro en biedt werk aan ruim een half miljoen mensen. Jaarlijks verschijnen ongeveer 580.000 nieuwe titels. Achter elk boek zitten auteurs, vertalers en uitgevers die leven van inkomsten uit creatieve arbeid.

Tegelijkertijd groeit de economische macht van AI-bedrijven in snel tempo. Terwijl auteurs vrezen voor inkomensverlies en concurrentie van automatisch gegenereerde teksten, realiseren sommige spelers in de AI-sector inmiddels miljardenomzetten. Dat voedt het gevoel van een groeiende kloof: technologiebedrijven bouwen winstgevende systemen op teksten, waarvoor de auteurs nooit werden vergoed.

Precies daarin schuilt de paradox van generatieve AI. De technologie lijkt steeds autonomer te worden, maar blijft afhankelijk van menselijke creativiteit. Onderzoek wijst erop dat taalmodellen kwaliteit verliezen, wanneer ze zich voeden met door AI gegenereerde teksten, een fenomeen dat bekendstaat als model collapse

Met andere woorden: zonder menselijke auteurs droogt uiteindelijk de bron van de generatieve AI onherroepelijk op.

Waarom auteurs naar de rechter trekken

Steeds meer schrijvers zoeken daarom hun gelijk in de rechtbank, te beginnen in de Verenigde Staten. Het Amerikaanse auteursrecht verschilt sterk van het Europese systeem. Rechters kunnen in de VS per geval afwegen of het gebruik van beschermd materiaal toch geoorloofd is via de fair use-doctrine. Europa werkt met een gesloten systeem van uitzonderingen. Wat niet uitdrukkelijk is toegestaan, blijft verboden.

Toch blijkt ook in de VS de herkomst van trainingsdata een heikel punt. Een rechter stelde in een zaak tegen Anthropic dat het downloaden en bewaren van miljoenen illegale boekkopieën niet zomaar kan worden goedgepraat omdat het een innovatieve techniek ten goede komt. De zaak eindigde uiteindelijk in een schikking van 1,5 miljard dollar, de grootste auteursrechtelijke schikking ooit in de VS.

Ondanks de verschillen tussen beide rechtssystemen groeit daardoor aan weerszijden van de Atlantische Oceaan hetzelfde besef: innovatie kent grenzen. Illegale bronnen vormen er daar één van.

Gelijk hebben is niet hetzelfde als gelijk krijgen

Toch betekent juridische duidelijkheid nog geen overwinning voor auteurs. 

Het grootste probleem blijkt de handhaving. Veel AI-modellen worden buiten Europa getraind, terwijl ze wereldwijd worden gebruikt. Bovendien weten auteurs meestal niet of hun boeken in trainingsdatasets zijn opgenomen. Zelfs wanneer zij vermoeden dat hun rechten werden geschonden, ontbreekt vaak het bewijs.

Daardoor ontstaat een ongelijke situatie. Technologiebedrijven beschikken over de data, de middelen en de technische expertise. Individuele auteurs en kleine uitgevers moeten ondertussen bewijzen dat hun rechten geschonden zijn, zonder toegang tot de informatie die daarvoor nodig is.

De Europese AI-verordening verplicht bedrijven wel tot meer transparantie, maar in de praktijk blijft vaak onduidelijk welke boeken precies werden gebruikt. Trainingsdata worden vaak omschreven met vage termen als “publiek beschikbare inhoud” of “data van het open web”.

Voor een auteur die wil nagaan of zijn boek werd gebruikt, is dat ongeveer even informatief als een restaurantrekening waarop alleen “eten” staat.

België probeert intussen de kraan dicht te draaien. In een rechtszaak liet de ondernemingsrechtbank in Brussel de toegang blokkeren tot verschillende schaduwbibliotheken, waaronder LibGen. Dat maakt het moeilijker om nieuwe illegale kopieën te verspreiden. Maar voor boeken die al in AI-systemen zijn verwerkt, biedt zo'n blokkering geen oplossing meer. Zodra een taalmodel eenmaal met bepaalde teksten is getraind, kunnen die niet zomaar weer worden verwijderd. Dat vraagt een technisch ingewikkeld en bijzonder duur proces.

Daardoor verschuift het debat geleidelijk van de vraag wat wettelijk mag, naar de vraag wat praktisch afdwingbaar is. Daarmee legt de masterproef een ongemakkelijke waarheid bloot. Het Europese auteursrecht weet perfect wat verboden is. Het weet alleen veel minder goed hoe het dat verbod moet afdwingen in een digitale economie die moeiteloos grenzen overschrijdt.

Intussen ontstaan er ook alternatieven. Sommige AI-projecten werken uitsluitend met gelicentieerde data. Nieuwe labels moeten zichtbaar maken welke boeken volledig door mensen zijn geschreven. Het zijn signalen dat een andere aanpak mogelijk is.

Meer dan een juridisch conflict

De belangrijkste conclusie van het onderzoek reikt daarom verder dan het auteursrecht alleen. De discussie gaat niet enkel over schrijvers tegenover technologiebedrijven. Ze raakt aan een bredere maatschappelijke vraag: hoe beschermen we menselijke creativiteit in een economie die steeds meer draait op data? 

Achter elke dataset schuilt uiteindelijk immers menselijk werk. Achter elk boek zit iemand die jaren heeft onderzocht, geschreven en herschreven.

De toekomst van AI zal niet alleen afhangen van krachtigere computers of betere algoritmen. Ze zal ook afhangen van de vraag hoe een samenleving omgaat met de makers van de kennis waarop die technologie gebouwd is. 

Want zonder nieuwe boeken valt er uiteindelijk, zelfs voor het slimste AI-model, niets nieuws meer te leren.

Bibliografie

Bibliografie

A. Wetgeving

  1. Internationale verdragen
  • Conventie van Bern van 24 juli 1971 voor de bescherming van werken van letterkunde en kunst (Berner Conventie), van 9 september 1886, aangevuld te Parijs op 4 mei 1896, herzien te Berlijn op 13 november 1908, aangevuld te Bern op 20 maart 1914, herzien te Rome op 2 juni 1928, te Brussel op 26 juni 1948, te Stockholm op 14 juli 1967 en te Parijs op 24 juli 1971, United Nations Treaty Series 1161, 3; goedgekeurd in België bij wet van 25 maart 1999, BS 10 november 1999, 41891.
  • Agreement on Trade-Related Aspects of Intellectual Property Rights, Annex 1C of the Marrakesh Agreement Establishing the World Trade Organization (TRIPs Agreement) van 15 april 1994, http://www.wto.org/english/tratop_e/trips_e/t_agm0_e.htm
  • WIPO Copyright Treaty (WCT) van 20 december 1996, http://www.wipo.int/treaties/en/ip/wct/trtdocs_wo033.html
  1. Europese wetgevende documenten
  • Verordening (EU) 2024/1689 van het Europees Parlement en de Raad van 13 juni 2024 tot vaststelling van geharmoniseerde regels betreffende artificiële intelligentie en tot wijziging van de Verordeningen (EG) nr. 300/2008, (EU) nr. 167/2013, (EU) nr. 168/2013, (EU) 2018/858, (EU) 2018/1139 en (EU) 2019/2144, en de Richtlijnen 2014/90/EU, (EU) 2016/797 en (EU) 2020/1828 (AI‑verordening), Pb. 2024, L 1689.
  • Richtlijn 2001/29/EG van het Europees Parlement en de Raad van 22 mei 2001 betreffende de harmonisatie van bepaalde aspecten van het auteursrecht en de naburige rechten in de informatiemaatschappij (InfoSoc‑richtlijn), Pb. 2001, L 167, 10.
  • Richtlijn 2004/48/EG van het Europees Parlement en de Raad van 29 april 2004 betreffende de handhaving van intellectuele eigendomsrechten (Richtlijn handhaving), Pb. 2004, L 195, 16.
  • Richtlijn (EU) 2019/790 van het Europees Parlement en de Raad van 17 april 2019 inzake auteursrechten en naburige rechten in de digitale eengemaakte markt en tot wijziging van Richtlijnen 96/9/EG en 2001/29/EG (DSM‑richtlijn), Pb. 2019, L 130, 92.

3. Nationaal

België

  • Wet van 28 februari 2013 tot invoering van het Wetboek van Economisch Recht, BS 29 maart 2013.
  • Wet van 19 april 2014 houdende invoeging van Boek XI “Intellectuele eigendom” in het Wetboek van Economisch Recht, en houdende invoeging van bepalingen eigen aan Boek XI in de Boeken I, XV en XVII van hetzelfde Wetboek, BS 12 juni 2014.
  • Wet van 19 juni 2022 Wet tot omzetting van Richtlijn (EU) 2019/790 van het Europees Parlement en de Raad van 17 april 2019 inzake auteursrechten en naburige rechten in de digitale eengemaakte markt en tot wijziging van Richtlijnen 96/9/EG en 2001/29/EG(1), BS 1 augustus 2022.
  • Koninklijk besluit van 18 april 2024 betreffende de oprichting van de Dienst voor de strijd tegen inbreuken op het auteursrecht en de naburige rechten op het internet en tegen de expoitatie van onwettige online kansspelen, BS 6 mei 2024.
  • Wetsontwerp tot omzetting van Richtlijn (EU) 2019/790 van het Europees Parlement en de Raad van 17 april 2019 inzake auteursrechten en naburige rechten in de digitale eengemaakte markt en tot wijziging van Richtlijnen 96/9/EG en 2001/29/EG, Parl. St. Kamer 2021-22, nr. 55K2608/001, https://www.dekamer.be/FLWB/PDF/55/2608/55K2608001.pdf.

Verenigde Staten 

  • Copyright Act of 1976, 17 U.S.C. § 101 e.v., in het bijzonder § 107 (fair use) en § 504 (statutory damages).

B. Rechtspraak

1. Internationale en buitenlandse rechtspraak

Frankrijk

  • Tribunal de grande instance Paris 7 maart 2019, ‘Elsevier e.a. t. Sci‑Hub’, onuitg., https://cdn2.nextinpact.com/medias/jugement-sci-hub-mars-2019.pdf
  • Tribunal judiciaire de Paris, ‘Syndicat national de l’édition (SNE), Syndicat national des auteurs et des compositeurs (SNAC) en Société des Gens de Lettres (SGDL) t. Meta Platforms Inc.’.

Duitsland

  • Landgericht Hamburg 27 september 2024, 310 O 227/23, ‘Kneschke t. LAION e.V.’

Verenigde Staten

  • United States District Court, Northern District of California, Bartz et al. v. Anthropic PBC, No. 3:24 cv 05417 WHA, 23 juni 2025.
  • United States District Court, Northern District of California, Kadrey et al. v. Meta Platforms, Inc., No. 3:23 cv 03417 VC, 25 juni 2025. 
  • United States District Court, Northern District of California, Carreyrou v. Anthropic PBC, 3:25-cv-10897. 
  • United States District Court, Northern District of California, Cruz et al v. Anthropic PBC, 3:26-cv-04482.

2. Europese rechtspraak

  • HvJ 16 juli 2009, C‑5/08, ‘Infopaq International A/S t. Danske Dagblades Forening’, ECLI:EU:C:2009:465.
  • HvJ 1 december 2011, C‑145/10, ‘Painer t. Standard VerlagsGmbH’, ECLI:EU:C:2011:798.
  • HvJ 4 oktober 2011, C‑403/08 en C‑429/08, ‘Football Association Premier League e.a. t. QC Leisure en Murphy t. Media Protection Services Ltd’, ECLI:EU:C:2011:631.
  • HvJ 1 maart 2012, C‑604/10, ‘Football Dataco Ltd e.a. t. Yahoo! UK Ltd e.a.’, ECLI:EU:C:2012:115.
  • HvJ 10 april 2014, C‑435/12, ‘ACI Adam BV e.a. t. Stichting de Thuiskopie e.a.’, ECLI:EU:C:2014:254.
  • HvJ 5 maart 2015, C‑463/12, ‘Copydan Båndkopi t. Nokia Danmark A/S’, ECLI:EU:C:2015:144.
  • HvJ 8 september 2016, C‑160/15, ‘GS Media BV t. Sanoma Media Netherlands BV e.a.’, ECLI:EU:C:2016:644.
  • HvJ 10 november 2016, C‑174/15, ‘Vereniging Openbare Bibliotheken t. Stichting Leenrecht’, ECLI:EU:C:2016:856.
  • HvJ 26 april 2017, C‑527/15, ‘Stichting Brein t. Jack Frederik Wullems’, ECLI:EU:C:2017:300.
  • HvJ 7 augustus 2018, C‑161/17, ‘Land Nordrhein‑Westfalen t. Dirk Renckhoff’, ECLI:EU:C:2018:634.
  • HvJ 29 juli 2019, C‑469/17, ‘Funke Medien NRW GmbH t. Bondsrepubliek Duitsland’, ECLI:EU:C:2019:623.
  • HvJ 29 juli 2019, C‑516/17, ‘Spiegel Online GmbH t. Volker Beck’, ECLI:EU:C:2019:625.
  • HvJ, zaak C‑250/25, ‘Like Company t. Google Ireland Limited’, prejudiciële verwijzing, Pb. C 2025, 3039.

3. Belgische rechtspraak

  • Voorz. Nederlandstalige ondernemingsrechtbank (afd. Brussel) 16 juli 2025, ‘Librius, Copiebel, GAU, GEWU, VAV, ADEB en Scam t. diverse tussenpersonen’, onuitg.

C. Rechtsleer

1. Boeken

  • VANHEES H. en GEIREGAT S., Handboek intellectuele rechten (studenteneditie), Brussel, LeA Publishers, 2024.
  • VAN DAMME K., Compendium Belgisch Auteursrecht, Larcier-Intersentia, 2025.

2. Artikels

D. Andere bronnen

1. Europese documenten

Documenten van de Europese Commissie

Documenten van het Europees Parlement

Documenten van het AI-bureau

Documenten van het EUIPO

2. Overige teksten

 

3. Online bronnen

(laatst geconsulteerd op 15 mei 2026)

https://booksbypeople.org/

Download scriptie (1.33 MB)
Universiteit of Hogeschool
KU Leuven
Thesis jaar
2026
Promotor(en) en begeleiders
Jozefien Vanherpe