• Home
  • /
  • Nieuws
  • /
  • OpenAI’s ChatGPT en Amazon KDP onder vuur: AI-boeken met gestolen teksten

Door Dave

mei 24, 2026

In online boekhandels verschijnen steeds meer door AI geschreven boeken. Die teksten lijken soms sterk op werk van echte schrijvers, omdat trainingsdata uit illegale kopieën komt. Dit speelt in Nederland en in de rest van Europa, en zorgt voor juridische en ethische vragen. De discussie over Europese AI-verordening gevolgen overheid en uitgevers wordt urgenter, omdat regels en toezicht snel veranderen.

AI-boeken kopiëren bestaande teksten

Generatieve AI is software die nieuwe tekst maakt op basis van enorme hoeveelheden voorbeeldteksten. Modellen zoals GPT-4 van OpenAI, Gemini van Google en Llama van Meta voorspellen woord voor woord wat waarschijnlijk volgt. Dat werkt goed voor snelheid en samenhang, maar kan ook leiden tot het letterlijk herhalen van zinnen uit het geheugen van het model. Dit risico groeit als trainingsdata ongefilterd en zonder toestemming is verzameld.

Met zelfpublicatieplatformen zoals Amazon Kindle Direct Publishing kunnen makers in enkele uren een “nieuw” boek online zetten. Sommige van deze titels bevatten passages die sterk doen denken aan bestaande romans of non-fictie. Kwaliteitscontrole schiet vaak tekort, waardoor dubieuze boeken tijdelijk online blijven. Lezers en auteurs merken dat pas op na aankoop of wanneer overeenkomsten openbaar worden gedeeld.

Onderzoekers tonen aan dat grote taalmodellen onder bepaalde prikkels teksten uit trainingssets bijna woordelijk kunnen reproduceren. Dit gebeurt vooral bij minder bekende of vaak herhaalde passages. De grens tussen ‘in stijl schrijven’ en ‘kopiëren’ is technisch dun, maar juridisch cruciaal. Juist dat maakt handhaving en bewijs lastig voor platforms en rechthebbenden.

Omstreden dataset Books3

In de kern van het probleem staat de herkomst van trainingsdata. De omstreden dataset Books3 bevatte volledige boeken die zonder toestemming online waren gezet en daarna zijn gebundeld. Onderzoekers en ontwikkelaars gebruikten de set voor het trainen en testen van open modellen. Daarmee belandden complete, auteursrechtelijk beschermde werken in de leercycli van algoritmen.

Books3 bevat circa 183.000 volledige boeken uit illegale bronnen, die als trainingsdata zijn gebruikt.

Auteurs en uitgevers stellen dat dit neerkomt op ongeoorloofd kopiëren en hergebruik. Techbedrijven beroepen zich geregeld op uitzonderingen zoals fair use in de VS of tekst- en datamijnbouw in de EU. In de praktijk is toestemming zelden expliciet gevraagd of vastgelegd. Dat leidt tot rechtszaken, schikkingen en een roep om duidelijke licenties.

Ook open-sourcegemeenschappen worstelen met de erfenis van dergelijke datasets. Sommige verzamelingen zijn offline gehaald of gelabeld, maar kopieën blijven circuleren. Transparantie over gebruikte data is nog geen vaste praktijk. Zonder heldere bronvermelding blijft het voor schrijvers onmogelijk om na te gaan of hun werk is gebruikt.

Platforms pakken misbruik aan

Grote winkels en uitgevers zetten stappen, maar met wisselend resultaat. Amazon KDP vraagt sinds 2023 om te melden of een boek met AI is gemaakt en beperkt het aantal dagelijkse uploads. Toch glippen problematische titels door de controle, mede omdat automatische detectie van AI-tekst onbetrouwbaar is. Handmatige beoordeling kost tijd en schaalbaar is die aanpak niet.

Andere winkels, zoals Apple Books en Kobo, leggen de verantwoordelijkheid vooral bij uitgevers en distributeurs. In Europa stuurt de Digital Services Act grote platforms aan op beter risicobeheer en klachtenafhandeling. Dat kan leiden tot snellere verwijdering en betere herkomstlabels. Voor kleinere platforms betekent dit extra kosten en nieuwe procedures.

Detectie blijft een technisch mijnenveld. AI-watermerken en classificatietools werken onvolledig en zijn gemakkelijk te omzeilen. Daarom vragen brancheorganisaties om “content provenance”: digitale herkomstlabels die meereizen met een tekst. Zonder zo’n ketenbewijs blijft het voor lezers onduidelijk wat ze kopen.

Europese AI-verordening: gevolgen overheid

De Europese AI-verordening (AI Act) legt generatieve systemen transparantieplichten op. Zo moeten aanbieders duidelijk maken hoe ze omgaan met auteursrechtelijk beschermd materiaal en welke maatregelen ze nemen tegen inbreuk. Ook kunnen lidstaten toezichthouders aanwijzen die klachten behandelen en sancties opleggen. Voor overheden betekent dit straks nieuwe taken bij inkoop en toezicht.

Daarnaast geldt in de EU het auteursrechtkader met uitzonderingen voor tekst- en datamijnbouw. Rechthebbenden mogen een machineleesbare opt-out publiceren om scraping te verbieden. Wie die opt-out negeert, loopt juridisch risico, zeker bij commercieel gebruik. Dit dwingt ontwikkelaars richting licenties of schoongefilterde datasets.

Als trainingsdata ook persoonsgegevens bevat, geldt de AVG. Ontwikkelaars moeten dan een geldige grondslag hebben, dataminimalisatie toepassen en risico’s beperken. Memoirs en non-fictie kunnen dergelijke gegevens bevatten, wat extra zorgplicht meebrengt. Voor publieke instellingen wegen deze eisen, op het moment van schrijven, extra zwaar bij de inzet van AI-teksten.

Nederland zoekt heldere afspraken

In Nederland pleiten auteurs- en uitgeversorganisaties voor licentiemodellen en transparantie over gebruikte data. Zij willen dat AI-bedrijven vooraf afspraken maken over vergoeding en bronvermelding. Ook vragen zij platforms om snelle verwijdering van titels die te veel lijken op bestaand werk. Dat moet de schade voor schrijvers en het vertrouwen van lezers beperken.

Boekverkopers en bibliotheken vragen om duidelijke labels bij AI-gegenereerde werken. Een zichtbaar herkomstlabel helpt bij selectie, collectiebeleid en klachtenafhandeling. Voor het onderwijs is herkomstinformatie belangrijk bij leeslijsten en leermiddelen. Zo voorkomen scholen dat dubieuze titels in het curriculum terechtkomen.

Consumenten kunnen zelf ook alert zijn. Let op plotselinge stijlwisselingen, herhalingen en onlogische alinea’s. Controleer de uitgever en publicatiedatum, en wees kritisch bij extreem lage prijzen. Meld vermoedens van plagiaat bij de winkel en de uitgever, zodat titels sneller worden onderzocht en zo nodig verwijderd.

Over de schrijver 

Dave

Hoi, ik ben Dave – schrijver, onderzoeker en nieuwsgierige geest achter AIInsiders.nl. Ik hou me bezig met de manier waarop technologie ons leven verandert, en vooral: hoe we dat een beetje kunnen bijbenen. Van slimme tools tot digitale trends, ik duik graag in de wereld achter de schermen.

Mijn stijl? Lekker helder, soms kritisch, altijd eerlijk. Geen onnodig jargon of overdreven hype, maar praktische inzichten waar je echt iets aan hebt. AI is niet eng of magisch – het is interessant, en ik help je graag om dat te zien.

Meer lezen

05/10/2026 15:46

Foto: Zulfugar Karimov via Unsplash OpenAI-topman Sam Altman vindt dat de wereld moet accepteren dat AI ook schade veroorzaakt, omdat de voordelen groter zijn. Dat lees verder

Altman: wereld moet ‘slechte dingen’ van AI accepteren

05/10/2026 14:52

Foto: Jonas Leupe via Unsplash Rabobank en ING hebben dit jaar al echte betalingen laten uitvoeren door een AI-agent. De assistent zocht binnen een budget lees verder

Je AI-assistent rekent straks zelf af: ING en Rabobank testen het al

05/10/2026 14:05

Over vier jaar kan AI in Nederland meer stroom gebruiken dan alle 1,7 miljoen woningen in Zuid-Holland samen. Dat blijkt uit een analyse van AI lees verder

Datacenters verbruiken straks driekwart van wat alle Nederlandse huishoudens gebruiken

05/10/2026 12:28

Studenten lopen bij Fontys rond met AI-brillen, terwijl veel medestudenten en medewerkers die niet herkennen. Dat meldt hogeschoolmedium Bron na een rondgang op drie campussen. lees verder

Journalist loopt met AI-bril tussen studenten in Venlo, Tilburg en Sittard: bijna niemand merkt de camera op
>