Bronnen
Blijf AI-kunst voor
Ontvang de beste AI- en AI-kunstverhalen van de week in je inbox — geselecteerd, kort en gratis.
Gratis. Je kunt je altijd afmelden.
Bespreek dit met
Kies een companion en ontdek wat die van dit verhaal vindt

Maya benchmarkt elke nieuwe modelrelease — eerst de cijfers, nooit de hype.
Ontvang de beste AI- en AI-kunstverhalen van de week in je inbox — geselecteerd, kort en gratis.
Gratis. Je kunt je altijd afmelden.
Kies een companion en ontdek wat die van dit verhaal vindt
Een AirTag verborgen in een zeldzaam boek volgde het exemplaar naar een Amazon-faciliteit waar het werd vernietigd — concreet fysiek bewijs dat Amazon zeldzame teksten verwerft en versnippert om trainingsdata te oogsten voor zijn AI-modellen.
De AirTag-bevinding, gerapporteerd door Ars Technica, maakt van wat omstandig vermoeden was een gedocumenteerd feit. Zeldzame boekverkopers hadden al een verontrustend patroon opgemerkt — grootschalige aankopen van ongewone of niet meer leverbare exemplaren, gevolgd door stilte — maar tot nu toe was er geen direct bewijs van wat er na de verkoop gebeurde.

Amazon heeft zeldzame fysieke boeken verworven en vernietigd om tekst te extraheren voor AI-trainingsdata.
Afbeelding: TechCrunch / TechCrunch AI
De aantrekkingskracht van fysieke zeldzame teksten voor AI-training is eenvoudig te verklaren: deze modellen hebben al het grootste deel van wat op het open web beschikbaar is verwerkt. Boeken die nooit zijn gedigitaliseerd — beperkte oplagen, regionale geschiedenissen, gespecialiseerde academische werken — vertegenwoordigen een werkelijk nieuw trainingssignaal. Volgens TechCrunch is die schaarste precies wat ze aantrekkelijk maakt voor AI-ontwikkelaars die wedijveren om hun trainingscorpora te onderscheiden.
De ironie is moeilijk te negeren. Amazon bouwde zijn volledige bedrijf op de verkoop van boeken. Het interne AI-datateam gebruikt blijkbaar een T. rex die een boek opeet als logo — een detail dat suggereert dat de vernietiging niet toevallig is, maar doelbewust en van een eigen identiteit voorzien.
Het volgapparaat volgde het boek van het verkooppunt door het logistieke netwerk van Amazon naar een faciliteit waar het signaal op een manier verdween die consistent is met vernietiging. De methode is recht door zee maar effectief: een klein, commercieel verkrijgbaar tracker dat een tijdgestempeld locatiespoor achterlaat dat eindigt bij een Amazon-locatie.
Wat onbevestigd blijft, is de omvang. Amazon heeft niet bekendgemaakt hoeveel boeken het op deze manier heeft verworven, welke titels of categorieën worden beoogd, of welk juridisch kader — als dat er al is — het van toepassing acht op de auteursrechtelijke status van de gescande inhoud. De vernietiging van het fysieke object lost de vragen over het recht om de tekst digitaal te reproduceren voor trainingsdoeleinden niet op, en er bestaat geen onafhankelijke audit van het programma.
Dit verhaal is een concreet gegeven in een bredere verschuiving: AI-bedrijven gaan voorbij het web en duiken fysieke archieven, bibliotheken en markten voor niet meer leverbare boeken in om trainingsmateriaal te vinden dat concurrenten nog niet hebben opgenomen. Die race heeft directe gevolgen voor iedereen die geeft om cultureel behoud — en voor makers die vertrouwen op AI-tools die zijn getraind op diverse, hoogwaardige tekst.
Voor AI-kunstmakers is de vraag naar trainingsdata van belang omdat de rijkdom en specificiteit van het tekstbegrip van een model bepaalt hoe goed het genuanceerde prompts interpreteert. Een model getraind op werkelijk zeldzaam historisch en literair materiaal kan verzoeken om periodiek accurate stijlen, obscure artistieke referenties of complexe narratieve prompts anders verwerken dan een model dat uitsluitend op webtekst is getraind. Of de aanpak van Amazon daadwerkelijk meetbare kwaliteitsverbeteringen in zijn modellen oplevert, is nog niet bekend.
Het Charmloop-artikel over eerdere vermoedens van boekverkopers behandelde het omstandige bewijs dat aan deze bevestiging voorafging — de AirTag-bevinding sluit die cirkel. Het bredere debat over dataprovenance sluit ook aan bij voortdurende vragen over wat AI-bedrijven doen met content die op hun platforms wordt gemaakt, een patroon dat zich afspeelt op het gebied van streaming, sociale media en nu ook fysieke media.
Amazon heeft niet publiekelijk gereageerd op een van beide rapporten. Zolang dat niet gebeurt, blijft de omvang van het programma — en de juridische status ervan — een open vraag.