
AI-bedrijven scannen boeken, maar zijn ze wel zeldzaam?
Beeld via Hackaday
AI-bedrijven scannen recentelijk grote hoeveelheden boeken om hun modellen te trainen met inhoud die vóór 2002 is geschreven en daardoor vrij is van AI-gegenereerde tekst. Het proces roept protest op omdat de boeken worden vernietigd, maar de term zeldzaam is misleidend.
Veel van deze boeken zijn massaproductie sinds de invoering van het ISBN-nummer in 1970. Alleen boeken met een klein oplage en historische waarde zijn écht zeldzaam, maar die vallen niet onder de scanoperaties.
Het doel is tweeledig: losse bladen zijn makkelijker te digitaliseren dan ingebonden boeken, en door de fysieke kopie te vernietigen kunnen bedrijven auteursrechtclaims ontlopen door te beweren dat er slechts één exemplaar bestaat. Hoewel het vernietigen van boeken symbolisch zwaar weegt, is de impact op de cultuur beperkt.
Het papierrecyclingbedrijf verwerkt jaarlijks miljoenen boeken, en uitgevers pulpen onverkochte exemplaren in grotere getallen. Meer achtergrond bij dit onderwerp staat op Hackaday.









