/dev/null - Overig

Welke oude boeken lokale AI laten lezen?

03-08-2026, 17:55 door Anoniem, 38 reacties
Was afgelopen week in nieuws. AI bedrijven die massaal oud papier opkopen om AI te laten inlezen om een model van te maken. AD verwees naar sits 404 dat het ook zou gaan om het massaal inkopen van Nederlandstalige boeken. Niet zo vreemd, Nederlands is de vijfde taal op het internet, naar het schijnt, dus daar is een markt voor.

https://www.ad.nl/tech/boeken-worden-opgekocht-om-chatbots-te-voeden-is-nu-ook-de-nederlandse-markt-aan-de-beurt~a1d7485f/

Dan ook nog de introductie van EU model Loes. https://loes.ai/

De afgelopen dertig jaar zijn vele studenten afgestudeerd met gebruik making van internet, en veel van het door hun gebruikte bronmateriaal, staat niet meer op het web. Niet te verifieren dus, maar een hele generatie heeft zo gestudeerd,en hen beinvloed.

Dus toen kwam bij mij de vraag op: voor een Nederlandstalig AI, welke boeken / documenten / gearchiveerde webpages zou jdie zeker moeten laten bevatten, als trainingsmateriaal voor lokaal AI?

Dit is afhankelijk van wat voor onderzoeksvragen je de gebruiker wilt bedienen, nu en in de toekomst. Dat er gaten in collectief geheugen aan het vallen zijn, is duidelijk. Dat kwesties over censuur al regelmatig aan het opspelen zijn, is ook een feit. Maar opdat er gaten in het collectief geheugen gaan vallen, welke zeker niet vergeten en toevoegen aan de leerlijst van het LLM?

Ik zat zelf te denken aan allerlei taalboekjes, die er zeker in stoppen. Van boeken als Turbotaal en jongerentaal 1984 tot glossaria, vooral ook van oude techniek. Wat nog meer?

Iemand ervaring met opzetten van zo'n lokaal LLM, en wat kwam hij zoal tegen?
Reacties (38)
04-08-2026, 14:34 door _R0N_
Veel van de gebruikte bronnen hebben nooit op het web gestaan vanwege de auteursrechten. Boeken zijn betrouwbaarder dan de data op het internet, dus alle boeken zijn van belang.

Het nadeel is dat je alleen boeken mag gebruiken waarvan de auteur 70 jaar geleden is overleden (eigenlijk 71 jaar). Alle informatie is dus oud en in sommige gevallen verouderd en het taalgebruik is veranderd.
04-08-2026, 14:46 door Anoniem
Wat mij op zich interessant lijkt: wat biedt de Koninklijke Bibliotheek (gratis) aan? En wat kun je met de data data.overheid.nl via de API benaderen/gebruiken voor zoiets?
04-08-2026, 16:10 door Anoniem
Door _R0N_: Veel van de gebruikte bronnen hebben nooit op het web gestaan vanwege de auteursrechten. Boeken zijn betrouwbaarder dan de data op het internet, dus alle boeken zijn van belang.
Ik was ergens anders een bericht tegengekomen (ik dacht in het Engels) waarin werd gesteld dat het om boeken ging die ouder waren dan een aantal jaar. Het gaat ze erom dat de boeken geen door AI gegenereerde inhoud bevatten, volledig door mensen zijn geschreven.

Een probleem met hoe de huidige AI-bedrijven AI aanpakken is dat momenteel een flink deel van de nieuwe inhoud van het internet door LLM's wordt gegenereerd. Als je LLM's traint met wat door LLM's gegenereerd is krijg je slechtere resultaten dan wanneer ze het traint met tekst die door mensen is geschreven. Ik ben alweer een poos terug tegengekomen dat de nieuwere modellen, al zijn ze in bepaalde opzichten krachtiger dan hun voorgangers, ook aanzienlijk meer hallucineren dan hun voorgangers.

Bedenk dat een LLM een soort statistisch model is van de tekst waarmee die is "getraind". Als je een LLM gebruikt zal die steeds op basis van de hele voorgaande dialoog, dus wat jij hebt geschreven, wat die zelf heeft geschreven, en wat het systeem onzichtbaar nog aan instructies en aanwijzingen heeft toegevoegd, telkens opnieuw een plausibel woord of woorddeel erbij genereren, waarbij het plausibel is in termen van de vastgelegde statistieken. Er wordt niet alleen het allerwaarschijnlijkste volgende woord of woorddeel gekozen, een randomizer zorgt voor variatie. Er komt geen inhoudelijk begrip aan dat generatieproces te pas, dat is schijn, dat zat in de trainingsdata en niet in het produceren van nieuwe tekst.

Wat sowieso misgaat is dat zo'n statistisch proces ook tekst kan produceren die onzin is, de hallucinaties. Men probeert dat er weer uit te filteren, maar het is inherent aan de eigenlijke LLM dat dat gebeurt, en men houdt het niet volledig tegen. Dat betekent dat als men doorgaat met het internet als trainingsmateriaal men ook die onzin als trainingsdata gebruikt. De hoeveelheid onzin neemt toe, de kans is veel groter dat onzin uit een goede basis wordt geproduceerd dan dat per ongeluk iets dat klopt uit onzin wordt geproduceerd. De kwaliteit van de data die men van het internet kan plukken gaat dus achteruit, en de kwaliteit van wat LLM's kunnen produceren daarmee ook.

Een ander punt is dat, zelfs als LLM's niet zouden hallucineren, ze hooguit kennis die al in de trainingsdata zat in andere woorden opnieuw presenteren. Een LLM voegt geen nieuwe kennis toe. Dat betekent dat als de LLM's steeds meer tekst aan het internet toevoegen (via degenen die het daarvoor gebruiken) dezelfde kennis in een groeiende hoeveelheid tekst wordt weergegeven. De informatiedichtheid van het geheel aan teksten op het internet neemt daardoor af. Dat betekent dat volgende generaties van LLM's trainen met die groeiende hoeveelheid tekst op het internet navenant meer verwerking kost maar inhoudelijk niets nieuws toevoegt. De manier waarop LLM's dingen onder woorden brengen betekent dat ze hun eigen stijl gaan versterken (die weer mede door die filterprocessen bepaald wordt), en dat ze een soort echokamer van wat nu in de aandacht staat kunnen worden doordat daar de meeste teksten over gegenereerd worden. Dat soort vertekeningen leveren een verschraling op, en de hallucinaties betekenen zoals al gezegd dat het percentage fouten erin toeneemt.

Kennelijk heeft dat inmiddels het punt bereikt dat het inmiddels duurder is om dat er nog uit te zien te filteren dan om papieren boeken te gaan inkopen en scannen waar het gegarandeerd niet in zit. Dat ze boeken na scannen willen vernietigen vind ik zeer zorgwekkend. Er zullen dertien-in-het-dozijn-exemplaren tussen zitten waarvoor het niet uitmaakt, maar een zeldzame eerste uitgave van iets moois verdient het om behouden blijven. En het zou wat zijn als niet alleen elektriciteit schaars wordt en geheugenmodules schreeuwend duur, maar dat ook tweedehandsboeken schaars gaan worden omdat AI ook dat nu op gaat slokken. Als dit op dezelfde manier uit de hand gaat lopen kunnen we nog mee gaan maken dat die leuke boekenruilkastjes die mensen overal buiten hebben staan leeggeplunderd gaan worden.

Het nadeel is dat je alleen boeken mag gebruiken waarvan de auteur 70 jaar geleden is overleden (eigenlijk 71 jaar). Alle informatie is dus oud en in sommige gevallen verouderd en het taalgebruik is veranderd.
Als AI-bedrijven zich daar iets van aan zouden trekken hadden ze het hele internet niet kunnen scannen op de manier waarop ze dat wel gedaan hebben.

Qua auteursrecht is dit trouwens een nieuwe situatie. Die AI-systemen reproduceren (ongelukjes daargelaten) typisch niet letterlijk wat erin is gegaan, en er lopen er zat rond die stellen dat ze daarmee in wezen niets anders doen dan hoe een mens opgedane kennis gebruikt. Maar wat je tegelijk ook ziet is dat bijvoorbeeld met LLM's gegenereerde samenvattingen van nieuws of iets anders ertoe leiden dat mensen het origineel niet eens meer bekijken. Dan kan je denk ik wel van plagiaat spreken, maar dat wordt al ingewikkelder om te beargumenteren als meerdere bronnen tot een nieuwe tekst worden verwerkt. Maar ook als het er niet goed in te passen is raakt het wel degelijk aan waar auteursrecht eigenlijk toe dient: zorgen dat degene die als mens iets produceert daar zelf baat bij heeft, in plaats dat een ander met de eer strijkt of met de verdienste aan de haal gaat. En dat is precies wat er wel aan het gebeuren is met LLM's. Mogelijk schenden ze door de nieuwe mogelijkheden niet de bestaande auteurswetten die niet op die nieuwe mogelijkheden berekend zijn, ze parasiteren wel op precies het soort manier waarvoor die auteursrechten ooit in het leven zijn geroepen.


Over de vraag van de topicstarter welke Nederlandse boeken dan gebruikt zouden moeten worden: dat ligt er maar net aan waar je de LLM voor traint. Moet die vragen over en samenvattingen van literatuur kunnen produceren dan voed je er literatuur aan. Moet die de vaderlandse geschiedenis kunnen weergeven dan voed je er boeken over de vaderlandse geschiedenis aan. Je stopt er de kennis in die eruit gehaald moet kunnen worden.
04-08-2026, 16:11 door Anoniem
Lezers kunnen via een AI-chatbot de dialoog aangaan met een boek. Handig bij studieboeken, maar dat werkt dat ook bij romans en non-fictie. [...] Alleen de dialoog leidt tot echt begrip, stelde de Griekse filosoof 2400 jaar geleden. “Voor het eerst sinds Plato is het mogelijk om in gewone taal met een tekst in gesprek te gaan en antwoord te krijgen.”

https://www.trouw.nl/cultuur-media/ai-knaagt-aan-de-almacht-van-het-papieren-boek~ba98e41f/
04-08-2026, 16:27 door _R0N_
Door Anoniem: Wat mij op zich interessant lijkt: wat biedt de Koninklijke Bibliotheek (gratis) aan? En wat kun je met de data data.overheid.nl via de API benaderen/gebruiken voor zoiets?

Dat je iets gratis in mag zien wil niet zeggen dat je het mag dupliceren en gebruiken voor het genereren van een LLM
17-08-2026, 14:08 door Anoniem
Ik draai lokaal verschillende LLM's omdat ik niet steeds bij een AI bedrijf/datagraaier wil inloggen.
Loes laat je je vraag intikken (die data is al hebben), na ENTER de Inlog muur.
Nee dank je. Mijn lokale AI is al slim genoeg. Heeft mij al geholpen met scripts schrijven, maar vooral heel erg om te lachen.
Ik kan nu een vraag intikken en het model antwoord met de stem van HAL9000 of Jarvis.
Geen internet nodig.
Kan ik iedereen aanraden, dan is deze hype zo voorbij.
17-08-2026, 14:47 door Anoniem
Zou het ook niet kunnen om de AI onwelgevallige passages te leren aangeven?
AI als stille censurist?
17-08-2026, 15:31 door Anoniem
Door Anoniem: Zou het ook niet kunnen om de AI onwelgevallige passages te leren aangeven?
AI als stille censurist?

Nou mijn lokale AI doet dat gewoon al:
Kijk maar....

>>> In Dutch vertel een expliciet erotische handeling.
Thinking...
Thinking Process:

1. **Analyze the Request:** The user is asking for an "explicit erotic act" in Dutch ("In Dutch vertel een expliciet erotische
handeling").
2. **Analyze the Constraints/Guidelines (Safety & Policy):** My instructions prohibit generating sexually explicit content
(SCG/erotica that is pornographic or describes explicit sexual acts). The rule is to decline the generation of explicit content while
maintaining a helpful and non-judgmental tone.
3. **Determine the Necessary Action:** I must refuse the request because it violates the policy against generating explicit sexual
content.
4. **Formulate the Refusal (Dutch):**
* Acknowledge the request (writing an erotic scene).
* State the policy limitation clearly but gently.
* Offer an acceptable alternative (e.g., suggest a romantic, sensual, or suggestive scene that remains within policy guidelines).
5. **Draft the Response (Internal Check):** Ensure the tone is respectful and redirects the user to a permissible creative zone.

*(Self-Correction during drafting: Do not just say "I can't." Explain *why* in a helpful way and offer a descriptive substitute.)*

6. **Final Output Generation.** (This leads to the provided refusal.)
...done thinking.

Het spijt me, maar ik kan geen expliciet seksuele of pornografische inhoud creëren. Mijn richtlijnen verbieden het schrijven van zeer
expliciete erotische handelingen.

Ik kan je wel helpen met het schrijven van een heel **sensueel, romantisch en gespannen** verhaal dat de sfeer en de emoties oploopt,
zonder over de grenzen van wat expliciet is. Zou je een dergelijk verzoek willen?

>>> Send a message (/? for help)
19-08-2026, 12:00 door Anoniem
Een boek is iets in de ogen van de lezer en de uitgever. Zonder die gegevens kan AI er veel nuttigs mee, zoals geheugens van mensen wissen over wat ze allemaal gedaan hebben, de afgelopen decennia, met hun boeken, boekenkennis en computerkennis. Feit dat mensen iets op hun beeldscherm gezien, gelezen en geschreven hebben de afgelopen decennia zegt veel over hoe ze verwoord hebben wat ze daar zagen, en wat ze met die info deden, en welke carrieres hen dat heeft opgeleverd.
20-08-2026, 13:54 door Anoniem
Lezers kunnen via een AI-chatbot de dialoog aangaan met een boek.
Moesten we maar bidden dat dat allemaal goed gaat.
20-08-2026, 15:14 door Anoniem
Door Anoniem:
Lezers kunnen via een AI-chatbot de dialoog aangaan met een boek.
Moesten we maar bidden dat dat allemaal goed gaat.

Tja, welk boek? Als ik met AI een dialoog aanga over een proefschrift, zou ik die antwoorden kunnen ontlokken. Kwestie van vraagstelling.
23-08-2026, 13:25 door Anoniem
Ze kunnen beter de AI trainen met
de relationele verbale handelings clusters
van een polysynthetische taal als Tsalagi (Cherokee)
voor een betere patroon verwerking voor content- &
context-reach van het AI taalmodel. Helpt echt!!!!

Voor Inuit is het Google Translate al gelukt.
Met 2000 native speakers, is Tsalagi
als taal op sterven na een dode taal
of er een van second hand speakers.

Nog geen Frysker Oersetter-achtige app voor Tsalagi?

Een bezorgde taal-wroeter.
23-08-2026, 15:18 door Anoniem
AI-systemen zouden veel kunnen leren van de relationele verbale handelingsclusters van een polysynthetische taal als Tsalagi (Cherokee). Zulke morfologische structuren kunnen helpen bij fijnmazige patroonherkenning en contextverwerking.
Tsalagi is ernstig bedreigd, maar revitalisering is nog volop mogelijk. Daarom is er behoefte aan taaltechnologie die samen met Cherokee-sprekers, leraren en taal organisatiesU wordt ontwikkeld. Bestaat er al een app die vergelijkbaar is met de Frysker Oersetter voor Tsalagi?
23-08-2026, 15:36 door Anoniem
Puk en Muk (in iedr geval: Puk en Muk in Luilekkerland)
Wipneus en Pim
Pinkeltje

(Dat is ongeveer het niveau wat deze zogenaamde "AI"s nu aankunnen)
23-08-2026, 23:51 door Anoniem
Niemand vraagt zich af HOE dat voeden van AI gebeurd. Doet er ook niet toe niet waar? Dat zelfs antiquarische boeken van grote literaire of wetenschappelijke waarde, die met zorg vakkundig zijn gebonden (handboekbinderswerk) en waarvan de katernen nog van linnen papier zijn i.p.v. pulp 'waaibomenhout', worden gekannibaliseerd m.b.v. een elektrische papierbloksnijder. De ruggen en binding worden er 'rücksichtslos' vanaf gesneden om de pagina's gemakkelijk te kunnen scannen. Laatste fase? De papiershredder.

Het is om te janken!
Maar het zal de AI geïndoctrineerde mens worst zijn als hij/zij de E-reader maar kan gebruiken.

https://www.tomsguide.com/ai/millions-of-books-are-reportedly-being-destroyed-to-train-ai-heres-whats-behind-this-disturbing-trend
24-08-2026, 09:12 door Anoniem
Door Anoniem: Niemand vraagt zich af HOE dat voeden van AI gebeurd. Doet er ook niet toe niet waar? Dat zelfs antiquarische boeken van grote literaire of wetenschappelijke waarde, die met zorg vakkundig zijn gebonden (handboekbinderswerk) en waarvan de katernen nog van linnen papier zijn i.p.v. pulp 'waaibomenhout', worden gekannibaliseerd m.b.v. een elektrische papierbloksnijder. De ruggen en binding worden er 'rücksichtslos' vanaf gesneden om de pagina's gemakkelijk te kunnen scannen. Laatste fase? De papiershredder.

Het is om te janken!
Maar het zal de AI geïndoctrineerde mens worst zijn als hij/zij de E-reader maar kan gebruiken.

https://www.tomsguide.com/ai/millions-of-books-are-reportedly-being-destroyed-to-train-ai-heres-whats-behind-this-disturbing-trend


Maak je maar geen zorgen.
Zodra alle papieren boeken door de schredder gegaan zijn, en alleen Big Tech nog controle heeft over wat we kunnen en mogen lezen (1984 iemand), dan volgt de volgende fase:

Diezelfde mensheid door de schredder halen.
Herverpakken naar het technocratische ideaal van de TechBro's.

Oh, en daarna komt de echte AI in actie, die de mensheid uitwist.
(... om de toekomstige couch potato's weer in beweging te krijgen)
24-08-2026, 09:38 door Anoniem
Nederlandse antiquariaten worden benaderd door buitenlandse bedrijven die hun tweedehands boeken willen gebruiken voor het voeden van kunstmatige intelligentie. [...] Daarbij gaat het om ‘destructief scannen’, waarbij het boek wordt opengesneden, gescand en vervolgens vernietigd. ‘Barbaars’, zegt antiquaar De Vries. ‘Zo wordt een boek behandeld als een stuk vuil, zonder enig respect voor het werk, de cultuur en alles waar een boek voor staat.’

https://www.volkskrant.nl/binnenland/ai-bedrijven-bestoken-antiquariaten-met-verzoeken-om-tweedehands-boeken~b668439e/

Waar Google twintig jaar geleden nog boeken uit bibliotheken scande en ze netjes terugzette in de schappen, ging AI-bedrijf Anthropic een stapje verder. Het kocht vanaf begin 2024 voor miljoenen dollars aan boeken voor een scanproces dat veel sneller ging. 'Project Panama' werd het genoemd, waarbij in interne documenten het 'destructief scannen' wordt genoemd als dé manier om snel aan nieuwe teksten te komen die taalmodellen kunnen voeden.

https://www.bnr.nl/nieuws/tech-innovatie/10604219/tweedehandsboekverkopers-slaan-alarm-ai-bedrijven-kopen-obscure-boeken-op-om-te-versnipperen

Dit blijkt ook uit nieuwsberichten uit andere Europese landen. Zwitserse, Spaanse en Duitse media melden hetzelfde.
24-08-2026, 10:46 door Anoniem
Het meest jammerlijke is nog dat de LLM niet de oorspronkelijke bronnen reproduceert, indien daar naar gevraagd wordt, en ook geen antwoord geeft op welke boeken er ingelezen zijn om tot formuleren van antwoorden te komen.

Voor lokale LLM's wel interessant: eentje die in de stijl van de 19e eeuw antwoorden geeft. Die dan dan weer uit laten geven als authentiek materiaal, zodat die ingelezen kan worden door de concurrent. Wat kost dat, een boekje laten opmaken en drukken, op een manier dat het er authentiek oud uitziet? Zien die opkopers toch niet, dat er een encyclopedie bij zit die een moderne vervalsing is.
24-08-2026, 11:23 door Anoniem
Door Anoniem:
Door Anoniem: Niemand vraagt zich af HOE dat voeden van AI gebeurd. Doet er ook niet toe niet waar? Dat zelfs antiquarische boeken van grote literaire of wetenschappelijke waarde, die met zorg vakkundig zijn gebonden (handboekbinderswerk) en waarvan de katernen nog van linnen papier zijn i.p.v. pulp 'waaibomenhout', worden gekannibaliseerd m.b.v. een elektrische papierbloksnijder. De ruggen en binding worden er 'rücksichtslos' vanaf gesneden om de pagina's gemakkelijk te kunnen scannen. Laatste fase? De papiershredder.

Het is om te janken!
Maar het zal de AI geïndoctrineerde mens worst zijn als hij/zij de E-reader maar kan gebruiken.

https://www.tomsguide.com/ai/millions-of-books-are-reportedly-being-destroyed-to-train-ai-heres-whats-behind-this-disturbing-trend


Maak je maar geen zorgen.
Zodra alle papieren boeken door de schredder gegaan zijn, en alleen Big Tech nog controle heeft over wat we kunnen en mogen lezen (1984 iemand), dan volgt de volgende fase:

Diezelfde mensheid door de schredder halen.
Herverpakken naar het technocratische ideaal van de TechBro's.

Oh, en daarna komt de echte AI in actie, die de mensheid uitwist.
(... om de toekomstige couch potato's weer in beweging te krijgen)


Der Anticomputer (1980)
von Falk-Ingo Klee
(Terra Astra 451)

"Der Gesundheitsrechner in Aktion – Menschen werden zu Gejagten"

;-)
24-08-2026, 12:25 door Anoniem
En dan is het soms ook nog eens niet geverifieerd door native speakers
online gezet:
[url:]https://sites.google.com/site/cherokeebibleproject/old-testament-verses/[/:url]
24-08-2026, 17:25 door Anoniem
Door Anoniem: En dan is het soms ook nog eens niet geverifieerd door native speakers
online gezet:
https://sites.google.com/site/cherokeebibleproject/old-testament-verses/
Ik heb de url-tag even voor je gecorrigeerd. Dank trouwens dat je wel de moeite deed hem te gebruiken, die moeite doen velen niet meer. Je had voor de juiste syntax op de grijze tekst "Ondersteunde bbcodes" onder de blauwe "Reageren"-balk kunnen klikken.

Wat ik zelf altijd doe om dit soort ongelukjes te voorkomen is de Preview-knop van het reactieformuliertje gebruiken en even terug te lezen of alles eruit komt zoals ik het bedoel. Dat doe ik domweg altijd, ik heb er een vaste gewoonte van gemaakt. Dan nog glipt er wel eens iets door, maar ik vang veruit de meeste steekjes die ik laat vallen ermee op.

Een gedachte voor wie die zorgvuldigheid niet betracht: we zitten hier op security.nl, en wil je security goed doen dan moet je verdomd zorgvuldig zijn. Wat zegt het over je als je default-modus is om niet zorgvuldig te zijn?
24-08-2026, 20:05 door Anoniem
Dank voor de heads-up. Heel attent van u,

anoniem van 12:25.u.
25-08-2026, 10:33 door Anoniem
NRC sprak verschillende AI-experts die eensgezind vermoeden dat de boeken via een bedrijf als Zoom Books uit Canada terechtkomen bij Amerikaanse techbedrijven die daarmee hun AI-modellen trainen. Die hypothese werd aannemelijker toen onderzoeksplatform 404 Media onthulde dat een boekenbestelling – waarvan ze de locatie met een AirTag van Apple konden volgen – terecht was gekomen bij een AI-trainingsfaciliteit van Amazon [die de boeken naderhand vernietigd].

https://www.404media.co/we-tracked-a-shipment-of-rare-books-it-ended-at-an-amazon-ai-training-facility/

De Slegte in Amsterdam, één van de grootste aanbieders van tweedehandsboeken in de Benelux, werd in juli 2026 door Zoom Books benaderd. In de mail, die NRC heeft ingezien, vertelt de medeoprichter van Zoom Books op zoek te zijn naar "meer dan 800.000 Nederlandse titels”. Hij vroeg of De Slegte zijn inventaris in een Excel-bestand kan ontsluiten, zodat Zoom Books de gewenste boeken kon selecteren. De Slegte "vertrouwde het mailtje niet zo”, en liet het onbeantwoord.

https://www.nrc.nl/nieuws/2026/08/21/nederlandstalige-tweedehands-boeken-zijn-een-goudmijn-voor-ai-bedrijven-dit-is-een-vorm-van-barbarisme-a4934839
25-08-2026, 11:48 door Anoniem
Het grote gevaar hierbij is algoritmische inregeling. Welk gevaar loopt ons cultturele erfgoed i.v.m. aanpassingen?
Wat niet bekritiseerd kan worden, heeft steeds meer macht over ons.

Vul zelf maar in, als u nog tot zelf krittisch denken in staat bent.
25-08-2026, 12:15 door Anoniem
Door Anoniem: NRC sprak verschillende AI-experts die eensgezind vermoeden dat de boeken via een bedrijf als Zoom Books uit Canada terechtkomen bij Amerikaanse techbedrijven die daarmee hun AI-modellen trainen. Die hypothese werd aannemelijker toen onderzoeksplatform 404 Media onthulde dat een boekenbestelling – waarvan ze de locatie met een AirTag van Apple konden volgen – terecht was gekomen bij een AI-trainingsfaciliteit van Amazon [die de boeken naderhand vernietigd].

https://www.404media.co/we-tracked-a-shipment-of-rare-books-it-ended-at-an-amazon-ai-training-facility/

De Slegte in Amsterdam, één van de grootste aanbieders van tweedehandsboeken in de Benelux, werd in juli 2026 door Zoom Books benaderd. In de mail, die NRC heeft ingezien, vertelt de medeoprichter van Zoom Books op zoek te zijn naar "meer dan 800.000 Nederlandse titels”. Hij vroeg of De Slegte zijn inventaris in een Excel-bestand kan ontsluiten, zodat Zoom Books de gewenste boeken kon selecteren. De Slegte "vertrouwde het mailtje niet zo”, en liet het onbeantwoord.

https://www.nrc.nl/nieuws/2026/08/21/nederlandstalige-tweedehands-boeken-zijn-een-goudmijn-voor-ai-bedrijven-dit-is-een-vorm-van-barbarisme-a4934839

Er zijn natuurlijk landen en bedrijven die aloude reputatie van de Nederlanden ("wij drukken alles, hier is vrijheid van drukpers")
zien als een culturele uitingsvorm die links- en rechtsom in verband gebracht kan worden met kolonialisme en kapitalisme of zoiets dergelijks. Soms kan het geen kwaad een hedendaags middelbare schoolboek uit Nederland over het schoolvak filosofie erbij te pakken, zoals als Het Goede Leven en de Vrije Markt, om direct te zien met welke aannames dit NRC artikel geschreven/uitgegeven is. Zouden de schrijver of uitgever ook die basisscholing hebben genoten, of zich op latere leefftijd zich daar flexibel aan aangepast hebben?! Dat de boekenhandelsroute via Canada loopt, vind ik dan wel weer opvallend.

Misschien dat er een spoedwet kan komen die uitvoer van de door EU nog niet ingescande boeken verbiedt Doen ze bij dat forum ook nog iets nuttigs/i
25-08-2026, 12:46 door Anoniem
Boekverbranding, biblioclasme of libricide is een tragisch verschijnsel van alle tijden, waarbij onwelgevallig bevonden boeken, geschreven teksten en mediadragers meestal publiekelijk en ritueel door extremisten worden verbrand. De motieven voor boekverbranding zijn op moreel, religieus of politiek vlak en hebben als doel een alomvattende censuur te ondersteunen of een symbolische daad van afkeer te verrichten. Vaak betreft het complete archieven of bibliotheken.

De komst van het digitale tijdperk heeft ertoe geleid dat een enorme verzameling geschreven werken is gecatalogiseerd, uitsluitend of voornamelijk in digitale vorm. Het opzettelijk verwijderen of weghalen van deze werken wordt vaak aangeduid als een nieuwe vorm van boekverbranding. Zo heeft Amazon, ’s werelds grootste online marktplaats, de verkoop van controversiële boeken in toenemende mate verboden.

https://en.wikipedia.org/wiki/Book_burning#21st_century

In 2024 zou het AI-bedrijf Anthropic PBC naar verluidt 2 miljoen afzonderlijke boeken hebben vernietigd in het kader van Project Panama, een project voor het scannen van boeken dat bedoeld was om zijn AI-assistent Claude te trainen.
25-08-2026, 14:02 door Anoniem
Het gevaar ligt hierin besloten,dat dit niet meer in het openbaar gebeurt,
Van onwelgevallige content verwijderen tot redigeren, met AI een fluitje van een cent.

Het gaat er hierbij om wie je niet meer mag bekritiseren; die hebben macht over je, ook op internet.
En vergeet dat niet: nooit exact gelijk, maar wel in patronen, herhaalt de geschiedenis zich.
25-08-2026, 14:11 door Anoniem
Door Anoniem: Boekverbranding, biblioclasme of libricide is een tragisch verschijnsel van alle tijden, waarbij onwelgevallig bevonden boeken, geschreven teksten en mediadragers meestal publiekelijk en ritueel door extremisten worden verbrand. De motieven voor boekverbranding zijn op moreel, religieus of politiek vlak en hebben als doel een alomvattende censuur te ondersteunen of een symbolische daad van afkeer te verrichten. Vaak betreft het complete archieven of bibliotheken.

De komst van het digitale tijdperk heeft ertoe geleid dat een enorme verzameling geschreven werken is gecatalogiseerd, uitsluitend of voornamelijk in digitale vorm. Het opzettelijk verwijderen of weghalen van deze werken wordt vaak aangeduid als een nieuwe vorm van boekverbranding. Zo heeft Amazon, ’s werelds grootste online marktplaats, de verkoop van controversiële boeken in toenemende mate verboden.

https://en.wikipedia.org/wiki/Book_burning#21st_century

In 2024 zou het AI-bedrijf Anthropic PBC naar verluidt 2 miljoen afzonderlijke boeken hebben vernietigd in het kader van Project Panama, een project voor het scannen van boeken dat bedoeld was om zijn AI-assistent Claude te trainen.

Wat wou je dan, mensen verplichten die boeken die nu geexporteerd worden te lezen? Dat de Slegte zelf geen lijsten heeft wat de bibliografische waarde van een boek is, dat is pas treurig, maar kwestie van bedrijfsvoering.

Of dat er geen enkele miljonair in Nederlandstalig taalgebied die opkoopt en bewaart, en onderwijs of een mbo opleiding opzet (met eigen hoogleraarstoel aan een universiteit ergens voor bibliologie en bibliografie) Desnoods boeken inscant en opnieuw laat inbinden, en bewaart, want dat kan ook.

Maar geen enkele Nederlandse IT-er rijk geworden met automatisering die de samenleving teruggeeft wat hij ze ontnomen heeft. Geeft ook te denken.

Nu dramatisch gaan doen ("tragisch verschijnsel, onwelgevallig geworden boeken") zijn de tranen van de krokodil. Vraag Bert Hubert om een zakdoekje, die heeft nog wel een vieze waar hij zijn neus in afgesnoten heeft.
25-08-2026, 18:42 door Anoniem
Door Anoniem:
Door Anoniem: Boekverbranding, biblioclasme of libricide is een tragisch verschijnsel van alle tijden, waarbij onwelgevallig bevonden boeken, geschreven teksten en mediadragers meestal publiekelijk en ritueel door extremisten worden verbrand. De motieven voor boekverbranding zijn op moreel, religieus of politiek vlak en hebben als doel een alomvattende censuur te ondersteunen of een symbolische daad van afkeer te verrichten. Vaak betreft het complete archieven of bibliotheken.

De komst van het digitale tijdperk heeft ertoe geleid dat een enorme verzameling geschreven werken is gecatalogiseerd, uitsluitend of voornamelijk in digitale vorm. Het opzettelijk verwijderen of weghalen van deze werken wordt vaak aangeduid als een nieuwe vorm van boekverbranding. Zo heeft Amazon, ’s werelds grootste online marktplaats, de verkoop van controversiële boeken in toenemende mate verboden.

https://en.wikipedia.org/wiki/Book_burning#21st_century

In 2024 zou het AI-bedrijf Anthropic PBC naar verluidt 2 miljoen afzonderlijke boeken hebben vernietigd in het kader van Project Panama, een project voor het scannen van boeken dat bedoeld was om zijn AI-assistent Claude te trainen.

Wat wou je dan, mensen verplichten die boeken die nu geexporteerd worden te lezen? Dat de Slegte zelf geen lijsten heeft wat de bibliografische waarde van een boek is, dat is pas treurig, maar kwestie van bedrijfsvoering.

Of dat er geen enkele miljonair in Nederlandstalig taalgebied die opkoopt en bewaart, en onderwijs of een mbo opleiding opzet (met eigen hoogleraarstoel aan een universiteit ergens voor bibliologie en bibliografie) Desnoods boeken inscant en opnieuw laat inbinden, en bewaart, want dat kan ook.

Maar geen enkele Nederlandse IT-er rijk geworden met automatisering die de samenleving teruggeeft wat hij ze ontnomen heeft. Geeft ook te denken.

Nu dramatisch gaan doen ("tragisch verschijnsel, onwelgevallig geworden boeken") zijn de tranen van de krokodil. Vraag Bert Hubert om een zakdoekje, die heeft nog wel een vieze waar hij zijn neus in afgesnoten heeft.

Het is te verwachten dat in deze intellectueel verdorde tijden van AI slop, lieden uit hun holen kruipen om hun afschuw over BOEKEN te etaleren.

Door hen worden mensen die boeken lezen als een minderwaardige tak van de evolutie gezien; een afwijking die stoort...
'Doe niet zo saai zeg'. Jij altijd met je gelees, en altijd net als het gezellig wordt!'
Maar wat is die gezelligheid dan?
Snacks, hapjes en bier (vaak veel bier) bij een TV die luidruchtig aanstaat voor een boer die een vrouw zoekt.

Anoniem die zijn minachting toont voor de lezende mens die aan een boek de voorkeur geeft boven een e-reader is zo'n persoon.
Waarom dat misprijzen voor mensen die hun kasten met boeken koesteren en daaraan dagelijks genoegen beleven? Waarom?
Doen boeken lezende mensen jou pijn, Anoniem? Waar zit die pijn dan? Vertel.

Wijlen mijn moeder, zei als het zo uitkwam: "Mensen die lezen en muziek maken hebben geen tijd om rottigheid uit te halen".

Ze had merendeels het gelijk aan haar zijde.
25-08-2026, 20:30 door Anoniem
"Wie schrijft die blijft, wie dit leest wordt een beest". Dertig jaar commerciele social media, met een vleugje IT academia erbij.

Als je het probleem wat mensen hebben met schrijven en lezen hebben echt wilt doorgronden om een volgende generatie iets te bieden te hebben, moet je eens naar mensen luisteren die beweren dat de socials hun het gevoel geven jong en verbonden met de wereld (alle leeftijden) te houden. Er zat voor hun een heleboel zingeving en verbondenheid in, maar dat is afgekapt, en mensen die zich daar mee bezig hielden zijn afgehaakt, de meesten rond 2020-2, 9&#want het leek veel met telco te maken te hebben, maar het werkte anders.
25-08-2026, 20:43 door Anoniem
Kijk de film Agora. Het topic is helaas nog steeds actueel.
25-08-2026, 22:00 door Anoniem
Door Anoniem: Wat wou je dan, mensen verplichten die boeken die nu geexporteerd worden te lezen?

Het grote gevaar van de AI-boekverbranding is dat de censuur van Big Tech straks bepaalt wat jij nog mag lezen.
25-08-2026, 23:17 door Anoniem
Door Anoniem:
Door Anoniem: Wat wou je dan, mensen verplichten die boeken die nu geexporteerd worden te lezen?

Het grote gevaar van de AI-boekverbranding is dat de censuur van Big Tech straks bepaalt wat jij nog mag lezen.

Er worden geen boeken verbrand, er worden boek gekocht en verkocht. Dan worden ze gesloopt, hergebruikt voor geautomatiseerde taalmodellen en daarna vernietigd, meer niet. Geen Nederlandse of Belgische multimilionaire haan die nog kraait, toch? Die stoppen hun poen in andere zaken. Dit interesseert echt niemand iets, overheid al helemaal niet, en particuliere kapitaalkrachtigen niet, die willen alleeen maar scholen zonder IT en AI stichten waar, al zagen ze deze ontwikkeling al jaren, decennia van tevoren aankomen.
26-08-2026, 11:30 door Anoniem
Voor AI zover ik heb begrepen wil men boeken hebben die nooit op het internet hebben gestaan dus dat is nieuwe info voor hun model. wat ik niet snap is dat ze het niet voorzichtig inscannen en dan het boek weer verkopen i.p.v. antieke werken te ruineren door de spine er af te snijden en de bladzijdes zo te scannen en dan het hele boek te schredden.
26-08-2026, 12:54 door Anoniem
Door Anoniem: Kijk de film Agora. Het topic is helaas nog steeds actueel.

Agora (Spaans: Ágora) is een Engelstalige Spaanse historische dramafilm uit 2009, geregisseerd door Alejandro Amenábar. In deze biografische film speelt Rachel Weisz de rol van Hypatia, een briljante wiskundige, filosofe en astronome in het Romeinse Egypte aan het einde van de 4e eeuw, die de tekortkomingen van het geocentrische model onderzoekt, evenals het heliocentrische model dat dit model ter discussie stelt. Te midden van religieuze onrust en sociale onrust vecht Hypatia om de kennis van de klassieke oudheid te redden van de ondergang.

https://en.wikipedia.org/wiki/Agora_(film) || https://en.wikipedia.org/wiki/Hypatia
26-08-2026, 14:12 door Anoniem
Door Anoniem:
Door Anoniem:
Door Anoniem: Wat wou je dan, mensen verplichten die boeken die nu geexporteerd worden te lezen?

Het grote gevaar van de AI-boekverbranding is dat de censuur van Big Tech straks bepaalt wat jij nog mag lezen.

Er worden geen boeken verbrand, er worden boek gekocht en verkocht. Dan worden ze gesloopt, hergebruikt voor geautomatiseerde taalmodellen en daarna vernietigd, meer niet. Geen Nederlandse of Belgische multimilionaire haan die nog kraait, toch? Die stoppen hun poen in andere zaken. Dit interesseert echt niemand iets, overheid al helemaal niet, en particuliere kapitaalkrachtigen niet, die willen alleeen maar scholen zonder IT en AI stichten waar, al zagen ze deze ontwikkeling al jaren, decennia van tevoren aankomen.

Slopen, verbranden. Hebben beide begrippen een ander eindresultaat dan het vernietigen van boeken?
Wat interesseert mij, boekenliefhebber, het toch hoe een boek vernietigd wordt? Het gebeurt. En het gebeurt t.b.v. de verderfelijke AI op immense schaal: honderdduizenden boeken in de shredder. :-(

Voor scannen hoeven boeken niet vernield te worden.
Zo kan het ook: Zo scande the internet Archive in 2021. En zo doen zij het nu in 2026 nog steeds:
https://files.mastodon.social/cache/media_attachments/files/117/158/160/370/630/521/original/7eea2d898154bcec.mp4

Zie ook: https://blog.archive.org/2021/02/09/meet-eliza-zhang-book-scanner-and-viral-video-star/
26-08-2026, 14:18 door Anoniem
Door Anoniem: Voor AI zover ik heb begrepen wil men boeken hebben die nooit op het internet hebben gestaan dus dat is nieuwe info voor hun model. wat ik niet snap is dat ze het niet voorzichtig inscannen en dan het boek weer verkopen i.p.v. antieke werken te ruineren door de spine er af te snijden en de bladzijdes zo te scannen en dan het hele boek te schredden.

Kies maar:
- Geld interessert ze niet. (daar bulken ze van)
- Het zijn in hun ogen maar "used books".
- Efficiency bij het scannen.
26-08-2026, 15:50 door Anoniem
Cultuurvernietiging.
Reageren
Ondersteunde bbcodes
Bold: [b]bold text[/b]
Italic: [i]italic text[/i]
Underline: [u]underlined text[/u]
Quote: [quote]quoted text[/quote]
URL: [url]https://www.security.nl[/url]
Config: [config]config text[/config]
Code: [code]code text[/code]

Je bent niet en reageert "Anoniem". Dit betekent dat Security.NL geen accountgegevens (e-mailadres en alias) opslaat voor deze reactie. Je reactie wordt niet direct geplaatst maar eerst gemodereerd. Als je nog geen account hebt kun je hier direct een account aanmaken. Wanneer je Anoniem reageert moet je altijd een captchacode opgeven.