VS noemen AI-training met auteursrechtelijk werk fair use

Het Amerikaanse ministerie van Justitie steunt OpenAI in de rechtszaak van The New York Times over auteursrechtenschending bij AI-training. Het ministerie stelt dat AI-toepassingen nieuw materiaal maken op basis van hun trainingsdata. Verder zou AI-ontwikkeling van cruciaal belang zijn voor de VS.

De Amerikaanse overheid betoogt in een nota dat het gebruik van auteursrechtelijk materiaal voor AI-training is toegestaan omdat het valt onder 'fair use'. Dit is een uitzondering op het Amerikaanse auteursrecht die contentgebruik zonder toestemming in bepaalde gevallen toestaat. AI-modellen zoals die van OpenAI zouden niet zomaar kopiëren, maar echt nieuw werk creëren. Het beperken van de ontwikkeling van grote taalmodellen (llm's) vanwege 'een misverstand over fair use' zou creatieve en wetenschappelijke vooruitgang dwarsbomen, aldus de Amerikaanse overheid.

Verder stelt de overheid in het dinsdag ingediende rechtbankdocument dat de Verenigde Staten streven naar 'werelddominantie op het gebied van AI'. Vooroplopen met AI is volgens de regering-Trump van cruciaal belang voor de nationale veiligheid, welvaart en economische groei 'voor alle Amerikanen', schrijft de Britse krant The Guardian. De nota verwijst ook naar een decreet van president Donald Trump om belemmeringen voor AI weg te nemen, meldt de Vlaamse omroep VRT.

Miljardeninvesteringen en -verliezen

The New York Times spande eind 2023 een rechtszaak aan tegen OpenAI. De maker van ChatGPT zou auteursrechten van de Amerikaanse krant schenden door miljoenen krantenartikelen zonder toestemming te gebruiken om zijn AI-chatbot te trainen. Deze zaak kan verstrekkende gevolgen hebben voor de hele AI-industrie, waar investeringen van vele miljarden samengaan met verliezen van vele miljarden.

OpenAI geld financiën verlies fpa
Beeld: Tweakers

Door Jasper Bakker

Nieuwsredacteur

03-09-2026 • 13:20

250

Submitter: wildhagen

Reacties (250)

250
245
114
3
0
85

Sorteer op:

Weergave:

Wij maken als mensen allemaal "nieuw materiaal" gebaseerd op onze "trainingsdata" (scholing en lectuur).

Het verschil tussen een LLM en een mens is in dat opzicht een kwantitatief verschil. De LLMs kunnen veel sneller en veel meer lezen.

Want, anders zou je de redenering van de kranten en uitgeverijen ook kunnen doortrekken tot wij allemaal. Moeten we hen ook auteursrecht betalen voor de boeken die we gelezen hebben, die ergens in ons onderbewustzijn leven?
Wij maken als mensen allemaal "nieuw materiaal" gebaseerd op onze "trainingsdata" (scholing en lectuur).
Nee. Ik word zo moe van dit hele geanthropomorfiserende dat sommige mensen doen, want het klopt nergens mee. Een LLM is een deterministisch statistisch model. Niet een levend en ademend iets. De LLM zelf "leert" niets, maar wordt in een rekenkundig process 'getraind' (waarbij 'training' dus een hele andere betekenis heeft dan bij mensen). Dat is compleet anders dan hoe mensen leren. Het ontwikkelen van een LLM gebeurt door een groep mensen die het bij elkaar stampen. Je kunt zien hoe dit auteursrechtelijk een wezenlijk verschil is.
Je haalt hier gewoon dingen door elkaar en wordt omhoog gemodereerd omdat het intelligent klinkt, maar inhoudelijk niet klopt.

De vergelijking die hij maak klopt namelijk wel. Niemand zegt dat een mens en een LLM hetzelfde zijn, maar het principe is identiek en beide genereren nieuwe output op basis van bestaande input. Dat is geen “geanthropomorfiseren”, dat is gewoon logisch redeneren.

Dat hele “LLM is deterministisch dus totaal anders” mist de kern. Dat gaat over hoe het werkt, niet over de auteursrechtelijke vraag. Als je het argument van uitgevers doortrekt, zou je ook mensen moeten laten betalen voor alles wat ze ooit gelezen hebben. En dat doet natuurlijk niemand. Kort gezegd jouw tegenargument zit in een compleet andere categorie.

IMO: Het auteursrecht zoals het nu bestaat is iets heel anders dan waar het ooit voor bedoeld was. Het idee was altijd dat een werk na een vaste periode in het publieke domein zou belanden, niet dat men praktisch eeuwig aanspraak kon blijven maken. Het was ook nooit de bedoeling dat auteursrecht overdraagbaar zou zijn aan familie.

De roep om hervorming is er al lang, en laat duidelijk zijn. niemand wil makers iets afpakken. Maar er moet wel een redelijke looptijd zijn, en die ontbreekt nu volledig.
het principe is identiek en beide genereren nieuwe output op basis van bestaande input
Dat een rekenmachine zegt dat 2+2 vier is, en ik ook, maakt niet dat we dit op dezelfde manier doen. Ook al heeft dit, bij een LLM, de schijn er van.
Niemand zegt dat een mens en een LLM hetzelfde zijn
Ja, wel? Ze worden in deze hele thread regelmatig als equivalent behandelt in de context van auteursrecht, en juist daar verschillen de twee omdat een LLM geen persoon is.
Dat gaat over hoe het werkt, niet over de auteursrechtelijke vraag.
Volgens mij is hoe een LLM intern werkt van essentieel belang als je het gaat hebben over auteursrecht en hoe dat zich met die AI verhoud. Auteursrecht wetgeving is specifiek gemaakt voor mensen en menselijke handelingen. Het maken van een LLM vereist auteursrechtelijk beschermd materiaal. Zijn de functies van een LLM dermate transformatief dat het (de LLM) een nieuw genoeg werk is? Kan een LLM worden gebruikt om een commercieel alternatief te vormen voor het gebruikte werkt, ten nadele van wiens werk wordt gebruikt? Bij dit soort vragen is "hoe werkt een LLM" toch wel van groot belang.
Je haalt hier gewoon dingen door elkaar en wordt omhoog gemodereerd omdat het intelligent klinkt, maar inhoudelijk niet klopt.
Volgens mij is dit eerder op je eigen reactie van toepassing. Ik zie zelden zo veel non-sequiturs in een enkele comment.

[Reactie gewijzigd door kokosnoten op 3 september 2026 18:20]

Mijn vergelijking gaat over het principe: zowel mensen als LLM’s genereren nieuwe output op basis van bestaande input. Dat zegt niets over hoe ze dat doen, maar over de auteursrechtelijke logica erachter.

Dat jij vervolgens begint over rekenmachines en determinisme is precies het soort non‑sequitur waar ik op wees. Het verandert niets aan de kern: het feit dat de interne werking anders is, maakt het auteursrechtelijke vraagstuk niet ineens fundamenteel anders.

Auteursrecht gaat niet over biologie, ademhalen of “persoon zijn” maar is er een kopie gemaakt? Is het afgeleid werk substantieel gelijk? Vormt het een commercieel alternatief? Dat zijn juridische criteria, geen filosofische brabbel waar jij het over hebt.

En ja, hoe een LLM werkt is relevant maar niet op de manier waarop jij het nu probeert te framen. Je springt van technische details naar juridische conclusies zonder dat die logisch op elkaar aansluiten. Je reactie gaat langs de kern heen en introduceert nieuwe categorieën die niets oplossen.
Kleine kanttekening . Alles ik het mij goed herinner heeft een rechter al eens gezegd dat in het kader van producten hoofdzakelijk gemaakt door ai, niemand copyright kan claimen. Simpelweg omdat een ai/LLM geen mens is een auteursrecht (in Amerika) alleen voor mensen is. Niet voor machines. Dus biologie heeft er in die zin wel wat mee te maken.

Maar verder, inderdaad mensen en LLM genereren output op basis van input. We zijn gelijker in dat respect dan veel mensen willen accepteren.
Naar ik vrees wordt hier constant om één punt heen gedraaid en dat is nou precies waar de Auteurswet om draait. Heeft iemand hier weleens een boek iets nader bekeken? Dan zal deze tekst diegene bekend voorkomen:

Niets uit deze uitgave mag worden verveelvoudigd, opgeslagen in een geautomatiseerd gegevensbestand of openbaar gemaakt, in enige vorm of op enige wijze, hetzij elektronisch, mechanisch, door fotokopieën, opnamen of enige andere manier, zonder voorafgaande schriftelijke toestemming van de uitgever.

Zonder toestemming vooraf, géén gebruik van een uitgave en alles dat daarin staat; simple as that. Of een LLM nou een penis met LED verlichting, een cloaca, een stekker of voelsprieten met Blue Toothsensoren heeft... niet boeiend in deze casus...

Corresponderende artikelen in de Auteurswet: 1, 10, 12, 13, 14. Bij deze eenieder uitgenodigd om deze gewoon eens te lezen. De toestemming van uitgeverijen en platenmaatschappijen is nooit gevraagd en als er geen doekoe op tafel wordt geknikkerd zal die toestemming er nooit komen ook. Dat lijkt me logisch.

Dat de Amerikaanse rechters daarmee aan de haal gaan (tot op zekere hoogte) is wat mij betreft hun probleem. Maar: Anthropic en Meta hebben inmiddels al op hun donder gehad. Die mochten alvast anderhalf miljoen dollar in totaal aan auteurs overmaken. Ik vind het nog steeds een schijntje, maar substantieel is het natuurlijk wel.

Ander puntje van legale ongezelligheid: de output van AI mag geen sprekend-op-het-werk-van-een-auteur gelijkend product uitspugen. Dat wordt gezien als het toebrengen van marktschade en inbreuk op auteursrecht. Dan is het dag met je handje naar fair use en ik vind dat terecht.

Dat die zogenaamde Amerikaanse regering (ik herken er geen regering meer in) er een politiek verhaal van maakt en vanuit dat standpunt met de term fair use begint te rommelen acht ik uiterst discutabel. Het is ook met twee maten meten, wat mij betreft: wél de AV-industrie de hand boven het hoofd houden, maar de auteurs en uitgeverijen niet? Dan zou Archive.org ook geen rechtszaak aan z'n broek mogen krijgen en daar heeft die club in San Francisco ook z'n handen aan vol.

De wet zegt eigenlijk: alles dat je aan zo'n machine opvoert is auteursrechtelijk beschermd als het onder die wet valt, vanaf de eerste letter van een verhaal tot de laatste punt op de laatste bladzijde van een boek; meesterwerk of niet... Ooit van Occam's razor gehoord?

Vanuit dat oogpunt hebben de uitgeverijen en platenmaatschappijen naar mijn inzicht gelijk: geen toestemming, dan ook geen data. Wel toestemming, dan een marktconforme vergoeding. Wat die zogenaamde Amerikaanse regering doet is zich rücksichtlos macht toe-eigenen Dat spelletje kennen we inmiddels wel. Dat heet politiek... en als het even kan ten koste van alles.

Weliswaar off topic, maar in deze context toch een beetje relevant: heeft iemand hier zich al in de Wet op de defensiegereedheid (Wodg), verdiept? Als je het mij vraagt zet je daarmee indirect de deur wagenwijd naar een staatsgreep open.

Als Defensie daar trek in heeft en met hulp van de slurpers van AI. Dat terzijde...

Ik dank u voor de aandacht... :)
Ja ik ben bekend met die tekst en niets van wat daar zo dik gedrukt staat is van toepassing.

LLM 's leren van de tekst, ze slaan deze niet 1 op 1 op. Dat is waar geautomatiseerd bestand naar verwijst.

Er is natuurlijk ook verschil tussen de wet hier een in de vs.

Occam's razor. The simplest solution is likely the right one. Simply put. Ik vraag mij ook af of dat van toepassing is. De LLM leert van boeken. Net als mensen. Dus net als mensen mag dat. Dat is de simpelste oplossing.

Dat is allemaal gesteld zonder dat het relevant is dat de Amerikaanse regering als corrupt zooitje zich er mee bemoeit.

Hoe je aan de wet wodg komt in je verhaal snap ik niet. Ga je een boek naar Trump gooien? Begrijpelijke reactie, maar verder?
Ja ik ben bekend met die tekst en niets van wat daar zo dik gedrukt staat is van toepassing.

LLM 's leren van de tekst, ze slaan deze niet 1 op 1 op. Dat is waar geautomatiseerd bestand naar verwijst.
Hoezo niet van toepassing ?
LLM's leren van de tekst !!!
Dan moet je die tekst toch eerst hebben, dus kopen, dus betalen !
Daar wringt het schoentje. Ze willen niet betalen voor het door die LLM's laten lezen van al die tekst, maar die gewoon kunnen 'jatten'.
Maat dat staat niet in de dikgedrukte tekst. Daar staat: verveelvoudigd, opgeslagen.
Het argument is dus dat het alleen gelezen wordt, en juist niet verveelvoudigd en niet opgeslagen.
En dat is technisch correct, het best soort correct.
Er wordt wel een soort afleiding of afbeelding (in filosofische zin) van gemaakt, in vorm van weigths, maar het is geen kopie. Eerder een soort lossy encoding.

Echter, en dit is belangrijk, uit de weigths kunnen delen van het originele werk gegenereerd worden. En dus was het toch opslag, via een omweg.

Wat veel belangrijker is, en ook geen nieuws meer is, is dat de US regering de kant kiest van geld van z'n vriendjes i.p.v. het recht.
En dat is technisch correct, het best soort correct.
:) :)
Echter, en dit is belangrijk, uit de weigths kunnen delen van het originele werk gegenereerd worden. En dus was het toch opslag, via een omweg.
Niet anders dan dat twee mensen hetzelfde onafhankelijke kunnen ontdekken of schrijven. Komt in de wetenschap regelmatig voor. Wil niet zeggen dat ze niet allemaal origineel waren.

Soms zijn de dingen gewoon voor de hand liggend geworden. Dat geld ook voor de LLM. Als je om een tekst over harry potter vraagt is de kans hoog dat de voorspelling plus iets van herinnering heel dicht bij het originele werk komt. Net als fanfiction dat komt en zo verder. Ik zie het niet als kopiëren. De boeken passen ook niet gecomprimeerd in de data van zo een netwerk. Het enige dat zou kunnen gebeuren is dat het model een illegale kopie op het internet vind en gebruikt. Maar daar heeft de gebruiker in essentie dan om gevraagd.
Ze hebben de tekst (buiten specifieke gevallen) ook gekocht. Dus betaalt. Gewoon in de winkel als ieder ander.

Dus ze betalen de teksten doorgaans gewoon, net als ieder ander die een boek koopt. En daarna verwerken ze de tekst door er iets van te laten leren. Je weet wel, zoals elke school dat doet of eigenlijk elke mens.

De uitspraak slaat in dit geval op fair use van gekochte, legale boeken. Niet van downloads e.d. Ze moeten nog steeds naar de cd of boekenwinkel. Maar ze kunnen gewoon heel Amazons digitale aanbod kopen.
Ze hebben de tekst (buiten specifieke gevallen) ook gekocht. Dus betaalt. Gewoon in de winkel als ieder ander.

Zo werkt dat niet. Dat je een boek koopt en naar huis mee kan nemen betekent niet dat je het auteursrecht in je zak hebt. De prijscomponenten van een boek vallen ruwweg in twee uiteen: een auteursrechtelijke bijdrage die je betaalt en de materiaalkosten. Dat houdt niet in dat je dan maar meteen een kopie kan maken en samples daarvan voor eigen gewin als product in de markt mag zetten.

Vandaar ook de term 'intellectueel eigendom'. Dat is van de auteur(-s), niet van de uitgeverij of de koper van een boek, tenzij de auteur daar (gedeeltelijk of geheel) afstand van heeft gedaan. Maar dat intellectueel eigendom is nu juist zijn/haar verdienmodel.

De basis van alles dat hier besproken wordt is: mag je zomaar auteursrechtelijk beschermde content aan een machine voeren, zónder toestemming te vragen aan degene die daarvan de eigenaar of vertegenwoordiger van de eigenaar is. Daar is de wet duidelijk over: dat mag niet. En dat blijkt dus toch gebeurd. Meta en Anthropic hebben dat inmiddels toegegeven en een schikking geregeld.

Volgens welke methode een AI systeem werkt: er mag gewoon geen intellectueel eigendom van een ander in worden opgeslagen/bewerkt zonder expliciete toestemming van de rechtmatige eigenaar.
Wodg geeft - als de wet wordt aangenomen - Defensie het recht om in principe alles van alles te weten te komen. Dat principe passeert elk recht dat individuen of rechthebbenden beschermt. Dit soort ontwikkelingen loopt parallel aan wat in de VS gebeurt, maar aard en werkingsprincipe zijn anders.
Niets uit deze uitgave mag worden verveelvoudigd, opgeslagen in een geautomatiseerd gegevensbestand of openbaar gemaakt, in enige vorm of op enige wijze, hetzij elektronisch, mechanisch, door fotokopieën, opnamen of enige andere manier, zonder voorafgaande schriftelijke toestemming van de uitgever.
En wanneer komt het punt dat een AI dat stukje zou kunnen lezen om erop te acteren?
Voor of na de training sessie?
En wat als een mens nou een alinea quote van een boek in een of ander forum/chat.
Hoe weet de AI waar dat stuk vandaan komt?

De intentie is dat een AI geen gebruik mag maken van auteursrecht maar het mag van jouw niet eens weten wat de inhoud is.
We moeten twee dingen gescheiden houden om te voldoen aan wat we willen.
1) De training data moet het auteursrechtelijke beschermd materiaal bevatten om te weten wat het niet mag gebruiken.
2) De output mag geen gebruik maken van het auteursrechtelijke beschermd materiaal.

Het kan ook niet anders, dan dat het geaccepteerd wordt om toe te voegen middels training als "Fair-use"
Daarnaast kan je wel een AI bedrijf aansprakelijk stellen als dat interne copyright blokkade niet werkt.
Dat is waar je op moet focussen.
Het gaat erom dat de bedrijven die AI bouwen en uitbaten weten waar wettelijke grenzen liggen. Als in elk boek zo'n tekst of een vergelijkbare tekst staat, dan weet je vantevoren al dat je illegaal bezig bent als je er geen aandacht aan schenkt.

De mens staat aan het startpunt van het inleesproces en hoort de wet te kennen; vooral als je met informatie werkt waarvan je op z'n minst kunt vermoeden dat die tot de wettelijk beschermde categorie behoort.


Daarnaast kan je wel een AI bedrijf aansprakelijk stellen als dat interne copyright blokkade niet werkt.
Dat is waar je op moet focussen.


Auteurswetgeving verbiedt (lees die tekst nog maar eens goed door) mechanische of elektronische opslag zónder voorafgaande, uitdrukkelijke toestemming van de rechthebbenden. Je mag dus geen halve letter aan die machine voeren als je die toestemming niet juridisch 100% waterdicht hebt. En daar ging het met Google Books ook al mis. Er was dus al ervaring mee opgedaan, dus de AI heren hadden beter moeten weten.
Als in elk boek zo'n tekst of een vergelijkbare tekst staat, dan weet je vantevoren al dat je illegaal bezig bent als je er geen aandacht aan schenkt.
Als jij een boek leest ben je niet strafbaar
Als jij een boek kopieert ben je strafbaar

Waarom zou dat voor een AI anders zijn? Je beroept je op dezelfde regels.
De wet zegt eigenlijk: alles dat je aan zo'n machine opvoert is auteursrechtelijk beschermd als het onder die wet valt, vanaf de eerste letter van een verhaal tot de laatste punt op de laatste bladzijde van een boek; meesterwerk of niet... Ooit van Occam's razor gehoord?
Waarom schrijf je dit dan?

Je beroept je op wetgeving gebaseerd op een entiteit zoals een mens en probeert het te gebruiken voor een stuk gereedschap.
Je spreekt jezelf helemaal tegen.

"De wet zegt eigenlijk"?? Vreemde interpretatie.
Niets uit deze uitgave mag worden verveelvoudigd (→ illegale kopie), opgeslagen in een geautomatiseerd gegevensbestand (→ AI geheugen), of openbaar gemaakt (→ output van AI), in enige vorm of op enige wijze, hetzij elektronisch, mechanisch, door fotokopieën, opnamen, of enig andere manier, zonder voorafgaande schriftelijke toestemming van de uitgever.

Dat lijkt me duidelijk, vooral als de frase 'alle rechten voorbehouden' er ook nog eens tegenaan wordt gegooid. Met alle rechten voorbehouden wordt ook daadwerkelijk alle rechten bedoeld.

Dat stuk gereedschap is niets anders dan een verlengstuk van het menselijk brein of menselijke fysieke arbeid. Dan vraag ik mij af op welk punt ik mezelf tegenspreek.

Verdiep je wat meer in het auteursrecht, als ik je mag adviseren. Dan wordt het je vanzelf duidelijk hoe in dat juridisch domein wordt gedacht en gehandhaafd. Ik heb de indruk dat je veel te veel focust op wat die AI jongens en meisjes je willen laten geloven, namelijk dat AI in staat is de mens te evenaren en zelfs te vervangen.

Ze hanteren in die taktiek een taalmodel, dat griezelig dicht bij de menselijke eigenschap 'communicatie' ligt, maar wat niet meer is dan het product van rekensommen door een geavanceerde rekenmachine. En die machine mag je niet zomaar programmeren aan de hand van illegaal verkregen data.

AI is knap bedacht, maar er worden teveel verhaaltjes rondgestrooid die illegale praktijken moeten goedpraten en die geld uit de markt proberen te halen om deze dure hobby te financieren om er in een later stadium miljonair van te worden.
Ik heb de indruk dat je veel te veel focust op wat die AI jongens en meisjes je willen laten geloven, namelijk dat AI in staat is de mens te evenaren en zelfs te vervangen.
AI als in Artificial Intelligence zal waarschijnlijk wel iets in die richting kunnen doen.
De vraag is eigenlijk of je gelooft dat we nu al iets hebben wat er überhaupt op lijkt.
De AI wat de tech giganten werkelijk promoten is Algorithmic Intelligence met een marketing jasje.
Ze hanteren in die taktiek een taalmodel, dat griezelig dicht bij de menselijke eigenschap 'communicatie' ligt, maar wat niet meer is dan het product van rekensommen door een geavanceerde rekenmachine. En die machine mag je niet zomaar programmeren aan de hand van illegaal verkregen data.
Je weet dat bijvoorbeeld een printer, software bevat wat je tegenhoudt om papier geld te kopiëren? Hoe kan de printer dat detecteren zonder de training data?
Je focus moet liggen op degene die de printje probeert te maken ipv tijd verspillen aan het enige optie wat je hebt om copyright te beschermen.
Die eigenschap valt onder andere wetgeving.

Ik sluit als je het niet erg vindt mijn bijdrage aan dit onderwerp. Heb niet de indruk dat je het volledige spectrum overziet.
Spectrum? Het lukt je niet eens om binnen een dag te reageren.
Jouw problemen zijn de mijne niet.
LLM is simpelweg een next word predictor niks minder niks meer
Dat zijn mensen ook. Niks minder en niks meer.

[Reactie gewijzigd door bzuidgeest op 4 september 2026 00:46]

Nou mensen zijn wel iets meer dan dat hoor.

Maar als jij jezelf graag degradeert tot het niveau van een algoritme dan be my guest.
Degradeer? Waarom denk jij dat je meer bent dan een algoritme? Onze lichamen volgen gewoon de wetten der natuur. De enige manier waarop we meer kunnen zijn is als je in een ziel geloofd. Je kan wellicht stellen dat ons algoritme complexer is, maar puntje bij paaltje is het niets anders

Ik ontmoet meer dan zat mensen, vooral in sales en management die weinig meer zijn dan next word predictors.
Je betaalt ook voor alles wat je leest, zelfs wanneer het 'gratis' is, betaal je door de reclame.

Het doel was inderdaad dat je tijdens je leven als auteur nog recht had op je auteursrecht, dat het daarna compleet is vervaagd en elke X aantal jaren verlengd werd tot Y jaren na je overlijden staat er los van.
Het principe is helemaal niet identiek.

Wat er uit AI komt is waardeloos en hoeft geen auteursrecht te hebben. Wat mensen maken zijn ze letterlijk inherent eigenaar van, en mogen zelf bepalen wat daar mee gebeurt. Kunst maken is een samenstroming van levenservaring, vaardigheid, emotie, liefde, verdriet, etc, etc. Dit kan een AI nooit imiteren, en dus de vergelijking maken door logisch te redeneren is onjuist.

Gooi je je werk in het openbaar, dan heb je altijd mensen die er misbruik van maken zoals AI scrapers, dat risico moet je dan nemen. Daarnaast, wat is een redelijke looptijd? Als de artiest is overleden? Wat als die artiest het aan familie overgedragen wil hebben, dat is hun beslissing en die dient gerespecteerd te worden aangezien hij letterlijk de maker is van het desbetreffende werk.

Er is helemaal geen roep om hervorming, er is een roep om te stoppen met ongeoorloofd jatten van andermans werk om er een plagiaatmachine van te maken die waardevol water opslurpt en 0 waarde heeft. De enige die bepaalt wat een redelijke looptijd is, is de maker van het werk zelf en niemand anders, en daar heb je het maar mee te doen.

En alle grote techbedrijven maar overal copyright strikes afschieten op niksvermoedende mensen, maar wel janken als ze hun plagiaatmachine niet vrijuit mogen trainen op auteursrechtelijk materiaal. EN gelijk krijgen in de rechtbank want Trump.

Make it make sense.
En het auteursrecht in Nederland is daar zeer duidelijk in: De termijn van 70 jaar gaat in op 1 januari van het jaar dat volgt op het sterfjaar van de maker. Na deze periode vervalt het auteursrecht en komt het werk in het publieke domein terecht, wat betekent dat iedereen het vrij mag gebruiken.

Een literair werk uit 1865 mag dus gewoon aan een AI machine worden gevoerd. Een literair werk uit 1970 dus niet.
Ik lees met belangstelling de argumenten voor en tegen, en leer er dikwijls wat van. Beweert iemand iets wat niet waar is? Wees blij dat hij/zij het zegt, dan kun je het weerleggen. Fanatieke Tweakers reageren soms als gestoken, dat hoeft echt niet.

Laat ik een paar hoofdzaken eenvoudig benoemen. Het auteursrecht is een wettelijke bevestiging van het verdienmodel van mensen die iets maken, dat van nut is voor hun medemens, die ervoor dient te betalen als ervan gebruik wordt gemaakt. Een LLM is het resultaat van invoeren, sorteren en markeren van gegevens, die worden aangeroepen na het analyseren van een gestelde vraag. Knap staaltje software, maar het is intelligentie noch creatie. Wat dan wel? Noem het uitgebreid kantoorwerk. De benaming op zich is dan ook misleidend, artificial intelligence had beter als simulated intelligence benoemd kunnen worden.

Belangrijke vraag is of de Big Tech dient te betalen voor de verzamelde informatie. Er is wel arbeid voor verricht om het verzamelde materiaal bijeen te harken en bruikbaar te maken voor de AI-softare, zoals we die nu kennen, maar de leveranciers van het materiaal zijn over het hoofd gezien. Het ziet er vooralsnog niet naar uit dat de Big Tech uit zichzelf die leveranciers schadeloos zal stellen, althans uit de verdienmodellen zoals we die tot nog toe gehanteerd zien worden, kunnen we opmaken dat de gigantische winsten die gemaakt gaan worden hoofdzakelijk vloeien naar een paar gigantische bedrijven. Daar kun je als brave burger weinig aan doen, dus dat kan niet anders dan een overheidstaak zijn/worden.
Je reactie is vooral emo. Het principe is identiek: zowel mensen als LLM’s genereren nieuwe output op basis van bestaande input. Dat zegt niets over emotie, levenservaring of “ziel”, maar over het mechanisme waarmee nieuwe informatie ontstaat. Dat jij dat probeert te framen als “waardeloos” of “geen auteursrecht waard” is precies het soort subjectieve insteek waar ik niet op reageer.

Auteursrecht gaat namelijk niet over emoties, inspiratie of levensverhalen, maar over heel concrete juridische criteria. Is er een kopie gemaakt, Is het afgeleid werk substantieel gelijk. Vormt het een commercieel alternatief. Dat zijn de vragen die tellen;  niet of een mens meer voelt dan een model.

En ja, er is al jaren een roep om hervorming. Niet om makers iets af te pakken, maar omdat de huidige termijnen en erfbaarheid totaal zijn losgezongen van het oorspronkelijke doel van auteursrecht. Dat kun je gewoon opzoeken. Het idee was nooit dat auteursrecht praktisch eeuwig zou blijven doorlopen en zeker ook niet bedoelt om ontwikkeling te blokkeren

Dat jij dit nu terugbrengt tot “AI is waardeloos” en “plagiaatmachine” is vooral emotie, geen argument. Het verandert niets aan de kern: de vergelijking die ik maak gaat over het principe van hoe nieuwe output ontstaat.
Het idee was nooit dat auteursrecht praktisch eeuwig zou blijven doorlopen en zeker ook niet bedoelt om ontwikkeling te blokkeren. Zo werkt dat in de praktijk en juridisch ook niet. De termijn van 70 jaar gaat in op 1 januari van het jaar dat volgt op het sterfjaar van de maker. Na deze periode vervalt het auteursrecht en komt het werk in het publieke domein terecht.

De bedoeling is geweest dat intellectueel eigendom door familie of andere nabestaanden als een erfenis kan worden overgedragen, maar daar is dus de 70 jaargrens op van toepassing. Lees: één generatie nazaten, daarna is het wel over en uit.
Het hele stukje waar LLMs deterministisch zouden zijn is ook volledig onzin, tenminste volgens de CompSci definitie van determinisme.

Deterministisch is exact wat LLMs niet zijn (of in elk geval niet hoe ze gebruikt worden¹), want anders zouden ze bij een identieke prompt elke keer exact dezelfde output geven, voor elke gebruiker.

Een browser doet dat. Een CAD programma ook. Maar LLMs niet.

¹ Er is een knop waar je aan kan draaien genaamd temperature (met een bereik van [0.0, 1.0]), en als je die op 0 zet handelt het model deterministisch. Maar in de praktijk is dat nutteloos dus wordt het eerder op 0.7 gezet, een lange afstand van deterministisch.
Een LLM is een deterministisch statistisch model.
De modellen zijn toch juist niet deterministisch?
Een model met dezelfde input, dezelfde parameters en dezelfde seed zal altijd dezelfde output geven.
Heb het net nog even geprobeerd op een lokaal model, twee keer dezelfde vraag, twee keer een andere antwoord, wel dezelfde strekking maar toch heel anders.
Zoals @Numbers6uy aangeeft, kun je bij een (lokale) LLM de randomness beperken of uitschakelen om de generatie deterministischer te maken. Technisch gezien bepaalt de temperature hoe sterk de kansverdeling over de mogelijke volgende tokens wordt afgevlakt of aangescherpt. Bij een temperature van 0 wordt doorgaans steeds het meest waarschijnlijke token gekozen, waardoor dezelfde prompt onder dezelfde omstandigheden hetzelfde antwoord kan opleveren.

Voor echte reproduceerbaarheid zijn echter ook andere generatieparameters relevant, zoals de seed, top-k/top-p en eventuele sampling-instellingen. Als die gelijk blijven en de inference-omgeving hetzelfde is, kun je dezelfde output deterministisch reproduceren.
Ik ben geen expert, maar uit alle lezingen, blogs en presentaties die ik heb gehad is dat juist niet het geval. Er zit een randomness waarbij de LLM soms een bepaalde woordkeuze maakt en meteen daarna bij zelfde input net een andere woordkeuze maakt.

En dan krijg je de discussie of iets een letterlijke quote is, of dat het aanpassen van een paar woorden met synoniemen iets "nieuws" is of niet. Als je volledige zinnen en artikelen in de antwoorden van een AI kan lezen die uit een boek, of concreet in dit geval uit een artikel van The New York Times herhaalt, is dat een schending van je auteursrecht? Ik denk het wel.

Wat voor mij heel lastig is is waar de grens ligt. Als ik een boek maak waarbij ik de eerste paragraaf van 1000 verschillende boeken achter elkaar zet, is dat auteursrechtscheding? plagiaat? Wat als ik in alle eerste paragrafen minimaal 4 woorden vervang door synoniemen, is het dan wel of geen auteursrechtscheding?
De randomness zit er bewust in. Die kun je er ook uithalen als het moet. Is gewoon hoe je je algo maakt. Ook bij LLM's
Dat wordt beschouwd als plagiaat en dat is schending van auteursrecht.
Ik dacht juist altijd dat er een stel random "dingen" in om de gebruikte wegingen in het model elke keer net anders te interpreteren. Bovendien worden de verbindingen tussen de nodes ook nog eens via reenforced-learning aangepast.

Dit is dan toch (conceptueel) niet anders dan hoe een mens werkt toch? Onze neuronen liggen ook 'vast', totdat ze door reenforced learning anders worden gelegd. Daarnaast zorgt ook bij ons zelfs bij exact gelijke input en state (wat lastig is natuurlijk) dingen als onze hormoonbalans voor een interne RNG op de werking van de neuronen.

Uiteindelijk is ons neural network "gewoon" een wat geavanceerdere variant van wat er door AI gebruikt wordt volgens mij. Om daarom in dit stadium al te beweren (niet specifiek door jou, maar wel in het algemeen) dat een AI nooit zal kunnen wat wij kunnen, lijkt me erg voorbarig.
In mijn ervaring met lokale modellen dus niet en wat ik er zelf ook over lees is dat 100% deterministisch output vrijwel onmogelijk is omdat er te veel factoren zijn die dit beïnvloeden.

En het feit dat er randomness in wordt gestopt maar het per definitie toch non deterministisch?

[Reactie gewijzigd door phray op 3 september 2026 17:38]

Nee hoor, het model zelf doet altijd hetzelfde. De bits en bytes binnen de weights veranderen namelijk tussendoor niet. Waarmee wel invloed wordt uitgeoefend is de omgeving waar zo'n model in draait (je Ollama's, oMLX, noem maar op); dat is waar de randomness er in wordt gezet via verschillende knoppen. Maar als je temperature op 0 zet en goed op let kun je prima hetzelfde respons herproduceren. De 'randomness' is ook niet inherent aan het draaien van een model, maar het wordt er meestal wel bijgestopt tijdens het draaien om iets 'natuurlijk' lijkendere tekst te genereren.
Ik snap je vergelijking (als je over een vaatwasser spreekt, zeg je ook niet dat er allemaal kaboutertjes met kleine wasborstels tussen je servies door gaan), maar van buitenaf gezien produceert een LLM nieuwe teksten/inzichten die voor de lezer vaak nog nieuw zijn.

Stel dat het ooit lukt om een echt superintelligente machine te ontwikkelen die toegang heeft tot alle beschikbare data van de wereld, maar zelf 0 kennis heeft. Wanneer deze iets genereert, gaat dan ook gebeuren op basis van diezelfde data als waar de huidige LLMs mee zijn getraind, maar in dat geval is het wel op een soortgelijke manier als een mens (die hele bibliotheken doorspit om juist dat ene ding te vinden dat nodig is). Mag je het dan wel anthropomorfiseren?
[...]

. De LLM zelf "leert" niets, maar wordt in een rekenkundig process 'getraind' (waarbij 'training' dus een hele andere betekenis heeft dan bij mensen). Dat is compleet anders dan hoe mensen leren.
Helaas voor je hypothese is dat volstrekt onwaar. Zowel een biologisch brein als een kunstmatig neuraal netwerk leert door verbindingen tussen neuronen te versterken of verzwakken.

Los daarvan zegt het auteursrecht niets specifiek hierover, dus auteursrechtelijk is er géén verschil - objectief.
Dat zegt het auteursrecht wel: mechanische of elektronische opslag niet toegestaan, zonder toestemming van de eigenaar van het auteursrechtelijk beschermde werk. Lijkt me duidelijk genoeg. AI = opslag in geheugen (om die informatie in wat voor vorm ook te manipuleren).
Om dit kracht bij te zetten en duidelijk te maken dat het leerproces heel anders is: een LLM moet tienduizenden keren op de "de hoofdstad van Frankrijk is Parijs" getraind worden wil dit er met een beetje betrouwbaarheid (nog steeds niet 100%) uit komen. Een mens hoeft het maar 1 keer te zien, en de informatie is geleerd.
klopt niet, en het voorbeeld klopt ook niet.
Je haalt pretraining en leren door elkaar. Zet een nieuw feit in de prompt en het model gebruikt het meteen. Eén keer zien. Dat heet in-context learning en bestaat sinds GPT-3 (2020). Een beetje research zou dit naar voor gebracht hebben. Het getal klopt ook voor pretraining niet. Bij grotere modellen en schonere data daalt dat. Parijs/Frankrijk staat sowieso miljoenen keren in het corpus, dus als voorbeeld zegt het niets. En mensen leren ook niet van één keer zien... o.a Ebbinghaus, vergeetcurves en spaced repetition. Je vergelijkt duurzame opslag bij een LLM met kortstondig begrip bij een mens. :-( het enige argument dat hier standhoudt is het mechanisme-argument dat aan beide kanten verouderd is.
Iets in de context zetten "leren" noemen vind ik heel erg ver gezocht, dat is gewoon AI marketingpraat. De context wordt bij elke tekstgeneratie meegegeven, dus dat is zeggen "als ik het juiste antwoord naar de LLM stuur, kan hij het juiste antwoord teruggeven". Oftewel, herhaling van wat je zegt, niet leren. En als je de context weghaalt is het feit ook weg, dus van onthouden is geen sprake. Het is wel degelijk zo dat mensen een stuk meer leren van feit 1 keer zien, los van dat we over de specifieke getallen gaan bakkeleien. LLMs hebben bulk data nodig om hun weights goed aan te passen om zinnige dingen te zeggen. Mensen kunnen van 1 of enkele voorbeelden leren en onthouden, omdat het proces gewoon substantieel anders is.

[Reactie gewijzigd door jaxxil op 3 september 2026 15:54]

Is het proces waarmee je leert relevant? Ik denk van niet. Volgens jouw redenatie zouden geestelijk gehandicapten, en gewoon de algemene koolraap niet bestaan. En wat als er aliens zijn die anders leren of vaak input nodig hebben. Die heel snel verwerken, maar slecht onthouden. Die zijn dan ineens niet intelligent meer?

Ik verbaas mij continue hoe krampachtig mensen bezig zijn om maar de met dwaze redenen te vinden in om de machine ondergeschikt te houden.

Nee zijn zijn niet zelfbewust, leven niet in onze biologische zin. Maar dat doen zoveel dingen niet. Dat is gewoon onze situatie en maar aannemen dat dit de enige optie is, is jezelf op een voetstuk zetten. Belachelijk.
Als je de thread leest, dan weet je dat ik deze reactie schrijf in de context dat je LLMs niet moet anthropomorfiseren. Dat is waar ik kritiek op geef, het behandelen van LLM en mens alsof ze functioneel hetzelfde zijn, en ja, dan maakt het uit dat ze heel anders om gaan met informatie. Als er aliens waren die heel anders werkten dan ons, dan zou ik ook vinden dat je ze niet zou moeten anthropomorfiseren.
Ik heb de thread gelezen en ik vind mijn comment nog steeds van toepassing.
Met zo'n woord als belachelijk maak je de hele discussie dood, dit na een paar nette berichten van jaxxil die door velen positief worden gewaardeerd, dit in tegenstelling tot jouw eigen bijdrage. Ik denk dat je met dat "op een voetstuk zetten" eerst eens op jezelf moet toepassen voordat je met modder gaat gooien.
Dus ik mag van jou iets niet belachelijk vinden. Bepaal jij of anderen mijn opinie? Als je er niet tegen kan dat andere mensen iets belachelijk vinden dan heb je het vast heel moeilijk. Wat vervelend voor je.

Als je echt aan de discussie wil bij dragen kan je altijd proberen uit te leggen waarom jij het niet belachelijk vind. In plaats van maar te doen alsof jij je opinie niet kan geven vanwege het feit dat iemand anders iets belachelijk vind.

-1 is bijna betekenisloos hier. Het was bedoeld voor trollen een flamebait, maar het word meer gebruikt door de gedachten politie. Fijn dat je dat weer eens bevestigd.

Jaxxil zijn comments zijn niet better ze zijn alleen maar populairder bij een groep. Je verward andere opinies met netheid.

[Reactie gewijzigd door bzuidgeest op 4 september 2026 00:19]

Ik bepaal je opinie niet. Ik was alleen de discussie met interesse aan het volgen totdat je deze liet ontsporen. Dat vind ik jammer en het was hier totaal onnodig, dat woord voegt helemaal niets toe.

-1 wordt misschien te vaak toegepast, maar als je expres dingen op de spits drijft in plaats van respectvol te discussiëren dan is zo'n -1 helemaal verantwoord.
Ik drijf niets express op de spits. Het is meer dat mensen slecht begrijpend kunnen lezen en zich daardoor alles maar persoonlijk aantrekken. "Belachelijk" is hoe ik iets vind. Daar is niets beledigends aan. Dat is vrij om te vinden. Als iemand dat weer belachelijk vind mag hij dat ook schrijven. Het is geen scheldwoord. Het is een omschrijving van wat ik ergens van vind.

En of dat nodig is? Ja ik mag gewoon in het Nederlands omschrijven wat ik vind. Als ik een persoon had aangesproken met een scheldwoord has je een punt. Maar ik had het over een idee.

Ik laat niets ontsporen. Sommige mensen ontsporen makkelijk vanzelf.

[Reactie gewijzigd door bzuidgeest op 4 september 2026 15:27]

Je denkt niet dat een reactie zoals "Jij hebt nog nooit in een school rondgelopen zeker. Je kan veel argumenten aanvoeren maar dat is wel een van de slechtste die gelezen heb. Straks ga je nog stellen dat het is omdat wij van god een ziel hebben gekregen of zo." een beetje te veel op de man is gespeeld? Je denkt dat dat niets op de spits drijft?

Als je gewoon het argument weerlegt is er niets aan de hand. En ik snap het niet, want verderop lijk je dit soort persoonlijke aanvallen helemaal niet nodig te hebben en lees ik je reacties met plezier.
Het is gewoon een observatie en ik ben niet bepaald de enige die dat schrijft. Ik heb het tegen iemand en dan is jij een heel gewone aanduiding. Het is ook nog eens een vraag. Het drukt ongeloof uit.

Iemand die stelt dat mensen alles in 1 keer leren. Kom op zeg. Dat is wel een heel slecht argument. En daar kan ik best een voorbeeld van een ander slecht argument naast zetten.

Als iemand een persoonlijk mening aandraagt, een specifieke observatie mag je die best oppakken en persoonlijk beantwoorden.

Ik had ook kunnen zeggen "mensen die vaak op school komen weten dat leerlingen lang niet alles in een keer oppakken" maar dat is exact hetzelfde. Deze "jij" is namelijk uit dat statement niet een van die mensen.

Zoals ik al stel, het komt allemaal neer op begrijpend lezen en je te makkelijk dingen aantrekken. Het is niet anders dan mensen hier die het erg vinden dat hun postadres lekt. Dat adres dat de halve wereld heeft om pakketjes te sturen, dat op elk pakje staat. Het is bijna bij definitie een openbaar gegeven.

Als je een persoonlijke opvatting neerzet, mag je iemand aanspreken over die opvatting.

Als ik die persoon een "sukkel" noem, dan had het beledigend en niet netjes geweest. Nu confronteer ik alleen de persoon met de implicaties van zijn eigen uitspraken. Dat is hoe een discussie werkt.
Dus je weet duidelijk wel hoe het moet. Je kan je echter niet inleven hoe anderen je posts lezen. Je ziet ook niet dat je wel degelijk op de man speelt, en dat dat niet OK is. Goed, dan blijf ik wel -1 uitdelen aan de posts waarbij je mensen aanvalt. Jammer.
Ik weet hoe het moet maar geef jezelf ook dan een -1, want je blijft er over zeuren, omdat je het na alle uitleg nog steeds niet begrijpt.

Ik kan mij prima inleven in die mensen, daarom was mijn response ook accuraat. Het enige waar jij op hyperfocus gaat is een woordje waar je context voor het gemak maar weglaat.

Maar ik hou je niet tegen met je -1. Als dat je gelukkig maakt, be my guest. Moet ik dat nou van gaan huilen of zo?. Er zijn nou eenmaal mensen die het niet snappen en overal aanvallen zien.

-1 is niet bedoelt voor een populariteit wedstrijd. En het is niet bedoelt om je mening die te drukken. Maar daar begrijp je ook al niet.

[Reactie gewijzigd door bzuidgeest op 5 september 2026 00:05]

Misschien is het wijs om de kern van computertechnologie als basis te houden in deze discussie: het woord zegt het al... 'computer', letterlijk vertaald 'rekenaar' of 'rekenmachine' zo je wilt.

Het ding doet niets anders dan berekeningen maken. Hij voelt niet, hij ruikt niet, hij neemt geen trillingen waar, heeft geen onderscheidend moreel kompas, kan niet lopen, kan niet zwemmen.... Het is niets anders dan een geavanceerde rekenmachine met een stevige bak geheugen en een programmacode die rekeninstructies verwerkt.
Ik denk dat de de reactie van Jaxxil wat kort door de bocht is maar er zit wel degelijk een verschil in hoe mensen en ai "trainen". Dit heeft te maken met hoe we omgaan met extrapolatie. Mensen kunnen met zeer beperkte informatie keuzes maken. We doen al tijdens het leerproces aannames of de bron betrouwbaar is en of het dus "correct" is. LLM's gebruiken statistische modellen om te bepalen of het correct is, op basis hoe vaak iets voorkomt. Een voorbeeld: Kind pakt een bal en gooit hem naar zijn vader. Veel mensen stellen zich automatisch een voetbal voor, maar als het een bowlingbal blijkt te zijn snappen we dat dit bijzonder is. Een llm heeft geleerd dat een bal prima te werpen is door een kind maar maar het model kent het gewicht van een bowlingbal niet omdat het nooit een bowlingbal heeft opgetilt, maar zelfs als het weet dat deze 7kg is snapt deze niet dat dit bijzonder is zonder te weten hoeveel een kind normaal kan optillen.

[Reactie gewijzigd door Mr.Analog op 3 september 2026 16:01]

Dat is omdat het geleerd het dat:

reactie chatgtp:
Een gemiddeld kind van 10 jaar weegt ongeveer 30-40 kg.
  1. 7 kg is dan ongeveer 18-23% van het lichaamsgewicht.
  2. Veel kinderen kunnen een gewicht van die grootte oppakken, dragen of wegduwen.
  3. Een gecontroleerde worp is iets anders. Een onhandig voorwerp van 7 kg enkele meters ver gooien vereist behoorlijk wat kracht en techniek.
Maar weet dit niet doordat het een bowlingbal optilt, als mens kom je tot de zelfde conclusie (zelfs als je niet weet dat het om 7kg gaat,) maar dat een kind waarschijnlijk niet veel verder dan enkele meters kan gooien, omdat we dit zelf ervaren.
dus een mens denkt:

1. Bowling bal is best zwaar.

Met minder informatie kunnen we dit dus al inschatten.
Een mens hoeft het maar 1 keer te zien, en de informatie is geleerd.
Dat zijn misschien mensen met een fotografisch geheugen. Iedereen moet middels herhaling iets in zijn geheugen stampen. Soms gaat dat heel makkelijk in één keer, maar bij de meeste mensen is het leerproces toch echt gebaseerd op herhaling, ofwel meerdere keren lezen. Als ik jou 1000 steden noem over de hele wereld en de locatie, dan weet je dat na 1 keer lezen ook niet.

Maar als je het dagelijks herhaald en bepaalde technieken gebruikt dan blijft dat op een gegeven moment wel hangen. Na verloop van tijd zal dat wel weer vervagen en moet je het weer opnieuw leren.

[Reactie gewijzigd door david-v op 3 september 2026 18:55]

Wel duidelijk dat je geen docent bent want je moet de meeste leerlingen echt wel vaker dan 1x iets uitleggen willen ze het snappen.
Jij hebt nog nooit in een school rondgelopen zeker. Je kan veel argumenten aanvoeren maar dat is wel een van de slechtste die gelezen heb. Straks ga je nog stellen dat het is omdat wij van god een ziel hebben gekregen of zo.
Ik word zo moe van mensen die denken dat omdat wij van vlees en bloed zijn, we uiteindelijke niet ook gewoon een al dan niet deterministisch statisch model zijn.

Heet enige verschil dat ik zie is dat de LLM geen eigen doelen hebben. Iets wat wij wel lijken te hebben. Maar ook wij moeten continue geprompt worden en doen het slecht in isolatie zonder input van buitenaf..

Het idee dat wij op een of andere manier bijzonder zijn riekt naar religie of exceptionalism.

Levend is een moeilijke definitie, je kan op zijn hoogst zeggen, niet ons soort leven en niet ons soort intelligentie.
Levend is een moeilijke definitie, je kan op zijn hoogst zeggen, niet ons soort leven en niet ons soort intelligentie.
"Ik ben niet dom, ik heb alleen een heel ander soort intelligentie!"
Lach er maar om. Maar probeer maar eens een definitie te vinden voor intelligentie of bewustzijn. De filosofen en wetenschappers zijn er na eeuwen nog niet over uit. Niet eens hebben ze duidelijk of wij vrije wil hebben of niet, of dat dit überhaupt bestaat.

Wij zijn een carbon based lifeform. Maar het is lang niet zeker of dat de enige optie is. Als we ooit een alien tegenkomen die op wat anders is gebaseerd, is het dan geen leven meer?
Zal allemaal best, maar alle wetenschappelijke experts zijn het er al lang over eens dat LLMs niet in de buurt komen van iets van bewustzijn of intelligentie. Die consensus is er al lang, en alleen in koppen van niet-wetenschappelijke artikelen zul je iets anders zien. Het idee dat een LLM an sich (dus niet, "wat het zou kunnen zijn") iets van 'intelligent leven' vertoont, daar lachen zij om.
Intelligent leven. Je gebruikt die twee worden samen. Maar kan het niet intelligent zijn, zonder dat het leeft? Ik ken ook genoeg mensen die leven maar de intelligentie van een knolraap hebben. Die zijn geen intelligent leven.

Er zijn zelfs discussie in de literatuur of taal tot intelligentie leid of intelligentie naar taal. Je heb taal nodig voor complexe begrippen. Of leiden complexe begrippen tot de noodzaak ze uit te drukken en dus naar taal

Als taal naar intelligentie kan leiden dan kunnen LLM 's intelligent zijn.

Let wel, intelligent is niet hetzelfde als bewustzijn of leven. Al die begrippen hebben hun eigen vage definitie. Het is niet vereist om ze samen te hebben.

Persoonlijk denk ik dat de LLM niet leeft of bewust is. Maar intelligent lijkt het wel te zijn. Creatief maar beperkt, maar hoe creatief zijn de meeste mensen nou? De meesten totaal niet.
Helemaal eens, alleen ik denk dat die LLM's non deterministich zijn. Hij gaat een beetje links en een beetje rechts af en soms een onbestemde kant op. En het als een mens zien, het is bijna onontkoombaar we hebben er een vriendje bij gekregen ook al moet je precies in het achterhoofd houden wat je schrijft. Een echoput en een gehaktmolen, een stochastische papegaai. Buiten dat een enorme slijmjurk die je naar de mond praat.
Je zegt: "Een LLM is een deterministisch statistisch model. Niet een levend en ademend iets." [dus] "De LLM zelf 'leert' niets". Dit is een categoriefout.

Alleen maar omdat mensen leven en en ademen en dat mensen denken, levert nog niet de conclusie dat alleen levende en ademende dingen kunnen denken. Voor die conclusie is trouwens geen filosofische of wetenschappelijke consensus: het is een filosofische niche om aan te nemen dat leven noodzakelijk is voor denken of bewustzijn. Je kunt wel helemaal losgaan met de filosofie dat denken noodzakelijk is voor fysica, als je dat leuk vindt, zie panpsychism.

'Deterministisch' -> Het wordt door veel mensen aangenomen dat onze hersenen uiteindelijk een deterministisch proces volgen, met een basisreden dat natuurkundig alles deterministisch is (er zijn tegenhangers van deze filosofie, maar er is geen consensus). Hoe dan ook is het onmogelijk te bewijzen dat het onmogelijk is om denken te simuleren met een deterministisch proces.

'Statistisch model' -> Je bedoelt natuurlijk dat het model een output geeft omdat het is getraind. Bijvoorbeeld zoals we ook een lineaire regressie doen om data te matchen met een model. Volgens mij is er geen reden om aan te nemen dat dit denken in de weg staat in de basis, maar bovendien: waarom ben je er zo zeker van dat dit in de basale zin niet ook voor hersenen geldt? (natuurlijk was 'lineaire regressie' hier een enorme simplificatie van wat er gebeurt in LLM's)

Ik wordt zelf erg moe van dit soort foutieve redenaties. Zelf ben ik er van overtuigd ik dat er een kwalitatief verschil is tussen wat mensen soms 'denken' noemen bij LLM's en wat dierlijke hersenen doen, maar het argument dat het 'simpelweg een statische voorspeller' is is nou juist nèt het zwakste argument: onze hersenen voorspellen continu dingen. We horen bijvoorbeeld soms de telefoon rinkelen wanneer het niet gebeurt puur op basis van interne hersenactiviteit als resultaat van jarenlang conditioneren/trainen. We noemen dat wel 'hallucinaties' (wink wink, nudge nudge).

Uiteraard kun je met maar het kleinste beetje fantasie, of een abonnement op de bibliotheek en een wandeling langs de Sci-Fi afdeling met boeken uit de jaren 70, je voorstellen dat er een 'levend en ademend iets' bestaat die een deterministisch statistisch model aan het uitvoeren is (denk aan de Navigators in Dune), en vice-versa dat er een vorm van 'denken' is waar geen noodzaak is voor 'leven' - en al zéker niet van 'ademen'. Hierbij mijn oproep: ga dieper, zoek iets wat hersenen kwalitatief verschillend maakt, en doe mee met de zoektocht. En gebruik alsjeblieft geen AI chatbots in dat proces, dat is de echte dood van al het menselijk denken.
Precies, kunstenaren (schilders, fotografen etc.) zijn ook vaak geinspireerd door andermans werk en een werk heeft altijd wel raakvlakken met een ander werk. Is dat dan gelijk verkeerd? Het gaat er denk ik vooral om in hoeverre het gegenereerde werk lijkt op de originele werken. Uiteindelijk bestaat tekst uit woorden en woorden zijn standaard, dus iets heeft al gauw een overeenkomst. Hooguit de woordkeuze en opbouw van zinnen kan een persoonlijke touch hebben.
En daar zit hem het verschil. Wij als mensen kunnen nieuwe dingen bedenken, materiaal wat nog niet bestaat omdat we een doel willen te bereiken wat misschien nog niet is bedacht/gehaald, waar AI dit gebruikt om een logisch gevolg te bepalen. Als mensen kunnen we dus "onlogische" dingen bedenken

Het verschil tussen mensen en ai zit hem in extrapolatie. Een mens kan problemen oplossen door inzichten, ervaringen of reflex , AI doet dit op basis van patronen. Een mens kan express iets negeren waar een AI dit niet zal doen.
Inzichten, ervaringen en reflexen zijn ook gestoeld op patronen.
Ervaringen en inzichten wellicht wel, al moeten deze ervaringen voor een LLM veel specifieker overeen komen omdat het ze niet "snapt" maar alleen herkent als dit als patroon kan zien. een reflex bij een AI heb ik nog nooit gezien, dit kan namelijk een reacite zijn die niet in lijn ligt met de verwachting. Een reactie kan natuurlijk wel, maar dit maakt het niet direct een reflex.
En reflex is niets anders dan een automatische vaak onbewuste reactie zonder uitgebreid nadenken. Als we een LLM input geven voor een reflex en die mogelijkheid toegestaan word dan krijgt het model reflexen. Net als mensen kunnen die goed of slecht zijn.

Wat je nu doet is klagen dat iets niet kan horen, terwijl je weet dat het geen oren gekregen heeft.
zijn eigen antwoordt: Does ChatGPT or Copilot have reflexes?

Not really.

When you send me a message, I do not continuously sense the environment or automatically react to events. I only generate a response when given input.

You could say my behavior resembles a cognitive response rather than a reflex:

User prompt → Language model processing → Generated response

Uiteraard kun je een ai inrichten om te monitoren en daar weer een reactie op te geven, maar het is geen biologische reactie zoals een relfex dit is. Dit is niet direct iets om over te klagen, maar juist iets waar we met AI ons voordeel uit moeten halen. Het wordt niet biologisch aangestuurd, en zal dus geen reflex hebben. Wel een reactie welke we kunnen programeren.

[Reactie gewijzigd door Mr.Analog op 3 september 2026 17:02]

Zoals ik al aangaf, maar is dat omdat het niet kan of omdat we gewoon geen reflexen geinstalleerd hebben. Niets in die reactie zegt dat het niet kan. Jou comment suggereerde dat het niet kon omdat het geen mens waar.

Maar het is een door ons gemaakt machine. Als er geen equivalent is voor reflex dan is dan omdat wij het niet ingebouwd hebben. En de machine ontwikkeld ze niet spontaan net als jij niet een spontaan en derde arm ontwikkeld omdat je die nodig hebt.
Onzin, bij mensen is voor de bedenker iets wat jij onlogisch vind gewoon logisch.

Het enige wat je dus stelt is dat de llm's slimmer zijn dan veel mensen.

[Reactie gewijzigd door bzuidgeest op 3 september 2026 17:14]

Dit is precies waar het verschilt, alleen een goed getrainde LLM is slimmer dan veel mensen, omdat het toegang heeft tot veel meer informatie. Mensen kunnen juist met beperkte informatie al keuzes maken, ongeacht de logica die er achter zit.
Dat kan de LLM ook, maar dan krijg je met zulke slechte antwoorden als je van de meeste managers, sales figuren en andere mensen die zelden weten waar ze het over hebben krijgt. 😂.

We verwachten betere antwoorden van de LLM is die gebruikt logica en wel "nadenken".

Dus wat je eigenlijk aangeduid hebt is een verschil in een verwachtings patroon.
Tja dat is zeker onderdeel van het verwachtingspatroon. LLM's zijn juist sterk in het herkennen van patronen, dit maakt ze efficient voor sommige taken. Het probleem is dat dit voor generative ai dit veel minder interessant is. Het is juist de beperking die ik probeer aan te halen, dat een LLM niet bewust tegen logica in gaat, los of dit correct is. Mensen hebben biologische impulsen om dingen te doen die niet altijd te verklaren zijn, dit maakt creativiteit, niet het "namaken" van bestaande content.
Impulsen waarvan de oorzaak niet bekend is zijn niet noodzakelijk onlogisch. Zonder de oorzaak te kennen kan je dat niet eens bepalen. Je kan alleen stellen dat je niet begrijpt waarom.

Ik denk dat je creativiteit te veel naar de hoek waar ook religie zit duwt. Het is niet magisch, het is gewoon impulsen waarvan we de logica niet altijd begrijpen. De logica bij creativiteit kan ook zo simpel zijn als ik voel mij goed bij deze kleur op die plek. De LLM ontbreekt de hormonen daarvoor.

Als je wil kan je een en LLM ook met een soort onderbewustzijn uitrusten. Een ruis op beslissingen. En soort Mini ai netwerkje dat reageert op zijn eigen tempo en impulsen maakt

De LLM is op dat gebied zo compleet als wij hem gemaakt hebben. Maar hij is gemaakt om logisch en zo accuraat mogelijk te zijn. Wij mensen niet. Dus dat is geen "eerlijke" vergelijking.

Wij mensen doen vaak zo niet altijd niets beter dan gewoon namaken een combineren in nieuwe combinaties, sommige werken, sommige niet.
Maar dat nu toch precies het punt? We kunnen een ai programmeren en “leren” dat iets zo is maar het zal het niet zelf bedenken of ondervinden? Daarmee loopt je tegen de beperkingen aan van wat wij al geleerd en ervaren hebben?
Het punt? Het punt is dat wij mensen niet zo bijzonder zijn als we graag denken. Wij zijn biologische machines. Er is wat mij betreft geen enkele reden dat we niet een machine kunnen maken die exact hetzelfde kan. Zij het met silicium, of een hybride met bio technologie. En die machine is dan het equivalent of beter dan de mens of kan dat zijn.

Het hele idee dat een machine niet kan zijn in een of andere variant wat wij zijn vind ik absurd. Dat we nog niet helemaal weten hoe is zeker waar, maar misschien zijn de llm's dichter bij op sommige punten dan veel mensen makkelijk accepteren. Want dat zou de superioriteit van de mens aan de kaak stellen.

En veel ego's of religieuzen kunnen dat niet aan. Niet onbegrijpelijk, menselijk, maar niettemin wat mij betreft niet in lijn met de realiteit.
Hoe weet je zo zeker dat de 'onlogische' dingen die jij bedenkt niet stiekem toch 'logisch' zijn? Denk niet aan een roze olifant.

De zekerheid waarmee mensen in deze discussies niet onderbouwde aannames over het slecht begrepen menselijk denken poneren verbaast me elke keer weer.
Het gaat er denk ik vooral om in hoeverre het gegenereerde werk lijkt op de originele werken.
De schilderijen, boeken, films, muziek en foto's die kunstenaars maken beschrijven als 'gegenereerd werk' kan alleen komen uit een door AI geschreven tekst. Aggregaten genereren stroom, antennes genereren radiogolven en AI genereert tekst. Schilders maken schilderijen en fotografen foto's. Voor AI en z'n evangelisten is dat echter allemaal 1 pot 'gegenereerd' nat.
Wouw wat een staaltje human exceptionalism. Onze hersenen genereren gewoon een resultaat.

Ik zie niets in het woordenboek dat stelt dat mensen niet iets kunnen genereren.

Uit het woordenboek:

genereren werkw.

Uitspraak: [xenə'rerə(n)]

Afbreekpatroon: ge·ne·re·ren

Vervoegingen: genereerde (verl.tijd enkelv.)

Vervoegingen: heeft gegenereerd (volt.deelw.) Toon alle vervoegingen


(iets) doen ontstaan

Voorbeelden: `groene stroom genereren`,

`inkomsten genereren met webadvertenties`

Synoniemen: voortbrengen, produceren


Synoniemen

aankweken aanplanten fokken kweken opkweken planten procreëren telen verbouwen voortbrengen


8 definities op Encyclo

Doen ontstaan, voortbrengen

1) Verbouwen 2) Procreëren 3) Opkweken 4) Doen ontstaan 5) Plant 6) Voortbrengen 7) Zich ontzien 8) Aankweken 9) Aanplanten 10) Kweken 11) Fokken 12) Telen

Genereren is het voortbrengen van iets, zoals bijvoorbeeld stroom. Ook kan het bij genereren gaan om het voortbrengen van radiogolven, trillingen die opgevangen kunnen worden door een andere ontvanger. Voor de opwekking van stroom bestaan verschillende generators of aggregaten. Ook zonnepanelen genereren stro...

Het samenstellen van een product of dienst op basis van bestaande elementen.

Het toekennen van een syntactische beschrijving aan een zin, bij het beschouwen van de grammatica als regelmechanisme
Not sure if sarcasm maar
Want, anders zou je de redenering van de kranten en uitgeverijen ook kunnen doortrekken tot wij allemaal. Moeten we hen ook auteursrecht betalen voor de boeken die we gelezen hebben, die ergens in ons onderbewustzijn leven?
Dat moeten wij toch ook al?
We moeten een krantenabo hebben om de krant te kunnen lezen. Overal op internet zijn tegenwoordig paywalls omdat het werk betaald moet worden. We moeten onze (e)boeken in een (online)winkel kopen.

De media-industrie heeft zelf tegen illegale downloads gestreden met verregaande (anti-privacy)wetgeving tot gevolg. "you wouldn't download a car".

Nog leuker, als dit wel toegestaan wordt, dan zou je kunnen beargumenteren dat het voor mensen ook legaal om alles maar te consumeren zonder aanschaf/licentiekosten. Want fair use, toch?
Als je nieuws hebt gevolg, heb je gelezen (of gehoord) dat er enorme hoeveelheden boeken worden ingekocht bij boekhandels om AI mee te trainen. Er wordt dus degelijk voor betaald.
Niet helemaal, ze zijn ook getraind op de gigantische illegale collectie.
En in deze rechtszaak wordt beargumenteerd dat het fair use is om auteursrechtelijke beschermde materiaal te gebruiken.
Precies. Van een crimineel zeg je ook niet dat ie niet illegaal bezig is als hij ook een ijssalon beheerd - zelfs als daar geen crimineel geld in omgaat. En het hergebruiken van het materiaal naar miljoenen klanten is natuurlijk ook niet waar je op zit te wachten want die hebben het werk niet meer nodig.
Ze kopen het één keer, doordat het model gecentraliseerd is en/of een kopij is van een ander, moeten ze maar 1 boek kopen. Terwijl mensen net elk apart bijna altijd een boek moeten kopen aangezien je niet gewoon de leeservaring van een ander kan kopiëren.

Het auteursrecht wordt hier dan ook zwaar misbruikt door bepaalde partijen die graag alles willen opslorpen, maar zelf op een gegeven moment niets meer gaan teruggeven.
Nou, volgens deze argumentatie gaat het er dus vooral om dat het toegestaan moet worden omdat ze het niet 'lezen' voor zichzelf, maar alleen om ervan te leren en dan weer nieuwe dingen te kunnen maken.

Dus: Als jij een boek leest voor de lol, dan moet je ervoor betalen, maar als jij een boek leest omdat je een boekverslag moet schrijven mag je hem volgens die redenering gratis digitaal downloaden (als je hem maar wel weer weg gooit)
Maar een LLM gooit het boek ook niet weg.
Dat doen ze blijkbaar wel... (bewust...)
Wij trainen onszelf ook doorgaans op auteursrechtelijk materiaal waarvoor we betaald hebben (zijnde in collegegeld of de kosten van de benodigde literatuur). Op basis daarvan ga je verder. Door een boek te kopen heb je direct ook een licentie in handen om gebruik te maken van die literatuur, niet om verder te verspreiden.

Dat is hierin niet anders, behalve dat de AI geen collegegeld of betaald heeft voor de kennis van anderen.
Het wordt mij op basis van dit artikel alleen niet heel duidelijk of er in zijn geheel niet betaald is voor de content (maar het ergens uit Torrents of een andere niet legale manier is binnen gehengeld door OpenAI) of dat er weliswaar betaald is voor een abonnement bij New York Times; maar laats genoemde van mening is dat dat nog steeds juridisch niet genoeg is om het ook te mogen reproduceren in LLMs.

De eerste situatie kunnen we heel kort over zijn; ook wij moeten betalen voor boeken en (de meeste) kranten. Situatie twee begrijp ik best wat je wilt zeggen, maar de keerzijde is wel dat er dan in de toekomst geen kranten, lesboeken en nieuwssites meer zijn. Want in plaats van dat iedereen individueel betaald voor een boek om te leren rekenen betalen nu alleen de OpenAI's van deze wereld ervoor en de rest gebruikt een AI. Dat kan voor andere bedrijven nooit uit.

[Reactie gewijzigd door !mark op 3 september 2026 14:30]

Jaren geleden was er al een boek waarbij mensen zich laten digitaliseren en waarbij een boek door al die mensen 1 keer werd verkocht en daarna (in enkele seconden) werd gelezen door iedereen. Grappig genoeg herinner ik me het boek niet en volgens ChatGPT haal ik boeken door elkaar. Dus tijdens het opzoeken van het boek leg ik eigenlijk al het verschil bloot. Ik ben weer lekker "meta" bezig dus.
Voor mijn gevoel is dat toch iets te snel door de bocht. Want Het verschil is niet enkel dat een LLM veel sneller en veel meer kunnen lezen. Voor de dingen die jij luist, luistert, etc. betaal jij namelijk wel waar een LLM dit vaak niet doet. En dat is in deze waar het verschil natuurlijk zit.

Want als jij een online krant leest dan betaal je ook indirect mee door advertentie-inkomsten. Als je muziek luistert via een platform als Spotify of Apple Music betaal je abonnementsgeld (of ook via advertenties via gratis versie Spotify). Als je een boek koopt dan betaal je hiervoor direct aan de auteur (dan wel via de boekhandel, dan wel via de bibliotheek).

Dat we hier uiteindelijk weer "nieuw materiaal" van maken is waar maar we hebben dus wel betaald om het "oude materiaal" als "trainingsdata" te gebruiken
Het probleem is dat de LLM ook letterlijk hele hoofdstukken uit boeken kan oplezen. Het trainen kan dus zo ver gaan dat het grote stukken opslaat. Dat is dat een ongeoorloofde kopie.
Dit is alleen onderzoekers gelukt met speciaal geconstrueerde prompts. In de praktijk zal dit niet voorkomen.
Het gaat om het principe. Niet allen het begrip, maar letterlijk grote stukken tekst zijn opgeslagen. Fair use betekent dat je een zin mag citeren, maar niet een heel hoofdstuk. Een LLM trained op zoveel citaten dat dat samen meer is dan mag.
Ik denk dat de crux meer zit in het feit dat er misschien maar 1 LLM model getraind wordt, maar vervolgens het model op Miljoenen keren kopieert om op al de servers te gaan draaien. In mijn ogen kan je dit nooit als fair use gaan zien en is het niet in de letter van waar fair use voor staat.
Wel, als ik een perfect geheugen heb en letterlijk elk artikel van alle jaargangen van een krant uit het hoofd ken, en ik dit uit mijn hoofd zou posten op een website, zou dit ook beschouwd worden als een schending van de auteursrechten.
Dus ja, ik denk dat LLM's die auteursrechtelijke data hergebruiken en breed verspreiden de wet schenden.
Dat kan toch niet. Alles wat we in school leren is ooit door iemand verzonnen/ontdekt/uitgevonden. Het creatieve proces wat hiervoor nodig is, daar heb ik die modellen nog niet op kunnen betrappen. Het is altijd een soort rehash van wat ooit aan data is gevoed.

Een mens heeft dat niet nodig. Die kan besluiten om te gaan tekenen op een rotswand zonder dat ooit gezien te hebben. Scholing voor de mensen is gewoon om je leerproces te versnellen en in een bepaalde richting te sturen. Alleen dat laatste komt overeen met een LLM doet.
Mijn eerste reactie was, WAT BELACHELIJK. Als ik er echter wat langer over nadenk, als je als mogendheid niet meegaat in de race...heb je straks waarschijnlijk echt een heel groot probleem...

Dus eigenlijk, hoop ik dat we in Europa nu eindelijk ook eens vaart gaan maken en belemmeringen wegnemen. We kunnen wel het netste jongetje van de klas blijven, maar als we straks opgegeten worden door andere mogendheden (zie de auto-industrie, die dat ook zeker aan zichzelf te danken heeft), dan zitten we verder in de penarie dan met het kopieren van wat tekst. Als China en Amerika een grote voorsprong op AI krijgen zijn we simpelweg f%^&#d op heel veel gebieden, die hebben echt totaal geen moreel kompas zoals wij dat nog wel (een beetje) lijken te hebben.

Denk dat we een balans moeten hebben in Europa, intern onze regels en wetten volgen. Extern, doen wat nodig is om onze vrijheid en positie te behouden.

[Reactie gewijzigd door OriginalFlyingdutchman op 3 september 2026 13:32]

Maar welke belemmeringen dan exact? Wat houdt een bedrijf tegen om een licentie te nemen op werken die ze willen gebruiken als trainingsdata?
Geld.. niet meer of niet minder.
Men wil er simpelweg niet (voldoende) voor betalen.
Maar als je er niet voor betaalt, dan zullen de meeste dingen verdwijnen, nu of later.

De hele AI wereld lijkt te denken dat het einde van de menselijke ontwikkeling is aangebroken. Dat ze eenmalig alles wat tot nu is geproduceerd aan hun systeem moeten voeden en dat het dan klaar is. Dat zien we ook in dat ze zeldzame boeken en manuscripten opkopen, inscannen en daarna vernietigen.

Ik vind dat een heel enge gedachte om een aantal redenen:
  • Ze gaan er kennelijk vanuit dat we de meeste mensen straks niet meer nodig hebben, en dus ook niet hoeven te betalen.
  • Ze gaan er vanuit dat er nooit meer iets beters dan hun huidige systeem gaan komen, dan toegang nodig zou kunnen hebben tot het originele materiaal.
  • Ze gaan er vanuit dat er niks meer door mensen geproduceerd zal worden wat de moeite waard is (en dus geld), dat alles straks door AI gemaakt wordt.
Het is een soort einde-der-tijden kult, waarbij we de mensheid wel op kunnen heffen zodra hun AI alles geconsumeerd heeft en "af" is. Als het aan hen ligt zijn we als mensheid straks overbodig.
Je einde-der-tijden kult is helaas minder vergezocht dan je wellicht denkt, vpro tegenlicht heeft daar onlangs nog een uitzending aan geweid: YouTube: De bizarre alliantie van technologie, fascisme en geloof | Astra Taylor
Dat is niet het hele verhaal. De vraag is ook of voldoende partijen willen meewerken. Zo schermen (Nederlandse) media uitgevers hun gegevens ook angstvallig af omdat ze liever de optie houden om in de toekomst een eigen businessmodel te ontwikkelen. Dan wordt het een kip-ei verhaal, want dat toekomstige businessmodel kan niet ontstaan als de technologie niet eerst ontwikkeld kan worden.

GPT-NL is van start gegaan met de gedachte van eerlijke samenwerking en eerlijke beloning, en het resultaat is (deels) dat veel partijen dan liever gewoon niet meedoen. Eerlijk betalen lost dat dus niet op.
Lijkt me ieders goed recht om niet aan zoiets mee te doen en daarmee een grote stap om dan maar te zeggen "als je niet wil meewerken, nemen we het gewoon van je".
Dat ontken ik niet, maar het gaat dus om meer dan geld alleen
Kosten. Die AI-bedrijven wisten heel goed dat wat ze deden eigenlijk niet door de bocht kon, maar helaas hebben ze met hun gelobby het toch voor elkaar gekregen dat dit nu als legaal beschouwd wordt.

Auteurs en artiesten, veel geluk in deze nieuwe wereld.
Je zou het in de gebruiksvoorwaarden van de krant kunnen opnemen dat het als trainingsdata niet gebruikt mag worden. Zeker bij de digitale versie.
Dat staat er allang in. Maar ik denk dat die weg nu is afgesloten. Fair Use is een recht wat je niet zomaar kunt afnemen, want anders zou iedere copyright houder altijd stellen dat Fair Use voor hen niet geldt, en zou het hele principe niks meer waard zijn.
Fair Use is een recht wat je niet zomaar kunt afnemen, want anders zou iedere copyright houder altijd stellen dat Fair Use voor hen niet geldt, en zou het hele principe niks meer waard zijn.
Dan kan de EU toch een wet aannemen dat het distilleren van de Anthropic, Open AI en Grokx modellen om daar een nieuw, eigen AI model mee te maken en op de markt te brengen ook valt onder Fair Use?
Hoe denk je dat die Chinese modellen het zo goed doen :D

Uiteindelijk kan ieder land natuurlijk een wet aannemen dat het legaal maakt om copyright uit andere landen te schenden, maar dat betekent wel het opzeggen van een aantal verdragen. En waarschijnlijk het straffeloos schenden van je eigen copyright. En een boel gedoe bij de volgende handelsonderandeling.
Dat lijkt me ook, want dat is "dan" precies hetzelfde als iets leren van een docent (in plaats van uit een boek).
Wacht even... Er is nog geen weg afgesloten. Dit bericht geeft alleen aan dat de Trump-kliek achter de AI-bedrijven staat. Dat wisten we natuurlijk al, maar is nu ook vanuit justitie expliciet.

Het moet nog maar blijken of de rechter het hier ook mee eens is - en zaken uit het verleden laten zien dat rechters anders redeneren. En al helemaal niet gevoelig zijn voor argumenten als 'we willen world dominance op AI gebied'.
Waarom zou een training systeem daar aan voldoen als het toch niet rechtsgeldig is?
Dat kan je doen. Het gaat geen verschil maken, maar je kan het prima doen.
China doet het ongevraagd. Dat is zijn insteek. En dan kan je wel braaf zijn maar loop je eeuwen achter. Niet dat ik daar vrolijk van wordt, maar dat was zijn (naar mijn menig on-topic) insteek met zijn reactie.
De belemmering is dat hun concurrent in het buitenland het gratis kan doen.
We kunnen wel het netste jongetje van de klas blijven, maar als we straks opgegeten worden door andere mogendheden (zie de auto-industrie, die dat ook zeker aan zichzelf te danken heeft),
Dat is een politieke keuze, en niet een juridische. Het is vergelijkbaar met de redenatie dat we zoveel mogelijk geld moeten verdienen aan de fossiele industrie, zodat we rijk genoeg zijn om onszelf te beschermen tegen klimaatverandering. Een hele cynische denkwijze, en voor zover ik weet is Ja21 de enige die dat expliciet hoeft te zeggen, maar als je gelooft dat een wereld alleen maar kan bestaand uit winnaars en verliezers, dan is dat de manier om winnaar te worden.
De manier om te denken dat je winnaar wordt, maar als iedereen zo zou denken zouden we aan het eind alleen verliezers hebben, en zou aarde er eerder als Mars uit zien dan we (mag ik hopen) willen.
maar als iedereen zo zou denken zouden we aan het eind alleen verliezers hebben,
Kijk eens om je heen. Dat is toch precies wat er gebeurt? Het stemt me niet vrolijk, maar de kern van het kapitalisme is toch gestoeld op "ieder voor zich"?

Natuurlijk heeft de EU de mond vol van moraal en goede bedoelingen, maar puntje bij paaltje alleen als dat de economie niet teveel schaadt. Was het Draghi die ons vertelde dat als we milieuregelgeving en mensenrechten te serieus nemen, we in een openluchtmuseum veranderen?
Ik weet dat dat is wat er gebeurd. Maar al te goed.... Gelukkig zijn er ook wel mensen die er wel tegen in durven te gaan, op een fatsoenlijk dsta gedreven manier, maar die vinden helaas nog te weinig gehoor of worden meteen weggezet als "linkse gekkies".
Europa heeft op dit moment al een grote afhankelijkheid van Amerika (software) en China (hardware). Maar vergis je niet. Deze landen zijn, ondanks alle grote woorden, volledig van elkaar afhankelijk.

Op dit moment is er een transitie gaande in Europa naar meer autonomie (nieuwe relaties aangaan, investeringen in defensie, energie en technologie). We moeten onszelf echter niet volledig wegcijferen (we zijn echt geen Calimero). We hebben op ons continent meerdere sterkhouders (farmacie, halfgeleiders, luchtvaart, luxe goederen, machinebouw). Daarnaast is handel geglobaliseerd. Alles in eigen beheer ontwikkelen is ondoenlijk en onwenselijk. Een afhankelijkheid is niet erg en soms zelfs wenselijk, zolang de afhankelijkheid maar wederzijds is.

Echter als we alle kaders loslaten en onszelf verloochenen haken we wel aan, maar maken we misschien wel meer kapot.

[Reactie gewijzigd door Quinz op 3 september 2026 15:31]

Een "race to the bottom" dus, waarin iedere natie zijn morele normen naar beneden bijstelt, want "als wij het niet doen, doen de anderen het wel".
Je stelt daarmee voor om rechten te ontnemen en dus de eigen normen en waarden maar minder belangrijk te vinden omdat een ander dat ook doet en je bang bent. Dat is juist het moment om voor je normen en waarden op te komen. Anders laat je je leiden door angst en streef je het recht van de sterkste na.

Een land is niet dominant omdat ze menen het te zijn maar omdat de rest het ze toe staat. Als je je waarden wil beschermen is het meest ondoordachte wat je kan doen ze maar onbeschermd laten of af gaan breken uit angst. Dus ook met ai en hoe bedrijven in de VS onze rechten en waarden negeren. Dat is precies waar men in de VS op uit is. Zodat je hun normen en waarden aan neemt. Als die je bevallen is daar een oplossing voor: verhuis er dan heen.

[Reactie gewijzigd door kodak op 3 september 2026 14:16]

Het probleem rondom de modellen is dat er nu eenmaal trainingsgegevens nodig zijn, als die informatie in zich in het publieke domein bevind dan is er niets aan de hand. Deze informatie is vrijelijk te gebruiken (effectief komt dat hier op neer dat het om materiaal gaat dat ruim 100 jaar oud is).

Het is mijns inziens erg discutabel als het om informatie gaat waar auteursrecht op zit, heb je dan recht om dit te gebruiken voor het trainen? De NYT vindt van niet, OpenAI en het DoJ vinden van wel. Het is nu de vraag wat een rechter hier van gaat vinden, maar dat er al voorgesorteerd is op een bepaalde uitkomst dat is al wel duidelijk...

* Little Penguin gebruikt ook af en toe taalmodelletjes, bijvoorbeeld om snel een script te maken of bugs te vinden. Dat "AI" handig is staat eigenlijk wel buiten kijf, alleen is de vraag welke prijs we als samenleving hier voor over hebben...
Je overschat de mogelijkheden van AI gigantisch. Iets teveel propaganda van Musk en Altman geconsumeerd ben ik bang.
Op dit moment ja maar over 10 of 20 jaar? Ik wil uw graag op beeld dit horen zeggen zoals die groep over de telefoon eind jaren 90.
Ik had eerst ook het idee dat het een ontzettende schending van auteursrecht is. Maar eigenlijk is het helemaal zo gek niet dat dit onder fair use wordt geschaard.

Auteursrecht betreft kopiëren van werken, maar wat die modellen doen is geavanceerde statistieken loslaten op een tekst. Als ik boeken koop, en van elk boek het aantal woorden en hoe vaak dat woord voorkomt ergens publiceer valt dat ook gewoon onder fair use. En wat een LLM doet lijkt daar meer op dan het opnieuw ergens publiceren of dupliceren van een werk.

Daarnaast, als je wil verbieden dat je afgeleide werken kan maken, dan kunnen kunstenaarsopleidingen het ook lastig krijgen aangezien veel geleerd wordt door anderen te imiteren (werken maken in de stijl van).

Daar tegenover kunnen alleen werken die door mensenhanden zijn gemaakt auteursrecht krijgen, dus alles wat een LLM produceert zou publiek domein moeten zijn.

Toegang tot een bepaald werk moeten ze uiteraard wel voor betalen (boeken kopen etc) maar dat is niet meer dan wat jij en ik er voor zouden betalen.

[Reactie gewijzigd door Shinji op 3 september 2026 14:34]

Er moet een onderscheid zijn tussen verschillende zaken hier. Fair use kan maar dan zou je er ook geen geld er aan mogen verdienen. Wil je geld verdienen dan moet je maar zien dat de mensen waar je gebruik van maakt ook geld verdienen. (Voor militaire doeleinden is een uitzondering natuurlijk gegeven)

Verder is AI helemaal niet hetgene wat een land doet winnen of verliezen.
Dus, ben je nu actief begonnen met het meehelpen hieraan, en heb je AI accounts gemaakt bij bijvoorbeeld Mistral (Europese aanbieder), en gebruik je die voor al je AI werk?

Of gebruik je ChatGPT, Claude, CoPilot of een van de andere aanbieders, en help je de Amerikanen?

Of gebruik je DeepSeek, Kimi, etc. en help je de Chinezen?

En als je dan toch bezig bent, heb je je Gmail, Outlook, etc. accounts gesloten en overgestapt op een Europese mail provider?
Dat en hoe ik het bekijk, mijn AI assistent is voor mij een volwaardige collega.
Als je vanuit dat licht kijkt dan is er toch niets aan de hand, ik mag toch ook elk beschikbaar artikel/boek/rapport etc. lezen en daar iets over schrijven of van maken.

Het commerciële aspect tja daar zouden we over kunnen twisten.
Ik snap niet waarom dat we geen EU AI voor elkaar kunnen krijgen, duurt veel te lang en als de chinezen besluiten om hun AI modellen niet meer als opensource beschikbaar te maken gaat het nog langer duren of zijn we zeker te laat....
Groot gelijk! Onbegrijpelijk dat dit inzicht voor velen zo lastig te bevatten is. Het is pompen of verzuipen. Europa laat continu het initiatief aan anderen, maakt zichzelf irrelevant en op een gegeven moment kunnen we alleen nog maar doen wat de US of China ons opleggen...
Ik vind het een lastige kwestie.


Enerzijds is trainen op data nodig om vooruitgang te garanderen voorsprong te behouden. Er zijn landen in de wereld die minder moeilijk doen.

Anderzijds is het een vorm van dupliceren van materiaal waar auteursrecht op zit en de maker niet wordt gecompenseerd.

En volgens mij is bij een AI antwoord moeilijk te bepalen welk werk welke invloed heeft, achteraf naar rato/gebruik compenseren lijkt me vrij onmogelijk.

Misschien moet het concept auteursrecht wel op de schop.
Het is geen lastige kwestie. Heb je materiaal nodig dan betaal je gewoon, of je neemt een licentie af.

[Reactie gewijzigd door SgtElPotato op 3 september 2026 14:28]

Het is een lastige kwestie. Heb je materiaal nodig dan betaal je gewoon, of je neemt een licentie af.
Maar waar trekken we die grens dan precies? Moet Google bijvoorbeeld ook een licentie afsluiten met iedere website die het scrapt, indexeert en vervolgens via zijn zoekmachine vindbaar maakt?

Google verdient immers miljarden aan een dienst die voor een belangrijk deel draait op informatie waarvan Google zelf niet de eigenaar is. Blijkbaar vinden we dat volkomen normaal — totdat ongeveer hetzelfde principe ineens “AI” heet.
Moet Google bijvoorbeeld ook een licentie afsluiten met iedere website die het scrapt
Hangt af van gebruik (zie ook één van die punten van Fair Use in de VS). Als ze een feature bouwen die het originele werk repliceert en ze daar geld aan verdienen, ja dan mogen ze niet zonder meer even het originele werk daarvoor gebruiken.
Google indexeert niet de gehele website, wat google indexeert voor de zoekmachine staat in geen verhouding ten opzichte van wat er gescraped wordt voor AI.
Indexeren is niet reproduceren, dus nee. Auteursrecht gaat niet over indexeren.
Google is een indexer. Zie het als een bibliotheek. Je kunt je eigen site / boek / product daar promoten. AI traint letterlijk op tekst / data die jij publiceert en verdient er geld mee, en zonder die data kunnen ze niks.

Er is dus wel degelijk een verschil tussen beide.
Wat is een licentie waard? Sommige content/data heeft meer invloed dan andere.

En, het is een gegeven dat bepaalde landen hier niet aan doen en geen barrières opleggen voor het trainen van modellen. Je loopt hoe dan ook achterstand op.
Wat is een licentie waard? Sommige content/data heeft meer invloed dan andere.
Dat is aan de verkoper/aanbieder om te bepalen en de afnemer om daar wel/niet mee akkoord te gaan als die het daar wel/niet mee eens is.
Misschien moet het concept auteursrecht wel op de schop. Of al dat gescrape door de datacenters met hun AI op de schop? Want draai het om, ik of jij gaat scrapen en maakt een mooi model, die een ieder goed kan gebruiken, maar wat blijkt, je hebt alles gepikt zonder ervoor te betalen, beetje vreemd niet dat men dit verheerlijkt?
Je mist het punt: AI begrenzen heeft een gigantische achterstand in de wereldorde als gevolg. Ik draai niks om, ik benoem slechts feiten.

Het is een dilemma.
Je kan als AI-producent ook gewoon betalen voor het auteursrechtelijk beschermd materiaal, al helemaal met de bakken geld die je binnensleept hiermee.
maar wat blijkt, je hebt alles gepikt zonder ervoor te betalen, beetje vreemd niet dat men dit verheerlijkt?
Er zijn genoeg mensen, ook op dit forum, die geen enkel probleem hebben met piraterij en het goedpraten met 'een kopie maken is geen stelen'. (en dat is het juridisch ook niet...)

Het is nooit de intentie geweest van copyright wetgeving om dit volledig te maximaliseren tot een nivo dat iedereen die een deuntje op straat neuriet gelijk een boete aan z'n broek heeft. In de praktijk zijn er al meerdere uitzonderingen op de regels en het zou mogelijk moeten zijn om afgewogen beslissingen te maken om meer uitzonderingen te maken als dat maatschappelijk wenselijk is. Zou je AI training willen verbieden als AI vervolgens medicijnen tegen levensbedreigende ziektes kan ontwikkelen?
Zolang jij content gebruik, die niet op de normale manier is verworven, dan heb je ten alle tijde een probleem als men je aanklaagt.

Draag je verantwoording als bedrijf en je plan om AI bij te werken met verkregen info, want ook ik heb wel een plan om van iedere Nederlander 1 euro te scrapen, want ik wil dit om zo snel mogelijk te rentenieren ;) Niet leuk dan toch als een ieder dit gaat doen?

En dan jouw dooddoener van piraterij, jij of ik stelen een paar films om te bekijken en op je harde schijf te plaatsen, of om weer te verwijderen, en je betaalt voor kopieren, wat dit gewoon is, je kopieert een bestand, dat staat niet in vergelijking wat AI doet, die pakken de gehele libary en daar schoort het mij in.


edit; Zou je AI training willen verbieden als AI vervolgens medicijnen tegen levensbedreigende ziektes kan ontwikkelen? Nee in principe niet, maar niet alles kan ingezien worden zomaar ;)

En dan heb ik een andere vraag met een voorbeeld. Dame van rond de 80 jaar is opgepakt omdat ze medicijnen stal. Ze gaf aan dat ze dit voor haar man deed van over de 80, medicijn kosten een jaar ervoor nog maar $50, nu $950 voor datzelfde en hoeveelheid. Vindt je dat dan kloppen dat de prijzen verhoogt zijn ivm gebruik AI ?

[Reactie gewijzigd door GameNympho op 3 september 2026 15:08]

Zolang jij content gebruik, die niet op de normale manier is verworven, dan heb je ten alle tijde een probleem als men je aanklaagt.
Definieer 'gebruik'? Openbaarmaking is verboden, maar je zal de eerste zijn die voor privé gebruik wordt aangeklaagd...
Draag je verantwoording als bedrijf en je plan om AI bij te werken met verkregen info, want ook ik heb wel een plan om van iedere Nederlander 1 euro te scrapen, want ik wil dit om zo snel mogelijk te rentenieren ;) Niet leuk dan toch als een ieder dit gaat doen?
In de praktijk doneert heel Nederland z'n comments al aan grote tech platformen en heeft de gemiddelde bezoeker van een site er niks over te zeggen.
En dan jouw dooddoener van piraterij, jij of ik stelen een paar films om te bekijken en op je harde schijf te plaatsen, of om weer te verwijderen, en je betaalt voor kopieren, wat dit gewoon is, je kopieert een bestand, dat staat niet in vergelijking wat AI doet, die pakken de gehele libary en daar schoort het mij in.
Ik kende vroeger ook wel mensen die hele bibliotheken aan films hadden. Of je nou 1 of een miljoen kopieert, het is of allebei legaal of allebei illegaal.
Vindt je dat dan kloppen dat de prijzen verhoogt zijn ivm gebruik AI ?
Ik zou verwachten dat de prijzen juist lager kunnen zijn of er een beter medicijn wordt gerealiseerd tegen mogelijk hogere prijzen. Maar het probleem wat jij noemt heeft niets met de kosten voor de fabrikant te maken.
AI training op auteursrechtelijk beschermd materiaal zonder toestemming en financiële compensatie? Ja, verbieden die hap. Het hoeft niet zo moeilijk te zijn.
Auteursrecht is niet absoluut en is ooit ingevoerd om te zorgen dat er meer werken geproduceerd worden. In de praktijk is het een inkomstenbron voor een select groepje beroemdheden waar vrijwel niemand nog tussen komt. Enige discussie lijkt me wel terecht en ja, dat is wel moeilijk.
Dit is gewoonweg niet waar. Iedereen geniet automatisch het auteursrecht zodra hij of zij iets creatiefs maakt. Het is niet zo dat een elite het voor het zeggen heeft. Uiteraard is het wel zo dat grotere bedrijven meer hun best doen om hun rechten te beschermen, want ja, ze hebben er het geld voor. Maar dit is niet exclusief aan hen voorbehouden. Eenieder die het wil kan geld verdienen met zijn kunst. (Of nouja, kon... met de komst van AI is dat wel een stuk moeilijker geworden.)

Je zegt dat het moeilijk is, terwijl je juist een positie inneemt waarbij je de grootmachten verdedigt ten koste van de kleinere spelers. Mijn argument is juist dat iedereen compensatie van AI-makers moet krijgen. Dat is veel eerlijker, niet voor een 'select groepje'. Waarom argumenteer je daar niet voor?
Als je AI medicijnen voor levensbedreigende ziektes kan ontwikkelen dan kan je daar bakken met geld mee verdienen. Dan kan je toch ook gewoon betalen voor een licentie op de data die je AI nodig heeft om die medicijnen te ontwikkelen? Lijkt me best een businesscase voor.

Het gaat in het geval van nagenoeg alle teksten en afbeeldingen niet om wetenschappelijke data om medicijnen te ontwikkelen (of iets anders dat je als voorbeeld wilt verzinnen waar niemand tegen kan zijn) maar om dingen die mensen gemaakt hebben als nieuws, kunst of vermaak om hun brood mee te verdienen. Waarom zou een AI bedrijf dat zomaar mogen gebruiken zonder ervoor te betalen?
LLMs worden wel nuttiger gebruikt dan slechts voor namaak kunst of vermaak. Goed toegepast kan het een heel waardevol middel zijn voor bepaalde brainstorm of uitzoek taken of extra controles om werk van hogere kwaliteit op te leveren.

Het probleem is dat onderhandelen over en aftikken van royalties een proces is wat voor geen meter schaalt. Op die manier hadden we nog 100 jaar moeten wachten op LLMs.

Bovendien is er geen enkele reden om 'up front' aan te nemen dat er massaal geld verdiend gaat worden (zelfs nu is dat nog een twijfelgeval) dus lijkt het me business technisch totaal onmogelijk om daar aan te beginnen.
Als het nuttig gebruikt wordt om werk van hogere kwaliteit op te leveren is er een businesscase om te betalen voor de benodigde data.

Onderzoek naar medicijnen (of ander onderzoek) levert nooit per definitie geld op, veel onderzoek loopt op niets uit, maar toch wordt er gewoon geld in gestoken.

Dat onderhandelen over rechten lastig schaalt is waar, maar dat is toch geen excuus om dan maar gewoon te doen alsof die rechten niet bestaan? Dat is hooguit een reden om uit te zoeken hoe dat schaalbaar georganiseerd kan worden.

Waarom zou het overigens per sé goed zijn dat er LLM's zijn (want dat impliceer je)? of zou het slecht zijn als het langer duurt voordat er LLM's zijn? Wat mij betreft is nog niet aangetoond dat LLM's de wereld alleen maar beter maken (of zelfs maar per saldo beter maken als je de plussen en minnen verrekent).

Dat jij (en heel veel anderen) LLM's als iets goeds zien maakt nog niet dat het dan maar ok is om het werk van anderen zonder hun toestemming en zonder ze ervoor te betalen te gebruiken voor LLM's of dat het het probleem van rechthebbenden zou zijn dat het lastig is voor ontwikkelaars van LLM's als ze de rechten moeten regelen.

[Reactie gewijzigd door Vizzie op 7 september 2026 08:46]

Dat onderhandelen over rechten lastig schaalt is waar, maar dat is toch geen excuus om dan maar gewoon te doen alsof die rechten niet bestaan? Dat is hooguit een reden om uit te zoeken hoe dat schaalbaar georganiseerd kan worden.
Zo lang er discussie is of copyright überhaupt van toepassing is op AI training en in welke mate 'winnen' de partijen die het voordeel van de twijfel aan zichzelf geven.
Waarom zou het overigens per sé goed zijn dat er LLM's zijn (want dat impliceer je)?
Dat jij (en heel veel anderen) LLM's als iets goeds zien
En dat heb ik dus nergens gezegd. Alleen dat het volgen van een copyright maximaliserend beleid er voor zorgt dat ze niet ontwikkeld kunnen worden. Er zijn 'ethisch' gesourcede LLMs die alleen uit publiek domein bronnen getraind zijn. Die kent niemand want in de praktijk heb je daar totaal niets aan...
Als in een creatief beroep had en AI zou mijn werk klakkeloos kopiëren en daaraan geld verdienen dan ga ik dit nimmer nooit accepteren. AI kan niets nieuws bedenken en moet het hebben van onze “trainingsdagen”. Maar goed, als ik een creatief beroep had, dan had ik al 2 jaar geleden al mijn online content gewist.
Daarom, hoe zou het anders kunnen?
Creatief werk is mijn hobby. Of nouja, was. AI heeft dit verpest. Ik had ooit de intentie om mijn werken te verkopen zodra ik deze goed genoeg beschouwde, maar daar is nu geen beginnen meer aan.

We hebben verloren. Kei- en keihard.
Alleen als jouw werk niet beter is dan dat van AI heb je verloren.

Er zal altijd een markt zijn voor 'echte' kunst waardoor mensen aangesproken worden en tot nadenken worden aangezet. Alleen is dat een markt waar altijd al heel moeilijk in te komen was. Echte kunstenaars interesseert dat geen bal, die maken gewoon hun dingen of ze die nou kunnen verkopen of niet.
Mijn werk is beter dan dat van AI. Maar het doet er niet toe, want het wordt direct opgeslokt en ik moet concurreren met MILJOENEN gegenereerde afbeeldingen in een vergelijkbare stijl. En AI ontwikkelt zich retesnel, zodanig dat het steeds moeilijker wordt om onderscheid te maken. Hoe kan eender welke echte artiest zich dan nog onderscheiden van AI 'artiesten', die in veelvoud aanwezig zijn en een nog groter veelvoud aan slop op het internet pleuren? Ik heb het al ervaren. N=1, ik weet het, maar het is zeer duidelijk. Sinds het bestaan van AI image generators is mijn exposure op verscheidene platforms drastisch omlaag gegaan.

Echte kunstenaars maken zich wel degelijk zorgen om AI, en al helemaal zij die er geld mee verdienen. Of nouja, verdienden. Ik denk dat je de invloed van AI slop zwaar onderschat.
Zullen we staalfabrikanten dan ook maar hun staal gratis laten afpakken omdat de Amerikaanse autofabrikanten nou eenmaal staal nodig hebben? Het journalistieke werk van de NYT is net zo goed een product als dat staal het is.
Breng ze nou niet op ideeën ;)
Misschien moet het concept auteursrecht wel op de schop.
Ik vind dit bijzonder, in een land wat die auteursrecht langer en langer en langer heeft gemaakt om een bepaalde muis te kunnen beschermen.
Of misschien moeten AIs gewoon betalen voor het gebruik van beschermd materiaal. Dan hoeft het auteursrecht niet op de schop maar kan het gewoon toegepast worden zoals normaal.
Echt eng hoe snel Amerika dankzij Trump afglijdt naar een bananenrepubliek.

Zelfs als ze de perfecte president krijgen, heeft Trump vakkundig alle soft power verspeeld wat opgebouwd is in pak hem beet 80 jaar en dan huilen dat andere landne niet bereid zijn zoals in 2000 om zich bij een oorlog aan te sluiten.

Het enige wat je als voordeel zou kunnen zien, is dat het nu eindelijk is doorgedrongen tot onze politici in de EU dat we zelf ook een blok moeten vormen in plaats van speelbal te zijn.

[Reactie gewijzigd door Zyphlan op 3 september 2026 13:38]

afglijden? Zit zitten al op de bodem hoor.

Vroeger dacht je nog wel eens 'dat zal in zo'n vaart niet lopen', maar dat is inmiddels ook een gepasseerd station. Men doet niet eens meer moeite om de corruptie te verbergen. En als ze zo nodig copyrighted training materiaal nodig hebben, laat ze dan US made materiaal tot zich nemen.
Dat is het probleem , met Trump weet je het dus niet. :+
Bodem? Er is nog een heel grote afgrond waar ze in kunnen schuiven.

Dat ze op de bodem zitten van de ontwikkelde landen is al een lange tijd zo.
Eigenlijk is de VS geen ontwikkeld land meer, en dat is duidelijk te zien nu.

Dat ze een paar rijken hebben die hun gemiddelde GDP opkrikken verandert daar niets aan. Sterker nog, ultra rijken zijn juist een symptoom van een corrupte maatschappij.
Geen enkel individu zou zoveel resources naar zichzelf mogen kunnen trekken, maakt niet uit hoe een geweldig genie deze is.
Dat is toch wel wat polariserend gebruik van simplistische parabolen. De vraag is of dat materiaal in die llm's gaat zitten, en of het die materialen reproduceert. Nee zegt de Amerikaanse overheid, er worden nieuwe dingen gemaakt. En daarnaast vinden we het ook erg belangrijk dat de VS zich goed kan blijven ontwikkelen.
Je krijgt toch wel het idee dat ze heel erg naar het door hun gewenste antwoord toepraten, in plaats van dat er na een secure juridische studie tot die conclusie gekomen wordt.

En ze komen er ook nog min of meer voor uit, want als je tussen de regels doorleest, zeggen ze feitelijk "auteursrecht mag even niet belangrijk zijn, want we moeten de AI-race winnen".
Als je ooit dus iets van betekenis hebt geproduceerd, is dat nu dus 'voor het landsbelang' genationaliseerd in de VS, en vervolgens leasen ze je het als een verwaterde en gepropagandeerde vorm van AI aan je terug.

[Reactie gewijzigd door kikibu op 3 september 2026 13:28]

Dit is nou het socialisme waar Trump, de techbros en andere rechts-conservatieven altijd hun mond van vol hebben. Als het ze uitkomt is ineens alles publiek eigendom.
Gewoon weer een vorm van socialize the cost, privatize the profit.
Punt is wel dat wat jij hebt gecreeerd in principe op een zelfde manier tot stand is gekomen als dat geavanceerde AI doet, ook alles wat jij doet heb je geleerd op basis van dingen die je ooit gelezen, gehoord, gezien of ervaren hebt, en al die 'kennis' gebruik je om iets te creeeren.
Maar voor het meeste auteursrechtelijke werk dat ik heb gelezen is op de één of andere manier betaald. Ik heb het óf zelf gekocht/ betaald via een abonnement. Of meegelezen bij een familielid/ vriend/ kennis die er voor heeft betaald. Of gelezen bij of via een bibliotheek. Of gelezen op een website die betaald wordt met advertenties (al wordt het hier wel wat schimmiger met een adblocker, natuurlijk ;) ).

Maar hoewel ik vrij veel lees, kan ik in mijn hele leven nog geen deuk slaan in al het materiaal waarmee een AI in een dag getraind wordt. En al zou ik dat allemaal gebruiken om er zelf geld mee te verdienen, dan is de 'schade' voor de rechthebbenden minimaal. Een AI kan echter over alles on-demand een overzicht maken, waardoor de oorspronkelijke rechthebbenden serieus inkomen mislopen.

Maar er is nog een loop-hole voor de rechthebbenden.
Bij fair-use is het lezen/ trainen misschien toegestaan. Maar voor het trainen struinen de AI-modellen niet zelf alle sites af om ter plekke het materiaal in zich op te nemen. Het materiaal waar de AI-modellen mee getraind wordt wordt door bots verzameld en in een grote database gezet, waarmee de modellen getraind worden. Dat verzamelen en opslaan valt naar mijn idee niet onder fair-use.
Hoe kan het zijn dat tekst wel als fair use wordt gezien, maar films en muziek niet?
Het ding in deze is dat het opnemen in een LLM als fair use policy word gezien. Het gaat niet om het feit dat het tekst betreft, maar om het feit dat het een LLM is welke het "gebruikt". Met deze uitspraak zou mogelijk dus ook geen onderscheidt meer gemaakt hoeven worden tussen de verschillende media. En op welk punt word er dan wel een streep in het zand getrokken? Bij prive media? Kans bestaat dat dat ook alst fair use word gezien, gewoon word gebruikt, en pas als een rechter er een stokje voor steekt het stopt zonder ook maar een boete.


Al met al vind ik het wel een enge situatie want het geeft wel weer hoe ver een Amerika in deze gaat om zijn samenleving te verloederen, in het voordeel van AI, welke niks meer doet als een klein groepje bedrijven en personen miljarden te laten verdienen.
Je word eigenlijk verplicht om alles op te laten nemen in hun LLM. Dat word een politie staat op steroiden.
Gezien het de Amerikaanse DOJ is die dit stelt, en niet een rechter, vermoed ik dat de argumentatie vooral neerkomt op dat zij LLMs meer nodig denken te hebben dan Diffusion Models.
Ik zeg dan: lekker films en muziek downloaden om je AI mee te trainen. Je moet natuurlijk wel controleren of de data goed is en dus alle films bekijken en de muziek luisteren. Rare kronkel om te zeggen dat als het voor AI is, opeens fair use is
Maar als je de boeken hebt gekocht, en de DVD's, en de kranten, en de tijdschriften.

Mag je het dan door jouw LLM laten lezen?

Het is ook niet zo dat dat deze LLM vervolgens op commando die exacte werken kan genereren. Ze zitten er niet verbatim in.
Jij mag met jou gekochte data en LLM trainen. Dat is het idee. Net als je jezelf mag trainen.

Veel mensen hier kunnen blijkbaar de concepten van entertainment en training niet uit elkaar houden.
Waarom? Als een mens mag ik de Donald Duck niet namaken, maar ik mag hem wel kopen en van leren hoe Disney het voor elkaar krijgt dat al 50 jaar of zo te verkopen.

Er is verschil tussen leren van legaal verkregen materiaal en downloaden voor entertainment
Om advocaat van de duivel te spelen:

Iedereen kan tekst schrijven, maar je moet artiest zijn om films en muziek te maken.
Iedereen met de juiste tools kan films, muziek en afbeeldingen maken. De kwaliteit zal soms om te janken zijn, maar iedereen kan het.
Het beperken van de ontwikkeling van grote taalmodellen (llm's) vanwege 'een misverstand over fair use' zou creatieve en wetenschappelijke vooruitgang dwarsbomen, aldus de Amerikaanse overheid.
Ik denk dat er een foutje in het artikel is geslopen. 'creatieve en wetenschappelijke vooruitgang' had moeten zijn: 'de portemonnee van ultra-rijken, inclusief die van mr. Trump himself'
Gaat deze logica ook op voor het belang van de patenten die ASML nodig heeft?
De Chinezen denken daar wel zo over ja...
Dit is echt van de gekke, er zou op zijn minst een verplichte jaarlijkse vergoeding moeten zijn. En flink hoog ook.
Het ministerie stelt dat AI-toepassingen nieuw materiaal maken op basis van hun trainingsdata.
Hmm, dan hebben ze er vast ook geen probleem mee als ik boeken, audio- en videomateriaal bestudeer (om er nieuw materiaal mee te maken)?

En voor patenten hoeven we ook niet meer te betalen neem ik aan?

[Reactie gewijzigd door Olaf van der Spek op 3 september 2026 13:43]


Om te kunnen reageren moet je ingelogd zijn