Nederlands taalmodel gaat offline na contact met Stichting Brein

Er is een Nederlands taalmodel gebaseerd op Mistral-7B offline gegaan nadat Stichting Brein contact had opgenomen. Het is onbekend om welk model het precies gaat. Het is het tweede taalmodel in korte tijd dat offline gaat.

De maker had het model getraind op 'miljarden tokens aan Nederlandstalige literatuur, nieuws en studieboeken'. Brein vroeg naar eigen zeggen om welke data dat ging, waarna de maker het model offline haalde. Het is op een Mistral-7B gebaseerd model, maar Brein noemt de naam niet. Vorige week ging GEITje offline na een verzoek van Brein.

Brein wil dat makers van modellen een vergoeding betalen als zij materiaal van auteursrechthebbenden gebruikt hebben voor training. Dat is in de AI-wereld lange tijd niet gebruikelijk geweest: ook grote bedrijven als OpenAI en Anthropic hebben het web gescraped. Onder druk van mogelijke rechtszaken hebben zij wel veelal deals gesloten met grote mediabedrijven.

Door Arnoud Wokke

Redacteur Tweakers

06-02-2025 • 14:13

176

Reacties (176)

Sorteer op:

Weergave:

Kijk naar 9/10 door leerlingen geschreven werkstukken en je zult de helft van Wikipedia, de andere helft van Google (of nu ChatGPT) tegenkomen. Waar dan door de leerling nog wat gratis spelfouten aan toegevoegd zijn.

Of vraag een "designer" om een website of logo te ontwerpen. 99% is copy pasta van stock afbeelldingen en voorbeeldteksten. Of een programmeur om een applicatie te schrijven. Een stukje buissiness logica, standaard kopietje van de ontwikkel omgeving en o ja. Stackoverflow.

En zelfs films en boeken zijn vrijwel allemaal kopieën met enkele aanpassingen v an andere films en boeken of oude verhalen. Zo is Disney groot geworden aan het kopieëren van "public domain" sprookjes, maar wanneer hun 'eigen' spul public domain moet worden doen ze moeilijk.

AI (LLM) doet IMHO hetzelfde, gebruikt input (kennis) om daarmee nieuwe output te genereren aan de hand van een prompt.

[Reactie gewijzigd door ShadLink op 6 februari 2025 16:47]

Als een mens daadwerkelijk zelf dingen schrijft is dat anders dan een LLM die het halve internet leeg gescraped heeft
en toch vraag ik mij dat echt af.

Schrijft een mens daadwerkelijk dingen zelf?

hoe vaak ik wel niet gebruik maak van artikelen en oplossingen van anderen op het internet is niet normaal. Dagelijks meerdere keren. Om echt van alles mee te doen. Dit ook. Ook allemaal gebaseerd op kennis van anderen en spul wat ik eerder gelezen of gezien heb. Een reactie als dit bestaat ook grotendeels uit gedichtenspinsels die voortkomen uit Literatuuronderzoek tijdens afstudeerstage 10 jaar geleden, veel ervaring met AI, \on the Job training van mijzelf en allerlei andere informatie uit opleidingen en trainingen.

Ik doe echt niet heel veel anders dan mijn eigen algoritme trainen met data van het internet en
Het is allemaal actie = reactie. Vraag = antwoord

Op dit item kan niet meer gereageerd worden.