Anthropic legt voor het eerst uit hoe zijn watermerktechnologie werkt

Het watermerk dat Claude op teksten zet, heeft geen invloed op de output en kost geen extra tokens, zegt Anthropic. Het systeem werkt vergelijkbaar met andere watermerktechnologieën voor AI, aldus het bedrijf. Anthropic brengt nu voor het eerst gedetailleerde informatie naar buiten brengt over zijn plan om teksten in Claude van een watermerk te voorzien.

Dit nieuws in het kort

  • Het is voor het eerst dat Anthropic gedetailleerd uiteenzet hoe watermerken werken.
  • Het watermerk is afgeleid van SynthID, een AI-watermerktechnologie die door Google is ontworpen.
  • Het watermerk gebruikt de random number generator en meerdere voorspelde woorden in de tekst om de waarschijnlijkheid dat Claude de tekst heeft gegenereerd in te schatten.

Anthropic heeft een uitgebreide blogpost geschreven waarin het bedrijf uitlegt hoe de watermerktechnologie in Claude werkt. Het bedrijf maakte eerder deze maand bekend dat het onzichtbare watermerken toevoegt aan Claude-output. Tot nu toe was Anthropic vaag over hoe dat systeem werkt.

Anthropic benadrukt dat de watermerken in ieder geval onzichtbaar zijn, maar ook dat ze de output van Claude niet beïnvloeden. Ook kost het genereren van watermerken geen extra tokens en wordt het niet duurder als gebruikers op basis van output betalen. Anthropic bevestigt ook dat het watermerk verplicht is op grond van de Europese AI-verordening. Eerder deze maand gingen nieuwe regels in op grond waarvan AI-gegenereerde output als zodanig herkenbaar moet zijn.

Anthropic Claude stock. Bron: Samuel Boivin/NurPhoto via Getty Images

SynthID-afgeleide

Nu zegt Anthropic ook hoe het watermerk precies wordt aangemaakt. Dat is zoals veel experts al dachten. Het gaat om een aangepaste versie van SynthID, een watermerktechnologie die is bedacht voor Googles DeepMind-afdeling. Google gebruikt die technologie ook voor zijn eigen systemen.

Het systeem werkt door enkele woordkeuzes en de sleutel achter de random number generator in Claude te analyseren om te zien of een tekst inderdaad door Claude is geschreven. Llm's zijn, heel platgeslagen, woordvoorspellers – ze werden een paar jaar geleden nog wel eens 'fancy autocorrect' genoemd. Dat betekent dat een llm telkens voorspelt welk woord of teken logischerwijs op een ander woord of teken volgt.

Random number generator

In sommige gevallen moet een llm een exact antwoord geven, maar veel vaker kan de llm synoniemen gebruiken. Welk synoniem de llm als output geeft, wordt dan bepaald door een random number generator. Die RNG is ontworpen door Anthropic zelf en werkt met een sleutel. Het watermerk gebruikt die sleutel en een aantal voorspellingen in de tekst om te kijken of de gegeven woorden op die plek in de tekst inderdaad zijn gekozen door de random number generator. Hoe vaker dat gebeurt, hoe groter de zekerheid dat de tekst inderdaad door Claude is geschreven.

Om die reden werken de watermerken vooral goed bij tekstuele output. Daarbij is het namelijk mogelijk veel synoniemen te gebruiken. Bij exacte teksten, waarbij output altijd moet kloppen, is dat minder het geval. Daarom is het watermerk dat op code wordt toegepast veel minder betrouwbaar, al kan het systeem bijvoorbeeld wel de codedocumentatie analyseren.

De EU verplicht transparantie over AI-gebruik. Beeld: Tweakers
De EU verplicht transparantie over AI-gebruik. Beeld: Tweakers

Door Tijs Hofmans

Nieuwscoördinator

16-08-2026 • 12:02

20

Reacties (20)

Sorteer op:

Weergave:

Oftewel een synoniemencheck er overheen en het watermerk werkt niet meer?
Wat is het resultaat als ik de gegenereerde tekst vervolgens terug in Claude stop met de vraag elk woord te vervangen voor een zo passend mogelijk synoniem? Of in ChatGPT?

Klinkt beetje flauw maar oprecht, werkt dit dan nog steeds?
Dan krijg je natuurlijk in je nieuwe tekst een nieuwe watermark.
tsja, kan je zoveel moeite verwachten van mensen die AI gebruiken en doen alsof het hun eigen tekst is?
tsja, kan je zoveel moeite verwachten van mensen die AI gebruiken en doen alsof het hun eigen tekst is?
Nee dat denk ik niet. En anderzijds, boeit het? Wat mij betreft niet overal. Ik ben van plan om uitleg te genereren van onze codebase voor onze klanten. Met wat sturing van mijn kant. Een kennisbank dus, waarvan ik verwacht dat de AI er prima uit komt. Dit zal door mij gecontroleerd en aangevuld worden. Normaal zou ik daar de tijd niet voor hebben gehad en het zal me zorg wezen of mensen wel of niet weten dat een AI er bij geholpen heeft.

Het hangt er naar mijn mening enorm vanaf hoe het ingezet wordt. Ik erger me vooral aan de grote hoeveelheden 'slop' die er vooral op gericht zijn de gebruiker bezig te houden. Of zelfs te beinvloeden. Bijvoorbeeld videos die 30 minuten lang dezelfde meuk herhalen in andere woorden en eigenlijk niks toevoegen. Wanneer AI zinnig wordt ingezet en van toegevoegde waarde is, dan maakt het mij als consument geen fluit uit. Zolang het maar een bepaalde waarde heeft.

Ik lach me stuk om Harry Spotter 7. Overduidelijk AI, maar toch heeft het voor mij toegevoegde waarde. Ik denk dat we uberhaupt moeten leren 'nee' te zeggen content. Zoveel mensen blijven eindeloos scrollen, daar mag men zelf ook een stuk verantwoordelijkheid voor nemen. Juist nu er zoveel meer content beschikbaar komt door AI. Maargoed, helaas wordt AI ook gebruikt voor minder frisse doeleinden en dan is het fijn om te weten dat het vanuit een AI komt.
Ik denk dat je de researchers van Google onderschat.
Oftewel een synoniemencheck er overheen en het watermerk werkt niet meer?
Klopt, maar een watermerk voor platte teksten is natuurlijk bijzonder lastig, zeker als het een korte tekst is. Bij een afbeelding heb je duizenden pixels met duizenden kleuren om mee te spelen, bij platte tekst het je het aantal woorden.
haha :+ ja, dat was wel te verwachten... Ik blijf er ook bij dat deze EU wet, daar het misschien soms nuttig kan zijn, ook wel degelijk een false sense of security geeft. Eigenlijk het enige dat je er aan hebt is dat als je een "made by AI tag" ziet je zeker weet dat het met AI is gemaakt, maar het ontbreken van zo'n tag zegt helemaal niks over of het WEL met AI is gemaakt.
Als je Alfred Iedema heet zegt die tag helemaal niets! :+
Probeer die maar eens op een wat kortere tekst. Maakt er een puinzooi van, dan zie je niet meer dat het door AI gemaakt is maar dan lijkt het door een kleuter geschreven.
Hoe gaat dit werken als je claude een tekst in het Engels laat schrijven en aan een andere llm vraagt om het te vertalen naar het Nederlands?
edit:
Het kan wel het werk van autonome ai Agents makkelijker zichtbaar maken.
En terwijl ik de Edit schrijf: als elke llm dit ingebouwd krijgt, dan helpt vertalen natuurlijk niet meer. Dan kan wellicht alleen een lokale ai helpen, tenminste ik ga er dan vanuit dat die dit niet krijgen/het daar vrij snel uitgeschakeld wordt door de community

[Reactie gewijzigd door Romborum op 16 augustus 2026 12:18]

Dan zit er een watermerk in van de andere llm?
Dan krijg je het watermerk van de andere LLM.
Wat ik nog niet helemaal snap is of/hoe je generieke AI content kan detecten. Ik kan me voorstellen als je precies het model weet of vermoedt waar het mee gemaakt is, dat die dan vrij makkelijk kan zien wat voor hem de afwijkende woordkeuze is. Maar wat als je niet weet met welk model, of ook welke versie van een model, het gemaakt is? Kan je bijvoorbeeld over vele jaren nog de watermarks herkennen van de models van nu zonder dat die misschien uberhaupt nog ergens draaien? Of werkt het veel model-onafhankelijker? Dat je bijvoorbeeld altijd wel een paar verschillende synoniemen of zinsopbouwen kan gebruiken, en dat de kans dat je precies die allemaal samen gebruikt snel afneemt (product).

[Reactie gewijzigd door Zoijar op 16 augustus 2026 12:11]

De Europese eisen stellen dat makkelijk herkenbaar moet zijn of een tekst of product gemaakt is door AI. Dat hoeft niet met het menselijk oog zichtbaar te zijn, maar het moet wel eenvoudig te verifiëren zijn.

Wat dat betreft is dit een mooie stap in transparantie van Anthropic, maar valt of staat dit met de eenvoud waarmee dat watermerk te verifiëren is. Gaat Anthropic een tool beschikbaar stellen die je als gebruiker op een tekst oid kunt loslaten, om te checken of het AI is? En gaan er dan Meta-tools komen die verschillende verificatie tools combineert? Want als een tekst gemaakt is met ChatGPT en je check of het watermerk van Claude erin herkenbaar is, kom je nog niet veel verder.

Wellicht een mooie taak voor Europa om zoiets te ontwikkelen, want zij zijn ook de hele ‘aanstichter’ van deze transparantie checks.

[Reactie gewijzigd door ZwolschBalletje op 16 augustus 2026 12:24]

Mijn vraag is, als het makkelijk te verifiëren is, is het dan ook niet makkelijk om deze verificatie te omzijlen? Dit klinkt als een race dat eigenlijk verloren is voor de kant dat de verificatie moet inbouwen, omdat het makkelijk te verifiëren moet zijn.

Denk niet dat het lang duurt voor je programma's ziet verschijnen welke erg eenvoudig deze verificatie eruit weten te slopen.
Is watermerktechnologie nou echt voor maatregel op regelgeving bedoeld of als IP middel voor toekomstige rechtszaken?
ff laten autoherschrijven met van die taaltooltjes zoals grammarly ofzo dus... (tenzij die OOK watermerken gaan toevoegen, maar lijkt me stug, die dingen zijn voor taal reparatie en niet content generatie)
Het is dus perfect mogelijk dat een volledig menselijk geschreven tekst als AI gegenereerd aanzien wordt als je schrijfstijl toevallig "verkeerd" is?

Fijn als je hele zelfgeschreven doctoraat op die manier AI wordt aanzien en je er niks kan tegenin brengen..

Om te kunnen reageren moet je ingelogd zijn