Reddit laat llm's posts en reacties controleren en automatisch verwijderen

Reddit komt met een tool waarmee moderators llm's kunnen gebruiken om posts en reacties te controleren. Ook wil het platform meer maatregelen nemen om scraping tegen te gaan.

Reddit werkt aan een pakket automatische moderatietools onder de naam Rules Hub, zegt het bedrijf. Daarmee kunnen moderators van subreddits moderatieregels opstellen voor llm's. Ook kunnen ze bepalen wat de AI-mod moet doen als deze detecteert dat een gebruiker een regel heeft geschonden. Ze kunnen de post automatisch naar een menselijke moderator laten sturen of meteen laten verwijderen.

Reddit-moderators konden al gebruikmaken van de AutoMod, maar deze gebruikte geen llm's. De AutoMod reageerde dus alleen op specifieke termen en patronen. De llm's kunnen volgens het platform beoordelen 'of een post of reactie voldoet aan de intentie van een regel'.

Reddit test de nieuwe moderatietools al enkele maanden met moderators van 700 community's. Alle nieuwe community's hebben vanaf nu ook toegang tot llm-moderatie. Later dit jaar moeten de tools voor iedere moderator beschikbaar komen.

Meer maatregelen om scraping te voorkomen

Reddit gaat daarnaast de toegang tot zijn api uitfaseren. Het bedrijf begon in 2023 al geld te vragen voor toegang, naar eigen zeggen om scraping voor het trainen van llm's tegen te gaan.

Old.reddit.com inloggen
Inlogverplichting voor old.reddit.com

In de toekomst moeten partijen die van Reddits api gebruik willen maken, zoals Reddit-apps van derden, overstappen op zijn Developer Platform. Het bedrijf wil naar eigen zeggen dat 'alle goede, betrouwbare automatisering op Reddit draait binnen een ecosysteem dat we kunnen ondersteunen en waar we consistent beleid voor kunnen handhaven'.

Om ongeautoriseerde scraping te voorkomen, wil Reddit ook 'veranderingen aanbrengen' in old.reddit.com. Om welke veranderingen het gaat, is onduidelijk. Sinds kort moeten gebruikers al inloggen om de oude website te kunnen bezoeken.

Door Kevin Krikhaar

Redacteur

06-08-2026 • 14:17

36

Reacties (36)

Sorteer op:

Weergave:

LLM's snappen context noch sarcasme. Denk dat dit gaat leiden tot een lawine aan willekeurige, onterechte bans, terwijl ze ondertussen de trouwste gebruikers definitief wegjagen door old.reddit en de API verder af te sluiten.

(edit; eerste comment was beetje kortaf)

[Reactie gewijzigd door sky op 6 augustus 2026 14:31]

Denk dat dit gaat leiden tot een lawine aan willekeurige, onterechte bans
Ben je bekend met Reddit? :+

En voor sarcasme wordt "/s" dan maar verplicht, I guess...

Ik weet niet of dit nou een positieve ontwikkeling gaat zijn of niet. Reddit als bedrijf is geen lieverdje, maar de "terminally online" vrijwillige mods zijn ook niet altijd fantastisch.

Sowieso is de site enkel nog goed te gebruiken op de wat meer niche subreddits. Op de grotere subreddits is iedereen vooral bezig met karma farmen lijkt het.
Dat is echt niet te misbruiken dan /s
En voor sarcasme wordt "/s" dan maar verplicht, I guess...
Dan is “/s” een workaround om alles te kunnen zeggen zonder ban? Of hoe zie je dat voor je. Want, schrik niet, dat kun je ook ergens achter zetten als het geen sarcasme is.
LLM's snappen context noch sarcasme.
Feitelijk onjuist. Het is lastiger meten omdat mensen het ook vaak daarover oneens zijn. Maar op datasets waar mensen een 90%+ consensus hebben doen LLMs het ook goed. En wanneer mensen zelf 50/50 scoren is het maar de vraag welke helft er gelijk heeft.
LLM's snappen context noch sarcasme.
Ja en nee: natuurlijk 'snappen' ze niets omdat het geen bewustzijn is, en er dus geen bewustzijn is dat snapt wat 'rood' of 'blij' eigenlijk betekent.

Maar even praktisch gezien: een LLM is redelijk goed in staat om sarcasme te detecteren en context te lezen. Natuurlijk niet perfect, maar dat kunnen de meeste mensen ook niet.
Denk dat dit gaat leiden tot een lawine aan willekeurige, onterechte bans,
Eens. Maar dat is nu ook al het geval in vele grote subreddits met menselijke moderators.
Reddit zou een van de duurste bedrijven ter wereld moeten zijn, omdat het een van de weinige platformen is die nog echte/organische content genereert waar AI op getrained kan worden. Eigenlijk is het meeste dat AI tegenwoordig zegt een samenvatting van reddit.
Ik ben wel bang dat dit al een beetje verleden tijd is.
Denk dat van de nieuwe content op Reddit steeds meer AI generated is.
Hoe groter de sub, hoe meer AI-generated content.
Klopt. Vooral in de grote subs zie je steeds vaker AI-reacties. In kleinere, niche communities zijn de antwoorden meestal nog een stuk authentieker en gebaseerd op echte ervaring.

^ Dit is automatisch gegenereerd met een LLM. Helaas zijn zie ik steeds vaker dat mensen, dan wel niet automatisch, AI gebruiken voor hun reacties. Ook komt het steeds vaker voor dat ontwikkelaars automatisch "support" verlenen via AI, en dan heb ik mijn twijfels erbij of de ontwikkelaar zelf ook echt wel de bug reports ziet.
Wat wel een interessant fenomeen was was dat er op een bepaald moment 'bot-teams' waren die populaire posts uit het verleden naspeelden. Dus niet enkel een repost als basis maar ook een reeks grappig beoordeelde reacties. (Met als bedoeling te karma-farmen en dan die accounts te kunnen doorverkopen, blijkbaar)

Gevolg is dat je als gebruiker naar re-runs zit te kijken van een forumconversatie :P
Ik zie regelmatig in discussies op sub-Reddits mensen roepen dat er misschien al bots meedoen in reacties, maar ik herken ze praktisch nooit. Wie weet zijn zelfs de mensen die het roepen dat er misschien bots meepraten, zelf ook bots. En als ze er dus al tussen zitten, heb ik werkelijk niks daar van gemerkt. Wat aan de ene kant ook wel een 'eng' idee is dat ik misschien wel reacties aan het lezen ben die heel menselijk overkomen maar van AI komen. Straks ben ik allemaal reacties aan het lezen van AI die met elkaar praat en leest het als een hechte 'community', maar heb je er helemaal niks van door dat er steeds minder mensen tussen zitten.

Rijst de vraag, als je geen verschil merkt tussen AI of menselijke reacties en je hebt wel veel plezier om het te lezen terwijl het allemaal AI is, moet je dan uit principe het niet lezen of gewoon accepteren of anders?

Je voelt het al van ver aankomen dat er misschien in de toekomst per bericht een icoontje bij gaat staan die aangeeft of het AI is of een mens, ter informatie.

[Reactie gewijzigd door Tjeerd op 6 augustus 2026 15:32]

omdat het een van de weinige platformen is die nog echte/organische content genereert waar AI op getrained kan worden
Zeg maar 'kon'. Sinds ze 3rd party apps blokkeren en een nieuwe nagenoeg onbruikbare UI opdringen is de activiteit gekelderd. Daarnaast is de hoeveelheid AI-spam geëxplodeerd.

Zelf vind ik Reddit in een paar jaar daarom echt totaal nutteloos geworden.
Automatisch verwijderen = zeer slecht idee. Daar is geen undo knop voor voor het geval de AI de context niet snapt of dat de instructie zelf gewoon niet duidelijk genoeg is. Er moet altijd een human in de loop zijn voor zulke beslissingen. Nu creeer je een AI-rechter. Dat moet je niet willen.
Ik voorzie een hoop zogenaamd niet zo bedoelde censuur.
Dus Reddit gebruikt straks AI om posts en reacties te modereren die geschreven zijn door AI en waarop massaal gestemd wordt met AI. :+

Relevante comic.

[Reactie gewijzigd door The Zep Man op 6 augustus 2026 14:37]

Straks worden posts geschreven door AI, beoordeeld door AI en verwijderd door AI. Dan hoeven mensen alleen nog maar ruzie te maken met de moderatiebeslissing.
Om ongeautoriseerde scraping te voorkomen, wil Reddit ook 'veranderingen aanbrengen' in old.reddit.com.
Dat klinkt niet goed, ik kan echt niet wennen aan die nieuwe layout (buiten dat het gewoon veel minder laat zien en wat het laat zien minder duidelijk laat zien).
Eerst zien dan geloven want op bijna alle grote platforms stikt het van de Ai Bots / LLM's. En niet een beetje maar 50% is standaard en 100% is ook geen uitzondering..
Ben benieuwd want voorheen mochten bots op hun data trainen.
Dit gaat de moderatoren veel tijd schelen. Waarom? Om dezelfde reden als een spamfilter. Het huidige filter zal werken op basis van blacklisting van bepaalde woorden, en dat haalt bepaalde afschuwelijke content eruit (maar ook enkele false positives). Een LLM kan de nuance vinden.

Toevallig heeft Mistral onlangs (blog post van 4 Aug) Shieldstral uitgebracht die in deze voorziet:
Shieldstral introduces a 3B open-weights multimodal safety classifier that outperforms models up to 7x its size by framing content moderation as a policy-adaptive question-answering task. Unlike traditional guardrail models, it accepts plain-language policies at inference time, unifying text and image safety evaluation without retraining. Released under Apache 2.0, it delivers calibrated safety scores across diverse benchmarks while running efficiently on a single 16GB NVIDIA GPU.
Ik hoop wel dat het niet het eindoordeel heeft, of dat we afglijden naar 'computer says so' ('LLM zegt het, dus dan is het zo, hoef ik niet te verifiëren'). Dus er moet altijd nog een mens kritisch naar kijken.
Ik snap dit ergens wel, een paar jaar geleden kregen enkele moderators ineens kapsones en ze probeerden toen de website te saboteren. Natuurlijk zijn er gevaren met AI maar als je kunt trainen op onpartijdigheid dan zie ik dit als een van de beste upgrades die ze ooit gedaan hebben.
Dit is een tool voor de moderators, niet een vervanging.
Nog niet een vervanging. LLM's moeten immers ergens op getraind worden.

[Reactie gewijzigd door The Zep Man op 6 augustus 2026 14:28]

Hoeveel moderatie trainingsdata heeft Reddit nu al? Ik zou daar prima een LLM op kunnen finetunen.
Ik denk dat echte onpartijdigheid een illusie is in moderatie; deel van de rol is juist om grenzen te stellen aan discussie. Dat is mensen en maatwerk.

Natuurlijk kan je als moderatoor regels opstellen wat wel en niet modereerbaar is, maar juist in de interpretatie van de intentie van een regel sluipen wel wat vooroordelen mee. Die verschuiven hiermee wel van een moderator naar een LLM. Of dat oke is vind ik maar een moeilijke vraag.
Niet alleen is dit geen tool tégen maar vóór moderatoren, destijds waren deze in protest tegen draconiaanse maatregelen van reddit. Ze probeerden de site niet te saboteren, ze probeerden reddit een bericht te sturen. Tevergeefs, want ze hebben langzaam maar zeker doorgezet met de enshittification van de site. Het zou me dan ook niets verbazen als hier wederom weerstand tegen ontstaat.
Ga voor de grap eens naar een gratis LLM - bv. google.ai - kopieer een willekeurig nieuwsartikel op tweakers.net compleet met reacties - paste dit in notepad - print het dan uit als PDF.

Maak dan de volgende prompt:

Je bent een onpartijdige moderator en je moet alle reacties individueel beoordelen in de context van het nieuwsbericht met een score per reactie : -1 bij ongewenst, 0 irrelevant, +1 relevant, +2 informatief en +3 spotlight. Negeer daarbij de huidige scores.

voeg daarna de PDF als bijlage toe en trek je conclusies: t.net zou zo'n upgrade dus ook helemaal niet misstaan.
Het zal vast beter zijn dan sommige geautomatiseerde moderaties die ik in het verleden heb gezien. Maar die lat ligt dan ook diep in de grond. Ik heb geen hoge verwachtingen.
De false positives vallen op. Alle rotzooi die geautomatiseerde moderaties doen, die je niet ziet, daar hoor je niemand over. Want die vallen niet op.

Om te kunnen reageren moet je ingelogd zijn