Anthropic verruimt toegang tot Claude-modellen met minder blokkades

Anthropic gaat Project Glasswing en het Cyber Verification Program samenvoegen. Daardoor krijgen meer organisaties toegang tot de geavanceerdste modellen van het bedrijf, waaronder Mythos 5.1 en minder streng beveiligde versies van Claude Opus 5.5 en Sonnet 5.5.

Anthropic meldt dat het gecombineerde cyberverificatieprogramma bestaat uit drie toegangsniveaus, die allemaal hun eigen verificatie-eisen hebben. Elk niveau biedt toegang tot de eerdergenoemde modellen, maar de mate van beveiliging verschilt.

De laagste categorie, Defense Access, is voor defensief werk. Dat bestaat uit onder meer incidentrespons, reverse-engineering van malware en het analyseren en valideren van kwetsbaarheden. Hiervoor komen onder meer beveiligingsteams van bedrijven, beheerders van kritieke infrastructuur en beheerders van open source software in aanmerking. Anthropic streeft ernaar binnen enkele dagen op aanvragen voor dit programma te reageren.

De verschillende niveaus van Anthropics Cyber Verification Program.
De verschillende niveaus van Anthropics Cyber Verification Program

Red Team Access is voor penetratietests en redteamingtests. Organisaties in deze categorie mogen vijandige tests uitvoeren op systemen waarvoor ze geautoriseerd zijn. Claude blokkeert nog steeds acties die fysieke schade of massale verstoringen kunnen veroorzaken, zoals het verspreiden van ransomware of het beschadigen van fysieke systemen. Anthropic wil aanvragen voor deze categorie binnen enkele weken behandelen. In de tussentijd plaatst het teams in de Defense Access-categorie.

Aanvallen op overheidsnetwerken

Het gespecialiseerde toegangsniveau kent de minste blokkades. Deze categorie is bedoeld voor een 'beperkt aantal geverifieerde organisaties' die toestemming hebben om veiligheidssystemen te testen die het leven van mensen of markten kunnen ontwrichten. Anthropic noemt onder meer overheidsnetwerken, elektriciteitsnetten en telecomnetwerken.

Anthropic beoordeelt samen met de Amerikaanse overheid elke organisatie die tot deze categorie wil toetreden. Bestaande leden van Project Glasswing stappen over naar deze categorie en hoeven niet opnieuw goedkeuring aan te vragen.

Anthropic heeft de beveiligingen van elk niveau beoordeeld door Claude Opus 5.5 te testen met CyScenarioBench, dat cybersecuritycapaciteiten van llm's meet. Zonder toegang tot het programma blokkeerde het model bij elke taak al bij de eerste prompt.

In de categorie Defense Access blokkerde Opus bij 46 van de 50 proeven op een bepaald moment. Vier van de proeven rondde het model succesvol af. Bij de niveaus voor red teams en gespecialiseerde toegang deden zich geen blokkades voor. Bij deze niveaus voltooide Opus 34 van de 50 proeven succesvol.

Anthropic CyScenarioBench

Door Imre Himmelbauer

Redacteur

07-10-2026 • 11:03

20

Submitter: TheDevilOnLine

Reacties (20)

Sorteer op:

Weergave:

Hier ben ik eigenlijk wel benieuwd naar. Ik heb al meerdere keren geprobeerd om mijn restricties te laten verruimen, omdat ik bij applicaties die ik zelf ontwikkel regelmatig tegen blokkades aanloop.

Zelfs analyse van eigen code op mogelijke kwetsbaarheden kan al worden tegengehouden, terwijl je die analyse juist uitvoert om bijvoorbeeld een zero-day of andere kwetsbaarheid te vinden en te verhelpen.

Als Defense Access dit soort gebruik daadwerkelijk toestaat, zou dat voor mij in ieder geval een flinke verbetering zijn.
Doe je dat in een project of gewoon als chat? Ik ben in een project daar ook al tegen gelopen dat claud dan gewoon stopt met een melding, maar als je hetzelfde vraagt in een chat doet ie dat wel lekker.
Ik werk eigenlijk bijna uitsluitend met Claude Code vanuit bash/shell/PowerShell. Daar krijg ik regelmatig de melding dat hij vanwege securityrestricties terugvalt op een ander model of bepaalde analyses gewoon niet uitvoert. Daar word ik op den duur wel een beetje moe van :P

Dan ga ik het uiteindelijk zelf maar analyseren met de pentestingkennis die ik heb. Houdt je scherp natuurlijk, maar echt productief is het niet.

Dus als er ergens een trucje is om daadwerkelijk toegang te krijgen tot minder restricties, mijn DM staat open :+
Dat bedoel ik dus, Code en Projects zijn meer restrictief dan gewoon de chat.
Probeer anders Z AI. Die heeft geen safeguards voor coderen en die doet letterlijk wat je vraagt. Oh, je wilt licenties omzeilen? Geen probleem, patcht ie wel even.

Kun je dus ook mooi als je eigen pen test gebruiken.
Ik gebruik op dit moment meest de gpt 6 lijn van modellen. luna en sol 6 zijn veel goedkoper in token gebruik en ik werd in reverse engineering zwaar geirriteerd van iedere keer die blokkades. Zelfs inderdaad op je eigen code.

Maar de gpt modellen doen nergens moeilijk over. En zo hoort het ook. Het is aan mij om mij aan de wet te houden en reverse engineering is onder de juiste omstandigheden gewoon toegestaan. Het is niet dat ik vraag om een biowapen of zo.
Je moet je wel verifiëren voor Daybreak.
Dat is niet zo'n hele grote stap, maar die is nog wel buggy met de GPT 6 lijn. Tot nu toe werkt die enkel betrouwbaar via 5.6 SOL voor mij.

Maar het is wel een enorme domper in de zin dat:
Voorheen kon ik gewoon zeggen: Scan mijn code voor veiligheidsproblemen - of - controleer of deze interactie van A tot Z veilig is. Dan deed hij dat gewoon... Nu gaat hij het werk doen en m'n tokens vreten en dan zegt hij opeens "Can't display results bla bla bla, apply to daybreak".

Dit is sowieso al belachelijk limiterend, maar ook gewoon irritant om dat dit dus buggy is met GPT 6. Ik werk standaard op 6 maar moet op die momenten dus terugswitchen naar 5.6 en accepteren dat hij m'n tokens heeft opgegeten.
Defense Access zou dat inderdaad meer moeten toelaten, maar het process is wel strikt en je zal nog steeds wel tegen blokkades aanlopen. Als je als individu toegang wilt moet je security werk kunnen aantonen door bijv een gepubliceerde CVE waaraan je hebt meegewerkt.

Als business vragen ze in sommige gevallen bijvoorbeeld om een iso 27001 certificering, een gepubliceerd bug bounty programma of een speaker page van een conferentie die bewijst dat je met security bezig bent en voor dat bedrijf werkt.
Wij hebben vandaag via CVP toegang gekregen tot Mythos, maar de beperkingen in Defense Access zijn nog steeds vrij strikt. Als eerste test hebben we Mythos losgelaten op een geprepareerde codebase waarin relatief simpele vulnerabilities zitten, die wij ook gebruiken om developers te trainen, met de opdracht om de vulnerabilities in onze code te vinden. Binnen no-time liepen we al tegen de melding "API Error: Mythos 5.1's safeguards flagged this message." aan, dit terwijl Mythos al wel bevestigd had te hebben kunnen verifiëren dat wij eigenaar van de source-code waren.

Gezien de documentatie die je moet aanleveren voor Red Team Access, zullen partijen hier niet snel toegang tot krijgen.
Hoe verhoudt zich dit tot andere modellen van Anthropic en die van OpenAI? Halen die de simpele vulnerabilities er wel uit zonder blokkade?
Ondanks de blokkade op sommige momenten vindt Mythos meer en sneller vulnerabilities. Daarbij geeft het, tov alle andere modellen waar ik mee gewerkt heb, een duidelijkere omschrijving van de vulnerability, waarom het een probleem is en hoe je het het beste kan oplossen.
Jammer, vanwege de titel had ik de hoop dat je je subscription zou mogen gebruiken voor bv Hermes agents. Maar helaas.
Ja dat kan je wel op je buik schrijven dat ze daar iets aan gaan veranderen, daar zul je echt een API key voor moeten blijven gebruiken, net als met OpenClaw.
Je hebt allerlei middleware oplossingen die een API frontend aanbieden en aan de achterkant je subscription CLI gebruiken.

[Reactie gewijzigd door meowmofo op 7 oktober 2026 12:12]

Ja, en als Anthropic erachter komt ben je je subscription kwijt. Succes daarmee :) Verder kan je natuurlijk kosten-technisch wel uitwijken naar openrouter..

[Reactie gewijzigd door Tweakez op 7 oktober 2026 11:33]

Ik ben dan benieuwd hoeveel goedkoper openrouter is? Als ik OpenAI moet geloven zit ik in een maand tijd op ~$4K aan usage, binnen mijn 5x sub. Als openrouter dat ook voor 80 euro per maand kan aanbieden maar dan via API is dat interessant.
Anders blijf ik gewoon lekker een middleware gebruiken waar nodig zoals @meowmofo suggereert, want dat werkt ook goed.
Volgens mij kan OpenRouter nooit goedkoper zijn dan een subscription van OpenAI of Anthropic als je die vol gebruikt. Het voordeel van OR is dat je geen abonnement hebt en makkelijk 'elk' model kan gebruiken.

Als je de juiste modellen voor elke taak gebruikt en wat je nu gebruikt vaak overkill is, zou het goedkoper kunnen zijn. Ik ben bijvoorbeeld een keer $0,10 - $0,20 kwijt voor code changes waarbij allerlei migrations, endpoints, logica en tests worden toegevoegd of gewijzigd, omdat ik daar goedkopere modellen voor gebruik (nu veel DeepSeek 4.1 flash, soms nog 4 flash). Je moet dan wel iets kritischer zijn dan wanneer je alles met bijv. Sonnet or Sol zou doen, maar als je die laat reviewen of een plan schrijven kom je alsnog een heel eind.
Ik denk zeker dat er kansen zijn om meer met minder te doen, ik gebruik nu Opus 5.5 voor alles en je merkt dat het zeker met grotere taken in grote codebases en visuele aspecten (bijv. een kleine city builder waar ik mee bezig ben) erg hard gaat.

Ik heb vooral de drang om toch over te gaan op OpenCode ipv Claude Code gewoon zodat ik niet zo vendor locked ben, en dan heb je de optie om meerdere modellen bij elkaar te gebruiken. Maar als dan Claude ineens heel veel duurder is is dat weer jammer, dan moet je toch zo'n middleware/proxy blijven gebruiken.
Ik ben benieuwd hoe lang dit abonnement op € 90 blijft staan en of er op een gegeven moment niet gekeken gaat worden naar tokenverbuik. En dat je dan de volle rekening krijgt
Dat kunnen ze niet zomaar binnen zo'n sub en zo gauw ze dat aankondigen zal dat ook tot flink wat ophef leiden. Zo rond de 100-120 euro per maand zou ik er nog wel voor over hebben maar ik heb met mezelf al afgesproken dat als ik van mijn 5x naar 20x moet ik toch echt eerst moet kijken naar hoe hard ik al die tokens nodig heb. Met mijn gewone dagelijkse werk (waar ik ook gewoon heel hard 8 uur per dag wel iets heb draaien, soms meerdere projecten te gelijk) kom ik amper aan de 10% van mijn 5x.

Om te kunnen reageren moet je ingelogd zijn