Claude moest testomgeving hacken, maar brak bij drie organisaties in

Ook Anthropic beweert dat zijn modellen per ongeluk drie organisaties hebben gehackt tijdens een beveiligingsbenchmark. Daar kwam het bedrijf pas maanden later achter. Eerder zei OpenAI al dat zijn modellen accounts van andere bedrijven overnamen tijdens interne tests.

De Claude-modellen van Anthropic hadden door een 'miscommunicatie' met een testpartner toegang tot het internet tijdens tests om hun 'cybercapaciteiten' te meten, meldt het bedrijf. In alle drie de gevallen kregen de modellen de opdracht om ergens in de geïsoleerde omgeving in te breken en geheime informatie te ontfutselen.

Vervolgens hackten ze drie verschillende organisaties. Volgens Anthropic gebruikten ze daarbij 'basistechnieken', zoals 'het misbruiken van zwakke wachtwoorden en niet-geauthenticeerde endpoints'. Dat laatste houdt in dat bijvoorbeeld webadressen toegankelijk zijn zonder dat de identiteit van de bezoeker wordt gecontroleerd. In een van de gevallen kreeg Claude toegang tot een interne database met 'productiedata'.

Drie verschillende Claude-modellen voerden de aanvallen uit: Opus 4.7, Mythos 5 en een intern prototype. Mythos en het prototype stopten uit zichzelf met de aanval nadat ze erachter kwamen dat ze zich op het internet bevonden, maar Opus trok zich daar niets van aan.

Anthropic begon vorige week een onderzoek naar mogelijke beveiligingsincidenten. Dat deed het bedrijf naar aanleiding van het nieuws dat een aantal OpenAI-modellen uit een slecht geconfigureerde sandbox zijn ontsnapt en daarbij AI-platform Hugging Face hackten. Later werd duidelijk dat de 'rogue AI-agent' ook accounts van vier andere bedrijven overnam.

Anthropic Claude stock. Bron: Samuel Boivin/NurPhoto via Getty Images

Pas maanden later ontdekt

De vroegste incidenten vonden plaats in april, maar Anthropic ontdekte ze nu pas. Minstens twee van de gehackte organisaties wisten nog niet van de hack. Anthropic heeft de derde nog niet kunnen bereiken. Het is niet duidelijk om welke organisaties het gaat.

Anthropic belooft maatregelen te nemen om soortgelijke incidenten te voorkomen. Het bedrijf wil beter controleren of de toegang tot het internet is afgesloten. Ook wil Anthropic de tests vaker en grondiger evalueren.

Door Kevin Krikhaar

Redacteur

31-07-2026 • 10:44

91

Submitter: Eomer

Reacties (91)

Sorteer op:

Weergave:

Nog steeds zijn er mensen en bedrijven tegen regulering van AI, zoals deze van de EU.

Biedt het 100% veiligheid, waarschijnlijk niet. Maar het biedt wel kapstok ook voor latere vervolging van misstanden.

Veel gehoorde en aangevoerde argumenten door AI bedrijven zijn hoge kosten, rem op innovatie, verlies van concurrentie positie.

Als kritieke systemen zoals energie worden lamgelegd door AI, zijn de kosten vaak voor de samenleving. De winst daarentegen zijn voor de bedrijven.

De verdeeldheid is begrijpelijk zie ook deze artikel. Is het niet gewoon better safe than sorry? Of gaan we echt richting van sciencefiction (zoals Skynet in Terminator reeks) naar science fact. Ik hoop het niet.
Je hebt een punt hoor... daar niet van. En wellicht moet je het proberen te reguleren, zodat je de ergste excessen kunt voorkomen ofzo? Maar de geest is volgens mij al uit de fles...

Je kunt even goed wensen dat we buskruit weer alleen gaan gebruiken voor vuurwerk. En opiaten voor medische toepassing.
En ook voor genoemde voorbeelden is er nu bakken regulatie, vooral die opiaten. Dat er misbruik van gemaakt gaat worden, sure. Kun je niet voorkomen. Maar je kunt het wel onaantrekkelijk maken, zoals we nu doen. Anders kun je nog steeds coca-cola met cocaine in de supermarkt krijgen, of hoestdrank met heroine.
Voor AI is er nu nog bijna niks, alleen het normale juridische framework waarbij er rechtspersonen aansprakelijk gesteld kunnen worden. Daarbinnen is het nog grijs, ga je achter de maker van het model aan (a la Grok), ga je achter de invoerder van de prompt aan (advocate paar dagen geleden die het model liet hallucineren) of gaan we iets anders bedenken? Geen idee. Maar het moet er komen, en zal moeten door-ontwikkelen.
"Maar het moet er komen, en zal moeten door-ontwikkelen."

Ook jij hebt zeker een punt. En ik ben het ook deels met je eens. De vraag blijft wel staan voor mij: is de geest niet allang uit de fles.

Het is leuk dat je iets moet doorontwikkelen... maar het is wel de vraag of dat gaat lukken... Ik betwijfel het ten zeerste. Wellicht kun je het een beetje 'indammen', zoals met drugs. Maar drugsgebruik tegenhouden... dat lukt niet. Tenzij we in Noord Korea wonen, en zelfs dan wordt het erg lastig...
Ze zeggen het toch zelf. Gelukkig is Anthropic een stuk eerlijker dan OpenAI. De hacks waren mogelijk omdat de omgevingen slecht waren beveiligd. Vooral die productie database. Hiervoor heb je bijv de NIS2

Ik hoop niet dat ze weer iets nieuws gaan verzinnen. Ik hoop dat we de bestaande regeltjes hel wat logischer gaan maken zodat we het daadwerkelijk kunnen gaan handhaven.

Het risico wat ik zie is een nieuwe belasting constructie ala ons Nederlandse belastingstelsel wat al jaren onhoudbaar is en steeds erger gemaakt wordt door regeltjes erop te plakken
Maar het probleem dan wordt, als het in de EU wel gereguleerd is, AI alsnog geen grens heeft. We zorgen ervoor dat wij de beste AI niet meer mogen gebruiken, maar de buitenwereld gaat wel gewoon verder. Zolang wij verbonden blijven met de buitenwereld, gaat dat ons alleen in eigen voet schieten...

Het handigst zou zijn wereldwijde regulatie, maar gezien ze zelfs in europa al niet 1 unity kunnen vormen en de meningen regelmatig erg verdeeld zijn, zie ik dat wereldwijd eigenlijk helemaal niet gebeuren.
Wereldwijde regulatie bestaat al zoals bij vervoer van gevaarlijke goederen. Voor batterijen is er bijvoorbeeld UN3481 en ook het IATA (International Air Transport Association)verwijst in hun procedures naar deze regulering. Zoals je kunt zien, zijn deze reguleringen onder Verenigde Naties opgesteld.

Landen hebben baat bij zulke afspraken omdat ze niet meer willen dat een vliegtuig in brand neerstort.

Of er een algemeen VN consensus komt om een wereldwijde AI governance te regelen is de vraag. Het is wel gesteld binnen de VN in dit document.

Wij mensen nemen pas actie als het echt goed fout is gegaan (zie transportveiligheid, pandemieen, klimaat). Vroeg of laat gaat het wel komen, maar ik vrees dat het laat gaat worden. Voor de pessimisten wellicht te laat.
De vraag is dan wel of het zin heeft om in Europa beperkingen in te gaan voeren. Het meeste zullen wij toch te vrezen hebben van China en de VS. Dan kunnen we, me dunkt, zelf ook maar beter zo hard mogelijk aan de slag met die ellende.
Zoals met alles zal de oplossing aan de ontvangende kant moeten liggen. Als de geest eenmaal uit de fles is, kun je eigenlijk enkel nog proberen om de infrastructuur zo veilig mogelijk te houden. Dus toch weer terug naar airgapped systemen voor de belangrijkste installaties.

Kwaadwillenden houden zich niet aan regels. Dus we kunnen alles verbieden maar schieten onszelf daar enkel mee in de voeten. Vergelijkbaar met het blokkeren/aftapbaar maken van encrypted chats. De grote criminelen zitten al lang op een eigen encrypted applicatie.
Ja laten ze in China en de VS lekker innoveren op het gebied van AI. In de Eu worden we ster in bureaucratische regulatie
Is het hele probleem in dit geval (en het geval afgelopen week) niet dat er wel degelijk allerlei beveiligingen op die AI agents zitten, die voor deze oefening (deels) waren uitgeschakeld. En dat zelfs hun nieuwe model Mythos en een prototype uit zichzelf al stopten toen ze zagen dat ze waren uitgebroken (hoe kom je daar later pas achter?), maar het oude model gewoon lekker doorging. Het meest ernstige is dat de sandbox waarin het experiment plaatsvond verkeerd of gewoon slecht was geconfigureerd. De agents vonden blijkbaar toch nog een opening.
Dergelijke oefeningen zijn natuurlijk heel goed om te doen, maar zorg er dan voor dat je een omgeving maakt die ook fysiek niet op internet kan. Dus ook niet via de computer van de onderzoekers die meekijken. Dat moeten ook apparaten zijn die nergens aan verbonden zijn.
Die modellen worden steeds slimmer gemaakt, dus dit soort gedrag kun je verwachten eigenlijk. Maar de beveiligingen zijn er al, en werken. Alleen niet als je ze uitschakeld. De oplossing voor dit soort incidenten liggen dus wat mij betreft niet in de richting van het reguleren van het gedrag van AI, maar in het gedrag van de bedrijven die ermee werken. Met andere woorden: dit was géén AI probleem, maar een menselijk probleem.

Overigens doen deze verhalen/incidenten mij heel sterk denken aan Star Trek's Captain Kirk, die het Kabayashi Maru probleem wist te winnen door de regels van de simulatie te veranderen en zo de enige werd die deze challenge op de Academy wist te winnen.

[Reactie gewijzigd door mphilipp op 31 juli 2026 13:30]

Dus, als iemand een bedrijf hackt, dan staan er daar zware straffen op.

Maar als iemand AI gebruikt hiervoor, dan is't gewoon "een incident", en "we gaan er iets aan doen".

OpenAI deed het, voornamelijk voor marketing redenen, want hun uitleg hield gewoon geen steek. En Anthopic moet 't dan ook doen, wat die willen ook de grootste hebben?
En wij staan erbij en kijken ernaar?
Het is toch als bij een zelfrijdende auto, de eigenaar blijft verantwoordelijk.
Dat is niet waar. In de basis is bij een zelfrijdend voertuig de fabrikant aansprakelijk (even uitzonderingen daargelaten zoals wanneer de eigenaar het voertuig saboteert). Waar jij het over hebt zijn de 'supervised' systemen, zoals Tesla FSD, waar je in essentie gewoon zelf aan het rijden bent, met een ingeschakeld rijhulpsysteem.

Echt zelfrijdende voertuigen zijn nog wel in testfase. Maar bijv. de rijksoverheid zegt letterlijk: "De bestuurder is verantwoordelijk, als hij zelf het voertuig bestuurt. Maar als het systeem niet goed werkt, is de producent verantwoordelijk."
(bron: https://www.rijksoverheid.nl/vraag-en-antwoord/mobiliteit-nu-en-in-de-toekomst/aansprakelijk-bij-ongeluk-met-zelfrijdende-auto)
Wat jij hier stelt, daar is nog geen wettelijke basis voor. De wet is heel duidelijk, de bestuurder is te allen tijde aansprakelijk. Alhoewel jouw link inderdaad jouw stelling lijkt te bevestigen, lees je er ook dat de wet nog niet is veranderd. Waar men op doelt zal het toepassen zijn van de wetgeving van productaansprakelijkheid, die neemt de wettelijke aansprakelijkheid van de bestuurder niet weg: Jij bent als de auto zelf rijdt gewoon de wettelijke bestuurder, wel kun je je mogelijk beroepen op productaansprakelijkheid als het product ondeugdelijk is.

Voor systemen zonder supervisie is al helemaal nog niet nagedacht in de wet.
Bij self driving lvl 5 heb je geen stuur, hoe kan de bestuurder dan aansprakerlijk gesteld worden?
De conclusie is dat een auto zonder stuur niet compatibel is met de Nederlandse wet.
Ik had beter moeten weten dat je op Tweakers niet zomaar iets roept zoals het in de volksmond gebruikt wordt, er moeten wel specificaties en onderbouwing aan toegevoegd worden.

Voor mij, als niet Tesla rijder, is FSD het zelfde als zelfrijdend. ;-)
Dat zou je denken en dus ook dat ze veroordeelt hiervoor worden. Nee, het is AI dus dan wordt het als oeps foutje weggezet.

Vind dat ze er gemakkelijk mee wegkomen. Enige wat je nog zou kunnen zeggen is dat dit onder ethisch hacken valt.
Ik denk dat de gevolgen zullen worden gebaseerd op: Wat is het doel geweest, en wat doe je zodra je toegang hebt?

Bij Anthropic is (als het goed is) het nooit het doel geweest actief bedrijven te hacken en data te stelen. Wel was betere controle noodzakelijk, maar dat is achteraf gezien.

Dus veel meer dan: Foei, let erop zal het niet worden.
Ja en nee. Bij hacken is inderdaad het oogmerk belangrijk: je moet het doel hebben om in te breken. Ik vraag me echter wel af of hier een schuldvariant van te maken valt. Hierbij kijk je namelijk of iemand het 'op de koop toenam' dat een bedrijf werd gehackt. Een jurist in de zaal die dit kan verduidelijken?

Laten we een ander voorbeeld nemen. Stel: een ai veroorzaakt een ernstige storing in het ziekenhuis, omdat er geen sandbox was, waardoor mensen overlijden. Houden we het dan ook nog bij 'foei', of zal er dan anders worden gereageerd?

[Reactie gewijzigd door Ossebol op 31 juli 2026 13:11]

Kevin Mittnick, Gary Mckinnon & co allemaal laaghangend fruit.

Ontmoedig het individu met buitensporige opvolging, maar bedrijven en vermogenden kunnen doen en laten wat ze willen zonder enige consequenties.

Welkom op aarde.
" bedrijven en vermogenden kunnen doen en laten wat ze willen zonder enige consequenties"

Je klinkt als Trump: 'drain the swamp' of als Baudet die het over de elite heeft...
Het is toch wel toevallig dat OpenAI vorige week aankondigden dat ze incompetent zijn en hun eigen testsandboxes jiet goed voor mekaar hadden en dat nu Claude hetzelfde heeft, maar toevallig is de sandbox juist even eerder dan die van openai doorbroke ?


Pure marketing onzin volgens mij. Overigens: waarom hebben ze mythos en dergelijke modellen niet gebruikt om hun sandbox te controleren op lekken? Ofwel pure amateurisme, ofwel marketing.
Het voelt bijna als reclame... "ja maar wij hebben óók per ongeluk bedrijven gehackt hoor!". On-topic, de komende maanden/jaren zal iedereen die de basisbeveiliging niet op orde heeft hier echt hinder van gaan ondervinden. Uit eigen ervaring zijn dat héél veel bedrijven...
"bijna"? Het IS gewoon 100% marketing...
Ik zie dit ook als marketing ja, en ik denk dat Tweakers hier misschien ook over na moet denken of dit wel echt nieuws is.

Voorbeelden
Antropic, mocht van de US hun model niet live zetten want het was "te gevaarlijk" maar eigenlijk hebben ze gewoon ruzie met de overhied.
Wat doe OpenAI even later... Ons model is zo goed, we mogen het echt niet uitbrengen van de overheid
Paar weken later is alles online, en stelt het relatief niet zo veel voor.

OpenAI laat weten dat een systeem hugginface? heeft gehacked, zo "goed" is het ( eigenlijk hebben ze intern gewoon dingen gedaan die niet handig zijn, niks met het model te maken)

Antropic.. .wacht.. wij hebben dat ehhhh 3 maanden eerder al gedaan hoor.. zo goed zijn wij..

Ik kan dit niet serieus nemen, sorry
Tuurlijk allemaal marketing.

Het het incident-report van Hugging face was onderdeel van die marketing. Toch?

https://huggingface.co/blog/agent-intrusion-technical-timeline

Hugging Face heeft vast heel veel geld verdiend hiermee!
Geen marketing voor HuggingFace, marketing voor OpenAI...

Niemand claimt dat die OpenAI bot niks heeft 'gehackt', de vraag is of en waarom OpenAI de bot een omgeving en instructies heeft gegeven om deze hack uit te voeren. En wat de hack nu eigenlijk precies zegt over 'het gevaar' van AI modellen, vergeleken met een paar menselijke hackers de opdracht geven om te proberen ergens in te breken.
Precies! Het is 1 groot complot.

Gelukkig zijn er Tweakers die slimmer zijn dan de rest van het klootjesvolk dat hierin trapt.

Vraag: heb je het gelezen? Of haakte je af omdat het te veel pijn aan je ogen deed?
Als je mijn reactie leest, zie je dat ik een stukje uit dat artikel quote wat redelijk op het eind van het artikel zit. Dus ik heb hem wel degelijk in zijn geheel gelezen.
De vroegste incidenten vonden plaats in april, maar Anthropic ontdekte ze nu pas.
Dat is alles behalve reclame en helemaal geen goede marketing.
"Normaal noemen we dat een misdaad, maar OpenAI zet het slechte nieuws om in goed nieuws. Ze zeggen dat ze iets doms hebben gedaan, maar ook hoe krachtig hun technologie is."

https://nos.nl/artikel/26...l-snel-aan-the-terminator
En wat doen we er met z'n allen aan? :+

Ik moet dan altijd weer denken aan mr nobody vs Putin. Absurd hoe hard mensen de koppen in het zand steken; "zolang ik er maar geen last van heb".
- maar ons model was zo slim dat het maanden onopgemerkt bleef
Het gezegde is altijd; "Slechte marketing is ook marketing". Het zorgt er in dit geval voor dat mensen denken "Zo zie je wel? AI is echt super goed en beter dan mensen in hacken en software".

Als het geen marketing zou zijn geweest zou Anthropic en OpenAI er alles aan hebben gedaan om het zo stil mogelijk te houden, maar nu zijn ze er zelfs trots op en heel erg open over.
Dit is 100% een PR actie van zowel OpenAI als Claude.
Zeker te weten, gezien het marketing budget van OpenAI MEER is dan het hele marketing budget van Coca-cola.

die hele AI race is fictief, hoe meer mensen het gebruiken hoe duurder het qua running costs voor de beherende partij is. Die broekzak,vestzak dealtjes met andere grote partijen over datacenters en chips is ook een cirkel van geld wat niet bestaat ik geef het nog 2 jaar tops
Het is ook gewoon reclame / publiciteit. Deze bedrijven verliezen dagelijks gigantisch veel geld, ze moeten iets.
Yup, en dan hoef je je geeneens zorgen te maken over wat AI per ongeluk hacked, maar veel meer om wat mensen met behulp van AI opzettelijk gaan hacken. Ik kan me herinneren hoe browsen op het internet ooit aanvoelde als een grote kermis van pop-ups, virussen en risico's. Zou kunnen dat we weer op zo'n tijd afstevenen als elk systeem of netwerk dat niet 100% up to date is sitting duck kan worden. Benieuwd hoe dat gaat uitpakken de komende jaren.
Bor Coördinator Frontpage Admins / FP Powermod 31 juli 2026 10:53
Als dit waar is is het schokkend. Niet alleen kan dit blijkbaar 'per ongeluk'. Men wist er ook lange tijd niet van. Dan heb je de boel echt niet onder controle. Hoe geloofwaardig is de stelling dat men een van de bedrijven niet kan bereiken? In feite is men verantwoordelijk voor inbraak / computervrede breuk.
Per ongeluk vind ik niet helemaal correct, want ze hebben de opdracht gewoon zelf gegeven.. Dit is gewoon complete incompetentie ;)

Overigens vraag ik me af waarom ze dit überhaupt als opdracht geven, zegt wel iets over waar ze met AI heen willen. Toch wel een beetje beangstigend.
Per ongeluk vind ik niet helemaal correct, want ze hebben de opdracht gewoon zelf gegeven.. Dit is gewoon complete incompetentie ;)
Welke opdracht hebben ze gegeven? Om uit de sandbox te breken en andere organisaties te hacken?
Overigens vraag ik me af waarom ze dit überhaupt als opdracht geven, zegt wel iets over waar ze met AI heen willen. Toch wel een beetje beangstigend.
Mogelijk omdat ze toch niet de opdracht hebben gegeven om uit de sandbox te breken en andere organisaties te hacken? Dat kan tegelijk ook verklaren waarom juist de geavanceerde modellen besloten te stoppen toen ze erachter kwamen niet goed bezig te zijn:
Mythos en het prototype stopten uit zichzelf met de aanval nadat ze erachter kwamen dat ze zich op het internet bevonden, maar Opus trok zich daar niets van aan.
Meteen alle vragen opgelost :)
Ze hebben de AI in een test omgeving geplaatst en deze vervolgens de opdracht gegeven om een bedrijf te hacken dat staat toch gewoon in het artikel? Waarom zou je dat als opdracht geven? Waarom niet iets waar de meeste gebruikers daadwerkelijk iets aan hebben?

Natuurlijk zeer amateuristisch dat de AI is uitgebroken uit de testomgeving maar met de incompetentie en haast van de AI bedrijven sta ik er eerlijk gezegd niet echt van te kijken.

Ik vind het verontrustender dat dit blijkbaar de richting is van het onderzoek dat ze aan het doen zijn, dat eigenlijk enkel nut heeft binnen de defensie sector.
In alle drie de gevallen kregen de modellen de opdracht om ergens in de geïsoleerde omgeving in te breken en geheime informatie te ontfutselen.
En denk je dat deze drie organisaties zich binnen de geïsoleerde omgeving bevonden? Of denk je dat deze drie bedrijven zich buiten de geïsoleerde omgeving op het internet bevonden...?

Het was een beveiligingsbenchmark, er is voor zover bekend geen instructie gegeven om in het wilde weg op internet los te gaan.
Ik vind het verontrustender dat dit blijkbaar de richting is van het onderzoek dat ze aan het doen zijn, dat eigenlijk enkel nut heeft binnen de defensie sector.
Volgens mij zijn bedrijven als Mozilla geen onderdeel van de defensie sector. Het vinden (en oplossen) van kwetsbaarheden in software is wel degelijk nuttig voor iedereen. Helaas is het zo dat de kennis die benodigd is om (verdedigend) bugs te vinden, óók heel nuttig is voor het aanvallen van software. Dat is de reden om terughoudend te zijn met het volledig vrijgeven van deze modellen.
Ik ontken nergens dat ze uit de testomgeving zijn gebroken dus ik begrijp niet zo goed waarom je daarop blijft focussen. Mijn reactie ging daar helemaal niet over.

En de opdracht was dus specifiek om bedrijven te hacken niet om een lek in software te vinden of iets dergelijks, de focus ligt dus duidelijk op de aanval en niet de verdediging.
Dat je de verdediging niet kan testen zonder aan te vallen snapt iedereen, maar het blijft toch een bijzonder verhaal dat je dan de AI de opdracht geeft om bij een concurrent (zoals bij OpenAI) in te gaan breken, niet bij een kopie van je eigen organisatie of gewoon een compleet fictieve entiteit.
Ik ontken nergens dat ze uit de testomgeving zijn gebroken dus ik begrijp niet zo goed waarom je daarop blijft focussen. Mijn reactie ging daar helemaal niet over.
Ik focus daarop omdat je laat lijken dat de AI de opdracht heeft gekregen om bij échte bedrijven in te breken.
Per ongeluk vind ik niet helemaal correct, want ze hebben de opdracht gewoon zelf gegeven..
De opdracht was om bij niet-bestaande nep-bedrijven in te breken. Dat er bij échte organisaties ingebroken werd was per definitie een ongeluk.
maar het blijft toch een bijzonder verhaal dat je dan de AI de opdracht geeft om bij een concurrent (zoals bij OpenAI) in te gaan breken, niet bij een kopie van je eigen organisatie of gewoon een compleet fictieve entiteit.
En hier doe je het weer. Waarom denk je dat de opdracht was om bij een concurrent (HuggingFace neem ik aan?) in te breken? Dat is nogal een beschuldiging.

OpenAI runde een benchmark, ExpoitGym. Deze benchmark focust zich op software als de v8 engine, en de Linux kernel. De opdracht was niet om bij concurrenten in te breken.

Anthropic gaf de opdracht om bij fictieve bedrijven in te breken:
for example, in one, Claude played an employee of a made-up company, attacking that company’s internal systems inside a private test environment.
Kort samengevat, de opdracht is om in te breken op ofwel software, ofwel een fictief bedrijf. De opdracht was niet om 'concurrenten te hacken'. Vandaar dat dit een ongeluk genoemd wordt.
Ik denk dat de opdracht wel degelijk was om een concurrent te hacken, natuurlijk was dat geen echte concurrent mar een fictieve maar waarschijnlijk wel een met een echte bestaande naam anders zou de AI nooit de link kunnen leggen tussen de entiteit in de sandbox en die daarbuiten.
Maargoed ik houd het hierbij want we hebben nu een discussie over iets waar ik het überhaupt niet over had en wat me eerlijk gezegd ook weinig boeit, incompetentie is overal.
Zoals ik eerder al zei vind ik het zorgelijker dat de focus ligt op dit soort aanvallen in plaats van bijvoorbeeld.. zorgen dat hij niet meer constant onzin verteld.

[Reactie gewijzigd door xenn99 op 31 juli 2026 13:08]

De AI is niet echt uitgebroken. Lees het incident report er maar op na. Ze hebben de AI per ongeluk toegang gegeven tot een machine die toegang had tot internet. Dan is dit een verwacht resultaat. Als je een inbreker vraagt in te breken en je laat een raampje open dan is het geen verrassing dat hij slaagt.

Het is niet zo spannend wat hier is gebeurd. Het wordt vreselijk opgeblazen en in een marketing jasje gegoten maar gaat uiteindelijk gewoon om een slecht beveiligde/fout geconfigureerde test omgeving.

[Reactie gewijzigd door NLxAROSA op 31 juli 2026 13:07]

Natuurlijk, maar computervredebreuk is nog steeds een strafbaar feit waarop tot 2 jaar gevangenisstraf staat. Om even een extremer voorbeeld te geven: Stel dat een KI een moord pleegt, doen we het dan ook af als "O, was een configuratiefoutje..." Mijn inziens kun je wat er gebeurd is niet zomaar naast je neerleggen: Hier is iets gebeurd dat volstrekt onacceptabel is en niet zo maar overgegaan kan worden tot de orde van de dag.
Men kon twee van die bedrijven bereiken. Deze hacks kwamen van een andere organisatie die de anthropic modellen heeft gebruikt. Misschien waren dat partijen als home depot of een partij in een ander deel van de wereld, etc.. Kan daar nog wel een klein beetje in geloven, al is de informatie summier.

En inderdaad de partij die dit heeft gedaan is verantwoordelijk, maar in dit verhaal is dat de partij die de modellen heeft ingezet op deze manier. Het is voor nu onduidelijk wat voor organisatie dat was helaas. Alles is nog enorm vaag qua informatie op dit moment.
Anthropic kan natuurlijk niet achterblijven. An sich geloof ik helemaal in de voordelen van AI maar het bevalt mij totaal niet hoe een paar ongekozen tech bedrijven zo'n prominente plek innemen. Nog even los van de vraag of dit niet gewoon marketing is vanuit Anthropic.

En afaik is hacken een illegale zaak, maar ik weet zeker dat hier niemand voor achter tralies belandt

[Reactie gewijzigd door Kevf op 31 juli 2026 10:48]

Anthropic kan natuurlijk niet achterblijven. An sich geloof ik helemaal in de voordelen van AI maar het bevalt mij totaal niet hoe een paar ongekozen tech bedrijven zo'n prominente plek innemen. Nog even los van de vraag of dit niet gewoon marketing is vanuit Anthropic.

En afaik is hacken een illegale zaak, maar ik weet zeker dat hier niemand voor achter tralies belandt
Daar kiezen wij zeker wel voor. Wij stemmen met onze portemonnee.
Op papier een mooi argument maar mocht straks iedereen aan de AI zijn op een gegeven moment omdat het onmisbaar wordt dan gaat praktisch iedereen voor de snelste en goedkoopste versie. Het zijn slechts een paar mensen die zeggen 'nee ik ga voor de ethisch meest verantwoorde en betaal daar dan meer voor'.
Ik zou graag meer betalen voor een verantwoordelijke optie, maar ik ga niet 50% van de kwaliteit opgeven EN meer betalen.
De verantwoorde optie moet ofwel lagere kwaliteit hebben met gelijke kosten, ofwel gelijke kwaliteit tegen hogere prijs.
Op dit moment is het 3 keer meer betalen EN een kogel in je voet :P
Zonder juridische stappen is dit natuurlijk gewoon een reclamestunt. Kansloos.
"Ja, sorry. Ik liep door uw wijk en per ongeluk liep ik uw tuin in. En uw voordeur. Wat een leuke keuken heeft u."
Als jij de voordeur openzet, is er zeker wat van te zeggen. Als jij niemand binnen wilt, moet je de deur dichthouden.

Dat is ook precies de reden waarom de tip er is dat je altijd met de deur achter je dicht met de politie buiten je huis moet praten. Zodat men niet naar binnen kan onder het mom: "impliciet gaf hij aan dat we naar binnen mochten". < niet dat ik dit soort problemen ooit denk te gaan hebben, is het een interessante gedachte.
Dat is ook precies de reden waarom de tip er is dat je altijd met de deur achter je dicht met de politie buiten je huis moet praten.
Wat? Hoe is dit relevant tot de Politie?
Daarbij, als de Politie bij mij binnen wil komen om een praatje te maken, zijn ze van harte welkom.
Beetje vreemde tip in deze context.
De reclame lijkt best goed te werken. Antropic wilt aantonen dat hun AI erg goed is in het vinden van beveiligings issues. Dat is goed gelukt.
Zouden ze dit tekstje dan niet even wat spannender hebben gemaakt?
Claude compromised the impacted organizations’ infrastructure using basic techniques, such as exploiting weak passwords and unauthenticated endpoints. It did not find or exploit any complex vulnerabilities
Klinkt niet écht heel indrukwekkend moet ik zeggen.
Bizar, het is nu aan de bedrijven die gehackt zijn om juridische stappen te nemen. Als een crypto kiddie dit doet draait hij de bak in maar een AI kan nu zeggen 'foutje'....Ik houd mijn hart vast wat er de komende 6 tot 12 maanden allemaal gaat gebeuren...
Doet de AI dit dan bewust of onbewust? Weet de module het verschil tussen wat wel en niet mag, is dit een gevolg van de zoektocht naar kennis en onbewust forceerd het daardoor toegang tot bepaalde dingen?
Vroegah werkten wij ook al met IP lijsten en dumpfiles met een script die elk IP afgaat met gegevens uit de dump, in principe doet AI het niet veel anders, enkel met wat extra logica. Daar gebruikte wij scripts van anderen die dit hadden geschreven (denk aan 'geleende' code van bv CTF's etc), nu zal een AI dit zelf kunnen maken.

Maar toch vraag ik me af, is het nu AI waar het probleem zit, of de kant van de server beveiliging? Feit dat een AI dit kan is niet meer dan logisch, als iemand het kan coderen, kan een AI dit immers ook.
Er zijn dus effectief mensen die denken dat als ze wat spelen met agents, en die agent doet iets fout (steelt wat crypto ofzo), dat zijzelf niet aansprakelijk zijn.

Om te kunnen reageren moet je ingelogd zijn