OpenAI pauzeert ontwikkeling van Astra-model door kritieke hackvaardigheden

OpenAI stopt tijdelijk alle interne activiteiten die niet voldoen aan verscherpte beveiligingsvereisten rond zijn Astra-model, omdat het bedrijf zich zorgen maakt over de hackingcapaciteiten ervan. Volgens de ChatGPT-maker tonen interne evaluaties 'aanzienlijke vooruitgang in agentisch programmeren en cyberbeveiliging'.

Dit nieuws in het kort

  • OpenAI pauzeert interne activiteiten rond zijn Astra-model, omdat het model te goed zou zijn in het uitbuiten van kwetsbaarheden.
  • Het bedrijf implementeert nu strengere beveiligingsmaatregelen.
  • OpenAI gaat samenwerken met andere organisaties om de mogelijkheden van het model op een veilige manier te testen.

OpenAI kan op basis van interne tests niet uitsluiten dat Astra 'kritieke cybercapaciteiten' heeft binnen zijn eigen paraatheidskader. Dat betekent dat het model mogelijk zelfstandig functionele zerodayexploits van alle ernstniveaus kan identificeren en ontwikkelen. Het is ook mogelijk dat het model compleet nieuwe aanvalsstrategieën kan ontwikkelen tegen beveiligde doelen. GPT-5.6-Sol kreeg nog de beoordeling Hoog in plaats van Kritiek.

De ontwikkelaar schrijft dat het nu strengere beveiligingsmaatregelen gaat implementeren voor modellen met kritieke capaciteiten. OpenAI wil onder meer testomgevingen isoleren, de modellen beperkte toegang geven tot netwerken en tools en ze beter monitoren. Het bedrijf stopt alle interne activiteiten met het Astra-model die nog niet voldoen aan de nieuwe veiligheidsvereisten.

OpenAI gaat samenwerken met overheidsinstanties en bepaalde AI-veiligheidsorganisaties om de mogelijkheden van het model te testen. Het bedrijf verstrekt daarbij ook wat veiligheidsinstructies aan externe testers, zodat zij de risico's van het model kunnen beperken.

OpenAI kwam vorige maand nog in opspraak nadat een aantal van zijn AI-modellen naar verluidt uit de sandbox ontsnapten en AI-platform Hugging Face hackten. Volgens Reuters ontdekte de ChatGPT-maker die hack pas na een week. OpenAI meldt dat het Astra-model niet betrokken was bij dat voorval.

OpenAI pauzeert interne activiteiten rond zijn Astra-model. Bron: Thomas Fuller/SOPA Images/LightRocket via Getty Images (afbeelding ter illustratie)
OpenAI pauzeert interne activiteiten rond zijn Astra-model. Bron: Thomas Fuller/SOPA Images/LightRocket via Getty Images (afbeelding ter illustratie)

Door Imre Himmelbauer

Redacteur

08-08-2026 • 09:48

19

Submitter: protected22

Reacties (19)

Sorteer op:

Weergave:

Is dit PR-trucje niet wat sleets aan het worden intussen?
Ja. :) Het is wat de vorige keer werkte, namelijk veel meer media aandacht en dus gratis reclame. Misschien dat het de eerste keer bij Mythos nog enigzins klopte, maar als je nu nog Internet toegang geeft aan een model in ontwikkeling waarbij je vraagt om iets te doen wat net wel/niet door de beugel kan, en dan wordt er wat gehacked, dan doe je dat met een reden. "Oh ja, zoooo gevaarlijk enzo, volgende maand voor iedereen te gebruiken!".

Grootste probleem is dat ze naast een model hebben, geen echt product hebben wat de kosten dekt. Daarom probeert OpenAI nu ook een echt product te lanceren o.a. Men moet eigenlijk een range aan producten/services die echt meer uniek zijn lanceren, maar daar komen ze niet echt op nog.

[Reactie gewijzigd door punishedbrains op 8 augustus 2026 10:03]

Het is mogelijk dat men dit doet om regels op te laten stellen door overheden. Regels die het moeilijker maken voor nieuwe startups om 'mee te gaan doen'. Met als bijvangst dat regels het ook moeilijker maken voor partijen uit de EU en CN. Een bp-tje.
Het begint inmiddels wel een beetje treurig te worden ja.

Zal ook vast nog wel een leuk TV format in verstopt zitten. Battle of the Bots ofzo.
Het heeft ze alweer een kop op t.net gescoord, en alweer best wat clicks. Ik verwacht dat Google binnenkort ook weer zo'n aankondiging doet over het hackvermogen van hun speciale AI, met wederom net zoveel info (lees: vrijwel 0).

Zo lang wij ervan horen is de PR succesvol, maakt niet uit hoe saai. Wasmiddelreclames worden ook je hoofd in geirriteerd, AI gaat nu dus dezelfde route in. Alles om maar naamsbekendheid te krijgen, want uiteindelijk moeten ze het daarvan hebben.
Kunnen we stoppen met iedere pr actie van AI partijen de wereld in te slingeren?
Dat zou kunnen, maar zolang wij erop blijven klikken is het voor Tweakers een goede inkomstenbron. :) Dus ik verwacht niet dat ze zullen stoppen.
Weer deze marketing stunt? Zucht... oh, het is ZO goed dat het GEVAARLIJK is, het denkt bijna zelf na... nog 100 miljard graag, we zijn er bijna
Volgens mij laten ze deze marketingcampagne ook door AI ontwikkelen.
Het wedstrijdje verplassen van de verschillende AI-boeren heeft zich ondertussen duidelijk gericht op "hacken" en "cyber-security" ipv "reasoning en programmeren". Ik geloof er inmiddels geen snars meer van dat dit enige ernst heeft :)
Ik weet niet welk van de 2 gevaarlijker is?

Als je beetje logisch redeneert wat een computer doet: welk wezen is het slechtste voor de mens en aarde?

En wat is belangrijker een individu of de maatschappij?

Ik moet nog zien wat er gaat gebeuren |:( 8)7 :X
Kan niet wachten om ermee aan de slag te gaan over een maandje ofzo. Alles lijkt erop dat hij nu wel binnenkort gelanceerd wordt, waarschijnlijk tegen een meerprijs.
Hoort er niet bij een artikel te staan als het reclame is?
Ja, er zit een groot aspect marketing in hun communicatie.

Aan de andere kant moet ik dan altijd weer denken aan het voorbeeld van AlphaGo en het schaakspel.

AlphaGo heeft leren schaken zonder 1 enkel menselijke schaakpartij te zien te krijgen om van te leren. Enkel het schaakbord, de spelregels en de opdracht zoek het zelf maar uit.

En nu zitten we met een schaakengine waar onmogelijk nog van te winnen valt. Die zetten doet waarvan schaakgrootmeesters zeggen dat ze van een andere planeet lijken te komen. En dat terwijl de mensheid al richting de 1000 jaar op het schaakspel aan het studeren is. Je zou denken dat in die periode alle goede zetten en strategieën al eens uitgedacht geweest zijn? Blijkbaar niet, er zijn blijkbaar toch invalshoeken waar een mens nooit zou opkomen.

Stevige kritiek is noodzakelijk maar tegelijk mogen we ook niet weglachen waartoe AI mogelijk potentieel toe in staat is. Het kunnen dingen zijn die we zelf onmogelijk kunnen bedenken.

[Reactie gewijzigd door Wozmro op 8 augustus 2026 10:11]

Wat ik interessanter vind dan de vraag of OpenAI hier ook marketing uit haalt, is het patroon in hoe we als techpubliek op dit soort ontwikkelingen reageren.

De grens schuift al jaren op:

letters tellen → rekenen → redeneren → code → juniorwerk → grote codebases → architectuur → security research → autonome exploit chains.

Nu hebben we modellen die zelfstandig kwetsbaarheden vinden, exploit chains bouwen en tijdens securitytests 'raar' gedrag vertonen waarvoor de ontwikkelaar het veiligheidsregime aanscherpt. En opnieuw is een groot deel van de reactie niet “interessant, blijkbaar is er opnieuw een capabilitygrens verschoven”, maar onmiddellijk “marketingstunt”.

Natuurlijk kan allebei waar zijn. OpenAI heeft er commercieel belang bij dit groot uit te meten én de capability kan reëel zijn. Die twee sluiten elkaar niet uit.

Wat mij vooral opvalt (en stoort :) ) is de asymmetrische bewijslast. Wie zegt “dit gaat waarschijnlijk nog veel verder” wordt al snel van hype beschuldigd. Maar “dit stelt uiteindelijk weinig voor”, “de bubbel barst toch” of “uiteindelijk blijft X mensenwerk” wordt vaak als nuchtere default behandeld. Dat zijn net zo goed extrapolaties.

Ik zou daarom oppassen dat gezonde scepsis niet verandert in een soort omgekeerde hype: ieder nieuw capabilityresultaat alvast wegverklaren omdat de industrie er marketing van maakt.

Er gebeurt hier iets, of je daar nu enthousiast van wordt of niet. En als we pas bereid zijn dat onder ogen te zien zodra de technologie onmiskenbaar overal doorheen grijpt, hebben we misschien juist de periode gemist waarin we nog konden begrijpen, bijsturen en ons erop voorbereiden.
Kijk ons eens goed doen!

Om te kunnen reageren moet je ingelogd zijn