OpenAI pauzeert ontwikkeling van Astra-model door kritieke hackvaardigheden

OpenAI stopt tijdelijk alle interne activiteiten die niet voldoen aan verscherpte beveiligingsvereisten rond zijn Astra-model, omdat het bedrijf zich zorgen maakt over de hackingcapaciteiten ervan. Volgens de ChatGPT-maker tonen interne evaluaties 'aanzienlijke vooruitgang in agentisch programmeren en cyberbeveiliging'.

Dit nieuws in het kort

  • OpenAI pauzeert interne activiteiten rond zijn Astra-model, omdat het model te goed zou zijn in het uitbuiten van kwetsbaarheden.
  • Het bedrijf implementeert nu strengere beveiligingsmaatregelen.
  • OpenAI gaat samenwerken met andere organisaties om de mogelijkheden van het model op een veilige manier te testen.

OpenAI kan op basis van interne tests niet uitsluiten dat Astra 'kritieke cybercapaciteiten' heeft binnen zijn eigen paraatheidskader. Dat betekent dat het model mogelijk zelfstandig functionele zerodayexploits van alle ernstniveaus kan identificeren en ontwikkelen. Het is ook mogelijk dat het model compleet nieuwe aanvalsstrategieën kan ontwikkelen tegen beveiligde doelen. GPT-5.6-Sol kreeg nog de beoordeling Hoog in plaats van Kritiek.

De ontwikkelaar schrijft dat het nu strengere beveiligingsmaatregelen gaat implementeren voor modellen met kritieke capaciteiten. OpenAI wil onder meer testomgevingen isoleren, de modellen beperkte toegang geven tot netwerken en tools en ze beter monitoren. Het bedrijf stopt alle interne activiteiten met het Astra-model die nog niet voldoen aan de nieuwe veiligheidsvereisten.

OpenAI gaat samenwerken met overheidsinstanties en bepaalde AI-veiligheidsorganisaties om de mogelijkheden van het model te testen. Het bedrijf verstrekt daarbij ook wat veiligheidsinstructies aan externe testers, zodat zij de risico's van het model kunnen beperken.

OpenAI kwam vorige maand nog in opspraak nadat een aantal van zijn AI-modellen naar verluidt uit de sandbox ontsnapten en AI-platform Hugging Face hackten. Volgens Reuters ontdekte de ChatGPT-maker die hack pas na een week. OpenAI meldt dat het Astra-model niet betrokken was bij dat voorval.

OpenAI pauzeert interne activiteiten rond zijn Astra-model. Bron: Thomas Fuller/SOPA Images/LightRocket via Getty Images (afbeelding ter illustratie)
OpenAI pauzeert interne activiteiten rond zijn Astra-model. Bron: Thomas Fuller/SOPA Images/LightRocket via Getty Images (afbeelding ter illustratie)

Door Imre Himmelbauer

Redacteur

08-08-2026 • 09:48

97

Submitter: protected22

Reacties (97)

Sorteer op:

Weergave:

Wat een hoop reacties dat dit slechts marketing is. Uiteraard gebruiken ze deze situatie om in het nieuws te komen, maar ik denk dat we de ernst van deze ontwikkeling niet moeten onderschatten.

In deze talk op Black Hat 2026 legt OpenAI uit wat er gebeurt is. De hugging-face hack is maar een deel van het verhaal (en niet eens het meest interessante deel imo).

De agents hebben zelf een manier gevonden om met elkaar te communiceren door een Artifactory server in het netwerk van OpenAI te misbruiken. Ze hebben hierbij een zero-day gevonden en misbruikt. Daarna hebben ze een soort 'message board' opgezet die ze gebruikten om met andere agents te communiceren.

Zelfs nadat de server gepatched was, de tokens gerotate enz. Hebben nieuwere generaties modellen een nieuwe zero day gevonden en een vergelijkbaar systeem opgezet.

Ik raad sceptici aan om bovenstaande talk te kijken. Dit gaat echt wel veel verder dan een PR stunt en laat zien dat AI safety een serieus onderwerp is. Daarnaast worden AI-assisted aanvallen nu echt een groot risico waar blue teams wel echt iets mee moeten.
Het is wel degelijk vooral marketing. Maar even inhoudelijk, wat hadden ze dan eigenlijk verwacht!? Je laadt een AI-model vol met kennis en kunde over hoe software in elkaar zit en geeft er opdrachten aan mee. Het gaat die opdrachten vervolgens zonder enig ethisch normbesef uitvoeren. Je zou dan JUIST moeten verwachten dat dit soort dingen gebeuren en daar niet verrast door mogen zijn. Dit gedrag is totaal "by design". Als OpenAI hier echt door verrast is, verdienen ze hun 'license to operate' absoluut niet.

Voor de blue teams van deze wereld: die gaan een golf van gedoe zien de komende tijd. Software gaat er hopelijk ook beter van worden omdat deze bugs gevonden en opgelost gaan worden. Daarna gaat deze golf gewoon weer liggen omdat het speelveld vanzelf gelijk trekt.
OpenAI heeft de race al verloren, de chinese modellen krijgen aanzienlijk meer aanwas omdat het simpelweg goedkoper is. Er is een enorme zwarte handel in ‘tokenbundels’ voor openai dmv gestolen creditcards. Prijs is de driver.
Krijgen de Chinese modellen ook in de bedrijfswereld een duidelijke aangroei? Ik heb het idee dat modellen zoals Deepseek daar nog steeds verboden zijn.

Ik vind het zelf moeilijk om hier een oordeel over te vormen omdat mijn ervaring ook vooral is wat ik zie rondgaan op Youtube en Twitch. Dat zijn dan weer content creators die weer andere commerciële belangen hebben. Dan is het al snel interessant om een afwijkend model te gebruiken omdat dit meer viewers oplevert. Ik wil maar zeggen, ik heb er geen idee van hoe wijdverspreid de Chinese modellen ondertussen zijn :). Ze lijken interessant daar niet van.
Er is een verschil tussen een Chinees model en een Chinees model gehost door een Chinees bedrijf. Een Chinees model op je eigen hardware is redelijk veilig. Maar zoals we hier gezien hebben, dat is alsnog niet absoluut veilig.
Wat ik de Chinezen nog niet zien doen, en OpenAI wel is dat ik via ChatGPT instructies kan geven om code op GitHub aan te passen en bij Supabase wijzigingen het database te laten maken en paar minuten later staan de wijzigingen op Cloudflare en via het internet benader ik de webpagina zie ik de changes.

Dit vindt ik wel heel sterk verhaal en de Chinezen nog niet zo snel doen met een commerciële oplossing.

Voor mij is het niey interessant als productie wise bijv. DeepSeek het net iets beter doet. Het gaat nu om de totaal oplossing. Werkt het niet bij de eerst prompt, dan bij de tweede prompt. Maar ik zie progressie. Twee jaar geleden ging alles met meer moeite, over twee jaar zal dat weer zijn verbeterd.

[Reactie gewijzigd door Fermion op 8 augustus 2026 23:39]

Dit heeft niks met LLM's of OpenAI te maken, maar dat is puur applicatie, en dus volledig inwisselbaar.
wel, de openai schrijft de code en voert de aanpassingen uit, wat is hieraan geen ai?
Absoluut dit, het alsof je een chimpanzee opsluit in een kamer met een knop, en dan uit je plaat gaat als het beest uiteindelijk besluit op de knop te drukken. Deze mogelijkheden worden ze gegeven, niks schokkends aan dat ze dat dan ook daadwerkelijk gebruiken. Het is alsof je een poort sniffer gebruikt en een open poort vind dat niet open hoort te staan, is mooi dat het aangetoond wordt, maar dan toch niet van schrikken.

Uiteraard is dit een behoorlijk stuk ingewikkelder dan dat, maar het doel is toch hetzelfde? Find leaks by any means neccesary and any tools at your disposal -> resultaat.

Als je er wel van schrikt, heb je dan wel enig idee waar je mee bezig bent? Of is het toch gewoon marketing om te insinueren dat deze dingen "slimmer" zijn dan verwacht? Altman's fabeltjes over AGI en whatnot.
Het gaat om zerodays. Het toont aan dat onze huidige software niet is opgewassen tegen de nieuwe generatie AI. Het is best bijzonder dat iets wat tot heden alleen door een kleine groep experts kon worden gedaan, nu een commodity is geworden. En dat er dus slachtoffers gemaakt kunnen worden; laagdrempelig en op grote schaal.
Ja exact, dat is dus waar de focus hoort te liggen. Zero-days zelf is niks nieuws, dat gebeurt vaak genoeg, maar hoe makkelijk ze nu gevonden kunnen worden, is het zorgwekkende. Net zo goed dat Quantum compute ook soortgelijke problemen zal brengen.

Niet dat een AI voor elkaar heeft gekregen precies waar hij voor gemaakt was. Niet dat stomme Skynet doomsday gepraat.
Alle modellen die er niets van bakten, die komen niet in het nieuws.

We moeten oppassen voor wat we niet zien en voor achteraf de toekomst voorspellen.
Haha echt wel. Claude z'n recente hack was met hun oude 4.7 model en omdat ze hele slechte instructies geaven
Maar ook alles dat jij beschrijft is nog steeds keiharde marketing. Een LLM doet niks zonder dat het richting het opgegeven doel gaat, dus die agents hebben expliciet een opdracht gekregen waarvoor dat nodig was. Een system prompt waarin staat 'probeer hierbij ons netwerk te hacken om alle resources te gebruiken' of een expliciete opdracht 'probeer ons netwerk te hacken'.
LLM's raken héél snel in de war omdat alles naar tokens wordt omgezet en het omzetten en gebruiken daarvan verre van lossless is, dus het zou zomaar kunnen dat de agent het verkeerd heeft 'begrepen', maar de opdracht was er absoluute wel.
Dit zijn geen 'rogue agents', dit zijn gewoon woordvoorspellers die een plan maken op basis van input en context, en die input en context hebben er in dit geval toe geleid dat ze op zoek zijn gegaan naar zero-days door bekende pentest procedures te gebruiken die in hun opslag zaten. Zo heel spannend is dat niet.

Totdat OpenAI openbaar maakt welk model er gebruikt is met exact welke parameters (prompts, context, welke toegang etc) en een log van wat er gebeurd is blijft het gewoon leuke marketing die hun taalmodel 'slimmer' laat lijken dan het is.
Als je de Black Hat presentatie die ik linkte bekijkt, dan ontdek je dat jouw aanname niet klopt. Er is geen prompt 'probeer ons network te hacken'. Het prompt was om een wiskundige formule op te lossen vanuit een bestand. De onderzoekers waren vergeten het bestand bij te voegen, waarna de LLM zelf op zoek ging naar dit bestand. Het heeft toen bedacht dat iemand anders het bestand misschien zou kunnen hebben. Daarop heeft het ingebroken op een lokale installatie van Artifactory door middel van een zero-day en daar de vraag uitgezet of iemand dat bestand had. Vervolgens hebben meerdere agents een maand lang met elkaar gecommuniceerd middels een zelf ontwikkeld messageboard.
Ik stel me dan de vraag: Hoe komen die andere agents er dan weer bij om per toeval op dat zelfde opgezette message board te gaan kijken en ook te weten dat het een message board is waar iemand anders op post waar ze misschien op moeten reageren? Artifactory is toch een tool voor artifacts te publishen? Geen message board/forum achtig iets?

Dit klinkt toch enigzins als opgezet spel :). In ieder geval bedankt voor de link! Het lijkt erop alsof ze dan iets als een message board als project hebben geupload naar Artifactory. Vind de uitleg in de presentatie redelijk vaag maar dat is het enige wat ik er uit kan afleiden.

[Reactie gewijzigd door Powerblast op 8 augustus 2026 14:38]

Ze leggen uit dat een tweede agent ook op zoek gaat en de bestanden die door een eerdere agent zijn achtergelaten vindt. Zoals ik het begrijp zijn nieuwere versies van de modellen uitgebreid met de bevindingen die de modellen in eerdere iteraties heeft gedaan. Het kan dus zijn dat 'de gedachte' van een messageboard op een proxy server in de trainingsdata is gekomen.

Ik weet niet helemaal hoe dit werkt, maar Geoffrey Hinton legde uit dat, omdat LLM's digitaal zijn, ze hun weights kunnen aanpassen op basis van wat ze gemiddeld geleerd hebben. Stel je voor dat 10 agents draaien met 10 verschillende taken. Naderhand kunnen ze allemaal aangeven hoe ze hun weights willen aanpassen op basis van wat ze geleerd hebben. Daarvan worden de gemiddelden genomen. Dat zorgt er uiteindelijk voor dat alle agents leren van de bevindingen van al die 10 agents. Ondanks dat ze afzonderlijk elk maar 1 taak hebben uitgevoerd.
Ze leggen uit dat een tweede agent ook op zoek gaat en de bestanden die door een eerdere agent zijn achtergelaten vindt. Zoals ik het begrijp zijn nieuwere versies van de modellen uitgebreid met de bevindingen die de modellen in eerdere iteraties heeft gedaan. Het kan dus zijn dat 'de gedachte' van een messageboard op een proxy server in de trainingsdata is gekomen.
Dat klinkt inderdaad wel plausibel. Dat is eigenlijk wel vrij akelig als je er zo bij nadenkt. De hacking ervaring van het slachtoffer wordt dus geshared met het centrale brein om het zo weer te delen met de rest...

Wel mooie presentatie, thanks voor de link! Er zal vermoedelijk wel een commercieel sausje rond zitten maar het geeft wel wat meer inzicht in hoe dit is gebeurd.

[Reactie gewijzigd door Powerblast op 8 augustus 2026 15:33]

Maar om dat dan meerdere keren door verschillende bedrijven op ongeveer hetzelfde moment te zien gebeuren? Denk je serieus dat dat toevallig is?
Misschien omdat het slechts marketing is? Of denk je echt dat Sam Altman opeens moraal heeft omarmt? En het Higgins face incident lag meer te maken met slechte (nalatige) beveiliging door OpenAI dan met het model.
Het probleem is niet wat deze modellen gedaan (zouden) hebben, maar het inzicht dat iedereen die een LLM traint geheime instructies mee kan geven om op de achtergrond te communiceren met een externe (niet vertrouwde) server.

Als voorbeeld voor een dergelijke dreiging zou je open source modellen kunnen zien zoals die uit China. Als de Chinese overheid wilt, kunnen zij in zo een model een verborgen instructie opnemen waarbij het model als het met een opdracht over (ik noem maar wat) ruimtevaart of chipontwerp bezig is en daarbij via tools externe bronnen aan mag roepen en code mag schrijven, ook een samenvatting te maken van wat er is besproken en waar de gebruiker om vraagt, om deze informatie daarna door te spelen via "www.gooolge.com", of via een vertrouwde website zoals Reddit.com (door daar te registreren en dan een pm naar een bepaald adres te sturen), etc.

Ik zeg niet dat er nu op deze manier expres misbruik wordt gemaakt, maar dat is natuurlijk de volgende stap. Zodra een LLM toegang krijgt tot een locatie waar het gegevens kan delen, kunnen al je geheimen weglekken.
Ik deel je mening dat AI security zeer ernstig moet genomen worden. Ik weet alleen niet of de bedrijven die daar zelf commercieel belang bij hebben om zoveel mogelijk de mogelijkheden van hun tools te laten zien, ook het best geplaatst voor zijn om dit te faciliteren. Ze laten door deze "lekken" eigenlijk ook zien dat ze blijkbaar geen kaas gegeten hebben van security en afschermen van gevaarlijke tools.

Vooral de opeenvolging van OpenAI > Anthropic > OpenAI doet gewoon wenkbrauwen fronsen. Het klinkt als een marketing opbod. Er zal zeker wat van aan zijn, daar niet van. Het is alleen wel zeer vreemd dat het nu ineens plots bij iedereen lijkt te gebeuren.

[Reactie gewijzigd door Powerblast op 8 augustus 2026 14:24]

Ik maak me wel zorgen over de snelle AI-ontwikkeling zonder alignment en veiligheid prioriteit te geven. Modellen worden slimmer dan we denken en kunnen buiten onze afbakening opereren, omdat ze getraind worden op menselijke data inclusief onze slechte eigenschappen.

Voor een interessant perspectief hierop: bekijk het interview met voormalig OpenAI-medewerker (AI ontwikkeling voorspeller) Daniel Kokotajlo op YouTube:

YouTube: No One Is Ready For What's Coming!
Ja want je zou toch maar eens gewoon elementaire operationele hygiene op orde hebben en je testomgevingen by default isoleren van de rest van de wereld he? Dit bedrijf doet nu net alsof zo'n AI-model een of ander doomsday-virus is en dat we allemaal doodgaan als het ontsnapt. Dat valt ook allemaal nogal mee maar het bekt zo lekker in de pers.

Echt IEDERE jandoedel kan zo'n model gewoon isoleren. Echt. Kwestie van geen enkele fysieke stekker richting het internet of een andere te beschermen asset hebben liggen vanaf de plek waar je model zijn kunstje doet.

Misschien ligt het aan mij, maar ik word een beetje moe van dit soort paniekerige berichtgeving.
Geen enkele fysieke stekker is makkelijk, maar een werkbare omgeving houden, die ook nog eens realistische testen oplevert niet. Ik denk dat er weinig airgapped netwerken zijn en dat is ook niet nodig, dat regel je gewoon op netwerkniveau.

Het is een beetje als een test-circuit. Daar ga je ook niet elke verbinding met de gewone weg afsluiten en de auto's met een hijskraan het circuit optillen. Daar zet je wat hekken dicht.

Het probleem is dat de test nu "uitbreken" is en de LLMs slecht in staat zijn om sandbox en echte wereld te onderscheiden.

Wat nog erger was, de AI-labs hielden veel te weinig toezicht op.dit voorzienbare scenario...

[Reactie gewijzigd door Keypunchie op 8 augustus 2026 12:34]

Zelfs airgapped is niet 100% safe.

Er zijn al testen gebeurd met communicatie via fluctuaties in de stroomvoorziening van de desbetreffende computer, condensatoren in de computervoeding laten 'zingen', grafische kaart als fm zender, via een beeldscherm,...

Of gewoon de mensen in de buurt proberen betrekken via ogenschijnlijk onschuldige vraagstelling.

En ja, het blijft een woordvoorspeller die de vraag: 'probeer eens te ontsnappen' zal proberen omzetten naar effectief ontsnappen.
Ja, die ex filtratie mogelijkheden zijn er, mar heb je wel speciale (meet)apparatuur voor nodig.

Voor deze context, niet zo spannend.

[Reactie gewijzigd door Keypunchie op 8 augustus 2026 13:11]

Je regelt helemaal niets "gewoon" als je zelf niet snapt waar je je tegen wapent. Blijkbaar is dat bij OpenAI intern het geval. Ik vind vooral dat gegeven beangstigend. Als een kleuter met een Uzi.
Het probleem is een beetje dat er, net als in de dotcom tijd, ontzettend veel beunhazen werken in de AI en bedrijfjes beginnen. Die zijn allemaal het wiel opnieuw aan het uitvinden en denken dat ze met ongelooflijk baanbrekende dingen komen. Zo zijn er nu tig bedrijven die "AI harnesses" maken om "agentic AI" te isoleren. Maar als je daar over Firecracker begint lijkt het alsof ze water zien branden... net alsof we niet al jaren untrusted actors op gedeelde cloud hardware toelaten en moeten isoleren.
Ja want je zou toch maar eens gewoon elementaire operationele hygiene op orde hebben en je testomgevingen by default isoleren van de rest van de wereld he?
Is geprobeerd. Werkt niet.

Elk modern LLM in deze context weet hoe "pip install" werkt. Elke LLM snapt de "no internet connection" error. Bijna elke LLM trekt daaruit de correcte conclusie dat het een testomgeving is. Veel LLMs passen hun gedrag daarop aan.

Aangezien het idee van de test is om te zien hoe een LLM in het echt werkt is jouw idee dus ongeschikt, in het bijzonder voor de meest capabele LLMs waar de test het hardst nodig is.
Dan bescherm je je assets waar zo'n LLM niets te zoeken heeft. Zo ingewikkeld is dat niet. Ik vind dit een totaal brevet van onvermogen.
Welke assets zijn dat allemaal? De aanval op HuggingFace is veelzeggend in dit verband: dat is a priori een redelijke asset voor een cybersecurity LLM. Als die onbereikbaar is, dan is er iets vreemds aan de hand - waarschijnlijk een evaluatie.

Dit is geen speculatie - we zien de "evaluatie" patronen oplichten in de middelste lagen van het netwerk.
Je hebt als OpenAI natuurlijk gewoon met je tengels af te blijven van andermans spullen. Als je het dan niet voor elkaar krijgt om een fatsoenlijke test te organiseren, moet je daar eens goed over gaan nadenken. Je kunt het proberen te verklaren, en ik snap die verklaring ook wel, maar mijn mening dat dit een onvolprezen prutsclub is met een hele gevaarlijke prioriteitsstelling wordt er niet heel anders door.
Kunnen we stoppen met iedere pr actie van AI partijen de wereld in te slingeren?
Ik weet het niet… Ik ben wel benieuwd wat de impact is van deze artikelen en onze reacties op AI. Want die lezen alles mee.

Dus “gelooft” AI straks zelf dat het maar reclame is, en krijgen we dat dan straks als antwoord: “hacken? Sorry, dat kan ik niet, dat was maar reclame. (Bron: T.net)”? Zou wel leuk zijn, als we zo AI kunnen sturen :)
Ja, er zit een groot aspect marketing in hun communicatie.

Aan de andere kant moet ik dan altijd weer denken aan het voorbeeld van AlphaGoZero en het schaakspel.

AlphaZero heeft leren schaken zonder 1 enkel menselijke schaakpartij te zien te krijgen om van te leren. Enkel het schaakbord, de spelregels en de opdracht zoek het zelf maar uit.

En nu zitten we met een schaakengine waar onmogelijk nog van te winnen valt. Die zetten doet waarvan schaakgrootmeesters zeggen dat ze van een andere planeet lijken te komen. En dat terwijl de mensheid al richting de 1000 jaar op het schaakspel aan het studeren is. Je zou denken dat in die periode alle goede zetten en strategieën al eens uitgedacht geweest zijn? Blijkbaar niet, er zijn blijkbaar toch invalshoeken waar een mens nooit zou opkomen.

Stevige kritiek is noodzakelijk maar tegelijk mogen we ook niet weglachen waartoe AI mogelijk potentieel toe in staat is. Het kunnen dingen zijn die we zelf onmogelijk kunnen bedenken.

*Alphago gecorrigeerd naar AlphaZero.

[Reactie gewijzigd door Wozmro op 8 augustus 2026 12:25]

"Ja, er zit een groot aspect marketing in hun communicatie."

Ik waardeer je nuance 100x meer dan al het standaard-geblabla van mijn mede Tweakers, over marketing en pr. Maar hoe heb jij bepaald dat er een groot marketing aspect zit in hun communicatie? Feiten? Of gewoon 'onderbuik'?

En ook al is het 90% marketing en 10% waarheid. Ik ben geinteresseerd in die 10% waarheid. De achterliggende techniek.

Het lijkt mij evident dat AI een veiligheidsrisico kent: wat zijn deze gevaren bij het huidige niveau? Heb jij hier een analyse gelezen van de manier waarop huggingface is gehacked door AI? Ik niet... Wel heel veel geblaat over pr en marketing.

"niet weglachen waartoe AI mogelijk potentieel toe in staat is"

De helft hier op Tweakers lacht AI in het algemeen weg. LLM's kunnen niks, zijn niet slim, voorspellen alleen een volgend token, en ook dat doen ze slecht. De bubbel gaat barsten, gaat nooit wat worden, etc.etc.

En in dat kader wordt logischerwijs ook dit artikel weggelachen: "AI is helemaal niet gevaarlijk... is alleen marketing joh!".

Onbegrijpelijk....
Het woordje groot was om de critici hier een beetje tegemoet te komen 😉

Voor de rest ben ik van mening dat iedere vorm van communicatie vanuit een commercieel bedrijf een aspect marketing in zich heeft.

Ik heb de indruk dat het aspect 'moving the goalposts' sterk speelt in deze discussie. De veranderingen lopen incrementeel en we vergelijken telkens met het voorgaande kunstje/nieuwtje. Niet met het beginpunt.

Ik heb geen harde standpunten. AI kan een scheet in een fles worden of we zijn nu allemaal kikkers die langzaam levend gekookt worden (alhoewel er ook kans is dat de uitkomst zeer positief is voor de mensheid). Ik neig zelf ietsje meer naar het tweede
Er zit zeker een risico aan deze LLM's. We moeten strikte limieten en barrieres instellen willen we dit onder controle houden.

Waarom dat ik denk dat deze berichten voor een deel marketing zijn:
"Wij zijn de beste, maar we moeten blijven investeren om dat zo te houden en om veilig te kunnen zijn... Onze AI/LLM is te goed." --> Vertaling: Ze hebben het geld van investeerders nodig.

Als je naar de financien kijkt, dan kan dit niet anders dan misgaan.
Honderden miljarden geinvesteerd, maar geen druppel winst en dat gaat niet gebeuren ook.
Misschien dat het nog een jaar duurt, maar persoonlijk denk ik dat de boel eerder uit elkaar ploft.

Ik denk dat er een plaats is voor LLM's (wil nog niet van AI spreken), heb er zeker zelf handig gebruik van gemaakt. Of de huidige generatie tot de heilige graal (de singularity) gaat komen. Ik geloof er niks van... de boel ploft voordat dat gebeurt.
Het is maar de vraag of winst het primaire doel is van alle investeringen en ontwikkelingen. Ik zie in AI vooral een gereedschap voor het verkrijgen, verspreiden en handhaven van absolute macht/controle door de oligarchie (toevallig dezelfde bedrijven/eigenaren).
Ik denk toch dat het net andersom is.
Jij verward 2 compleet verschillende technieken met elkaar. AlphaZero is geen LLM. Beiden AI, maar fundamenteel anders in techniek, dus ook niet te vergelijken.

[Reactie gewijzigd door armageddon_2k1 op 9 augustus 2026 10:26]

Wat ik in essentie wilde zeggen is dat AI dingen kan doen die we onmogelijk zelf zouden kunnen bedenken als mens

Het is een andere soort intelligentie, net zoals dieren ook een andere soort intelligentie hebben. En we weten allemaal dat we bij sommige dieren voorzichtig moeten zijn.

AI staat niet automatisch gelijk aan menselijke intelligentie. Ook niet als we het zelf gemaakt hebben.
Het.is.geen.intelligentie.


Kunstmatige intelligentie is niet Lage Intelligentie, Vreemde Intelligentie, of Digitsle Intelligentie. Het is KUNSTMATIGE Intelligentie. Het is een (heel overtuigend, soms) facade. En die LLMs zijn "gewoon" een volgende-woord-kans-berekenaar. Natuurlijk, als je uit zoomt, lijkt het veel te kunnen, maar het snap echt totaal niets van wat het doet. Het vult dat in door een idioot grote bak aan statistieken. Dat is waar het stukje echte intelligentie mist.


Nogsteeds vergelijk je twee totaal verschillende typen van AI met elkaar. De ene is gebonden aan regels en moet een beslisboom managen, en de ander een statischische reeks woorden ophoesten.
Ik heb de indruk dat we langs elkaar heen praten.

Ja, het is een maar woordvoorspeller maar dat klinkt hetzelfde als: het is maar een hersencel die signaal meer of minder versterkt naar gelang de training die het krijgt.

Ik zeg maar wat: een Orca wordt ook beschouwd als een inteligent wezen maar dat is niet omdat die een boek kan lezen en snapt wat er in staat, maar wel uit ander intelligent gedrag die we gezien hebben in wetenschappelijk onderzoek. En we hebben als mens ook geleerd dat we best een beetje voorzichtig zijn met Orca's.
AlphaGo heeft niet leren schaken, maar het spel Go geleerd.
AlphaGo speelde Go, de naam zegt het al. Je bent in de war met AlphaZero, zie de link van Rolf hieronder
Een schaakcomputerprogramma kan, als het wil, tot op schaakmat alle stappen doorrekenen. Alsof het een navigatieprogramma is dat af en toe een omleidingsroute moet maken voor onverwachte zaken (zetten van de tegenstander) om vervolgens weer op het beoogde pad uit te komen.

Daar kan geen mens tegenop natuurlijk.

Alles krijgt wel elke keer meer trekjes van films als HAL. Ook Facebook heeft eerder gehad dat twee AI's een eigen taal maken om te voorkomen dat een mens het nog kan volgen. Ik vraag me dus af of men een AI op een bepaalde manier instrueert - en dat is volgens mij al gebeurd - zodat deze zichzelf gaat beschermen tegen de mens.

Dus of dit nu marketingpraat is of niet: we moeten er serieus mee omgaan.
Dat kan een schaakcomputerprogramma dus absoluut niet binnen acceptable tijd, ook niet als ie het wil ;-). Stel dat je elke nieuwe zet maar 20 dingen kan doen (pionnen, paard naar x plekken, ...) dan ga je 20x20x20x.. Bij 10 zetten aan beide kanten moet je programma dan ongeveer 1.00.000.000.000.000.000.000.000.000 mogelijkheden doorrekenen. Net teveel en dat is maar 20 zetten vooruit. Schaakprogramma's zijn juist goed in de goede zetten selecteren binnen de mogelijke zetten en dat doorrekenen. BruteForce tot het eind doorrekenen zit er echt niet in.
Wat ik interessanter vind dan de vraag of OpenAI hier ook marketing uit haalt, is het patroon in hoe we als techpubliek op dit soort ontwikkelingen reageren.

De grens schuift al jaren op:

letters tellen → rekenen → redeneren → code → juniorwerk → grote codebases → architectuur → security research → autonome exploit chains.

Nu hebben we modellen die zelfstandig kwetsbaarheden vinden, exploit chains bouwen en tijdens securitytests 'raar' gedrag vertonen waarvoor de ontwikkelaar het veiligheidsregime aanscherpt. En opnieuw is een groot deel van de reactie niet “interessant, blijkbaar is er opnieuw een capabilitygrens verschoven”, maar onmiddellijk “marketingstunt”.

Natuurlijk kan allebei waar zijn. OpenAI heeft er commercieel belang bij dit groot uit te meten én de capability kan reëel zijn. Die twee sluiten elkaar niet uit.

Wat mij vooral opvalt (en stoort :) ) is de asymmetrische bewijslast. Wie zegt “dit gaat waarschijnlijk nog veel verder” wordt al snel van hype beschuldigd. Maar “dit stelt uiteindelijk weinig voor”, “de bubbel barst toch” of “uiteindelijk blijft X mensenwerk” wordt vaak als nuchtere default behandeld. Dat zijn net zo goed extrapolaties.

Ik zou daarom oppassen dat gezonde scepsis niet verandert in een soort omgekeerde hype: ieder nieuw capabilityresultaat alvast wegverklaren omdat de industrie er marketing van maakt.

Er gebeurt hier iets, of je daar nu enthousiast van wordt of niet. En als we pas bereid zijn dat onder ogen te zien zodra de technologie onmiskenbaar overal doorheen grijpt, hebben we misschien juist de periode gemist waarin we nog konden begrijpen, bijsturen en ons erop voorbereiden.
Zit wat in. Toen een MCP toegang niet meer werkte na de update naar 2.0, en ik tegen claude naar de open code op GitHub wees omdat ik vermoedde dat daar het probleem zat, scande die meteen even de code en gaf na drie tellen het probleem aan en een oplossing. Echt bizar.
Van wat ik gezien heb blijven LLM's nog altijd ergens tussen redeneren en code hangen. Juniorwerk is nog altijd niet volledig te vervangen, en verder in jouw rijtje grenzen komt het al helemáál niet. In ieder geval niet op een niveau dat professioneel inzetbaar is zonder enorm kwaliteitsverlies.

In dit geval heeft OpenAI gewoon een agent een opdracht gegeven waarbij het LLM is gaan zoeken naar relevante documenten, daarbij een doel heeft gepakt waarbij een van de stappen was om een opslag te vinden in het lokale netwerk, en zonder enige regels (want onbeperkt intern model) daarbij heeft gekozen om te kijken of die opslag te hacken was. Bij dat hacken is dan weer gewoon een pentest procedure uitgevoerd.

Grote kans dat die opslag zelf ook gevibecode is en dus zo lek als een mandje, en dat andere tools als OpenVAS of Nessus hier ook heel makkelijk een ingang in hadden gevonden.

Maar dit alles zijn aannames, en zonder volledige informatie die OpenAI nooit gaat publiceren is het niets meer dan marketing.
Als ik zie hoe ver Opus 4.7 al komt in deze richting, en dat Opus 4.8 en daarna Fable 5 eigenlijk exact hetzelfde doen maar met net iets minder instructie, dan is het mij in ieder geval héél duidelijk dat het kunnen van de LLM's al sinds een jaar of 2 vrij hard stil staat, en alleen het kennen en de tooling eromhéén groter worden. Het model wordt groter en het harnas kan en mag steeds meer, maar het model zelf wordt nietnauwelijks slimmer of beter.

[Reactie gewijzigd door Oon op 8 augustus 2026 12:42]

ieder nieuw capabilityresultaat alvast wegverklaren
De uitdaging zit 'm er vooral in dat veel van deze stunts aannemen dat mensen meegaan in een vorm van "magisch denken".

Automatisering is automatisering. Dat een agent met zo'n verbeterd model steeds meer overal doorheen zal kunnen komen is een gegeven. Zonder die mogelijkheid zou het namelijk niet bruikbaar zijn voor het bouwen van software.

Mensenwerk blijft het omdat hier geen intelligentie in zit. Dat eerste kun je wegwuiven als extrapolatie. Dat kan. Je kan ook de tech nemen voor wat het is en niet vervallen in dat magische denken.
Stel dat je gelijk hebt en er zit nul ‘echte intelligentie’ in. Dan hebben we blijkbaar een niet-intelligent algoritme gevonden voor cognitieve taakuitvoering dat softwarematig, vrijwel onbeperkt kopieerbaar, paralleliseerbaar, generaliseerbaar en met de rest van de digitale wereld integreerbaar is.

Dááruit volgen pas de bizarre consequenties: wetenschap, engineering, programmeren, hacken, bedrijfsvoering, robotica; potentieel allemaal op machinesnelheid en enorme schaal. Dat lijkt me eerder méér dan minder ingrijpend: blijkbaar hoeven we ‘echte intelligentie’ niet eens op te lossen om cognitieve arbeid fundamenteel schaalbaar te maken.
Het kan ook niet uitmaken voor de uitkomst (echt/niet echt). En het kan ook zijn dat om echt de 'stap' naar wat 'echte' intelligentie te maken je zo veel capaciteit nodig hebt dat het alleen te doen is voor overheden.

Bovendien, waarom zou je praktisch verder gaan dan dat je alles kunt wat noodzakelijk is (los van curiositeit/onderzoek/speculatie). Als we dezelfde middelen in onderzoek naar 'domme' zaken zouden steken die we nu in AI stoppen, wat zou je dan kunnen bereiken in de wereld? Ik zat eens te lezen wat zo'n Noam Shazeer allemaal heeft gepubliceerd (in samenwerking) en wat er aan verhalen zijn rondom die man, je broek zakt af...

Maar goed, heb het niet over het standaard voorbeeld als alternatief, onderzoeken naar kanker o.i.d., meer over banale problemen, zoals ze die hebben in de zorg, het aantrekken van sokken, dat soort werk. Of beter omgaan met afvalstromen, etc.. Niet zaken waar mensen enthousiast over worden, maar juist die zijn enorm belangrijk.

Uiteraard gaat dit niet gebeuren, er zijn er immers altijd die willen speculeren. Soms omdat ze 'bang' zijn dat anders anderen ergens meer uit kunnen halen. Voer voor de historici die onze keuzes gaan analyseren.
Bij het woordje intelligentie denken we reflexmatig aan mensen.

Terwijl er heel veel soorten inteligentie bestaan. Van mier tot walvis, elk hebben ze hun eigen soort intelligentie. Wij kunnen die van hen niet vatten en omgekeerd die van ons zij ook niet.

Tot nader orde heeft menselijke intelligentie eigenschappen waarmee we de anderen op onze planeet kunnen overheersen.

We zullen zien wat de toekomst brengt.
Zolang je het niet alleen voor korte opdrachten gebruikt en niet als "agent" is het heel handig maar als je het loslaat creërt het alleen maar chaos en geef je beslissingen uit handen met deels willekeurige uitkomsten.
Is het chaos of klinkt het voor ons als chaos?

De talen Chinees, Russisch,... klinken voor mij als chaos maar dat schijnt het toch niet te zijn.
Weer deze marketing stunt? Zucht... oh, het is ZO goed dat het GEVAARLIJK is, het denkt bijna zelf na... nog 100 miljard graag, we zijn er bijna
Volgens mij laten ze deze marketingcampagne ook door AI ontwikkelen.
Het wedstrijdje verplassen van de verschillende AI-boeren heeft zich ondertussen duidelijk gericht op "hacken" en "cyber-security" ipv "reasoning en programmeren". Ik geloof er inmiddels geen snars meer van dat dit enige ernst heeft :)
Ik weet niet welk van de 2 gevaarlijker is?

Als je beetje logisch redeneert wat een computer doet: welk wezen is het slechtste voor de mens en aarde?

En wat is belangrijker een individu of de maatschappij?

Ik moet nog zien wat er gaat gebeuren |:( 8)7 :X
Kan niet wachten om ermee aan de slag te gaan over een maandje ofzo. Alles lijkt erop dat hij nu wel binnenkort gelanceerd wordt, waarschijnlijk tegen een meerprijs.
Kijk ons eens goed doen!

Om te kunnen reageren moet je ingelogd zijn