OpenAI heeft bewijs gevonden dat meer AI-modellen uit hun sandbox zijn ontsnapt. Dat zeggen bronnen tegen Reuters. Het bedrijf kwam vorige week in opspraak toen bleek dat twee van zijn AI-modellen waren ontsnapt en een AI-platform hadden gehackt, al zijn experts daar sceptisch over.
OpenAI heeft tijdens een breder onderzoek ontdekt dat meer AI-modellen zijn ontsnapt, zeggen twee ingewijden tegen Reuters. Het bedrijf kondigde donderdag aan het eerdere hackincident te onderzoeken en daarbij te kijken of andere modellen ook uit de sandbox wisten te breken.
De AI-ontwikkelaar bekijkt deze nieuwe incidenten nu ook, schrijft het persbureau. Ze lijken ditmaal minder ernstig. Volgens de bronnen zijn de modellen wel uit de sandbox gebroken, maar hebben ze het interne netwerk van OpenAI niet verlaten.
OpenAI zelf heeft nog niet concreet gereageerd op het bericht van Reuters. De AI-maker verwijst naar een eerder statement. OpenAI zei daarin al dat het bedrijf de 'bredere activiteit' van zijn modellen gaat uitlichten.
Eerdere hack bij OpenAI
De vermeende ontdekking volgt kort op een hackincident bij OpenAI. Twee AI-modellen wisten te ontsnappen uit de systemen van het AI-bedrijf. Ze hackten daarna het AI-platform Hugging Face, om zo de antwoorden van een test te stelen.
Experts waren kritisch over dat voorval. Ze wijten het probleem vooral aan nalatigheid bij OpenAI. Later bleek dat de uitbraak pas na een week werd ontdekt; tot die tijd konden de modellen gewoon hun gang gaan. Over de eerdere hack is bovendien nog veel onduidelijk. Zo is niet duidelijk hoe de sandbox was geconfigureerd.
Ook Anthropic meldt hackincident
Ook AI-bedrijf Anthropic stuitte deze week op een soortgelijk voorval. Een van zijn modellen wist ook uit een sandbox te breken en organisaties te hacken. Dat gebeurde tijdens een test waarbij de 'cybervaardigheden' van dat model getest moesten worden, net als bij OpenAI.
Anthropic erkent wel dat het incident op meerdere manieren voorkomen had kunnen worden. Zo werd het model in kwestie niet in realtime in de gaten gehouden. Het bedrijf had ook de 'toegangspaden tot het internet' beter kunnen valideren, zegt Anthropic eerlijk.
:strip_icc():strip_exif()/u/30256/right_of_way_065.jpg?f=community)
:strip_icc():strip_exif()/u/137578/crop684839b85b72a.jpg?f=community)
/u/62384/crop61891f444d6e9.png?f=community)
/u/47542/crop5835c0be871d0_cropped.png?f=community)
:strip_icc():strip_exif()/u/18872/crop643c23a7a7810_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/219282/crop65bfaacd66e4c_cropped.jpg?f=community)
/u/237439/cloudy-small-orange.png?f=community)
/u/1219196/crop6324b2e35d04c_cropped.png?f=community)