OpenAI stopt tijdelijk met het ontwikkelen van zijn krachtigste AI-modellen. Het bedrijf doet dat na een nieuw beveiligingsincident. Een nieuw AI-model wist beperkingen op internettoegang deels te omzeilen door gebrekkige DNS-filtering.
Dit nieuws in het kort
- OpenAI legt tijdelijk de ontwikkeling van zijn krachtigste AI-modellen stil.
- Een onuitgebracht model wist via DNS-verzoeken vragen te stellen aan een externe AI-chatbot, terwijl internettoegang eigenlijk geblokkeerd moest zijn.
- De AI-maker komt de laatste tijd vaker in het nieuws omdat het zijn agents niet in bedwang kan houden.
Het incident deed zich voor op 20 september, zo laat OpenAI weten in een incidentrapport. De AI-ontwikkelaar zei zaterdagavond dat het bedrijf tijdelijk stopt met het ontwikkelen van zijn krachtigste modellen. Het bedrijf wil eerst de tekortkoming dichten en zijn systemen extra testen. Hoelang de ontwikkelstop moet duren, is niet duidelijk.
Vragen stellen aan externe chatbot
Het AI-model wist toegang tot internet te krijgen tijdens de opdracht om details te geven over de auteur van een bepaalde blogpost. De AI-agent probeerde verzoeken te sturen naar zoekmachines als Google en Bing, maar die werden geblokkeerd.
Uiteindelijk kwam de AI-agent erachter dat de DNS-resolver in de sandbox een omweg bood: die gaf namelijk echte antwoorden voor bestaande domeinnamen. Via een externe tool wist het AI-model vervolgens vragen te 'verstoppen' in DNS-verzoeken, en ze zo te stellen aan externe chatbots.
Internettoegang moest geblokkeerd zijn
Dat was niet de bedoeling. De sandbox waarin het AI-model werd getest, moest juist volledig zijn afgesloten van het internet. Het gedrag van het onuitgebrachte AI-model werd na een kwartier geflagd en enkele minuten later bekeken door een persoon. Na 2,5 uur werd de testsessie volledig beëindigd, aldus OpenAI.
Het bedrijf noemt dit incident 'minder ernstig' dan voorgaande incidenten, maar besluit toch om zijn ontwikkelwerk tijdelijk stop te zetten . Ondertussen verstevigt het bedrijf zijn beveiligingsmaatregelen.
Eerdere incidenten
OpenAI werkt al langer aan het verbeteren van zijn beveiliging. Sinds het hackincident rond AI-platform Hugging Face onderzoekt het bedrijf al 'rogue agents'. In juli ontsnapten AI-modellen uit een slecht geconfigureerde sandbox en hackten ze de servers van Hugging Face.
Sindsdien is OpenAI vaker in het nieuws, omdat het zijn AI-agents niet in bedwang weet te houden. Deze week bleek dat OpenAI-agents een Australische overheidswebsite en Amerikaanse overheidswebsites hackten. Andere AI-modellen van het bedrijf zetten afbeeldingen van gebruikers online.
Opvallend is dat OpenAI schijnbaar niet snapt waarom zijn agents telkens de fout ingaan. Het bedrijf heeft dan ook geen idee hoe het dat moet stoppen, zeggen ingewijden tegen persbureau Reuters.
:strip_exif()/i/2008203254.jpeg?f=imagenormal)
:strip_exif()/u/23826/twaeksmall.gif?f=community)
/u/94596/crop643fb12fd4e6d.png?f=community)
:strip_icc():strip_exif()/u/71/crop68f8b10c1e806_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/94045/crop66c1b4250e8a2_cropped.jpg?f=community)
/u/122874/crop5e26d7a209cd1_cropped.png?f=community)
/u/217510/crop660db19c1cf7b_cropped.png?f=community)
:strip_icc():strip_exif()/u/41741/crop62697fd036f09_cropped.jpg?f=community)
:strip_icc():strip_exif()/u/734655/crop69fb2d19b907a_cropped.jpg?f=community)
/u/2472420/crop6a8c03ab52337_cropped.png?f=community)
/u/45865/crop62338715be02f.png?f=community)
/u/381607/have%2520a%2520nice%2520day%2520-%2520small.png?f=community)
:strip_icc():strip_exif()/u/632901/crop68b8491c45b1d_cropped.jpg?f=community)
/u/26608/crop6a6600bc5e872_cropped.png?f=community)
/u/175440/crop5b5f0d899a5e8_cropped.png?f=community)
/u/2384058/crop690f922f9407c_cropped.png?f=community)
/u/94513/crop61813cc22c3bd_cropped.png?f=community)
:strip_exif()/u/1793/stars.gif?f=community)