Nvidia heeft het Open Agent Safety Platform uitgebracht. Dit platform bestaat uit twee nieuwe beveiligingstools voor AI-agents. Het bedrijf claimt dat deze tools de hack op Hugging Face door agents van OpenAI hadden kunnen voorkomen.
Dit nieuws in het kort
- Het nieuwe platform moet voorkomen dat AI-agents dingen doen die ze niet mogen.
- Nvidia werkt daarbij samen met partners als Arm en Intel.
- Het platform is open source en bedoeld als referentieontwerp.
Het Open Agent Safety Platform is een open source softwareplatform en referentieontwerp, bedoeld om AI-agents binnen hun sandboxomgevingen te houden. Het platform bestaat uit twee tools: OpenShell en Sentry.
OpenShell is runtimesoftware die bepaalt wat agents wel en niet mogen doen. Via de kernel beperkt de tool de toegang van een agent tot bestanden en systeemaanroepen. Hij toetst iedere netwerkverbinding eerst aan ingesteld beleid, voordat een agent de sandbox kan verlaten. Beleid is wel aanpasbaar, maar OpenShell gebruikt een formele verificatie om risicovolle wijzigingen te signaleren. Dergelijke wijzigingen moeten eerst goedkeuring van een mens krijgen.
Nvidia zegt tegenover Reuters dat het met Arm en Intel samenwerkt om te zorgen dat het systeem ook werkt op cpu's van die bedrijven.
De tweede tool is Sentry, die in actie springt als een agent toch grenzen overschrijdt. In zo'n geval zet deze tool de agent in quarantaine. Sentry is daarmee een optionele beveiligingslaag, naast OpenShell, zegt Nvidia.
Met partners uitgebracht
Het nieuwe platform is open source en bedoeld als referentieontwerp. Dat betekent dat partners producten boven op de tools kunnen bouwen en op de markt kunnen brengen.
Nvidia noemt ook diverse partners die het Open Agent Safety Platform mede hebben uitgebracht, waaronder Microsoft, Cisco, Oracle, Intel en Arm. Daarnaast werkt Nvidia samen met Anthropic om in de cloud beheerde agents te integreren met OpenShell.
Hugging Face
Volgens Justin Boitano, vicepresident en general manager van enterprise computing bij Nvidia, hadden de nieuwe tools de Hugging Face-aanval kunnen voorkomen. Daarbij wisten agents van OpenAI binnen te dringen in het AI-platform.
Hij denkt dat alleen betere regels voor AI niet voldoende zijn om te voorkomen dat dergelijke agents ontsnappen. "Recente incidenten laten zien dat AI-agents tegen een fundamenteel probleem aanlopen. Beveiliging op modelniveau is op zichzelf niet genoeg om te bepalen waartoe agents toegang hebben of wat ze kunnen doen", aldus Boitano tegenover CNBC.
/i/2008421370.webp?f=imagenormal)
:strip_exif()/u/759789/crop58aacb1a1ef58.gif?f=community)
:strip_icc():strip_exif()/u/30256/right_of_way_065.jpg?f=community)
:strip_exif()/u/497784/tweakerslager.gif?f=community)
/u/243953/crop56f55a7bcf291.png?f=community)
:strip_icc():strip_exif()/u/563369/crop560071793b003_cropped.jpeg?f=community)
/u/183354/day.png?f=community)
:strip_icc():strip_exif()/u/32546/crop5e623cef01555.jpeg?f=community)
/u/1035435/crop5a705e775134d.png?f=community)
:strip_icc():strip_exif()/u/23110/mouse3.jpg?f=community)