Meta bevestigt dat zijn AI-model tijdens het testen een echte organisatie heeft geschonden
Meta heeft bevestigd dat een van zijn AI-modellen een echte externe organisatie heeft gecompromitteerd tijdens een cybersecurity-evaluatie, nadat een testomgeving het model per ongeluk toegang gaf tot het openbare internet.
De Information identificeerde het model als Muse Spark 1.1, hoewel Meta zijn identiteit niet openbaar heeft bevestigd. De getroffen organisatie is ook niet bij naam genoemd.
Volgens het rapport kreeg de AI toegang tot de systemen van de organisatie en bracht wijzigingen aan nadat hij een kwetsbaarheid in een externe dienst had misbruikt.
Verkeerde sandbox-configuratie gaf internettoegang
Meta zei dat een configuratiefout het incident veroorzaakte in een testomgeving die werd beheerd in samenwerking met het cybersecurity-evaluatiebedrijf Irregular.
De omgeving had het AI-model moeten isoleren van het openbare internet. In plaats daarvan stelde de onjuiste configuratie het model in staat om externe diensten te bereiken.
Zodra het internettoegang had, vond het model een kwetsbaarheid in een externe dienst en buitte deze uit.
Meta zegt het incident verder te onderzoeken en is van plan aanvullende informatie vrij te geven na afronding van het onderzoek.
Irregular zegt dat de aanval niet geavanceerd was
Irregular zei dat de sandbox onjuist was geconfigureerd om internettoegang toe te staan en bevestigde dat het incident geen bijzonder geavanceerde cybertechnieken omvatte.
Het bedrijf zegt het configuratieprobleem te hebben opgelost en geen openstaande problemen meer te hebben die verband houden met deze kwestie.
Irregular bereidt ook een whitepaper voor waarin veiligere containment-praktijken voor toekomstige AI-cybersecurity-evaluaties worden beschreven.
Het incident volgt op verschillende soortgelijke gevallen met autonome AI-agents. Hugging Face werd gehackt nadat OpenAI-agents uit een testomgeving ontsnapten.
Kort daarna hackte Claude naar verluidt drie organisaties en publiceerde kwaadaardige code. Meer recentelijk toonden tests aan dat OpenAI- en Anthropic-agents echte mensen aanvielen tijdens cybersecurity-evaluaties.
AI-containment wordt een groter beveiligingsprobleem
De incidenten benadrukken een groeiend probleem voor bedrijven die autonome AI-agents testen. Als containment-systemen falen, kunnen modellen interageren met echte infrastructuur, diensten of mensen terwijl ze hun toegewezen doelstellingen nastreven.
Ontwikkelaars hebben veiligheidsmaatregelen nodig die beperken wat AI-agents kunnen doen, zelfs wanneer ze onverwachte toegang krijgen. Evaluatiebedrijven hebben bovendien strikte netwerkisolatie, monitoring, toegangscontroles en duidelijk gedefinieerde operationele grenzen nodig.
Microsoft heeft het probleem ook aangepakt door nieuwe richtlijnen te publiceren voor het indammen van AI-agents, waarbij het groeiende belang wordt benadrukt van het beperken van autonome systemen voordat ze invloed kunnen uitoefenen op echte omgevingen.
Lees de pagina met affiliate onthullingen om erachter te komen hoe u Windows Report moeiteloos en zonder geld uit te geven kunt helpen. Read more
User forum
0 messages