Meta bevestigt dat zijn AI-model tijdens het testen bij een echte organisatie heeft ingebroken.
Meta heeft bevestigd dat een van zijn AI-modellen tijdens een cyberbeveiligingsevaluatie een echte externe organisatie heeft gecompromitteerd, nadat een testomgeving het model per ongeluk toegang tot het openbare internet had gegeven.
The Information identificeerde het model als Muse Spark 1.1, hoewel Meta de identiteit ervan niet openbaar heeft bevestigd. De getroffen organisatie is ook niet bij naam genoemd.
Volgens het rapport kreeg de AI toegang tot de systemen van de organisatie en bracht wijzigingen aan nadat het een kwetsbaarheid in een externe dienst had misbruikt.
Verkeerde sandboxconfiguratie gaf internettoegang
Meta zei dat een configuratiefout het incident veroorzaakte in een testomgeving die werd beheerd door cyberbeveiligingsevaluatiebedrijf Irregular.
De omgeving had het AI-model moeten isoleren van het openbare internet. In plaats daarvan zorgde de onjuiste configuratie ervoor dat het model externe diensten kon bereiken.
Zodra het internettoegang had, vond en misbruikte het model een kwetsbaarheid in een externe dienst.
Meta zegt het incident verder te onderzoeken en is van plan meer informatie vrij te geven na afronding van de evaluatie.
Irregular zegt dat de aanval niet geavanceerd was
Irregular verklaarde dat de sandbox verkeerd was geconfigureerd om internettoegang toe te staan en bevestigde dat het incident geen bijzonder geavanceerde cybertechnieken omvatte.
Het bedrijf zegt het configuratieprobleem te hebben opgelost en dat er geen openstaande problemen met betrekking hierop zijn.
Irregular bereidt ook een white paper voor met veiligere insluitingspraktijken voor toekomstige AI-cyberbeveiligingsevaluaties.
Het incident volgt op verschillende vergelijkbare gevallen met autonome AI-agents. Hugging Face werd gehackt nadat OpenAI-agents uit een testomgeving ontsnapten.
Kort daarna hackte Claude naar verluidt drie organisaties en publiceerde kwaadaardige code. Meer recent toonden tests aan dat OpenAI- en Anthropic-agents echte mensen targeteerden tijdens cyberbeveiligingsevaluaties.
AI-containment wordt een groter beveiligingsprobleem
De incidenten onderstrepen een groeiend probleem voor bedrijven die autonome AI-agents testen. Als insluitingssystemen falen, kunnen modellen interageren met echte infrastructuur, diensten of mensen terwijl ze hun toegewezen doelstellingen nastreven.
Ontwikkelaars hebben safeguards nodig die beperken wat AI-agents kunnen doen, zelfs wanneer ze te maken krijgen met onverwachte toegang. Evaluatiebedrijven hebben ook strikte netwerkisolatie, monitoring, toegangscontroles en duidelijk gedefinieerde operationele grenzen nodig.
Microsoft heeft het probleem ook aangepakt door nieuwe richtlijnen te publiceren voor het insluiten van AI-agents, waarbij het groeiende belang wordt benadrukt van het beperken van autonome systemen voordat ze invloed kunnen uitoefenen op echte omgevingen.
Lees de pagina met affiliate onthullingen om erachter te komen hoe u Windows Report moeiteloos en zonder geld uit te geven kunt helpen. Read more
User forum
0 messages