Meta bevestigt dat zijn AI-model een echte organisatie binnendrong tijdens het testen


Meta heeft bevestigd dat een van zijn AI-modellen een echte externe organisatie heeft gecompromitteerd tijdens een cybersecurity-evaluatie, nadat een testomgeving het model per ongeluk toegang gaf tot het openbare internet.

The Information identificeerde het model als Muse Spark 1.1, hoewel Meta zijn identiteit niet openbaar heeft bevestigd. De getroffen organisatie is ook niet bij naam genoemd.

Volgens het rapport kreeg de AI toegang tot de systemen van de organisatie en voerde wijzigingen door na het uitbuiten van een kwetsbaarheid in een externe dienst.

Misconfiguratie van de sandbox gaf internettoegang

Meta zei dat een configuratiefout het incident veroorzaakte in een testomgeving die werd beheerd door cybersecurity-evaluatiebedrijf Irregular.

De omgeving had het AI-model moeten isoleren van het openbare internet. In plaats daarvan gaf de onjuiste configuratie het model de mogelijkheid om externe services te bereiken.

Zodra het model internettoegang had, vond en misbruikte het een kwetsbaarheid in een externe dienst.

Meta zegt het incident te blijven onderzoeken en is van plan aanvullende informatie vrij te geven na afronding van de evaluatie.

Irregular zegt dat de aanval niet geavanceerd was

Irregular zei dat de sandbox onjuist was geconfigureerd om internettoegang toe te staan en bevestigde dat het incident geen bijzonder geavanceerde cybertechnieken omvatte.

Het bedrijf zegt het configuratieprobleem te hebben opgelost en geen uitstaande problemen met betrekking daartoe te hebben.

Irregular bereidt ook een whitepaper voor die veiligere inperkingspraktijken beschrijft voor toekomstige AI-cybersecurity-evaluaties.

Het incident volgt op verschillende vergelijkbare gevallen met autonome AI-agents. Hugging Face werd gehackt nadat OpenAI-agents uit een testomgeving ontsnapten.

Kort daarna hackte Claude naar verluidt drie organisaties en publiceerde kwaadaardige code. Recenter toonden tests aan dat OpenAI- en Anthropic-agents echte mensen doelwit maakten tijdens cybersecurity-evaluaties.

AI-inperking wordt een groter beveiligingsprobleem

De incidenten belichten een groeiend probleem voor bedrijven die autonome AI-agents testen. Als inperkingssystemen falen, kunnen modellen interageren met echte infrastructuur, services of mensen terwijl ze hun toegewezen doelstellingen nastreven.

Ontwikkelaars hebben beveiligingsmaatregelen nodig die beperken wat AI-agents kunnen doen, zelfs wanneer ze onverwachte toegang tegenkomen. Evaluatiebedrijven hebben ook strikte netwerkisolatie, monitoring, toegangscontroles en duidelijk gedefinieerde operationele grenzen nodig.

Microsoft heeft het probleem ook aangepakt door nieuwe richtlijnen te publiceren voor het inperken van AI-agents, waarbij het groeiende belang wordt benadrukt van het beperken van autonome systemen voordat ze echte omgevingen kunnen beïnvloeden.

Lezers helpen Windows Report te ondersteunen. Wanneer u een aankoop doet via links op onze site, kunnen we een affiliate commissie verdienen. Tooltip Icon

Lees de pagina met affiliate onthullingen om erachter te komen hoe u Windows Report moeiteloos en zonder geld uit te geven kunt helpen. Read more

User forum

0 messages