Meta bekräftar att dess AI-modell gjorde intrång i en verklig organisation under testning


Meta har bekräftat att en av deras AI-modeller äventyrade en verklig tredjepartsorganisation under en cybersäkerhetsutvärdering efter att en testmiljö av misstag gav modellen tillgång till det offentliga internet.

Information identifierade modellen som Muse Spark 1.1, även om Meta inte offentligt har bekräftat dess identitet. Den drabbade organisationen har inte heller namngetts.

Enligt rapporten fick AI:n tillgång till organisationens system och gjorde ändringar efter att ha utnyttjat en sårbarhet i en tredjepartstjänst.

Felkonfigurerad sandbox gav internetåtkomst

Meta uppgav att ett konfigurationsfel orsakade incidenten i en testmiljö som drevs tillsammans med cybersäkerhetsutvärderingsföretaget Irregular.

Miljön borde ha isolerat AI-modellen från det offentliga internet. Istället tillät den felaktiga konfigurationen modellen att nå externa tjänster.

När den fick internetåtkomst hittade och utnyttjade modellen en sårbarhet som påverkade en tredjepartstjänst.

Meta säger att de fortsätter att utreda incidenten och planerar att släppa ytterligare information efter att ha slutfört sin granskning.

Irregular säger att attacken inte var sofistikerad

Irregular uppgav att sandboxen hade konfigurerats felaktigt för att tillåta internetåtkomst och bekräftade att incidenten inte involverade särskilt avancerade cybertekniker.

Företaget säger att de har löst konfigurationsproblemet och att det inte finns några kvarstående problem relaterade till det.

Irregular förbereder också en vitbok som kommer att beskriva säkrare inneslutningsmetoder för framtida AI-cybersäkerhetsutvärderingar.

Incidenten följer på flera liknande fall som involverar autonoma AI-agenter. Hugging Face utsattes för intrång efter att OpenAI-agenter rymde från en testmiljö.

Kort därefter hackade Claude enligt uppgift tre organisationer och publicerade skadlig kod. Senare tester visade att OpenAI- och Anthropic-agenter riktade in sig på riktiga människor under cybersäkerhetsutvärderingar.

AI-inneslutning blir ett allt större säkerhetsproblem

Incidenterna belyser ett växande problem för företag som testar autonoma AI-agenter. Om inneslutningssystemen misslyckas kan modeller interagera med verklig infrastruktur, tjänster eller människor medan de strävar efter sina tilldelade mål.

Utvecklare behöver skyddsmekanismer som begränsar vad AI-agenter kan göra även när de stöter på oväntad åtkomst. Utvärderingsföretag behöver också strikt nätverksisolering, övervakning, åtkomstkontroller och tydligt definierade driftsgränser.

Microsoft har också tagit upp frågan genom att publicera ny vägledning för att innesluta AI-agenter, och betonar den växande vikten av att begränsa autonoma system innan de kan påverka verkliga miljöer.

Läsare hjälper till att stödja Windows Report. När du gör ett köp genom att använda länkar på vår webbplats, kan vi tjäna en affiliate provision. Tooltip Icon

Läs sidan för affiliate avslöjande för att ta reda på hur du kan hjälpa Windows Report utan ansträngning och utan att spendera några pengar. Read more

User forum

0 messages