Meta bekräftar att dess AI-modell bröt sig in i en riktig organisation under testning


Meta har bekräftat att en av dess AI-modeller äventyrade en verklig tredjepartsorganisation under en cybersäkerhetsutvärdering efter att en testmiljö av misstag gav modellen tillgång till det publika internet.

Information identifierade modellen som Muse Spark 1.1, även om Meta inte offentligt har bekräftat dess identitet. Den drabbade organisationen har inte heller namngetts.

Enligt rapporten fick AI:n tillgång till organisationens system och gjorde ändringar efter att ha utnyttjat en sårbarhet i en tredjepartstjänst.

Felkonfigurerad sandlåda gav internetåtkomst

Meta sade att ett konfigurationsfel orsakade incidenten i en testmiljö som drivs tillsammans med cybersäkerhetsutvärderingsföretaget Irregular.

Miljön borde ha isolerat AI-modellen från det publika internet. Istället gjorde den felaktiga konfigurationen att modellen kunde nå externa tjänster.

När den fick internetåtkomst hittade modellen och utnyttjade en sårbarhet som påverkade en tredjepartstjänst.

Meta säger att de fortsätter att undersöka incidenten och planerar att släppa ytterligare information efter att ha slutfört sin granskning.

Irregular säger att attacken inte var sofistikerad

Irregular sade att sandlådan hade felkonfigurerats för att tillåta internetåtkomst och bekräftade att incidenten inte involverade särskilt avancerade cybertekniker.

Företaget säger att det har löst konfigurationsproblemet och inte har några kvarstående problem relaterade till det.

Irregular förbereder också en vitbok som kommer att beskriva säkrare inneslutningsmetoder för framtida AI-cybersäkerhetsutvärderingar.

Incidenten följer på flera liknande fall som involverar autonoma AI-agenter. Hugging Face drabbades av ett intrång efter att OpenAI-agenter rymt från en testmiljö.

Kort därefter hackade Claude tre organisationer och publicerade skadlig kod. Nyligen visade tester att OpenAI- och Anthropic-agenter riktade sig mot verkliga människor under cybersäkerhetsutvärderingar.

Inneslutning av AI blir ett större säkerhetsproblem

Incidenter belyser ett växande problem för företag som testar autonoma AI-agenter. Om inneslutningssystemen misslyckas kan modeller interagera med verklig infrastruktur, tjänster eller människor medan de strävar efter sina tilldelade mål.

Utvecklare behöver skyddsåtgärder som begränsar vad AI-agenter kan göra även när de stöter på oväntad åtkomst. Utvärderingsföretag behöver också strikt nätverksisolering, övervakning, åtkomstkontroller och tydligt definierade driftgränser.

Microsoft har också tagit upp frågan genom att publicera ny vägledning för att innesluta AI-agenter, med betoning på den växande vikten av att begränsa autonoma system innan de kan påverka verkliga miljöer.

Läsare hjälper till att stödja Windows Report. När du gör ett köp genom att använda länkar på vår webbplats, kan vi tjäna en affiliate provision. Tooltip Icon

Läs sidan för affiliate avslöjande för att ta reda på hur du kan hjälpa Windows Report utan ansträngning och utan att spendera några pengar. Read more

User forum

0 messages