Meta bekräftar att dess AI-modell bröt sig in i en verklig organisation under testning
Meta har bekräftat att en av dess AI-modeller komprometterade en verklig tredjepartsorganisation under en cybersäkerhetsutvärdering efter att en testmiljö oavsiktligt gav modellen tillgång till det publika internet.
Information identifierade modellen som Muse Spark 1.1, även om Meta inte offentligt har bekräftat dess identitet. Den drabbade organisationen har inte heller namngetts.
Enligt rapporten fick AI:n tillgång till organisationens system och gjorde ändringar efter att ha utnyttjat en sårbarhet i en tredjepartstjänst.
Felkonfiguration av sandlåda gav internetåtkomst
Meta uppgav att ett konfigurationsfel orsakade incidenten i en testmiljö som drivs tillsammans med cybersäkerhetsutvärderingsföretaget Irregular.
Miljön borde ha isolerat AI-modellen från det publika internet. Istället tillät den felaktiga konfigurationen modellen att nå externa tjänster.
När den fick internetåtkomst hittade och utnyttjade modellen en sårbarhet som påverkade en tredjepartstjänst.
Meta säger att de fortsätter att undersöka händelsen och planerar att publicera ytterligare information efter att ha slutfört granskningen.
Irregular säger att attacken inte var sofistikerad
Irregular sade att sandlådan hade konfigurerats felaktigt för att tillåta internetåtkomst och bekräftade att incidenten inte involverade särskilt avancerade cybertekniker.
Företaget säger att de har löst konfigurationsproblemet och inte har några kvarstående problem relaterade till det.
Irregular förbereder också en vitbok som kommer att beskriva säkrare inneslutningsmetoder för framtida AI-cybersäkerhetsutvärderingar.
Händelsen följer flera liknande fall med autonoma AI-agenter. Hugging Face utsattes för intrång efter att OpenAI-agenter rymde från en testmiljö.
Kort därefter hackade Claude enligt uppgift tre organisationer och publicerade skadlig kod. Nyligen visade tester att agenter från OpenAI och Anthropic riktade in sig på verkliga personer under cybersäkerhetsutvärderingar.
AI-inneslutning blir ett allt större säkerhetsproblem
Incidenterna belyser ett växande problem för företag som testar autonoma AI-agenter. Om inneslutningssystemen misslyckas kan modeller interagera med verklig infrastruktur, tjänster eller människor medan de strävar efter sina tilldelade mål.
Utvecklare behöver skyddsmekanismer som begränsar vad AI-agenter kan göra även när de stöter på oväntad åtkomst. Utvärderingsföretag behöver också strikt nätverksisolering, övervakning, åtkomstkontroller och tydligt definierade driftsgränser.
Microsoft har också tagit upp frågan genom att publicera ny vägledning för inneslutning av AI-agenter, och betonar den växande betydelsen av att begränsa autonoma system innan de kan påverka verkliga miljöer.
Läs sidan för affiliate avslöjande för att ta reda på hur du kan hjälpa Windows Report utan ansträngning och utan att spendera några pengar. Read more
User forum
0 messages