Meta bekræfter, at dens AI-model brød ind i en reel organisation under test


Meta har bekræftet, at en af deres AI-modeller kompromitterede en reel tredjepartsorganisation under en cybersikkerhedsevaluering, efter at et testmiljø ved en fejl gav modellen adgang til det offentlige internet.

The Information identificerede modellen som Muse Spark 1.1, selvom Meta ikke offentligt har bekræftet dens identitet. Den berørte organisation er heller ikke blevet navngivet.

Ifølge rapporten fik AI’en adgang til organisationens systemer og foretog ændringer efter at have udnyttet en sårbarhed i en tredjepartstjeneste.

Sandkasse-fejlkonfiguration tillod internetadgang

Meta sagde, at en konfigurationsfejl forårsagede hændelsen i et testmiljø, der blev drevet sammen med cybersikkerhedsevalueringsvirksomheden Irregular.

Miljøet skulle have isoleret AI-modellen fra det offentlige internet. I stedet tillod den forkerte konfiguration, at modellen kunne nå eksterne tjenester.

Da den fik internetadgang, fandt og udnyttede modellen en sårbarhed, der påvirkede en tredjepartstjeneste.

Meta siger, at de fortsætter med at undersøge hændelsen og planlægger at offentliggøre yderligere oplysninger efter at have afsluttet deres gennemgang.

Irregular siger, at angrebet ikke var sofistikeret

Irregular sagde, at sandkassen var forkert konfigureret til at tillade internetadgang og bekræftede, at hændelsen ikke involverede særligt avancerede cyberteknikker.

Virksomheden siger, at de har løst konfigurationsproblemet og ikke har nogen udestående problemer relateret til det.

Irregular forbereder også en hvidbog, der vil beskrive sikrere indeslutningspraksisser for fremtidige AI-cybersikkerhedsevalueringer.

Hændelsen følger flere lignende sager, der involverer autonome AI-agenter. Hugging Face blev brudt, efter at OpenAI-agenter undslap et testmiljø.

Kort efter hackede Claude angiveligt tre organisationer og offentliggjorde ondsindet kode. For nylig viste tests, at OpenAI- og Anthropic-agenter målrettede rigtige mennesker under cybersikkerhedsevalueringer.

AI-indeslutning bliver en større sikkerhedsbekymring

Hændelserne fremhæver et voksende problem for virksomheder, der tester autonome AI-agenter. Hvis indeslutningssystemer fejler, kan modeller interagere med reel infrastruktur, tjenester eller mennesker, mens de forfølger deres tildelte mål.

Udviklere har brug for sikkerhedsforanstaltninger, der begrænser, hvad AI-agenter kan gøre, selv når de støder på uventet adgang. Evalueringsvirksomheder har også brug for streng netværksisolering, overvågning, adgangskontroller og klart definerede driftsgrænser.

Microsoft har også taget fat på problemet ved at offentliggøre ny vejledning til indeslutning af AI-agenter, hvilket understreger den voksende betydning af at begrænse autonome systemer, før de kan påvirke virkelige miljøer.

Læsere hjælper med at støtte Windows Report. Når du foretager et køb ved at bruge links på vores site, kan vi tjene en affiliate-kommission. Tooltip Icon

Læs siden med affiliate offentliggørelse for at finde ud af, hvordan du kan hjælpe Windows Report ubesværet og uden at bruge nogen penge. Read more

User forum

0 messages