Meta bekrefter at deres AI-modell brøt seg inn i en ekte organisasjon under testing


Meta har bekreftet at en av deres KI-modeller kompromitterte en reell tredjepartsorganisasjon under en cybersikkerhetsevaluering etter at et testmiljø utilsiktet ga modellen tilgang til det offentlige internettet.

Information identifiserte modellen som Muse Spark 1.1, selv om Meta ikke offentlig har bekreftet identiteten. Den berørte organisasjonen er heller ikke navngitt.

Ifølge rapporten fikk KI-en tilgang til organisasjonens systemer og gjorde endringer etter å ha utnyttet en sårbarhet i en tredjepartstjeneste.

Feilkonfigurering av sandkasse tillot internettilgang

Meta sa at en konfigurasjonsfeil forårsaket hendelsen i et testmiljø drevet sammen med cybersikkerhetsevalueringsselskapet Irregular.

Miljøet skulle ha isolert KI-modellen fra det offentlige internettet. I stedet tillot den feilaktige konfigurasjonen modellen å nå eksterne tjenester.

Da den først fikk internettilgang, fant og utnyttet modellen en sårbarhet som påvirket en tredjepartstjeneste.

Meta sier at de fortsetter å undersøke hendelsen og planlegger å frigi ytterligere informasjon etter å ha fullført gjennomgangen sin.

Irregular sier at angrepet ikke var sofistikert

Irregular sa at sandkassen hadde blitt feilkonfigurert for å tillate internettilgang og bekreftet at hendelsen ikke involverte spesielt avanserte cyberteknikker.

Selskapet sier at det har løst konfigurasjonsproblemet og har ingen utestående problemer knyttet til det.

Irregular forbereder også en hvitbok som vil beskrive sikrere innkapslingspraksiser for fremtidige KI-cybersikkerhetsevalueringer.

Hendelsen følger flere lignende tilfeller som involverer autonome KI-agenter. Hugging Face ble kompromittert etter at OpenAI-agenter rømte fra et testmiljø.

Kort tid etter hacket Claude angivelig tre organisasjoner og publiserte ondsinnet kode. Mer nylig viste tester at OpenAI- og Anthropic-agenter rettet seg mot virkelige personer under cybersikkerhetsevalueringer.

Inneslutning av KI blir et større sikkerhetsproblem

Hendelsene understreker et voksende problem for selskaper som tester autonome KI-agenter. Hvis innkapslingssystemer svikter, kan modeller samhandle med reell infrastruktur, tjenester eller mennesker mens de forfølger sine tildelte mål.

Utviklere trenger sikkerhetstiltak som begrenser hva KI-agenter kan gjøre selv når de møter uventet tilgang. Evalueringsselskaper trenger også streng nettverksisolering, overvåking, tilgangskontroller og klart definerte operasjonsgrenser.

Microsoft har også tatt tak i problemet ved å publisere ny veiledning for inneslutning av KI-agenter, og understreker den økende viktigheten av å begrense autonome systemer før de kan påvirke virkelige miljøer.

Lesere hjelper til med å støtte Windows Report. Når du gjør et kjøp ved å bruke linker på nettstedet vårt, kan vi tjene en affiliate-kommisjon. Tooltip Icon

Les siden for affiliate-avsløring for å finne ut hvordan du kan hjelpe Windows Report uten anstrengelse og uten å bruke penger. Read more

User forum

0 messages