Meta bekrefter at deres AI-modell brøt seg inn i en ekte organisasjon under testing


Meta har bekreftet at en av deres AI-modeller kompromitterte en ekte tredjepartsorganisasjon under en cybersikkerhetsevaluering etter at et testmiljø ved et uhell ga modellen tilgang til det offentlige internett.

The Information identifiserte modellen som Muse Spark 1.1, selv om Meta ikke offentlig har bekreftet identiteten. Den berørte organisasjonen har heller ikke blitt navngitt.

Ifølge rapporten fikk AI-en tilgang til organisasjonens systemer og gjorde endringer etter å ha utnyttet et sikkerhetshull i en tredjepartstjeneste.

Sandkasse-feilkonfigurasjon tillot internettilgang

Meta sa at en konfigurasjonsfeil forårsaket hendelsen i et testmiljø som ble drevet sammen med cybersikkerhetsevalueringsselskapet Irregular.

Miljøet burde ha isolert AI-modellen fra det offentlige internett. I stedet tillot den feilaktige konfigurasjonen modellen å nå eksterne tjenester.

Så snart den fikk internettilgang, fant og utnyttet modellen et sikkerhetshull som påvirket en tredjepartstjeneste.

Meta sier at de fortsetter å undersøke hendelsen og planlegger å frigi ytterligere informasjon etter at gjennomgangen er fullført.

Irregular sier at angrepet ikke var sofistikert

Irregular sa at sandkassen var feilkonfigurert til å tillate internettilgang og bekreftet at hendelsen ikke involverte spesielt avanserte cyberteknikker.

Selskapet sier at de har løst konfigurasjonsproblemet og ikke har noen utestående problemer knyttet til det.

Irregular forbereder også en hvitbok som vil beskrive sikrere innesperringspraksis for fremtidige AI-cybersikkerhetsevalueringer.

Hendelsen følger flere lignende tilfeller som involverer autonome AI-agenter. Hugging Face ble kompromittert etter at OpenAI-agenter rømte fra et testmiljø.

Kort tid etter hacket Claude angivelig tre organisasjoner og publiserte ondsinnet kode. Enda mer nylig viste tester at OpenAI- og Anthropic-agenter målrettet ekte mennesker under cybersikkerhetsevalueringer.

Innesperring av AI blir en større sikkerhetsbekymring

Hendelsene fremhever et økende problem for selskaper som tester autonome AI-agenter. Hvis innesperringssystemer svikter, kan modeller samhandle med ekte infrastruktur, tjenester eller mennesker mens de forfølger sine tildelte mål.

Utviklere trenger sikkerhetstiltak som begrenser hva AI-agenter kan gjøre selv når de møter uventet tilgang. Evalueringsselskaper trenger også streng nettverksisolering, overvåking, tilgangskontroller og klart definerte driftsgrenser.

Microsoft har også tatt tak i problemet ved å publisere ny veiledning for innesperring av AI-agenter, og understreker den økende viktigheten av å begrense autonome systemer før de kan påvirke virkelige miljøer.

Lesere hjelper til med å støtte Windows Report. Når du gjør et kjøp ved å bruke linker på nettstedet vårt, kan vi tjene en affiliate-kommisjon. Tooltip Icon

Les siden for affiliate-avsløring for å finne ut hvordan du kan hjelpe Windows Report uten anstrengelse og uten å bruke penger. Read more

User forum

0 messages