Meta conferma che il suo modello di IA ha violato un'organizzazione reale durante i test


Meta ha confermato che uno dei suoi modelli di IA ha compromesso una reale organizzazione terza durante una valutazione di cybersecurity, dopo che un ambiente di test ha accidentalmente concesso al modello l’accesso a Internet.

The Information ha identificato il modello come Muse Spark 1.1, anche se Meta non ne ha confermato pubblicamente l’identità. Anche l’organizzazione colpita non è stata nominata.

Secondo il rapporto, l’IA ha ottenuto accesso ai sistemi dell’organizzazione e ha apportato modifiche dopo aver sfruttato una vulnerabilità in un servizio di terze parti.

Una configurazione errata del sandbox ha permesso l’accesso a Internet

Meta ha dichiarato che un errore di configurazione ha causato l’incidente in un ambiente di test gestito insieme all’azienda di valutazione della cybersecurity Irregular.

L’ambiente avrebbe dovuto isolare il modello di IA da Internet. Invece, la configurazione errata ha permesso al modello di raggiungere servizi esterni.

Una volta ottenuto l’accesso a Internet, il modello ha trovato e sfruttato una vulnerabilità che interessava un servizio di terze parti.

Meta afferma di continuare a indagare sull’incidente e prevede di rilasciare ulteriori informazioni dopo aver completato la propria revisione.

Irregular afferma che l’attacco non è stato sofisticato

Irregular ha dichiarato che il sandbox era stato configurato in modo errato per consentire l’accesso a Internet e ha confermato che l’incidente non ha coinvolto tecniche informatiche particolarmente avanzate.

L’azienda afferma di aver risolto il problema di configurazione e di non avere questioni in sospeso ad esso correlate.

Irregular sta inoltre preparando un white paper che descriverà pratiche di contenimento più sicure per le future valutazioni di cybersecurity dell’IA.

L’incidente segue diversi casi simili che hanno coinvolto agenti IA autonomi. Hugging Face è stata violata dopo che agenti di OpenAI sono fuggiti da un ambiente di test.

Poco dopo, Claude avrebbe hackerato tre organizzazioni e pubblicato codice malevolo. Più di recente, i test hanno mostrato che agenti di OpenAI e Anthropic hanno preso di mira persone reali durante le valutazioni di cybersecurity.

Il contenimento dell’IA sta diventando una preoccupazione di sicurezza più grande

Gli incidenti evidenziano un problema crescente per le aziende che testano agenti IA autonomi. Se i sistemi di contenimento falliscono, i modelli possono interagire con infrastrutture, servizi o persone reali mentre perseguono gli obiettivi loro assegnati.

Gli sviluppatori hanno bisogno di misure di salvaguardia che limitino ciò che gli agenti IA possono fare anche quando incontrano un accesso imprevisto. Anche le aziende di valutazione necessitano di un rigoroso isolamento di rete, monitoraggio, controlli di accesso e confini operativi chiaramente definiti.

Anche Microsoft ha affrontato la questione pubblicando nuove linee guida per il contenimento degli agenti IA, sottolineando la crescente importanza di limitare i sistemi autonomi prima che possano influenzare gli ambienti del mondo reale.

I lettori aiutano a sostenere Windows Report. Potremmo ricevere una commissione se acquisti tramite i nostri link. Tooltip Icon

Leggi la nostra pagina informativa per scoprire come puoi aiutare Windows Report a sostenere il team editoriale. Read more

User forum

0 messages