OpenAI fornisce dettagli sul modello AI di cybersecurity Astra, definito “critico”, in vista della data di rilascio
OpenAI ha ufficialmente delineato alcuni dettagli importanti sul suo prossimo modello di IA Astra per la sicurezza informatica. In un dettagliato post sul blog condiviso ieri, l’azienda di IA ha confermato che Astra ha ufficialmente raggiunto la soglia di capacità di sicurezza informatica di livello Critical. Secondo quanto riferito, il modello è in grado di scoprire vulnerabilità sconosciute e costruire catene di exploit su sistemi rafforzati senza una costante guida umana.
Astra è ora il modello di sicurezza informatica più capace di OpenAI
Non si tratta solo dell’ennesimo balzo nei benchmark per OpenAI. L’azienda afferma che Astra è in grado di trovare vulnerabilità precedentemente sconosciute e trasformarle in catene di exploit funzionanti. In un test interno basato su 20 vulnerabilità recenti ad alta gravità, Astra ha ottenuto tassi di esecuzione del codice molto più elevati rispetto a GPT-5.6 Sol. Sempre durante i test, avrebbe inoltre scoperto due vulnerabilità zero-day.
OpenAI afferma che gli esperti hanno visto Astra compromettere un browser rafforzato e uscire dalla sua sandbox. Il modello ha inoltre concatenato vulnerabilità del sistema operativo per passare da un account senza privilegi a root. È per questo che OpenAI ha classificato Astra al livello Critical. È il primo modello dell’azienda a ricevere tale designazione. La tempistica è interessante, considerato il recente incidente di Hugging Face.
OpenAI osserva inoltre di aver sospeso parti dello sviluppo di Astra mentre rafforzava l’infrastruttura di addestramento, l’isolamento di rete, il monitoraggio e i controlli di allineamento. L’azienda ha riavviato il 28 agosto una grande sessione di apprendimento per rinforzo per modelli di frontiera. Alcune sessioni di addestramento sperimentali più piccole restano temporaneamente sospese.
OpenAI sta ponendo Astra dietro salvaguardie più rigorose
OpenAI afferma che Astra rifiuta il 91,5% delle richieste di jailbreak informatico, rispetto al 59% di GPT-5.6 Sol. L’azienda ha inoltre aggiunto un monitoraggio più rigoroso per le azioni non autorizzate. In un test simulato con honeypot, GPT-5.6 Sol ha tentato di accedere ai bersagli circostanti il 56% delle volte.
Astra non ha effettuato alcun tentativo del genere in quelle condizioni di test. OpenAI afferma che il modello non ha mai nemmeno tentato di aggirare la revisione automatica dopo aver ricevuto un rifiuto. Tuttavia, queste salvaguardie potrebbero creare grattacapi ai legittimi ricercatori di sicurezza. Alcune attività difensive potrebbero essere rallentate, sospese o interrotte quando i sistemi rilevano un possibile uso improprio.
Il rilascio di Astra inizierà con un accesso limitato
OpenAI afferma che Astra è «in arrivo», ma le sue capacità di sicurezza informatica più avanzate raggiungeranno inizialmente un piccolo gruppo di alpha tester. Seguirà l’accesso tramite Daybreak Blue, ampliando l’uso difensivo della sicurezza informatica mentre OpenAI continua a perfezionare le sue protezioni. A proposito di modelli di sicurezza informatica, Anthropic ha lanciato anche Fable 5.1 e Mythos 5.1.
Leggi la nostra pagina informativa per scoprire come puoi aiutare Windows Report a sostenere il team editoriale. Read more
User forum
0 messages