OpenAI fornisce dettagli sul modello di intelligenza artificiale per la cybersecurity "critico" Astra in vista della data di rilascio


OpenAI ha delineato ufficialmente alcuni dettagli importanti sul suo prossimo modello AI per la cybersecurity, Astra. In un dettagliato post sul blog condiviso ieri, l’azienda di AI ha confermato che Astra ha ufficialmente raggiunto la soglia Critical di capacità di cybersecurity. Secondo quanto riferito, il modello è in grado di scoprire vulnerabilità sconosciute e costruire catene di exploit su sistemi rafforzati senza una costante guida umana.

Astra è ora il modello cyber più capace di OpenAI

Non si tratta solo dell’ennesimo salto nei benchmark per OpenAI. L’azienda afferma che Astra è in grado di trovare vulnerabilità precedentemente sconosciute e trasformarle in catene di exploit funzionanti. In un test interno che utilizzava 20 vulnerabilità recenti ad alta gravità, Astra ha ottenuto tassi di esecuzione del codice molto più elevati rispetto a GPT-5.6 Sol. Sempre secondo quanto riferito, durante i test ha anche scoperto due vulnerabilità zero-day.

OpenAI afferma che gli esperti hanno visto Astra compromettere un browser rafforzato e uscire dalla sua sandbox. Il modello ha inoltre concatenato vulnerabilità del sistema operativo per passare da un account senza privilegi all’accesso root. È per questo che OpenAI ha classificato Astra al livello Critical. È il primo modello dell’azienda a ricevere questa designazione. La tempistica è interessante, considerato il recente incidente di Hugging Face.

OpenAI sottolinea inoltre di aver sospeso parti dello sviluppo di Astra mentre rafforzava l’infrastruttura di addestramento, l’isolamento di rete, il monitoraggio e i controlli di allineamento. L’azienda ha riavviato una grande fase di apprendimento per rinforzo frontier il 28 agosto. Alcune fasi di addestramento sperimentali più piccole rimangono temporaneamente sospese.

OpenAI sta proteggendo Astra con salvaguardie più rigorose

OpenAI afferma che Astra rifiuta il 91,5% delle richieste di jailbreak cyber, contro il 59% di GPT-5.6 Sol. L’azienda ha inoltre introdotto un monitoraggio più rigoroso delle azioni non autorizzate. In un test simulato con honeypot, GPT-5.6 Sol ha tentato di accedere ai bersagli circostanti il 56% delle volte.

Astra non ha compiuto alcun tentativo del genere in quelle condizioni di test. OpenAI afferma che il modello non ha mai nemmeno tentato di aggirare la revisione automatica dopo aver ricevuto un rifiuto. Tuttavia, le salvaguardie potrebbero creare difficoltà ai legittimi ricercatori di sicurezza. Alcune attività difensive potrebbero essere rallentate, sospese o interrotte quando i sistemi rilevano un possibile uso improprio.

Il rilascio di Astra inizierà con un accesso limitato

OpenAI afferma che Astra è «in arrivo», ma le sue funzionalità di cybersecurity più potenti raggiungeranno inizialmente un piccolo gruppo di alpha tester. Seguirà l’accesso tramite Daybreak Blue, ampliando l’uso della cybersecurity a scopo difensivo mentre OpenAI continua a perfezionare le proprie protezioni. A proposito di modelli di cybersecurity, Anthropic ha lanciato anche Fable 5.1 e Mythos 5.1.

I lettori aiutano a sostenere Windows Report. Potremmo ricevere una commissione se acquisti tramite i nostri link. Tooltip Icon

Leggi la nostra pagina informativa per scoprire come puoi aiutare Windows Report a sostenere il team editoriale. Read more

User forum

0 messages