OpenAI detalha modelo de IA de cibersegurança Astra “crítico” antes da data de lançamento
A OpenAI revelou oficialmente alguns detalhes importantes sobre o seu próximo modelo de IA de cibersegurança, o Astra. Num artigo de blogue detalhado partilhado ontem, a empresa de IA confirmou que o Astra atingiu oficialmente o seu limiar Crítico de capacidade de cibersegurança. O modelo pode, alegadamente, descobrir falhas desconhecidas e criar cadeias de exploração em sistemas reforçados sem orientação humana constante.
Astra é agora o modelo de cibersegurança mais capaz da OpenAI
Isto não é apenas mais um salto de benchmark para a OpenAI. A empresa afirma que o Astra consegue encontrar vulnerabilidades anteriormente desconhecidas e transformá-las em cadeias de exploração funcionais. Num teste interno com 20 vulnerabilidades recentes de gravidade elevada, o Astra alcançou taxas de execução de código muito superiores às do GPT-5.6 Sol. Também descobriu, alegadamente, duas vulnerabilidades de dia zero durante os testes.
A OpenAI afirma que especialistas viram o Astra comprometer um navegador reforçado e escapar da sua sandbox. O modelo também encadeou vulnerabilidades do sistema operativo para passar de uma conta sem privilégios para root. É por isso que a OpenAI classificou o Astra no nível Crítico. É o primeiro modelo da empresa a receber essa designação. O momento é interessante, tendo em conta o recente incidente com o Hugging Face.
A OpenAI salienta ainda que pausou partes do desenvolvimento do Astra enquanto reforçava a infraestrutura de treino, o isolamento de rede, a monitorização e os controlos de alinhamento. A empresa reiniciou uma grande execução de aprendizagem por reforço de fronteira a 28 de agosto. Algumas execuções de treino experimentais mais pequenas continuam temporariamente pausadas.
OpenAI está a colocar o Astra sob salvaguardas mais rigorosas
A OpenAI afirma que o Astra recusa 91,5% dos pedidos de jailbreak cibernético, em comparação com 59% no caso do GPT-5.6 Sol. A empresa também reforçou a monitorização das ações não autorizadas. Num teste simulado de honeypot, o GPT-5.6 Sol tentou aceder a alvos circundantes em 56% das vezes.
O Astra não fez qualquer tentativa desse tipo nessas condições de teste. A OpenAI afirma que o modelo também nunca tentou contornar a revisão automática depois de receber uma rejeição. No entanto, as salvaguardas podem causar dores de cabeça aos investigadores de segurança legítimos. Algumas tarefas defensivas podem ser abrandadas, pausadas ou interrompidas quando os sistemas detetam uma possível utilização indevida.
O lançamento do Astra começará com acesso limitado
A OpenAI afirma que o Astra chegará “em breve”, mas as suas capacidades de cibersegurança mais fortes chegarão inicialmente a um pequeno grupo de testadores alfa. O acesso através do Daybreak Blue virá a seguir, expandindo a utilização defensiva em cibersegurança enquanto a OpenAI continua a afinar as suas proteções. A propósito dos modelos de cibersegurança, a Anthropic também lançou o Fable 5.1 e o Mythos 5.1.
Leia a nossa página de divulgação para descobrir como pode ajudar o Windows Report a sustentar a equipe editorial. Read more
User forum
0 messages