OpenAI detalha modelo de IA de cibersegurança Astra “crítico” antes da data de lançamento


A OpenAI delineou oficialmente alguns detalhes importantes sobre o seu próximo modelo de IA para cibersegurança, o Astra. Em um artigo detalhado publicado ontem, a empresa de IA confirmou que o Astra atingiu oficialmente o limiar Critical de capacidade de cibersegurança. O modelo consegue, alegadamente, descobrir falhas desconhecidas e construir cadeias de exploração em sistemas reforçados sem orientação humana constante.

Astra é agora o modelo de cibersegurança mais capaz da OpenAI

Este não é apenas mais um salto de benchmark para a OpenAI. A empresa afirma que o Astra consegue encontrar vulnerabilidades anteriormente desconhecidas e transformá-las em cadeias de exploração funcionais. Em um teste interno com 20 vulnerabilidades recentes de alta gravidade, o Astra alcançou taxas de execução de código muito mais altas do que o GPT-5.6 Sol. Ele também descobriu, segundo relatos, duas vulnerabilidades de dia zero durante os testes.

A OpenAI afirma que especialistas viram o Astra comprometer um navegador reforçado e escapar da sandbox. O modelo também encadeou vulnerabilidades do sistema operacional para passar de uma conta sem privilégios para root. É por isso que a OpenAI classificou o Astra no nível Critical. É o primeiro modelo da empresa a receber essa designação. O timing é interessante, considerando o recente incidente da Hugging Face.

A OpenAI observa ainda que pausou partes do desenvolvimento do Astra enquanto reforçava a infraestrutura de treinamento, o isolamento de rede, o monitoramento e os controles de alinhamento. A empresa reiniciou uma grande execução de aprendizado por reforço de fronteira em 28 de agosto. Algumas execuções menores de treinamento experimental permanecem temporariamente pausadas.

OpenAI está colocando o Astra atrás de salvaguardas mais fortes

A OpenAI afirma que o Astra recusa 91,5% dos pedidos de jailbreak cibernético, contra 59% do GPT-5.6 Sol. A empresa também adicionou monitoramento mais rigoroso para ações não autorizadas. Em um teste simulado de honeypot, o GPT-5.6 Sol tentou acessar alvos ao redor em 56% das vezes.

O Astra não fez nenhuma tentativa desse tipo nessas condições de teste. A OpenAI afirma que o modelo também nunca tentou contornar a revisão automática após receber uma rejeição. No entanto, as salvaguardas podem gerar dores de cabeça para pesquisadores de segurança legítimos. Algumas tarefas defensivas podem ser desaceleradas, pausadas ou interrompidas quando os sistemas detectam possível uso indevido.

O lançamento do Astra começará com acesso limitado

A OpenAI afirma que o Astra chega “em breve”, mas suas capacidades de cibersegurança mais fortes chegarão inicialmente a um pequeno grupo de testadores alfa. O acesso através do Daybreak Blue virá a seguir, expandindo o uso defensivo da cibersegurança enquanto a OpenAI continua ajustando suas proteções. Falando em modelos de cibersegurança, a Anthropic também lançou o Fable 5.1 e o Mythos 5.1.

Os leitores ajudam a apoiar o Windows Report. Podemos receber uma comissão se você comprar através dos nossos links. Tooltip Icon

Leia a nossa página de divulgação para descobrir como pode ajudar o Windows Report a sustentar a equipe editorial. Read more

User forum

0 messages