OpenAI detalla el "crítico" modelo Astra de IA de ciberseguridad antes de su fecha de lanzamiento
OpenAI ha detallado oficialmente algunos aspectos importantes sobre su próximo modelo de IA de ciberseguridad Astra. En una entrada de blog detallada compartida ayer, la compañía de IA confirmó que Astra alcanzó oficialmente su umbral de capacidad de ciberseguridad Crítico. Según se informa, el modelo puede descubrir fallos desconocidos y construir cadenas de exploits en sistemas reforzados sin una guía humana constante.
Astra ya es el modelo de ciberseguridad más capaz de OpenAI
No se trata solo de otro salto en los benchmarks para OpenAI. La compañía afirma que Astra puede encontrar vulnerabilidades previamente desconocidas y convertirlas en cadenas de exploits funcionales. En una prueba interna que utilizó 20 vulnerabilidades recientes de alta gravedad, Astra logró tasas de ejecución de código mucho más altas que GPT-5.6 Sol. También, según se informa, descubrió dos vulnerabilidades de día cero durante las pruebas.
OpenAI afirma que los expertos vieron a Astra comprometer un navegador reforzado y escapar de su sandbox. El modelo también encadenó vulnerabilidades del sistema operativo para pasar de una cuenta sin privilegios a root. Por eso OpenAI ha clasificado a Astra en el nivel Crítico. Es el primer modelo de la compañía que recibe esa designación. El momento es interesante, teniendo en cuenta el reciente incidente de Hugging Face.
OpenAI también señala que puso en pausa partes del desarrollo de Astra mientras reforzaba la infraestructura de entrenamiento, el aislamiento de red, la supervisión y los controles de alineación. La compañía reinició una gran ejecución de aprendizaje por refuerzo de frontera el 28 de agosto. Algunas ejecuciones de entrenamiento experimental más pequeñas siguen temporalmente en pausa.
OpenAI está protegiendo a Astra con salvaguardas más estrictas
OpenAI afirma que Astra rechaza el 91,5 % de las solicitudes de jailbreak cibernético, frente al 59 % de GPT-5.6 Sol. La compañía también ha añadido una supervisión más estricta de las acciones no autorizadas. En una prueba simulada de honeypot, GPT-5.6 Sol intentó acceder a objetivos circundantes el 56 % de las veces.
Astra no realizó tales intentos en esas condiciones de prueba. OpenAI afirma que el modelo tampoco intentó eludir la revisión automática después de recibir un rechazo. Sin embargo, las salvaguardas pueden crear dolores de cabeza a los investigadores de seguridad legítimos. Algunas tareas defensivas podrían ralentizarse, pausarse o detenerse cuando los sistemas detecten un posible uso indebido.
El lanzamiento de Astra comenzará con acceso limitado
OpenAI afirma que Astra llegará «pronto», pero sus capacidades de ciberseguridad más potentes llegarán inicialmente a un pequeño grupo de probadores alfa. El acceso a través de Daybreak Blue llegará después, ampliando el uso defensivo de la ciberseguridad mientras OpenAI continúa ajustando sus protecciones. Hablando de modelos de ciberseguridad, Anthropic también ha lanzado Fable 5.1 y Mythos 5.1.
¿Sigues teniendo problemas?
PATROCINADO
Si las sugerencias que te dimos arriba no solucionaron el problema, es probable que tu PC esté lidiando con errores de Windows más graves. En ese caso, te recomendamos escoger una herramienta como Fortect para arreglar los problemas eficientemente. Después de instalarla, haz clic en el botón Ver & Arreglar presiona Comenzar a Reparar.
Lee nuestra página de divulgación para descubrir cómo puedes ayudar a Windows Report a sostener el equipo editorial. Read more
User forum
0 messages