OpenAI détaille le modèle d’IA de cybersécurité « critique » Astra avant sa date de sortie
OpenAI a officiellement présenté quelques détails importants concernant Astra, son prochain modèle d’IA de cybersécurité. Dans un billet de blog détaillé publié hier, l’entreprise d’IA a confirmé qu’Astra avait officiellement atteint le seuil Critical de capacité en cybersécurité. Le modèle serait capable de découvrir des failles inconnues et de construire des chaînes d’exploitation sur des systèmes renforcés sans intervention humaine constante.
Astra est désormais le modèle cyber le plus performant d’OpenAI
Il ne s’agit pas seulement d’un nouveau bond dans les benchmarks pour OpenAI. L’entreprise affirme qu’Astra peut trouver des vulnérabilités jusqu’alors inconnues et les transformer en chaînes d’exploitation fonctionnelles. Lors d’un test interne portant sur 20 vulnérabilités récentes de gravité élevée, Astra a atteint des taux d’exécution de code bien plus élevés que GPT-5.6 Sol. Il aurait également découvert deux vulnérabilités zero-day pendant les tests.
OpenAI indique que des experts ont vu Astra compromettre un navigateur renforcé et s’échapper de son bac à sable. Le modèle a également enchaîné des vulnérabilités du système d’exploitation pour passer d’un compte sans privilèges au compte root. C’est pourquoi OpenAI a classé Astra au niveau Critical. C’est le premier modèle de l’entreprise à recevoir cette désignation. Le moment choisi est intéressant, compte tenu du récent incident Hugging Face.
OpenAI précise en outre avoir mis en pause certaines parties du développement d’Astra afin de renforcer l’infrastructure d’entraînement, l’isolation réseau, la surveillance et les contrôles d’alignement. L’entreprise a relancé le 28 août une vaste session d’apprentissage par renforcement de pointe. Certaines sessions d’entraînement expérimentales plus modestes restent temporairement suspendues.
OpenAI place Astra derrière des garde-fous renforcés
OpenAI indique qu’Astra refuse 91,5 % des demandes de jailbreak en cybersécurité, contre 59 % pour GPT-5.6 Sol. L’entreprise a également renforcé la surveillance des actions non autorisées. Lors d’un test de pot de miel simulé, GPT-5.6 Sol a tenté d’accéder aux cibles environnantes 56 % du temps.
Astra n’a fait aucune tentative de ce type dans ces conditions de test. OpenAI indique que le modèle n’a jamais non plus tenté de contourner la revue automatique après avoir reçu un rejet. Toutefois, ces garde-fous pourraient compliquer la tâche des chercheurs en sécurité légitimes. Certaines tâches défensives pourraient être ralenties, mises en pause ou arrêtées lorsque les systèmes détectent un possible usage abusif.
Le lancement d’Astra commencera par un accès limité
OpenAI indique qu’Astra arrive « bientôt », mais ses capacités de cybersécurité les plus avancées seront d’abord accessibles à un petit groupe de testeurs alpha. L’accès via Daybreak Blue suivra, élargissant l’usage défensif en cybersécurité pendant qu’OpenAI continue d’ajuster ses protections. En parlant de modèles de cybersécurité, Anthropic a également lancé Fable 5.1 et Mythos 5.1.
Consultez notre page de divulgation pour découvrir comment vous pouvez aider Windows Report à soutenir l'équipe éditoriale. Read more
Vous rencontrez toujours des problèmes? Corrigez-les avec cet outil:
User forum
0 messages