OpenAI détaille le modèle d'IA de cybersécurité « critique » Astra avant sa date de sortie


OpenAI a officiellement dévoilé quelques détails importants au sujet de son prochain modèle d’IA de cybersécurité Astra. Dans un article de blog détaillé partagé hier, l’entreprise d’IA a confirmé qu’Astra a officiellement atteint son seuil critique de capacité en cybersécurité. Le modèle serait capable de découvrir des failles inconnues et de construire des chaînes d’exploits sur des systèmes durcis sans supervision humaine constante.

tipVous rencontrez toujours des problèmes? Corrigez-les avec cet outil:
Ce logiciel réparera les erreurs informatiques courantes, vous protégera contre la perte de fichiers, les logiciels malveillants et les pannes matérielles tout en optimisant les performances de votre PC. Réparez votre PC et supprimez les virus instantanément en 3 étapes faciles:
  1. Téléchargez l'outil Fortect
  2. Cliquez sur Analyser pour dépister les erreurs de votre PC.
  3. Cliquez sur Réparer pour résoudre les erreurs de sécurité et des performances du PC.
  • 0 utilisateurs ont téléchargé Fortect ce mois-ci.

Astra est désormais le modèle de cybersécurité le plus performant d’OpenAI

Il ne s’agit pas d’un simple bond dans les benchmarks pour OpenAI. L’entreprise affirme qu’Astra peut découvrir des vulnérabilités jusqu’alors inconnues et les transformer en chaînes d’exploits fonctionnelles. Lors d’un test interne reposant sur 20 vulnérabilités récentes de gravité élevée, Astra a atteint des taux d’exécution de code bien supérieurs à ceux de GPT-5.6 Sol. Il aurait également découvert deux vulnérabilités zero-day au cours des tests.

OpenAI indique que des experts ont vu Astra compromettre un navigateur durci et s’échapper de son bac à sable. Le modèle a également enchaîné des vulnérabilités du système d’exploitation pour passer d’un compte sans privilèges à un compte root. C’est la raison pour laquelle OpenAI a classé Astra au niveau Critique. C’est le premier modèle de l’entreprise à recevoir cette désignation. Le moment est intéressant, compte tenu du récent incident chez Hugging Face.

OpenAI note également avoir mis en pause certaines parties du développement d’Astra le temps de renforcer l’infrastructure d’entraînement, l’isolation du réseau, la supervision et les contrôles d’alignement. L’entreprise a relancé une grande session d’apprentissage par renforcement « frontier » le 28 août. Certaines sessions d’entraînement expérimentales plus modestes restent temporairement suspendues.

OpenAI place Astra derrière des garde-fous renforcés

OpenAI indique qu’Astra refuse 91,5 % des requêtes de jailbreak cyber, contre 59 % pour GPT-5.6 Sol. L’entreprise a également renforcé la surveillance des actions non autorisées. Lors d’un test simulé reposant sur un pot de miel, GPT-5.6 Sol a tenté d’accéder aux cibles environnantes 56 % du temps.

Astra n’a effectué aucune tentative de ce type dans ces conditions de test. OpenAI indique que le modèle n’a également jamais tenté de contourner l’examen automatique après avoir reçu un refus. Ces protections pourraient toutefois compliquer la tâche des chercheurs en sécurité légitimes. Certaines tâches défensives pourraient être ralenties, suspendues ou arrêtées lorsque les systèmes détectent un possible usage abusif.

Le lancement d’Astra commencera par un accès limité

OpenAI indique qu’Astra arrive « bientôt », mais ses capacités de cybersécurité les plus avancées seront d’abord réservées à un petit groupe de testeurs alpha. Un accès via Daybreak Blue suivra, afin d’étendre l’usage défensif en cybersécurité pendant qu’OpenAI continue d’ajuster ses protections. En parlant de modèles de cybersécurité, Anthropic a également lancé Fable 5.1 et Mythos 5.1.

Les lecteurs aident à soutenir Windows Report. Nous pouvons percevoir une commission si vous achetez via nos liens. Tooltip Icon

Consultez notre page de divulgation pour découvrir comment vous pouvez aider Windows Report à soutenir l'équipe éditoriale. Read more

User forum

0 messages