OpenAIは、リリース日を前に「重要」なサイバーセキュリティAIモデル「Astra」の詳細を明らかにしました
OpenAIは、同社が近日発表予定のサイバーセキュリティ向けAIモデル「Astra」について、いくつかの重要な詳細を正式に明らかにした。昨日公開された詳細なブログ記事で、同社はAstraがサイバーセキュリティ能力における「Critical」基準に正式に到達したことを確認した。このモデルは、人間による継続的な指示なしに未知の脆弱性を発見し、堅牢化されたシステム上でエクスプロイトチェーンを構築できると報じられている。
AstraはOpenAIで最も有能なサイバーモデルに
これはOpenAIにとって単なるベンチマークの向上ではない。同社によると、Astraはこれまで知られていなかった脆弱性を発見し、それを実際に機能するエクスプロイトチェーンに変えることができる。最近の重大度の高い脆弱性20件を使用した内部テストでは、AstraはGPT-5.6 Solよりもはるかに高いコード実行率を達成した。また、テスト中に2件のゼロデイ脆弱性を発見したとも報じられている。
OpenAIによると、専門家はAstraが堅牢化されたブラウザーを侵害し、そのサンドボックスから脱出するのを確認した。このモデルは、OSの脆弱性を連鎖させて、特権のないアカウントからrootへ昇格することも行った。そのためOpenAIはAstraを「Critical」レベルに分類した。同社のモデルでこの指定を受けるのは初めてだ。最近のHugging Faceのインシデントを考慮すると、このタイミングは興味深い。
OpenAIはさらに、トレーニングインフラ、ネットワーク分離、監視、アラインメント制御を強化する間、Astraの開発の一部を一時停止したと述べている。同社は8月28日に大規模なフロンティア強化学習の実行を再開した。一部の小規模な実験的トレーニングの実行は、引き続き一時的に停止されている。
OpenAIはAstraをより厳重な保護策の下に置く
OpenAIによると、Astraはサイバージェイルブレイク要求の91.5%を拒否し、GPT-5.6 Solの59%を上回る。同社はまた、不正なアクションに対する監視も強化した。あるシミュレーションのハニーポットテストでは、GPT-5.6 Solは周囲の標的へのアクセスを56%の割合で試みた。
Astraはそのテスト条件下ではそのような試みを一切行わなかった。OpenAIによると、このモデルは拒否を受けた後に自動レビューを回避しようとしたことも一度もなかった。ただし、こうした保護策は正当なセキュリティ研究者にとって頭痛の種になる可能性がある。システムが悪用の可能性を検知すると、一部の防御タスクが遅延、一時停止、または停止される可能性がある。
Astraのリリースは限定的なアクセスから始まる
OpenAIによると、Astraは「近日公開」だが、その最も強力なサイバーセキュリティ能力は当初、少数のアルファテスターに提供される予定だ。その後、Daybreak Blueを通じたアクセスが続き、OpenAIが保護策の調整を続ける中で、防御的なサイバーセキュリティ用途が拡大される。サイバーセキュリティモデルといえば、AnthropicもFable 5.1とMythos 5.1を発表している。
情報開示ページをご覧いただき、Windows Report の編集チームをどのように支援できるかをご確認ください。 Read more
User forum
0 messages