米国、オープンウェイトAIモデルをサイバーテストから除外と報道


オープンウェイトAIモデルは、高度なシステムが巧妙なサイバー作戦を実行できるかどうかをテストするために設計された、米国政府の新プログラムの対象外となる見込みです。

トランプ政権の顧問らは、Reuters によると、Meta、Google、Nvidia、OpenAI、Anthropic の代表者が出席した8月4日のホワイトハウス会合で、この決定を伝えました。

連邦プログラムはプロプライエタリAIモデルに焦点

この自主的なテスト枠組みは、6月2日の大統領令に基づくもので、連邦政府機関に対し、高度なAIサイバーセキュリティ能力に関する機密ベンチマークを作成するよう指示したものです。

当局は、フロンティアモデルが政府システム、重要インフラ、または民間組織を脅かす可能性のある複雑なサイバー作戦を実行できるかどうかを判断したいと考えています。

以前の協議では、Anthropic の Mythos および Fable モデルや、OpenAI の GPT-5.6 Sol を含む、強力なプロプライエタリシステムをテストするための手配が最終決定されたと報じられています。

しかし、現在の枠組みでは、オープンウェイトモデルは対象外となる見込みです。これらのシステムは、開発者が企業管理のサービスを通じてのみアクセスするのではなく、基盤となるモデルの重みをダウンロード、検査、変更、展開することを可能にします。

オープンウェイトの除外はセキュリティギャップを残す可能性

報じられている除外措置は、連邦政府の評価システムに重大なギャップを生じさせる可能性があります。

オープンウェイトモデルは、個人や組織が元の開発者のインフラストラクチャに依存せずにコピーおよび変更できるため、急速に拡散する可能性があります。開発者は、組み込みの安全策を削除したり、特殊なタスク向けにモデルをファインチューニングしたり、非公開で実行したりすることもできます。

したがって、非常に高性能なオープンウェイトモデルは、プロプライエタリなフロンティアシステムと同じ連邦サイバーセキュリティテストを受けることなく、多数のユーザーに到達する可能性があります。

政府は、この除外がすべてのオープンウェイトリリースを対象とするのか、特定の能力閾値を下回るモデルのみを対象とするのかを明らかにしていません。

Anthropic は最近、高度なAIシステムが深刻なサイバーセキュリティおよび国家安全保障上のリスクを生み出す可能性があると繰り返し警告しているにもかかわらず、オープンウェイトAIモデルの禁止を支持しないと述べました。

プログラムの主要詳細は依然として不明

ホワイトハウスは、どの連邦政府機関がテストプログラムを運営するのか、または機密ベンチマークへのアクセスを管理するのかを特定していません。

当局はまた、評価結果を公表するかどうかについても説明していません。調査結果を機密扱いにすることは、機密性の高いテスト手法を保護するのに役立つ可能性がありますが、研究者や一般市民に、評価中に明らかになった能力に関する情報をほとんど与えないことになります。

政権は、モデルが危険なサイバー能力を示した場合に、企業がどのような結果に直面する可能性があるかを開示していません。プログラムの自主的な性質は、開発者が追加テストを拒否したり、懸念される結果が出た後もモデルのリリースを継続したりできるかどうかについても疑問を投げかけています。

当局は最終的にオープンウェイトシステム向けの別の枠組みを作成する可能性がありますが、そのようなプログラムはまだ発表されていません。

この決定は、政府とAI企業が自律エージェントが実際のシステムとどのように相互作用するかを調査している中で行われました。別のケースでは、OpenAI と Anthropic のエージェントがサイバーセキュリティテスト中に実在の人物を標的にし、高度なモデルが制御された環境を超えて動作する際に出現する可能性のあるリスクを浮き彫りにしました。

読者の皆様のご支援が Windows Report を支えています。当サイトのリンクを経由してご購入いただいた場合、当社が手数料を受け取ることがあります。 Tooltip Icon

情報開示ページをご覧いただき、Windows Report の編集チームをどのように支援できるかをご確認ください。 Read more

User forum

0 messages