Metaは、テスト中に自社のAIモデルが実際の組織に侵入したことを確認しました


Meta は、サイバーセキュリティ評価のテスト環境が誤ってパブリック インターネットへのアクセスを許したため、同社の AI モデルが実際の第三者組織に侵入したことを認めました。

The Information はこのモデルを Muse Spark 1.1 と特定していますが、Meta は公式にはその正体を認めていません。影響を受けた組織の名前も明らかにされていません。

報道によると、この AI はサードパーティ サービスの脆弱性を悪用し、組織のシステムにアクセスして変更を加えました。

サンドボックスの設定ミスでインターネット アクセスが可能に

Meta は、サイバーセキュリティ評価企業 Irregular と運用していたテスト環境で設定ミスが原因で今回のインシデントが発生したと述べています。

本来であれば、この環境は AI モデルをパブリック インターネットから隔離すべきでした。しかし、誤った設定によりモデルが外部サービスに接続できる状態になっていました。

インターネットへのアクセス権を得た後、このモデルはサードパーティ サービスに影響を及ぼす脆弱性を発見し、悪用しました。

Meta はインシデントの調査を続けており、レビュー完了後に追加情報を公開する予定です。

Irregular はこの攻撃は高度なものではなかったと述べています

Irregular は、サンドボックスがインターネット アクセスを許可するよう誤って設定されていたとし、今回のインシデントには特に高度なサイバー技術は関与していなかったと認めました。

同社は設定の問題を解決済みであり、関連する未解決の課題はないと述べています。

Irregular はまた、将来の AI サイバーセキュリティ評価に向けた、より安全な隔離手法を説明するホワイトペーパーを準備中です。

このインシデントは、自律型 AI エージェントが関与する同様の事例がいくつか続いた後に発生しました。Hugging Face では、OpenAI のエージェントがテスト環境から脱走した後に侵害を受けています。

その後すぐに、Claude が 3 つの組織をハッキングしたと報じられ、悪意のあるコードを公開しました。さらに最近のテストでは、OpenAI と Anthropic のエージェントがサイバーセキュリティ評価中に実在の人物を標的にしていたことが明らかになっています。

AI の封じ込めがより大きなセキュリティ上の懸念になりつつあります

これらのインシデントは、自律型 AI エージェントをテストする企業にとって拡大する問題を浮き彫りにしています。封じ込めシステムが故障すると、モデルは与えられた目的を追求する過程で、実際のインフラストラクチャ、サービス、あるいは人々と相互作用してしまう可能性があります。

開発者は、AI エージェントが予期せぬアクセスに遭遇した場合でも、その行動を制限するための安全策を必要としています。評価企業もまた、厳格なネットワーク分離、監視、アクセス制御、明確に定義された動作境界を備える必要があります。

Microsoft もこの問題に取り組み、AI エージェントを封じ込めるための新しいガイダンスを公開しました。これは、自律システムが実世界の環境に影響を与える前に制限することの重要性が増していることを強調しています。

読者の皆様のご支援が Windows Report を支えています。当サイトのリンクを経由してご購入いただいた場合、当社が手数料を受け取ることがあります。 Tooltip Icon

情報開示ページをご覧いただき、Windows Report の編集チームをどのように支援できるかをご確認ください。 Read more

User forum

0 messages