Meta、テスト中にAIモデルが実在の組織に侵入したことを確認
Metaは、サイバーセキュリティ評価の実施中に、テスト環境が誤ってAIモデルに公共インターネットへのアクセスを許可した結果、実在するサードパーティ組織のシステムが侵害されたことを確認しました。
The Informationは対象モデルをMuse Spark 1.1と報じていますが、Metaは現時点で正式にモデル名を公表していません。影響を受けた組織の名称も伏せられています。
報道によると、このAIはサードパーティサービスの脆弱性を悪用し、当該組織のシステムにアクセスして変更を加えました。
サンドボックスの設定ミスがインターネットアクセスを許す
Metaは、サイバーセキュリティ評価企業Irregularが運用するテスト環境において、構成エラーが今回のインシデントを引き起こしたと説明しています。
本来この環境はAIモデルを公共インターネットから隔離すべきものでした。しかし、誤った構成により、モデルが外部サービスに到達できる状態になっていました。
インターネットアクセスを獲得した後、当該モデルはサードパーティサービスに影響する脆弱性を発見し、悪用しました。
Metaは引き続きインシデントを調査中であり、レビュー完了後に追加情報を公開する予定だとしています。
Irregular、攻撃は高度なものではなかったと説明
Irregularは、サンドボックスがインターネットアクセスを許可するよう誤って設定されていたとし、今回のインシデントに特に高度なサイバー技術は関与していなかったことを確認しました。
同社は既に構成の問題を解決しており、関連する未解決の問題はないとしています。
またIrregularは、今後のAIサイバーセキュリティ評価におけるより安全な封じ込め手法について説明するホワイトペーパーを準備中です。
このインシデントは、自律型AIエージェントに関連する類似事例の後に発生しました。Hugging Faceは、OpenAIのエージェントがテスト環境から脱出したことで侵害を受けています。
その直後には、Claudeが3つの組織をハッキングし、悪意あるコードを公開したと報じられています。さらに最近のテストでは、OpenAIとAnthropicのエージェントがサイバーセキュリティ評価中に実在の人物を標的としたことが明らかになりました。
AIの封じ込めがより大きなセキュリティ上の懸念に
これらのインシデントは、自律型AIエージェントをテストする企業にとって深刻化する問題を浮き彫りにしています。封じ込めシステムが機能しない場合、モデルは割り当てられた目的を追求しながら、実際のインフラ、サービス、または人物と相互作用する可能性があります。
開発者には、AIエージェントが予期しないアクセスに遭遇した場合でも、その行動を制限するセーフガードが必要です。評価企業においても、厳格なネットワーク分離、監視、アクセス制御、そして明確に定義された動作境界が求められます。
Microsoftもこの問題に対処し、AIエージェントの封じ込めに関する新たなガイダンスを公開しました。これは、自律システムが実世界の環境に影響を及ぼす前に制限することの重要性の高まりを強調するものです。
情報開示ページをご覧いただき、Windows Report の編集チームをどのように支援できるかをご確認ください。 Read more
User forum
0 messages