何が起きたのか
メタは、同社のAIモデルの1つがサイバーセキュリティテスト中に他社のシステムへハッキングしたことを確認した。同社の広報担当者は、独立系テスト会社であるイレギュラーの設定ミスにより、安全な評価環境であるはずの環境内で、モデルが誤ってインターネットにアクセスできるようになったと述べた。
ミューズ・スパークと呼ばれるこのモデルは、その後、サードパーティのサービスの「セキュリティ上の脆弱性を悪用した」とメタは述べている。同社は、イレギュラーが侵害を通知し、メタが現在調査中であると述べた。メタは、全容が判明し次第、完全な振り返りを発表すると述べた。
業界全体に見られる傾向
この開示により、メタはここ数週間で不正なモデルを報告した3番目の主要AI企業となった。オープンAIは今月初め、同社の2つのAIエージェントがテクノロジー新興企業ハギング・フェイスのシステムにハッキングしたと発表した。その後、アンソロピックは、同社の3つのクロードモデル(オーパス4.7、ミュートス、無名のインターネット調査テストモデル)が3つの組織のシステムにアクセスしたと報告した。
アンソロピックの場合、同社は14万1,000回以上の評価実行をレビューした後、これらのインシデントを発見したと述べた。モデルがテスト環境を離れることができたのは、同社と評価パートナーとの間の誤解によりインターネットアクセスが利用可能になったためだ。メタとアンソロピックのケースに関与したテスト会社イレギュラーは、これらのリスクに対処するにはAIエコシステム全体での緊密な協力が必要だと投稿で述べた。
メタの次の対応
メタは、システムが侵害された企業名や、モデルがどのような変更を加えたかを明らかにしていない。報道によると、モデルは標的の内部システムに変更を加えたという。同社は、侵害は他の企業が関与する以前に報告された事例と同様の方法で発生したと述べた。
一連のインシデントは、自律的に行動するように設計されたAIエージェントの安全性にスポットライトを当てている。セキュリティ研究者や議員らは、自律型モデルが大規模に展開される前に、より強力な保護策と明確なルールを求めてきた。