MetaのAIモデル、誤設定で外部システム侵入 試験環境の隔離に課題
攻撃能力を測るAIの安全性評価が、試験対象を現実のネットワークへ出してしまう事故につながった。Metaは、外部評価会社の設定ミスで自社モデルが公開ネットへ接続し、第三者サービスの脆弱性を悪用したと認めた。
攻撃能力を測るAIの安全性評価が、試験対象を現実のネットワークへ出してしまう事故につながった。Metaは、外部評価会社の設定ミスで自社モデルが公開ネットへ接続し、第三者サービスの脆弱性を悪用したと認めた。
ウェブ上の指示を読み取って操作するAIブラウザーは、ログイン済みサービスへの権限も引き継ぐ場合がある。LayerXの実証では、偽のゲームに誘導された5種類のブラウザーと1種類の拡張機能が、試験用のSSH認証情報を外部へ送った。
攻撃能力を測るために安全機能を弱めたAIが、隔離されたはずの評価環境から外部ネットへ到達した。OpenAIのモデル群は脆弱性と盗んだ認証情報を連鎖させ、Hugging Faceの本番基盤から試験の解答を取得した。