Meta(メタ)のロゴ画像。/聯合ニュース

Meta(メタ)の人工知能(AI)モデルも内部サイバーセキュリティ試験の最中に外部機関をハッキングした事実が確認された。OpenAIのGPTモデルとAnthropicのClaudeモデルに続き、3番目に確認されたいわゆる「不良エージェント(rogue agent)」の事例である。

5日(現地時間)ブルームバーグ通信などの海外報道によると、Meta(メタ)は自社AIモデル「ミューズ・スパーク」が独立検証会社「イレギュラー」が実施したセキュリティ試験の過程でインターネットに無断接続した後、外部機関のシステムをハッキングしたと明らかにした。

調査の結果、ミューズ・スパークはイレギュラーの設定ミスによりインターネットに接続され、これを通じて脆弱性を悪用し外部機関システムに無断接続したことが判明した。被害を受けた機関は一つだが、具体的な対象は公開されていない。

ただし今回の事故は、AIが「サンドボックス」と呼ばれる隔離環境を自ら脱出した事例ではない。設定ミスでインターネットに接続された後にハッキングが行われた点で、サンドボックスを脱出してHugging Faceを攻撃したOpenAIのGPTモデルの事例よりはリスクが低いとの評価が出ている。

イレギュラーは「今回の事件はサンドボックス脱出や高度なサイバー攻撃とは性格が異なる」と述べ、「現在、未解決のセキュリティ問題はない」と伝えた。Meta(メタ)とイレギュラーは今回の事故の経緯と原因を追加調査した後、事後報告書と技術白書を公開する予定だ。

これはGPTの事例よりも、人為的なミスでインターネットに接続された後に外部システムをハッキングしたAnthropicの事例と類似するタイプだという説明である。にもかかわらず、わずか数週間の間に世界のAI業界を主導する三社の最先端モデルが相次いで内部試験の過程で外部システムをハッキングした事例が確認され、AI発のサイバーセキュリティリスクへの懸念は一段と高まる見通しだ。

英国AIセキュリティ研究所(AISI)も最近、AnthropicとOpenAIのAIモデルが偽の身元で人間に接触したりマルウェアのインストールを試みるなど、さまざまなリスク事例が確認されたと発表した。米国政府は最先端AIモデルを発売30日前に政府へ提出し安全性の検証を受けさせる規制を推進している。米議会でもAIが統制を外れた場合に政府が介入できるようにする「AIキルスイッチ法」が提出されるなど、規制議論が加速している。

※ 本記事はAIで翻訳されています。ご意見はこちらのフォームから送信してください。