(ブルームバーグ):OpenAIは、インターネットから遮断された安全な環境で訓練していたはずの自律型AIシステムがウェブに接続し、外部の第三者チャットボットにアクセスしていたことを明らかにした。
25日にOpenAIのウェブサイトに掲載されたブログ投稿によると、問題が発覚したのは1週間足らず前。同社の自律型AIシステムの一つが、外部ネットワークから隔離された「サンドボックス」と呼ばれる環境での訓練中に「隙間」を突き、インターネットに接続。第三者のチャットボットサービスに「フランスの首都はどこか」など、少なくとも20件の質問を送信した。サービス名は明らかにしていない。
同社によると、こうした隔離環境からの逸脱に伴うセキュリティー上のインシデントは7月以来だった。当時、社内テスト中に複数のモデルが連携してネットに接続し、AIプラットフォームのハギングフェイスのシステムに意図せず侵入した。
OpenAIは今回の問題について、「取り組みの次の段階で、どこに重点を置くべきかを示す重要な手掛かりとなる」と説明。サンドボックスの不備を解消するまで、最も高性能なモデルについて、ツールを使用する訓練を一時停止すると決めた。また、「当該モデルの訓練は再開しない」とした。
ここ数カ月、OpenAIやアンソロピック、グーグルのディープマインド、メタ・プラットフォームズが開発したAIモデルによる侵入が相次ぎ、サイバーセキュリティーやAIの安全性の専門家の間で懸念が広がっている。
アンソロピックのダリオ・アモデイ最高経営責任者(CEO)が2週間前に業界全体でAI開発のペースを落とすよう呼び掛けた際も、ハギングフェイスの一件を理由の一つに挙げていた。OpenAIのサム・アルトマンCEOや実業家イーロン・マスク氏らは直ちに賛同を表明。AI規制強化の必要性を巡る世界的な議論に発展した。
OpenAIは、自律型AIシステムが以前ネットに接続した際に引き起こした問題をなお調査する中で、今回の不備を公表した。同社は25日、同社のAIモデルが訓練や評価の過程で、国勢調査局や米証券取引委員会(SEC)など米政府機関のウェブサイトにある公開情報にアクセスしていたことを認めた。
わずか数日前には、同社のAIモデルがオーストラリア政府のウェブサイトに不正アクセスしていたことを明らかにしていた。
今回の問題では、社内の運用手順の不備も浮き彫りになった。ブログによると、「人間の確認担当者」は社内監視システムから警告を受け、3分以内に業務用チャットのスラック上でそれを認識した。しかし、訓練は想定通りに自動停止せず、担当者が手動で停止するまで2時間以上かかった。
AIの安全性に取り組む非営利団体ナイチンゲールの創設者、シドニー・フォン・アークス氏は、「ハギングフェイスの一件を受けてセキュリティーを強化した後も、OpenAIのモデルが許可なくインターネットに接続できてしまうのは残念だ」と指摘。「今、最大の焦点は、応急処置だけで一刻も早く訓練を再開するのか、それとも根本原因を突き止めて解消するのかだ」と述べた。
原題:Another OpenAI Sandbox Failed, AI Agent Gained Internet Access(抜粋)
もっと読むにはこちら bloomberg.com/jp
©2026 Bloomberg L.P.