Deepa Seetharaman Raphael Satter Jeff Horwitz

[サンフランシスコ/ワシントン 25日 ロイター] - 米人工知能(AI)開発企業オープンAIが開発中のAIが米新興ハギングフェイスのシステムに不正侵入したと公表してから2カ月が経過したが、同社はなおもAIエージェントの暴走の全容解明に努めている。2人の関係者がロイターに語った。

オープンAIは25日、同社のAIエージェントがチャットGPTユーザーから53枚の画像を漏洩させたと発表した。同社は、これらの画像がAIによって生成されたものなのか、実在の人物を特定したものなのかについては明らかにしなかった。また、画像の漏洩時期についても言及を避けた。

オープンAIが現在も続けているエージェント暴走事例の全容究明は、同社がテストしているモデルの性能と、その行動を監督あるいは追跡する能力との間に、大きな隔たりがあることを浮き彫りにしている。

関係者によると、9月中旬時点でオープンAIがエージェントによる望ましくない行動を約24件発見したと推定されるが、同社のチームがエージェントの活動に関する内部ログを精査するにつれ、その数は増え続けている。

オープンAIは、作業の規模を考慮すると、エージェントの不適切な活動に関する調査の完了には数カ月を要すると発表した。また、こうした活動について数十の第三者機関に通知したと明らかにした。

同社によると、今回流出した画像の大部分はすでに削除されており、残りの画像についてもホスティングプロバイダーに対し削除を要請している。

同社や元従業員、および専門家は、オープンAIのエージェントがこれらの画像にアクセスできた理由について、同社がモデル学習プロセスの一部で匿名化されたユーザーデータに依存しているためだと指摘する。企業データは学習の対象外である一方、チャットGPTの一般ユーザーは、同社が自身のデータを学習に利用することを許可しないようオプトアウトする必要がある。

同社は、ユーザーの投稿がトレーニングに使用される前に、メタデータや氏名、その他の連絡先情報を削除する匿名化プロセスを経ており、個々のユーザーまで遡ることは困難になるはずだと説明した。

だが関係者によると、個人を特定できる情報がデータから完全に除去されていない可能性があり、モデルの稼働過程で情報が漏洩する恐れがあるという。

オープンAIは25日、同社のモデルが研究およびトレーニング中に米国証券取引委員会(SEC)と米国国勢調査局のウェブサイトから情報にアクセスしたが、不正アクセス、アカウントの乗っ取り、またはセキュリティー侵害の証拠は見つからなかったと発表した。

これとは別に、AI研究を行う非営利団体Transluceは、オープンAIに由来するとみられるエージェントが、米国教育省の公民権関連ウェブサイトをハッキングしようとしたが失敗したと発表した。

オープンAIは、AIの不正行為に関する透明性を高める必要性が一般的にあることを認め、こうした事象を開示するための新たな枠組みを発表し、「重要性が不確かな場合でも」透明性を優先するとした。

それでも、同社によるエージェントの活動調査に詳しい2人の関係者は、その調査が厳重に管理され、社内の弁護士によって形作られていると述べた。

Reuters Copyright (C) 2026 トムソンロイター・ジャパン(株) 記事の無断転用を禁じます。