本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]
OpenAIは2026年9月30日付の発表で、自社モデルの「保護された推論」を抽出しようとする組織的な活動を阻止したと明らかにした。同社は、活動の中心となったグループについて、AIアシスタント「Kimi」を開発するMoonshot AIの関係者が関与していたとみている。
暗号化された推論を再利用する抽出手法
OpenAIによると、活動は7月1日に低頻度で始まり、7月24~25日には、抽出パターンを使った約1万6,000件のリクエストを4,000人超から確認した。さらに調査した結果、関連するプロンプトパターンが1万5,000人超の利用者群で確認された。同社は、これらの数値は抽出の試行を示すもので、必ずしも成功した件数ではないとしている。
手口についてOpenAIは、既に入手した暗号化済みの推論情報を別の会話で再利用し、内容を復元できる経路が悪用されたと説明している。暗号自体が破られたり、データベースや保存済みの利用者会話へ直接アクセスされたりしたわけではないという。
アカウント停止と推論保護を強化
OpenAIは7月28日までに関連活動を全面的に遮断し、不正アカウントの停止・制限、登録やインフラ管理、監視、保護された推論への対策を強化した。調査結果はFrontier Model Forumや政府の情報共有経路を通じ、他のAI開発企業や公共部門にも共有した。
蒸留は、あるモデルの出力を別モデルの開発に活用する一般的な手法だが、OpenAIは無許可で体系的に出力や推論を抽出する行為を「敵対的蒸留」と位置付ける。抽出された推論が安全対策を引き継がないモデルの開発や高度な能力移転に使われる可能性があるとして、業界横断の対策を求めている。今回、抽出情報が別モデルの訓練や性能向上に実際に使われたことは確認されていない。
