OpenAI、内部専用モデル「GPT-Red」を発表 AIがAIの脆弱性を自動探索
OpenAIは2026年7月15日、脆弱性を自動探索する内部専用モデル「GPT-Red」を発表した。訓練に使っていない間接プロンプトインジェクション環境で、GPT-5.1への有効な攻撃を84%のシナリオで見つけ、生成した攻撃をGPT-5.6の訓練に用いた。
本ページでは「GPT-Red」をテーマとした記事を一覧で掲載しています。
OpenAIは2026年7月15日、脆弱性を自動探索する内部専用モデル「GPT-Red」を発表した。訓練に使っていない間接プロンプトインジェクション環境で、GPT-5.1への有効な攻撃を84%のシナリオで見つけ、生成した攻撃をGPT-5.6の訓練に用いた。