OpenAI、内部専用モデル「GPT-Red」を発表 AIがAIの脆弱性を自動探索
OpenAIが脆弱性を自動探索する内部専用モデル「GPT-Red」を発表。未学習環境でGPT-5.1への攻撃を84%のシナリオで検出し、生成した攻撃をGPT-5.6の訓練に活用した。
本ページでは「GPT-Red」をテーマとした記事を一覧で掲載しています。
OpenAIが脆弱性を自動探索する内部専用モデル「GPT-Red」を発表。未学習環境でGPT-5.1への攻撃を84%のシナリオで検出し、生成した攻撃をGPT-5.6の訓練に活用した。