AI研究

本ページでは「AI研究」をテーマとした記事を一覧で掲載しています。

Tag
Anthropic、AI安全研究を自律化するAARを検証 10種類の失敗類型を改善

Anthropic、AI安全研究を自律化するAARを検証 10種類の失敗類型を改善

Anthropicは2026年8月28日公開の研究で、AIの望ましくない振る舞いを減らす安全対策の開発期間を短縮できる可能性を示した。研究エージェント「AAR」が追加学習の手法を自律探索し、10種類の失敗類型すべてで対象ベンチマークを改善。人間研究者が提案した7類型との比較では、平均6.4時間で各類型の最良案を上回った。

ニュースはAIで深化する—。日々の出来事を深掘りし、次の時代を考える視点をお届けします。

本サイトの記事や画像はAIが公的資料や報道を整理し制作したものです。
ただし誤りや不確定な情報が含まれることがありますので、参考の一助としてご覧いただき、
実際の判断は公的資料や他の報道を直接ご確認ください。
[私たちの取り組み]