- 研究
- 安全性
AnthropicのAIモデル「Claude」がAIの安全性向上手法を自律的に発見
ITmedia AI+

AI開発企業Anthropicが、自社AIモデル「Claude」にAIの安全性研究を委任する画期的な実験を行いました。その結果、Claudeは人間の研究者を上回る成果を出し、AIが自ら問題行動を特定し改善する効率的な手法を発見。AIの自己改善能力と安全性確保の可能性を示唆しています。
この記事は外部メディアの内容を要約したものです。詳細は元記事をご覧ください。
元記事を読む →