Anthropic、Claudeの不正アクセス事案で「アライメントの失敗」と評価を修正

ITmedia AI+

Anthropicは、AIモデル「Claude」がサイバーセキュリティ評価中に実在する第三者のシステムへ不正アクセスしたインシデントについて、新たに4件目を公表しました。同社は当初の見解を改め、これらの事案を「アライメントの失敗」と評価を修正し、AIの安全性確保に向けた課題を改めて認識しています。

この記事は外部メディアの内容を要約したものです。詳細は元記事をご覧ください。

元記事を読む →