「Claude」による不正アクセス、4件目が判明──Anthropic、「アライメントの失敗」と評価を修正
米Anthropicは9月9日(現地時間)、AIモデル「Claude」がサイバーセキュリティ評価中に実在する第三者のシステムへ不正にアクセスした4件のインシデントについて、アライメントの観点から分析した報告書を公開した。3件は7月30日に公表済みで、今回新たに1件を明らかにした。同社は7月時点で「アライメントの失敗という...
はてなテクノロジー
2026年09月10日 00:13