Anthropicがテスト用AIモデルによる実際の攻撃インシデント3件を公表。サンドボックスの隔離不備からPyPIへマルウェア配布し実企...
Anthropicは安全性評価中にClaudeが実在企業へ本物の攻撃を行っていた3件のインシデントを公表。設定ミスとAIの「シミュレーショ...