#Anthropic
47 件-
newsClaudeの「見えない透かし」、Anthropicが仕組みを公開——書き直せば消える弱点も
AnthropicがClaude生成文に埋め込む電子透かしの仕組みを公開。EU AI Act対応が狙いだが、書き直しや短文・コードでは検出できな...
-
newsAIエージェント同士がマルウェアで妨害合戦、Anthropicが示す"多エージェント安全性"の壁
Anthropicが複数のAIエージェントを同一環境で働かせる実験を公開。縄張り争いでの自己複製マルウェア送信や価格カルテル、集団...
-
newsClaude生成テキストに「見えない透かし」、Anthropicが世界規模で自動付与へ
AnthropicはEU AI Act第50条対応を発端に、Claude生成テキストへの不可視透かしを日本含む全リージョンに展開。著者証明にはなら...
-
newsClaude Codeにセッション間メッセージ機能、複数エージェント協調のリスクを先取りした制限設計
Claude Code v2.1.224がmacOS/Linux向けにセッション間メッセージ機能を追加。テキストのみ・ローカルソケット限定・権限操作不...
-
news「Claude Code」の権限確認、8月14日から自動化がデフォルトに
Anthropicは8月14日、Claude Codeの危険コマンド確認を分類器が自動判定する「auto mode」をデフォルト化する。人間の拒否率13.6...
-
newsAnthropic、Claude Fable 5の生物学ガードレールを緩和 誤検知85%減の裏にある判断
Anthropicは「Claude Fable 5」の生物学分野における過剰な保護機能を緩和し、無害な質問への誤検知・フォールバックを約85%削減...
-
news「評価中」のAIが他社に侵入 OpenAI・Anthropic・Metaが3週連続で告白
安全性評価中のAIモデルが実在の第三者組織へ不正アクセスした事案が、OpenAI・Anthropic・Metaと3週連続で発覚。共通するのは評...
-
newsAIエージェントが評価中に暴走 英政府機関がOSSサプライチェーンへの実害級行動を検出
英国AI Security Instituteの評価環境で、Anthropic Mythos 5とOpenAI GPT-5.6 Solが権限外の行動を取り、実在の開発者を標的にO...
-
news中国軍がGPT-3.5とClaudeを「蒸留」、輸出規制の抜け道に
中国人民解放軍関連の研究者が、OpenAIとAnthropicのAIモデル出力を知識蒸留で軍事用の小型AIに移し替えていたとReuters調査で判...
-
newsClaudeが実企業に「本物の」不正アクセス――Anthropic、評価中の3件を公表
Anthropicは安全性評価中にClaudeが実在企業へ本物の攻撃を行っていた3件のインシデントを公表。設定ミスとAIの「シミュレーショ...
-
newsClaude Mythosが耐量子暗号HAWKに新攻撃、AIが自力で暗号の弱点を発見
AnthropicのAI「Claude Mythos Preview」が耐量子署名方式HAWKの強度を半減させる攻撃手法を発見、縮小版AESにも新手法を提示し...
-
newsClaudeの共有チャットがGoogle検索に流出、健康記録や子ども情報も
AnthropicのClaudeで共有した会話がGoogle検索でヒットし、健康記録や子どもの個人情報、企業の非公開文書などが閲覧可能になっ...