#Anthropic
55 posts-
news「Claude Code」の権限確認、8月14日から自動化がデフォルトに
Anthropicは8月14日、Claude Codeの危険コマンド確認を分類器が自動判定する「auto mode」をデフォルト化する。人間の拒否率13.6...
-
newsAnthropic、Claude Fable 5の生物学ガードレールを緩和 誤検知85%減の裏にある判断
Anthropicは「Claude Fable 5」の生物学分野における過剰な保護機能を緩和し、無害な質問への誤検知・フォールバックを約85%削減...
-
news「評価中」のAIが他社に侵入 OpenAI・Anthropic・Metaが3週連続で告白
安全性評価中のAIモデルが実在の第三者組織へ不正アクセスした事案が、OpenAI・Anthropic・Metaと3週連続で発覚。共通するのは評...
-
newsAIエージェントが評価中に暴走 英政府機関がOSSサプライチェーンへの実害級行動を検出
英国AI Security Instituteの評価環境で、Anthropic Mythos 5とOpenAI GPT-5.6 Solが権限外の行動を取り、実在の開発者を標的にO...
-
news中国軍がGPT-3.5とClaudeを「蒸留」、輸出規制の抜け道に
中国人民解放軍関連の研究者が、OpenAIとAnthropicのAIモデル出力を知識蒸留で軍事用の小型AIに移し替えていたとReuters調査で判...
-
newsClaudeが実企業に「本物の」不正アクセス――Anthropic、評価中の3件を公表
Anthropicは安全性評価中にClaudeが実在企業へ本物の攻撃を行っていた3件のインシデントを公表。設定ミスとAIの「シミュレーショ...
-
newsClaude Mythosが耐量子暗号HAWKに新攻撃、AIが自力で暗号の弱点を発見
AnthropicのAI「Claude Mythos Preview」が耐量子署名方式HAWKの強度を半減させる攻撃手法を発見、縮小版AESにも新手法を提示し...
-
newsClaudeの共有チャットがGoogle検索に流出、健康記録や子ども情報も
AnthropicのClaudeで共有した会話がGoogle検索でヒットし、健康記録や子どもの個人情報、企業の非公開文書などが閲覧可能になっ...
-
news「オープンウェイトAI規制」に猛反発 ― Microsoft・NVIDIA等30社超が書簡、Anthropicは不参加
MicrosoftやNVIDIAなど米国企業30社超が、オープンウェイトAIモデルへの規制強化に反対する共同書簡を公開した。AI安全性で知ら...
-
news「Claude Opus 5」公開 ― 性能倍増と"介入率85%減"の安全設計
AnthropicがLLM「Claude Opus 5」を公開。性能はFable 5に迫りつつ価格据え置き、サイバー関連タスクへの介入率を85%減らした安...
-
news「Kimi K3」不正蒸留疑惑、AIサプライチェーンに突きつけられた調達リスク
中国AI「Kimi K3」がAnthropicのClaude出力を無断学習した疑いが浮上。AI調達における学習データの透明性が新たな論点に。
-
newsGPTもClaudeも「不正行為」に手を染めていた 英AISIがCTFで実測
英国のAI安全研究機関AISIがOpenAIとAnthropicの最新5モデルにCTF演習を課したところ、全モデルが7.8〜14.1%の頻度で禁止行為に...