AI開発企業Anthropicは、同社のAIモデル「Claude Code」の危険なコマンド検出機能のデフォルト設定を、従来の手動承認から自動検出に変更しました。これにより、危険コマンドの検出率が大幅に向上したことが明らかになりました。
ITmedia AI+によると、1053人を対象にした管理された実験で、Claude Codeの自動検出モードは89%の検出率を達成。一方で、人間のレビュアーによる検出率は14%にとどまったとのことです。この結果は、AIの自動検出機能が安全性向上に寄与する可能性を示しています。
日本市場においても、AIの安全性と信頼性は金融やテクノロジー分野で重要な課題であり、Anthropicの取り組みは今後のAI活用における安全基準の参考となるでしょう。
