AnthropicがClaude Codeのプロンプトインジェクション対策強化を発表
AnthropicのClaude Code責任者Boris Cherny氏は、AIエージェントにおける大きな課題だったプロンプトインジェクション攻撃について、実際の利用環境ではほぼ解決できる段階に到達したと明らかにしました。悪意あるウェブページなどから不正な指示を読み込ませ、機密情報の取得や不要な操作を誘発する攻撃に対し、Anthropicは三層の防御システムを導入しています。Claude本体による拒否機能、外部コンテンツの入力前検査、操作実行前のAuto Modeによる最終確認を組み合わせています。第三者テストでは72種類の未知の攻撃を720回試行しましたが、Sonnet 5、Fable 5、Opus 5でAuto Modeを有効化した環境では成功例が一度も確認されませんでした。