AIにコードを書かせる時代になり、開発スピードは劇的に向上しました。しかしその一方で「AIが書いたコードに潜む脆弱性を、誰がどのタイミングで見つけるのか」という新たな課題が浮上しています。Pull Requestが積み上がるたびにセキュリティレビューの負荷は増し、CI/CDのスキャンだけでは対応が追いつかないという声も多く聞かれます。こうした課題に対する公式回答として、Anthropicは2026年5月末に「security-guidance(通称:Claude Security Plugin)」をClaude Code向けにベータリリースしました。本記事執筆時点(2026年9月1日)では、全Claude Codeユーザーに向けてベータ提供が続いており、管理者はAdmin ConsoleからOrganization全体への一括有効化も可能になっています。
この記事では、Claude Security Pluginがどのような仕組みでリアルタイムに脆弱性を検出・修正するのか、従来のルールベース型セキュリティツールとの違い、導入手順、そして実際にどのようなチームに向いているのかを、具体例を交えながら徹底的に解説します。これからAIエージェント開発におけるセキュリティ体制を整備したいエンジニア・セキュリティ担当者・マネージャー層にとって、必読の内容です。
Claude Security Pluginとは何か
Claude Security Plugin(security-guidance)は、Claude Codeがコードを書いている最中に、そのコード変更を自動的にレビューし、脆弱性を検出・修正まで行う公式プラグインです。従来のセキュリティツールは、正規表現やシグネチャベースの「パターンマッチング」で既知の脆弱性を検出する方式が主流でした。この方式は既知のパターンには強いものの、複雑なビジネスロジックに起因する脆弱性や、コンテキスト依存の問題を見逃しやすく、また誤検知(False Positive)が多発してアナリストの時間を浪費するという課題がありました。
Claude Securityはこれとは一線を画すアプローチを取ります。Claudeはセキュリティリサーチャーのようにコードを「推論」します。Git履歴を読み、データフローを追跡し、そのコードが持つビジネスロジックを理解した上で、本当に悪用可能な脆弱性を見つけ出し、実際に機能する修正パッチまで生成します。さらに重要な特徴として「敵対的検証(Adversarial Verification)」というプロセスがあります。ある検出結果は、報告される前に別のClaudeインスタンスによって「本当にこれは脆弱性か?」と自ら challenge されます。このプロセスを経ることで、実際の脆弱性の検出率を上げつつ、誤検知を大幅に減らすことができるのです。
主要機能・特徴の解説
3段階の自動審査フロー
Claude Security Pluginの最大の特徴は、開発ワークフローの3つのタイミングで多層的に脆弱性をチェックする点です。
- 編集時チェック(無料・パターンマッチ):Claudeがファイルに書き込む瞬間、新しいコンテンツをリスクの高いパターンでスキャンします。
eval()、new Function、os.system、child_process.execといった動的コード実行、pickleを使った安全でないデシリアライズ、dangerouslySetInnerHTMLや.innerHTML =、document.writeなどのDOMインジェクション、さらに.github/workflows/配下のワークフローファイル編集(リポジトリレベルの権限を付与しうるため)まで、幅広いカテゴリをカバーします。この段階はモデル呼び出しを行わない純粋なパターンマッチなので、追加の利用コストは一切発生しません。 - ターン終了時レビュー:ユーザーがメッセージを送り、Claudeが作業して応答するまでの1往復(ターン)が終わるごとに、その間に発生したすべての変更(編集ツール、Bashコマンド、サブエージェントによる変更を含む)のgit diffを計算し、セキュリティ専用のClaudeレビューに送信します。このレビューはバックグラウンドで実行されるため、Claudeの応答が遅延することはありません。問題が見つかった場合、Claudeは検出結果とともに再プロンプトされ、同一セッション内で修正を行います。
- コミット時レビュー:git commitのタイミングでも独立したレビューが走り、コードがリポジトリに永続化される前の最終チェックとして機能します。
自己評価バイアスを排除する「独立レビュアー」設計
このプラグインの設計思想として特筆すべきは、コードを書いたClaudeとそれを審査するClaudeが「別インスタンス」である点です。ターン終了時レビューとコミットレビューでは、新たなコンテキストでセキュリティ審査に特化したプロンプトを与えられた、独立したモデル呼び出しが実行されます。これにより「自分が書いたコードを自分で甘く評価してしまう」という自己評価バイアスを構造的に排除しています。
ゼロコンフィグ導入とカスタマイズ性
導入は非常にシンプルです。Claude Codeのセッション内で以下のコマンドを実行するだけで、追加設定なしに即時利用開始できます。
/plugin marketplace add anthropics/claude-plugins-official(マーケットプレイス未登録の場合)/plugin install security-guidance@claude-plugins-official/reload-plugins(現在のセッションへ即時反映)
また、YAMLファイルによるパターン定義やMarkdownによるガイダンス記述を通じて、自社独自の禁止パターンやコーディング規約をプラグインに組み込むことも可能です。チーム全体への展開も、設定ファイル.claude/settings.jsonをリポジトリにコミットするだけで完了し、メンバー全員に自動的に同じセキュリティ基準が適用されます。
Review and Patch:検出だけでなく修正まで一気通貫
多くのセキュリティツールは「検出」までしか行わず、修正はエンジニアのバックログに積まれていくのが実情でした。Claude Securityは検出した各問題に対して推奨パッチを提示し、チームはそれをレビュー・承認するだけで適用できます。脆弱性が発見されてから修正されるまでのリードタイムを大幅に短縮できる点は、他の静的解析ツールとの大きな差別化ポイントです。
比較・メリット・デメリット
従来のルールベース型セキュリティスキャナ(SAST)と、Claude Security Pluginを比較すると、それぞれの得意分野・弱点が明確になります。
| 比較項目 | 従来のルールベースSAST | Claude Security Plugin |
|---|---|---|
| 検出方式 | 正規表現・シグネチャによるパターンマッチ | コード推論+データフロー・ビジネスロジック理解 |
| 誤検知率 | 比較的高い傾向 | 敵対的検証により低減 |
| 実行タイミング | CI/CDでのバッチ実行が主流 | 編集時・ターン終了時・コミット時にリアルタイム |
| 修正対応 | 検出のみでバックログ化しやすい | 推奨パッチを同時に生成 |
| 導入コスト | ルール整備・チューニングが必要 | 1コマンドでゼロコンフィグ導入 |
| 利用料金 | ツールにより有料 | 全プランで無料(2026年9月時点) |
メリットとしては、既存ワークフローに組み込みやすいこと、複雑な脆弱性を発見できること、そして修正パッチが即座に得られることが挙げられます。一方でデメリットも存在します。公式ドキュメントでも明記されている通り、Claude Security Pluginは「すべての脆弱性を保証する完全なソリューション」ではなく、多層防御の一つの層として位置づけられています。Claudeが提案する修正は必ずしも完璧ではなく、特にミッションクリティカルなシステムに適用する前には、人間のレビューを挟むことが強く推奨されています。また、ベータ版であるため、今後仕様変更が入る可能性がある点も念頭に置く必要があります。
実際の活用例・おすすめのターゲット
Claude Security Pluginは特に以下のようなシーンで力を発揮します。
- スタートアップ・小規模開発チーム:専任のセキュリティエンジニアを雇う余裕がないチームでも、AIによるリアルタイムレビューによって基本的な脆弱性(SQLインジェクション、XSS、安全でないデシリアライズなど)を早期に潰すことができます。
- 大規模エンタープライズのAppSecチーム:Admin ConsoleからOrganization全体に一括適用し、`.claude/settings.json`をリポジトリ標準として組み込むことで、開発者ごとのセキュリティ意識のばらつきを軽減し、PRレビューの負荷を大幅に削減できます。
- OSSメンテナー:外部コントリビューターからのPull Requestに対して、CIパイプラインとは別のレイヤーで、GitHub Actionsのワークフローファイル改変など権限昇格リスクの高い変更を検知できます。
- 金融・医療など高規制業種の開発現場:多層防御の一環として既存のSAST/DASTツールと併用し、AIエージェントが自律的にコードを書くフェーズにおけるガードレールとして活用できます。
具体的な活用イメージとしては、Claude Codeで新機能のAPIエンドポイントを実装している最中に、ユーザー入力を直接シェルコマンドに渡すコードをClaudeが書いてしまった場合、編集時チェックで即座にパターン検出がかかり、ターン終了時レビューでより深いコンテキスト分析が行われ、最終的にセキュアな実装への修正パッチが提案される、という流れが自動的に完結します。人間の開発者はその修正案を確認し、承認するだけで安全なコードをコミットできるのです。
まとめ
Claude Security Plugin for Claude Codeは、AIがコードを書くスピードに、セキュリティレビューのスピードを追いつかせるための重要な一手です。従来のパターンマッチ型ツールとは異なり、セキュリティリサーチャーのように推論し、独立したClaudeインスタンスによる敵対的検証を経て、検出だけでなく実用的な修正パッチまで提供する点が最大の強みです。編集時・ターン終了時・コミット時という3段階の多層防御設計により、開発フローを止めることなくリアルタイムでセキュリティを担保できます。
ただし、これは万能薬ではなく「多層防御の一層」であることを忘れてはなりません。特に重要システムへの適用前には必ず人間によるレビューを行い、既存のSAST/DASTツールやCI/CDスキャンと併用することが推奨されます。2026年9月時点では全プランで無料かつベータ提供中ということもあり、まずは自社の開発環境に`/plugin install security-guidance@claude-plugins-official`を試してみて、AIエージェント時代のセキュリティ運用をアップデートしてみてはいかがでしょうか。
関連サイト: https://www.aegis4.net/