Google「Mantis」が変える脆弱性対策の未来

ネタ・雑学
STΛCKHUB ANALYSIS2026.09.04 01:10

偽陽性の嵐に立ち向かう合議制AI

深夜2時、静まり返ったオフィスで、静的解析ツールが吐き出した数千件の「脆弱性警告」の山と格闘した経験が、あなたにもあるはずだ。その大半は、実際には動作に影響しない「偽陽性(False Positive)」、つまりオオカミ少年である。我々エンジニアを疲弊させるのは、脆弱性そのものよりも、このノイズの処理なのだ。このような「アラート疲れ」による開発現場のデッドロックに対し、Googleが公開したオープンソースフレームワーク「Mantis」は、極めて現実的なアプローチで切り込んでいる。

従来のAIによるコードスキャンは、一見スマートに見えて、その実態はハルシネーションの温床だった。Google自身が指摘するように、精度の低いAIスキャンにおける「真陽性率(実際に脆弱性である確率)」は、わずか7%未満に留まるという。これは、100件の警告のうち93件がゴミであるという絶望的な数値だ。これでは、AIを導入したことで、かえって人間のセキュリティ担当者の負担が増えるという本末転倒な事態に陥る。Mantisはこの課題を解決するため、単にコードを「読む」だけでなく、複数のAIエージェントによる「合議制」と「実証」のプロセスを導入した。

Mantisのワークフローは、脆弱性の候補を見つけた後、別の「批判的検証エージェント」がその成立条件を厳しくレビューし、さらに隔離されたサンドボックス環境で実際にエクスプロイト(攻撃コード)を実行して再現を試みる。この「動的検証」を経て初めて、Mantisは修正コードの作成へと進む。私はこのアプローチを極めて強力だと評価する。静的解析の限界を、AIエージェントの協調動作と動的実行環境の組み合わせによって突破しようという思想は、これからのDevSecOpsの標準となるべきものだ。開発者が詳しい設計資料や脅威モデルを用意していないプロジェクトであっても、Mantis自身がリポジトリの変更履歴や過去の修正履歴から情報を収集し、自動的に脅威モデルを構築する点も、現場の泥臭い運用を理解した設計と言える。

トークン85%削減がもたらす破壊力

巨大なモノリシックリポジトリを前にして、LLM(大規模言語モデル)に「この中から脆弱性を探してくれ」と頼むのは、富豪的なアプローチが過ぎる。数百万行のソースコードをそのままコンテキストウィンドウに流し込めば、APIの利用料金は一瞬で跳ね上がり、モデルの処理能力は限界を迎えてフリーズするか、あるいはコンテキストの「中だるみ(Lost in the Middle)」によって重要な脆弱性を見落とすことになる。これは、無限ループに陥ったプログラムのように、リソースを無駄に食いつぶすだけの最悪のシナリオだ。

Mantisはこの問題に対し、「階層型セキュリティ要約(Hierarchical Security Summarization)」という極めてエレガントなアーキテクチャを提示した。リポジトリ全体のコードを一度に読み込ませるのではなく、まず各ファイルの情報をディレクトリ単位でまとめ、それをさらにリポジトリ全体の要約へとボトムアップで積み上げていく。AIはまずこの「要約の地図」を俯瞰し、怪しいとアタリをつけた部分のコードだけをピンポイントで深掘りしていくのだ。Googleの検証によれば、この手法によって、重要な構造情報を維持したまま、トークンのオーバーヘッドを85%以上削減することに成功したという。これは単なるコスト削減ではない。これまでコンテキスト制限のためにAIによる解析を諦めていた、数ギガバイト規模の巨大プロジェクトに対しても、実用的な時間とコストでセキュリティスキャンを適用可能にしたという技術的ブレイクスルーなのだ。

比較項目 従来の一括投入アプローチ Mantisの階層型アプローチ
入力方式 全コードをそのままLLMに投入 ディレクトリ単位の要約から段階的に深掘り
トークン消費量 極めて膨大(コード量に比例して爆発) 85%以上のオーバーヘッド削減
コスト効率 API利用料金が非常に高額 低コストで大規模リポジトリに対応可能
解析精度 コンテキスト過多によるハルシネーション多発 構造化された脅威モデルに基づくため高精度

自律型セキュリティの光と影

サイバーセキュリティの世界は、今やAI同士の軍拡競争の様相を呈している。OpenAIがサイバー領域に特化した「GPT-5.6-Cyber」を発表し、ゼロデイ脆弱性の研究を強化している一方で、Googleは「Mantis」によって防御側の自動化を急ぐ。この「矛と盾」の進化スピードは、我々人間のエンジニアがコードを書き、レビューする速度を遥かに凌駕しつつある。しかし、ここで我々は立ち止まり、冷徹な技術的懸念を抱かざるを得ない。Mantisが自動生成した修正コードを、我々はそのまま本番環境にデプロイして良いのだろうか?

答えは否だ。AIが生成したコードが、一見すると脆弱性を修正しているように見えて、実は新たな、より巧妙なバックドアやバグを埋め込んでいる可能性(スパゲッティコードの再生産)を排除できないからだ。Google自身も、Mantisの出力を本番システムから隔離された環境で実行し、セキュリティ専門家が手作業で最終確認することを強く推奨している。我々エンジニアが明日から取るべき実践的な処方箋は、AIを「全自動の意思決定者」として崇めるのではなく、「超優秀なセキュリティアシスタント」として飼い慣らすことだ。具体的には、MantisをCI/CDパイプラインに組み込みつつも、その出力に対する厳格なゲートキーパー(人間によるコードレビュー)を維持すること。そして、AIが安全にエクスプロイトを再現できる「隔離されたサンドボックス環境」を自社内に構築することである。

AIが脆弱性を見つけ、AIがそれを修正する時代において、我々人間のエンジニアの価値はどこに残るのか?単にコードを書くだけの存在は、淘汰される運命にある。我々に求められるのは、AIが提示した「修正案」の妥当性を、システムの全体最適とビジネスロジックの観点から冷徹に評価する「最後の砦」としての審美眼だ。あなたはこのAI主導のセキュリティシフトに、自らのキャリアをどう適応させるだろうか。その問いに対する答えが、これからの10年を生き抜くエンジニアの分水嶺となるはずだ。

Published at 01:10

コメント

タイトルとURLをコピーしました