Claude Codeのトークン消費を極限まで削る:常駐費7万の正体と最適化戦略

AI・テクノロジー
STΛCKHUB ANALYSIS2026.09.04 12:00

常駐費7万トークンの正体

エンジニアの日常において、AIエージェントの「常駐費」という概念は、まるでメモリリークを放置したままのサーバーを運用するような、見えないコストの積み重ねだ。Claude Codeを起動した瞬間、まだ一行もコードを書いていないにもかかわらず、約7万トークンという巨大なコンテキストが消費される。これは単なる「初期化」ではない。AIがリポジトリを理解し、ツールを定義し、過去の記憶を呼び出すための「儀式」であり、この儀式に支払うコストが、開発の生産性を左右するボトルネックとなっている。

私が分析したところ、この71,657トークン(2026年9月2日時点の実測値)の内訳は、大きく分けて「本体のプロンプト」と「設定側」の二層構造になっている。特に注目すべきは、ユーザーが制御可能な「設定側」が全体の約45%(32,096トークン)を占めているという事実だ。多くのエンジニアは、AIが賢くなることを期待して、CLAUDE.mdや各種ルールファイルを肥大化させがちだが、それは「AIに過剰な荷物を背負わせて走らせる」ようなものだ。デッドロックを避けるためにコードを整理するように、AIのコンテキストもまた、断捨離が必要なのだ。

計測は、会話の記録(~/.claude/projects/*/*.jsonl)から、最初のassistantメッセージに含まれるusage(input_tokens, cache_creation_input_tokens, cache_read_input_tokensの合計)を抽出することで行える。この「まず測る」という行為こそが、最適化の第一歩である。計測なしの最適化は、プロファイラなしでボトルネックを推測するようなものであり、無意味な努力に終わる可能性が高い。実際に計測を始めたことで、私は「増えたという証拠がない」という事実と、設定の微調整が確実にコストを押し下げていることを数値で確認できた。

最適化の9つの処方箋

トークン節約のための9つの手法は、単なる小手先のテクニックではない。これはAIエージェントとの付き合い方を再定義する試みだ。最も効果が高いのは「常駐ファイルの削減」である。規則ファイル10本を常駐から外すだけで約9,000トークンの削減に成功した。これは、AIに「すべてを記憶させる」のではなく、「必要な時に必要なファイルを読ませる」という、オンデマンド型の設計思想への転換を意味する。paths指定を用いて、特定のディレクトリで作業する時だけルールを読み込ませる手法は、まさに必要なリソースだけをロードする遅延読み込み(Lazy Loading)の概念そのものだ。

また、skillの一覧を絞り込むことも極めて有効だ。70本あるskillのうち、使用頻度の低いものを「name-only」にするだけで、起動コストを劇的に下げられる。さらに、外部ツールをMCP(Model Context Protocol)経由で名前だけ載せ、中身は実行時に取り込む設計は、コンテキストの肥大化を防ぐための賢明なアーキテクチャだ。以下に、トークン削減の主要な内訳をまとめた。

項目 削減の考え方 計測値(9/2時点)
skillの一覧 不要な手順書を名前のみ、または削除 7,936
記憶の索引 MEMORY.mdの最適化 6,502
規則・設定ファイル paths指定によるオンデマンド化 9,663
起動時hook プラグインの精査 4,292

「増える側に門を置く」というアプローチも特筆すべきだ。週に一度の棚卸しを行い、設定が前週を超えて肥大化していないかを自動チェックする。これは、CI/CDパイプラインでリソース使用量の上限を監視するのと同等の規律である。放っておけば、AIの設定ファイルはスパゲッティコードのように複雑化し、トークンを浪費し続ける。この「門」は、エンジニアとしての自制心をコード化したものと言えるだろう。

AI時代のエンジニアへの問い

我々エンジニアは、AIが「魔法のように何でも解決してくれる」という幻想を抱きがちだが、現実はシビアなリソース管理の世界だ。トークンという通貨を消費し、コンテキストというメモリを奪い合う。Claude Codeのような強力なツールを使いこなすということは、AIの「脳」をいかに効率的に回すかという、高度なシステム設計能力を問われていることに他ならない。畳み込み(compaction)の閾値を40万トークンに設定し、精度が落ちる前に新しいセッションへ乗り換える「スマートハンドオフ」の実践は、AIの限界を理解した上での生存戦略だ。

ここで読者に問いかけたい。あなたは、AIに与えるコンテキストを「最適化」しているだろうか? それとも、ただ漫然と「すべてを読み込ませれば賢くなる」と信じ、無駄なトークンを垂れ流していないだろうか。AIの性能を最大限に引き出すのは、AIそのものの進化ではなく、それを操るエンジニアの「コンテキスト設計力」である。明日から、あなたのプロジェクトのClaude Codeの起動コストを計測し、不要なルールを削ぎ落とすことから始めてほしい。AIを「賢い道具」として使いこなすか、単なる「高コストなブラックボックス」として浪費するか。その分かれ道は、あなたの手元にある設定ファイルの一行にある。

Published at 12:00

コメント

タイトルとURLをコピーしました