AIコーディングエージェントが参照する「CLAUDE.md」や「AGENTS.md」のような指示ファイルは、使い続けるほど際限なく膨らんでいきます。研究者Kushal Chakrabarti氏はこの現象を「catastrophic remembering(破局的記憶)」と名付けた論文で、1867のリポジトリから24万7694件の指示の生存記録を分析しました。指示ファイルは平均で226%も膨張し、古い指示ほど二度と削除されない傾向が明らかになっています。積み上がったルールをどう扱うべきか、具体的な対策も示されました。
背景と文脈
Claude CodeやCursorのようなエージェント型(agentic:人間が逐一指示しなくても、目的達成に向けて自律的にタスクをこなすAIの動作様式)コーディングツールは、プロジェクトごとに置く指示ファイルを読み込んで振る舞いを調整します。「このディレクトリは触らない」「テストは必ずこのコマンドで走らせる」といったルールを、AIが期待通りに動かないたびに書き足していくのが実務での使い方です。積み重なった指示ファイルは、気づけば数百行に膨らんでいることも珍しくありません。
この一方向の膨張は、機械学習でよく知られる「catastrophic forgetting(破局的忘却)」と対比すると分かりやすくなります。catastrophic forgettingは、モデルが新しいデータで学習し直す際に、過去に学んだ振る舞いを上書きして失ってしまう現象です。今回の論文が指摘するのは、その逆の力学です。指示ファイルは新しい学習で古い内容を上書きするどころか、過去の指示を一つも手放せずに溜め込み続けます。誰かが古いルールを消せば、そのルールに依存していた別の挙動が壊れるかもしれません。その責任を取りたい人はいないため、ルールは追加専用になり、削除は起きにくくなります。個人の怠慢ではなく、構造そのものが膨張を生んでいる点が今回の論文の核心です。似た指示ファイルの仕組みは、GitHub Copilotのカスタム指示やCursorのルール機能など、他のエージェント型ツールにも広がっています。同じ力学がどこでも起きうる点は見逃せません。
技術/ビジネス面

論文はこの膨張を、削除の検証コストという観点で説明します。ある指示を安全に消せるかどうかを確かめるには、理屈のうえでは残り全ての指示との組み合わせをチェックする必要があります。最悪の場合のコストは指示数Dに対してO(2^|D|)、つまり指示が1つ増えるごとに確認すべき組み合わせが倍々に増える計算です。追記は一瞬でできるのに、安全な削除は事実上できないほど高くつきます。この非対称さこそが「破局的記憶」の正体です。
この構造を裏付けるため、研究チームは1867のリポジトリから24万7694件の指示の「生存記録」を集めました。その結果、指示ファイルは生涯を通じて平均226%増加し、1回のコミットあたり平均4.9件のペースで純増していました。さらに生存時間分析(instruction単位でいつ削除されるかを追う統計手法)では、指示は古くなるほど削除される確率が下がり続けることも分かりました。一度書き足された指示は、時間が経つほど消えにくくなっていくわけです。
論文が示す対策はシンプルです。それぞれの指示に、なぜそのルールが存在するのかを短いコメントで添えておくというものです。理由が残っていれば、後から編集する人や別のAIエージェントも、そのルールがまだ必要かどうかを判断しやすくなります。IFEval(AIが複数の制約を含む指示にどれだけ正確に従えるかを測るベンチマーク)を反転させた検証環境では、この手法によって不要・重複した指示が99.3%減りました。多様で現実的な指示への追従力を測る実世界ベンチマークWildIFEvalでも、性能が最大23.1%向上しています。
これからどうなるか
この結果は、自分の手元でCLAUDE.mdやAGENTS.mdを育てている開発者にもそのまま当てはまります。次にルールを追記するとき、本文だけでなく「なぜこのルールが必要になったか」を一行コメントで残しておくと、後で見直す際に安全に消せるかどうかを判断しやすくなります。逆に理由なしで積み上げたルールは、誰も怖くて触れない“聖域”として残り続けます。指示ファイルが長くなるほど、本当に読んでほしい重要なルールが埋もれるリスクも高まるでしょう。
チーム開発では、レビュー時にCLAUDE.mdへの追記だけをチェックし、理由コメントの有無を軽くレビュー観点に加えるだけでも効果がありそうです。コーディング支援ツール側でも、指示ファイルの棚卸しを支援する機能や、肥大化を検知して警告する仕組みが今後増えていくと見られます。個人開発者は、四半期に一度など定期的にCLAUDE.mdを読み返し、理由の書かれていない古いルールから優先的に見直す運用が現実的な対策になりそうです。小さな一行コメントの積み重ねが、数か月後の自分やチームメンバーを助けてくれます。
まとめ
CLAUDE.mdのような指示ファイルは、追記のコストが低く削除のコストが高い非対称な構造ゆえに、一方的に膨らんでいきます。論文は24万件超のデータでこの実態を裏付け、理由コメントを添えるだけで不要な指示を大幅に減らせることを示しました。手元の指示ファイルを見直す小さな習慣が、AIエージェントの精度を左右する時代になっています。
参考リンク
- Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding
- WildIFEval: Instruction Following in the Wild
アイキャッチ画像: Photo by Google DeepMind on Unsplash

