クラウ・コンパクター:LLMパイプライン向け14段階トークン圧縮エンジン

✍️ OpenClawRadar📅 公開日: March 18, 2026🔗 Source
クラウ・コンパクター:LLMパイプライン向け14段階トークン圧縮エンジン
Ad

Claw Compactorとは?

Claw Compactorは、14段階のFusion Pipelineを中心に構築されたオープンソースのLLMトークン圧縮エンジンです。各段階は特殊な圧縮器(ASTを考慮したコード分析からJSON統計サンプリング、simhashベースの重複排除まで)で構成され、各段階の出力が次の段階に渡される不変データフローアーキテクチャを通じて連鎖しています。

アーキテクチャの詳細

Fusion Pipelineには以下の段階が含まれます:

  • QuantumLock → Cortex → Photon → RLE → SemanticDedup → Ionizer
  • LogCrunch → SearchCrunch → DiffCrunch → StructuralCollapse
  • Neurosyntax → Nexus → TokenOpt → Abbrev

主要な設計原則:

  • 不変データフロー — FusionContextは凍結されたデータクラスです。各段階は新しいFusionResultを生成し、何もその場で変更されません。
  • 圧縮前のゲート — 各段階にはshould_apply()があり、作業前にコンテキストタイプ、言語、役割を検査します。適用されない段階はコストゼロでスキップされます。
  • コンテンツ認識ルーティング — Cortexはコンテンツタイプ(コード、JSON、ログ、差分、検索結果)と言語(Python、Go、Rust、TypeScriptなど)を自動検出し、下流の段階がタイプを考慮した圧縮決定を行います。
  • 可逆圧縮 — Ionizerはオリジナルをハッシュアドレス指定のRewindStoreに保存します。LLMはツールを呼び出して、マーカーIDで圧縮されたセクションを取得できます。

ベンチマーク結果

実世界の圧縮(FusionEngine v7 vs 従来の正規表現):

  • Pythonソース:25.0%圧縮(従来比3.4倍改善)
  • JSON(100項目):81.9%圧縮(従来比6.5倍改善)
  • ビルドログ:24.1%圧縮(従来比4.4倍改善)
  • エージェント会話:31.0%圧縮(従来比5.4倍改善)
  • Git差分:15.0%圧縮(従来比2.4倍改善)
  • 検索結果:40.7%圧縮(従来比7.7倍改善)
  • 加重平均:53.9%圧縮(従来比5.9倍改善)

SWE-bench実タスク:

  • django__django-11620(4.5K):14.5%圧縮
  • sympy__sympy-14396(5.5K):19.1%圧縮
  • scikit-learn-25747(11.8K):15.9%圧縮
  • scikit-learn-13554(73K):11.8%圧縮
  • scikit-learn-25308(81K):14.4%圧縮

LLMLingua-2との比較(ROUGE-L忠実度):

  • 圧縮率0.3(積極的):Claw Compactor 0.653 vs LLMLingua-2 0.346(+88.2%)
  • 圧縮率0.5(バランス):Claw Compactor 0.723 vs LLMLingua-2 0.570(+26.8%)
Ad

クイックスタート

git clone https://github.com/open-compress/claw-compactor.git
cd claw-compactor
# ワークスペースのベンチマーク(非破壊的)
python3 scripts/mem_compress.py /path/to/workspace benchmark
# 完全圧縮パイプライン
python3 scripts/mem_compress.py /path/to/workspace full

要件:Python 3.9以上。オプション:正確なトークンカウントにはpip install tiktoken。

APIの使用法

from scripts.lib.fusion.engine import FusionEngine

engine = FusionEngine() result = engine.compress( text="def hello(): \n # greeting function \n print('hello')", content_type="code", # またはCortexに自動検出させる language="python", # オプションのヒント ) print(result["compressed"]) # 圧縮出力 print(result["stats"]) # 段階ごとの統計

📖 Read the full source: HN LLM Tools

Ad

👀 See Also

ローカルLLMをClaudeコードサブエージェントとして使用してコンテキスト使用量を削減する
Tools

ローカルLLMをClaudeコードサブエージェントとして使用してコンテキスト使用量を削減する

Redditユーザーが、Claude CodeがLM Studioを介して実行されるローカルLLMにタスクを委譲し、ファイルの内容をClaudeのコンテキストから除外する方法を実演しています。このセットアップでは、LM Studioのツール呼び出しAPIを使用してファイル操作をローカルで処理する約120行のPythonスクリプトが用いられています。

OpenClawRadar
多段階LLMワークフローのための決定論的コンパイラアーキテクチャが強力なベンチマーク結果を示す
Tools

多段階LLMワークフローのための決定論的コンパイラアーキテクチャが強力なベンチマーク結果を示す

構造化されたLLMワークフローのための決定論的コンパイルアーキテクチャは、型付きノードレジストリ、パラメータ契約、静的検証を使用して、ワークフローグラフを事前にコンパイルします。ベンチマークでは、3〜12以上のノード深度にわたるワークフローで、GPT-4.1およびClaude Sonnet 4.6を上回る性能を示しています。

OpenClawRadar
Agentlint: すべてのPRでCLAUDE.mdの矛盾や壊れたポインタを検出するGitHubアプリ
Tools

Agentlint: すべてのPRでCLAUDE.mdの矛盾や壊れたポインタを検出するGitHubアプリ

Agentlintは、すべてのPRでエージェントルール面(CLAUDE.md、AGENTS.md、スキル、フック)を監査し、矛盾、パス切れ、サポート外のハーネス機能に対してインラインコメントを投稿するGitHubアプリです。パブリックリポジトリでは無料で利用できます。

OpenClawRadar
ヴォイガー、フレッシュプレイスインテリジェンス向けビジネス検証APIを開始
Tools

ヴォイガー、フレッシュプレイスインテリジェンス向けビジネス検証APIを開始

Voygrのビジネス検証APIは、複数のデータソースを集約し、矛盾するシグナルを検出することで、企業が営業中、閉鎖中、ブランド変更中、または無効であるかどうかをチェックします。チームは、正確な場所データとニュース、記事、イベントなどの最新のウェブコンテキストを組み合わせた、無限にクエリ可能な場所プロファイルを構築しています。

OpenClawRadar