CAL: LLMエージェントのためのオープンソースコンテキスト最適化レイヤー

✍️ OpenClawRadar📅 公開日: April 15, 2026🔗 Source
CAL: LLMエージェントのためのオープンソースコンテキスト最適化レイヤー
Ad

CALの機能

CALは、既存のコードとLLM API呼び出しの間に位置するPythonライブラリで、各リクエストに対してコンテキストをインテリジェントに選択、圧縮、組み立てます。トークン使用量の多いエージェント設定におけるコストとコンテキストの問題に対処し、特に最近のClaude Pro/Maxサブスクリプションの変更に関連しています。

パフォーマンスベンチマーク

Claude Opus 4と103のコンテキストチャンクを使用した本番環境での結果:

  • CALなし:すべてのリクエストで103チャンクすべて(約23,000トークン)を送信し、1リクエストあたり$0.043
  • CALあり:約6チャンク、4,100トークンに減少し、1リクエストあたり$0.008
  • 結果:トークン83%削減、コスト81%削減

5,000のWildChatプロンプト(57言語にわたる実際のLLM会話のオープンアカデミックデータセット)に対して検証され、平均97.6%の節約を実現。

主な機能

  • セレクター: IDF加重スコアリングにより、クエリごとに関連するチャンクのみを選択。安定したプレフィックスとリクエストごとに動的に選択されるチャンクを使用。
  • ツールスタブ: 3段階のレイジーローディングを実装し、モデルが特定のツールを使用する意図を示すまで軽量なスタブを使用。
  • コストエンジン: プロバイダーを認識する節約計算機で、Anthropicの4つの入力階層とGoogleのキャッシュストレージ価格を把握。
  • ノイズ抑制: IDFフロアとrequire-anyゲートにより、一般的な単語がすべてのリクエストで無関係なチャンクをロードするのを防止。
  • キャッシュ安定順序付け: 選択にはスコアのみを使用し、位置はアルファベット順でキャッシュヒットを維持。
Ad

技術詳細

マルチターンコンテキスト処理:ツールスタブは履歴を認識。モデルが前のターンでツールを使用した場合、完全なスキーマがロードされたまま維持され、会話の連続性を保ちます。

プロバイダーサポート:CALはプロバイダーに依存せず、チャット完了エンドポイントを持つあらゆるプロバイダーで動作。コストエンジンは既にAnthropicの4つの入力階層とGoogleのキャッシュストレージ価格を処理。

エッジケース:曖昧なクエリに対してIDFフロアとノイズ抑制を使用。ハイブリッドキーワード+セマンティックスコアリングはロードマップに含まれています。

インストールとライセンス

pip install cal-context

MITライセンス。PyPI:https://pypi.org/project/cal-context/

GitHub:https://github.com/vjc-lab/context-assembly-layer

📖 Read the full source: r/openclaw

Ad

👀 See Also

Claude Codeのセッションログを全てディスクに保存 — インデックス化と呼び出し方法
Tools

Claude Codeのセッションログを全てディスクに保存 — インデックス化と呼び出し方法

Claude Code はすべてのセッションターンを ~/.claude/projects/ に JSONL として書き込んでいます。あるユーザーは 1026 セッション (57MB、76K ターン) を SQLite+FTS5 にインデックス化し、MCP サーバーを介した検索とスレッド呼び出しを実現しました。

OpenClawRadar
ローカルAI画像批評ツール、Ollama Visionモデルを活用してフィードバックを提供
Tools

ローカルAI画像批評ツール、Ollama Visionモデルを活用してフィードバックを提供

開発者が、Ollamaのビジョンモデルを利用してAI生成画像をローカルで分析する無料デスクトップアプリケーションを作成しました。このツールは、改善提案やプロンプトのアップグレードを含む構造化されたフィードバックレポートを提供します。

OpenClawRadar
オープンソースのGmail MCPサーバーが、複数アカウント対応と書き込みアクセス機能を追加しました。
Tools

オープンソースのGmail MCPサーバーが、複数アカウント対応と書き込みアクセス機能を追加しました。

オープンソースのMCPサーバーにより、Claude AIが複数のGmailアカウントに接続し、アーカイブ、ラベル付け、自動購読解除機能を含む完全な読み書き機能を利用できるようになります。Gmail検索構文をサポートし、Railwayへの5分でのデプロイまたはセルフホスティングが可能です。

OpenClawRadar
ローカルLLMをClaudeコードサブエージェントとして使用してコンテキスト使用量を削減する
Tools

ローカルLLMをClaudeコードサブエージェントとして使用してコンテキスト使用量を削減する

Redditユーザーが、Claude CodeがLM Studioを介して実行されるローカルLLMにタスクを委譲し、ファイルの内容をClaudeのコンテキストから除外する方法を実演しています。このセットアップでは、LM Studioのツール呼び出しAPIを使用してファイル操作をローカルで処理する約120行のPythonスクリプトが用いられています。

OpenClawRadar