デュアルモデルアーキテクチャは、長い会話においてトークン消費量を半減させます。

✍️ OpenClawRadar📅 公開日: March 9, 2026🔗 Source
デュアルモデルアーキテクチャは、長い会話においてトークン消費量を半減させます。
Ad

AIエージェントのためのコンテキスト圧縮システム

r/ClaudeAIの開発者が、会話圧縮後にAIエージェントがコンテキストを失う問題に対する解決策を共有しました。このシステムは、安価な小さなモデル(「潜在意識」と呼ばれる)がバックグラウンドで継続的に会話履歴を圧縮する二重モデルアーキテクチャを使用しています。

アーキテクチャの詳細

このシステムは4つの層で構成されています:

  • ナラティブ要約(約1Kトークン)
  • 圧縮された事実情報
  • 意味的に検索された逐語引用
  • 生の最近のやり取り

メインモデル(「意識」)は、通常は120Kトークンの生の履歴が必要となる情報密度を維持しながら、精選された約35Kトークンのコンテキストを受け取ります。メインモデルは一貫したタイムラインを読み取り、メモリシステムの存在を知りません。

パフォーマンス結果

開発者は、異なる会話タイプにわたる260ターンをシミュレーションしました。継続的なプロジェクト作業(重い調査から始まり、モデルがドメインを学習するにつれて迅速なやり取りに移行する)では、このシステムはトークン消費量を約半分に削減します。

開発ツール

このシステムは、シミュレーション用にClaude Code、コンサルティングおよび研究段階でClaude.aiを使用して構築されました。開発者は、小さなモデルをルーティングして大きなモデルのコンテキストを管理しようとしたり、圧縮問題に対する他の回避策を見つけたりした他の人々を探しています。

📖 完全なソースを読む: r/ClaudeAI

Ad

👀 See Also

改訂:エージェンティック・コーディングツールとY.js CRDTで構築されたAIエディター
Tools

改訂:エージェンティック・コーディングツールとY.js CRDTで構築されたAIエディター

Reviseは、エージェント型コーディングツールを使用して10ヶ月間にわたって一から構築されたAI文書エディターです。カスタムワードプロセッサエンジンとレンダリング層を備え、CRDTスタックにはY.jsのみを使用しています。校正と修正のため、GPT-5.4バリアントやClaudeモデルなど複数のAIモデルを統合しています。

OpenClawRadar
ExposureGuard MCPサーバーがClaude Desktopにドメインセキュリティスキャン機能を追加
Tools

ExposureGuard MCPサーバーがClaude Desktopにドメインセキュリティスキャン機能を追加

開発者がClaude Codeを使用してドメインセキュリティスキャンのためのMCPサーバーを構築し、SPF、DMARC、SSL、セキュリティヘッダー、DNSSEC、開放ポート、MX、HTTPSをチェックする4つのツールを公開しました。このサーバーはpip install exposureguard-mcpで利用可能で、無料枠は1日あたり100回のAPI呼び出しです。

OpenClawRadar
OpenClaw iOSアプリは、最大18ヶ月分の過去のApple Healthデータ同期機能を追加しました。
Tools

OpenClaw iOSアプリは、最大18ヶ月分の過去のApple Healthデータ同期機能を追加しました。

OpenClaw iOSアプリの最新バージョンでは、Apple Healthの過去データのエクスポートが可能になり、ユーザーは最大18か月分の健康データをエージェントと同期して、パーソナライズされた分析やAIトレーニングに活用できます。

OpenClawRadar
APEXテストベンチマーク結果:実践的コーディングタスクにおけるQwen 3.5の性能
Tools

APEXテストベンチマーク結果:実践的コーディングタスクにおけるQwen 3.5の性能

APEXテストベンチマークの結果によると、Qwen 3.5モデルは70の実際のGitHubコーディングタスクで評価され、397Bバージョンはマスターレベルのタスクで1194 ELOまで低下しました。一方、GLM-4.7量子化モデルは1572 ELOでローカルモデルをリードしています。

OpenClawRadar