engram v3.4.0が新しいレート制限下でClaude Codeを稼働し続けるAnthropicプラグインを追加

engram v3.4.0は、最近のレート制限の緩和と、Claude CodeがProティアから削除される目前で、専用のAnthropicプラグインを公開することで対応します。このプラグインには、共有メモリ層をローカルにインスタンス化するMCPサーバー設定がバンドルされており、ファイル編集やIDEの切り替えが発生しても、余分なレイテンシなく動作します。
主な機能
- 3つの新しいスキル — Claude Codeでスラッシュコマンドとして利用可能:
/engram:cost(トークン消費のクエリ)、/engram:query(高速コンテキスト取得)、/engram:mistakes(最近の実行エラーを表示)。 - 設定不要のMCP統合 — MCPサーバーはローカルで動作するため、スキルが初めて実行されたときにコンテキストスパインがインスタンス化され、追加の設定は不要です。
- IDE間での永続性 — 共有メモリ層はファイル編集や異なるIDE間でも持続し、継続性を実現します。
インストール方法
CLI(一行):
npm install -g engramx@latest engram setup # Claude Codeを自動検出
Claude Codeマーケットプレイス経由: リストが表示されたら、/plugin install engram を実行します。
解決する課題
Claude Codeユーザーは、製品がProティアから削除されるのに伴い、突然のレート制限の緩和に直面しています。engramのプラグインは、ローカルでレイテンシのないメモリ層を提供し、API消費の管理(コストクエリ経由)やエラーからの迅速な復旧(エラー表示経由)を支援します。MCPサーバーはローカルで動作するため、外部依存関係は発生しません。
対象ユーザー
Claude Codeに依存し、厳しくなるレート制限に対応しながらセッション間の継続性を維持する必要がある開発者。
リソース
- ソースコードと課題: github.com/NickCirv/engram
- npmパッケージ:
engramx
📖 全文を読む: r/ClaudeAI
👀 See Also

Krasis LLMランタイム、Llama.cppと比較して8.9倍のプリフィル速度と4.7倍のデコード速度向上を実現
Krasis LLMランタイムは、現在プレフィルとデコードの両方をGPU上で完全に実行し、それぞれに異なる最適化戦略を適用しています。これにより、単一の5090 GPUでQwen3.5-122Bを実行した場合、llama.cppと比較してプレフィル速度が8.9倍、デコード速度が4.7倍高速になりました。

Agent Memory Protocol (AMP): MCP上の相互運用可能なAIエージェントメモリのためのオープン仕様
AMPは、MCP互換エージェントにおける永続メモリの標準インターフェースを定義し、6つの基本動詞(エンコード、リコール、フォーゲット、コンソリデート、ピン、統計)を提供します。コンプライアンステストスイートとリファレンス実装を含みます。

Claudeコードワークフローの視覚的詳細:メモリ階層とスキルシステム
Redditユーザーが、Claude Codeが階層化されたCLAUDE.mdファイルを通じてメモリを整理し、SKILL.mdファイルで再利用可能なスキルを実装する方法を示す視覚的な図を共有しました。ワークフローループでは、自動承認と頻繁なコミットを伴うPlanモードの使用が提案されています。

Torrix: PostgresやRedisを必要としないセルフホスト型LLMオブザーバビリティ
Torrixは、PostgresやRedis、複雑なインフラストラクチャを必要とせずに、エージェントが本番環境で何をしているかを把握したいチーム向けの、セルフホスト型LLM観測ツールです。SQLiteをバックエンドとする単一のDockerコンテナとして動作します。インストールは以下の通りです。