engram v3.4.0 adiciona plugin Anthropic para manter o Claude Code funcionando sob novos limites de taxa

engram v3.4.0 aborda as recentes reduções de limite de taxa e a iminente remoção do Claude Code do nível Pro, expondo um plugin dedicado da Anthropic. O plugin inclui uma configuração de servidor MCP que instancia uma camada de memória compartilhada localmente, sobrevivendo a edições de arquivos e trocas de IDE sem latência extra.
Principais Recursos
- Três novas habilidades acessíveis por comandos de barra no Claude Code:
/engram:costpara consultas de gastos de tokens,/engram:querypara recuperação rápida de contexto e/engram:mistakespara exibir erros recentes de execução. - Integração MCP sem configuração — o servidor MCP é executado localmente, então a espinha de contexto é instanciada na primeira vez que uma habilidade é executada, sem configuração adicional.
- Persistência entre IDEs — a camada de memória compartilhada persiste em edições de arquivos e até mesmo entre diferentes IDEs, permitindo continuidade.
Instalação
CLI (uma linha):
npm install -g engramx@latest engram setup # detecta Claude Code automaticamente
Via mercado Claude Code: Quando a listagem aparecer, execute /plugin install engram.
O Que Resolve
Os usuários do Claude Code enfrentaram reduções repentinas de limite de taxa com a iminente remoção do produto do nível Pro. O plugin do engram fornece uma camada de memória local sem latência que ajuda a gerenciar o consumo da API (via consultas de custo) e a se recuperar rapidamente de erros (via exibição de erros). O servidor MCP é executado localmente, portanto, nenhuma dependência externa é introduzida.
Para Quem É
Desenvolvedores que dependem do Claude Code e precisam contornar limites de taxa mais apertados, mantendo a continuidade entre as sessões.
Recursos
- Código fonte e problemas: github.com/NickCirv/engram
- Pacote npm:
engramx
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Claude Code prompts de código aberto, engenharia reversa usando Claude
Um desenvolvedor usou o Claude para reescrever todos os 26 prompts do código-fonte do Claude Code após estudar a base de código TypeScript durante uma breve janela de disponibilidade pública. A coleção licenciada pelo MIT inclui prompts de sistema, ferramentas, agentes, memória, coordenador e utilitários.

Apresentando o Lean Collab: Um Orquestrador Multiagente para Tarefas de LLM de Longa Duração
Lean Collab é um orquestrador de código aberto projetado para gerenciar tarefas de longa duração de LLM usando subagentes coordenados e paralelos.

Flash-MoE: Executando o Modelo Qwen de 397B Parâmetros no MacBook Pro com C/Metal Puro
Flash-MoE é um mecanismo de inferência puro em C/Metal que executa o modelo Qwen3.5-397B-A17B, um modelo Mixture-of-Experts com 397 bilhões de parâmetros, em um MacBook Pro com 48GB de RAM a 4.4+ tokens/segundo. O modelo de 209GB é transmitido do SSD por meio de shaders de computação Metal personalizados, sem Python ou frameworks.

Sistema de Memória Persistente Sem Código para Claude Usando Notion e MCP
Um radiologista construiu um 'Hub Cognitivo' no Notion que o Claude lê e escreve através do MCP, criando uma base de conhecimento estruturada com uma tabela de roteamento para carregar apenas informações relevantes por conversa. O sistema cresceu para mais de 70 páginas após um mês de uso diário.