Bespoke AI v0.8.1: Extensão de Autocompletar do VS Code para Código e Texto

Bespoke AI v0.8.1 é uma extensão do VS Code que fornece funcionalidade de autocompletar tanto para código quanto para texto não-código. O desenvolvedor criou-a após não encontrar projetos decentes de autocompletar de código aberto que funcionassem bem para autocompletar de texto.
Detalhes Principais
A extensão aproveita assinaturas existentes do Claude Code através do SDK do Agente da Anthropic, permitindo que os usuários acessem autocompletar de potência total (incluindo Opus) sem incorrer em cobranças de API. Alternativamente, os usuários podem configurá-la para usar qualquer API que desejarem, incluindo Ollama.
A extensão está disponível no VS Code Marketplace em https://marketplace.visualstudio.com/items?itemName=TrentMcNitt.bespoke-ai e o código-fonte está hospedado no GitHub em https://github.com/trentmcnitt/bespoke-ai-vscode-ext.
O desenvolvedor está buscando testadores para validar a extensão em configurações diferentes da sua própria. O feedback pode ser fornecido via comentários no post do Reddit, mensagens diretas ou criando issues no repositório do GitHub.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Benchmarking do Nemotron 3 Super 120B com contexto de 1 milhão de tokens no M1 Ultra
Um usuário testou o Nemotron 3 Super 120B com um modelo quantizado Q4_K_M usando llama.cpp em um M1 Ultra, alcançando uma janela de contexto de 1 milhão de tokens que consumiu aproximadamente 90 GB de VRAM. Os benchmarks de desempenho mostram velocidades de geração de tokens variando de 255 t/s no processamento de prompt de 512 até 22,37 t/s em contexto de 100.000 tokens.

Gerenciando Múltiplas Tarefas de Agentes de IA com Quadros Kanban
Um desenvolvedor compartilha sua experiência executando múltiplos agentes de IA Claude em abas de terminal e identifica três desafios principais no fluxo de trabalho: falta de visibilidade do progresso, perda de contexto ao alternar entre tarefas e interrupções por limite de taxa. Sua solução envolve tratar tarefas de IA como itens de trabalho em um quadro Kanban.

Galadriel: Estrutura de Cache Quente de Código Aberto para Agentes Persistentes do Claude
Galadriel é um harness de cache em 3 camadas para Claude que reduz custos em 87% e a latência para menos de 3s em prompts de 100K tokens. Integra o MemPalace para memória vetorial persistente.

Markdown como Protocolo para Interface de Agente com Execução em Fluxo Contínuo
Um protótipo usa Markdown como um protocolo unificado para agentes de IA transmitirem texto, código executável e dados em uma única resposta. Ele apresenta execução em streaming, onde o código é executado instrução por instrução conforme chega, e um primitivo mount() para criar interfaces React com fluxo de dados entre cliente, servidor e LLM.