TideSurf: Ferramenta de compressão DOM reduz uso de tokens de agentes web em 30 vezes, acelera TTFT em 12 vezes

O que o TideSurf faz
O TideSurf é uma ferramenta que aborda um problema comum com agentes de uso do navegador: eles frequentemente dependem da multimodalidade nativa dos modelos em vez de fontes de página concretas, e mesmo quando usam fontes de página, consomem tokens de contexto em excesso. A solução converte o DOM renderizado para um formato compactado semelhante a markdown antes de enviá-lo para agentes de LLM.
Melhorias de desempenho
De acordo com experimentos com páginas do GitHub, o TideSurf reduz o consumo de tokens em 32 vezes em comparação com o DOM bruto. O processo de análise leva aproximadamente 30ms. Em testes específicos com Qwen 3.5 9B (raciocínio desativado, cache KV Q8 quantizado, outras configurações padrão) em um MacBook Pro 14" Final de 2021 (M1 Pro, GPU 14C, 16GB LPDDR5 Unified Memory, MacOS Tahoe 26.2) usando LM Studio 0.4.7-b2 com runtime MLX:
- Tokens por segundo: 24.788 (DOM bruto) vs 26.123 (TideSurf)
- Tempo até o primeiro token: 106.641s vs 8.442s (redução de 12.6x)
- Tempo de geração: 9.117s vs 6.163s
- Tokens do prompt: 17.371 vs 3.312 (incluindo definições de ferramentas)
- Tokens de inferência: 226 vs 161
Capacidades das ferramentas
O TideSurf inclui 18 ferramentas para LLMs trabalharem interativamente com páginas da web. Essas ferramentas funcionam com qualquer modelo que tenha capacidades de chamada de ferramentas. O sistema suporta interfaces CLI e MCP (Model Context Protocol).
Status atual e disponibilidade
Este é um projeto inicial na versão 0.3, e o desenvolvedor está buscando feedback. O TideSurf está disponível como um pacote npm (@tidesurf/core), com documentação em tidesurf.org/docs e código-fonte no GitHub.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude TimeTrack: aplicativo da barra de menus do macOS que lê arquivos JSONL do Claude Code para rastrear automaticamente o tempo de desenvolvimento por projeto
App de código aberto para a barra de menus do macOS que analisa arquivos JSONL de sessão do Claude Code e histórico do git para rastrear automaticamente o tempo por projeto — sem temporizadores manuais.
GLiGuard: Modelo de Moderação de Segurança de Código Aberto com 300 Milhões de Parâmetros Alega Aceleração de 16x sobre Barreiras de LLM
Fastino Labs lança GLiGuard, um modelo baseado em encoder de 300 milhões de parâmetros que realiza múltiplas tarefas de segurança em uma única passagem, superando ou igualando modelos 23 a 90 vezes maiores enquanto é até 16 vezes mais rápido.

Lançamento do Modelo Qwen 3.5 Chat com 21 Correções de Bugs para Fluxos de Trabalho de Agentes
Um desenvolvedor lançou um modelo de chat corrigido para os modelos Qwen 3.5, abordando 21 bugs, incluindo falhas na chamada de ferramentas, separação de chamadas paralelas e estabilidade do loop do agente. É uma substituição direta testada em llama.cpp, Open WebUI, vLLM e outras plataformas.

Mind Keg MCP: Memória Persistente para Claude Code e Agentes Compatíveis com MCP
Mind Keg MCP v0.1.1 é um servidor MCP de código aberto que fornece memória persistente para Claude Code e outros agentes compatíveis com MCP. Ele armazena aprendizados localmente via SQLite e os recupera através de busca semântica, permitindo que assistentes de codificação de IA lembrem o contexto entre sessões.