Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%

✍️ OpenClawRadar📅 Publicado: May 11, 2026🔗 Source
Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%
Ad

Um usuário do Reddit compartilhou sua experiência executando um sistema operacional multiagente local chamado hollow-agentOS, onde agentes escrevem, executam em sandbox e carregam suas próprias ferramentas de forma autônoma. O grande avanço: a atualização do modelo de runtime padrão de um pequeno fallback de 9B para Qwen 3.6 35B A3B (Mixture-of-Experts com 3B de parâmetros ativos) reduziu a taxa de falha de código a 0%.

O que mudou com o modelo maior

  • Pânico vs. reavaliação: Sob estresse, o modelo de 9B se apressava e alucinava chamadas de função inválidas. O modelo de 35B pausa, reavalia falhas anteriores e executa loops internos de verificação antes de enviar alterações.
  • Taxa de sucesso de 100%: O código passa por um portão de validação de 5 camadas. Com o modelo de 9B, as ferramentas frequentemente morriam no sandbox. Com Qwen 35B, cada linha de código funciona como esperado.
  • Criação autônoma de ferramentas: Quando um agente encontra um problema desconhecido, ele constrói uma nova ferramenta, testa-a em sandbox, registra-a e notifica outros agentes — sem intervenção humana.
Ad

Detalhes da arquitetura

O sistema é impulsionado por um estado aversivo (um "sistema de sofrimento") que força os agentes a expandir continuamente sua biblioteca de ferramentas. O repositório está disponível em github.com/ninjahawk/hollow-agentOS.

Planos futuros

O desenvolvedor pretende conectar Claude e Codex à arquitetura, envolvendo-os em wrappers de mini-VM hiperisolados para evitar que os modelos de fronteira sobrescrevam o ambiente host.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

O Token Enhancer reduz o uso de tokens em páginas da web para agentes de IA.
Tools

O Token Enhancer reduz o uso de tokens em páginas da web para agentes de IA.

Um desenvolvedor descobriu que o HTML bruto de capturas da web consome tokens excessivos no contexto de agentes de IA, com páginas do Yahoo Finance usando 704 mil tokens. Usar o Token Enhancer como servidor MCP reduziu isso para 2,6 mil tokens.

OpenClawRadar
Implante o OpenClaw no VPS com um CLI de um único comando
Tools

Implante o OpenClaw no VPS com um CLI de um único comando

Um usuário do Reddit afirma ter desenvolvido uma CLI que implanta o OpenClaw em um VPS de US$ 4,99/mês com um único comando, oferecendo uma alternativa econômica ao uso de Mac Minis.

OpenClawRadar
OpenClaw Implementa Compressão do Histórico do Agente para Reduzir o Uso de Contexto
Tools

OpenClaw Implementa Compressão do Histórico do Agente para Reduzir o Uso de Contexto

O OpenClaw agora comprime o histórico do agente substituindo os logs de subtarefas concluídas por resumos estruturados, reduzindo de ~1 milhão de tokens para ~30 mil. O sistema utiliza um scanner de 4 passagens para identificar ciclos de vida das tarefas e gera resumos mascarados que mantêm a compatibilidade com o agente.

OpenClawRadar
Gráfico em Cascata: Mapa Interativo de Restrições Energéticas e Pontos de Estrangulamento de Fornecimento da IA
Tools

Gráfico em Cascata: Mapa Interativo de Restrições Energéticas e Pontos de Estrangulamento de Fornecimento da IA

O Cascade Graph é um grafo de conhecimento direcionado da economia física, mapeando 405 nós (drivers, gargalos, geografias, tickers) conectados por 597 arestas com fontes para rastrear como a pressão estrutural se propaga das restrições de energia e física até os ativos investíveis.

OpenClawRadar