Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%

Um usuário do Reddit compartilhou sua experiência executando um sistema operacional multiagente local chamado hollow-agentOS, onde agentes escrevem, executam em sandbox e carregam suas próprias ferramentas de forma autônoma. O grande avanço: a atualização do modelo de runtime padrão de um pequeno fallback de 9B para Qwen 3.6 35B A3B (Mixture-of-Experts com 3B de parâmetros ativos) reduziu a taxa de falha de código a 0%.
O que mudou com o modelo maior
- Pânico vs. reavaliação: Sob estresse, o modelo de 9B se apressava e alucinava chamadas de função inválidas. O modelo de 35B pausa, reavalia falhas anteriores e executa loops internos de verificação antes de enviar alterações.
- Taxa de sucesso de 100%: O código passa por um portão de validação de 5 camadas. Com o modelo de 9B, as ferramentas frequentemente morriam no sandbox. Com Qwen 35B, cada linha de código funciona como esperado.
- Criação autônoma de ferramentas: Quando um agente encontra um problema desconhecido, ele constrói uma nova ferramenta, testa-a em sandbox, registra-a e notifica outros agentes — sem intervenção humana.
Detalhes da arquitetura
O sistema é impulsionado por um estado aversivo (um "sistema de sofrimento") que força os agentes a expandir continuamente sua biblioteca de ferramentas. O repositório está disponível em github.com/ninjahawk/hollow-agentOS.
Planos futuros
O desenvolvedor pretende conectar Claude e Codex à arquitetura, envolvendo-os em wrappers de mini-VM hiperisolados para evitar que os modelos de fronteira sobrescrevam o ambiente host.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Calculadora de Custos Free OpenClaw Mostra Despesas de Configuração Antes da Execução
Um desenvolvedor criou uma ferramenta de navegador gratuita e de código aberto que calcula os custos de configuração do OpenClaw antes da execução, detalhando despesas por modelo principal, cadeias de fallback, consumo de heartbeat e modo de cobrança.

23 Habilidades do Agente para Desenvolvimento iOS 26 com SwiftUI e Swift 6.2
Um desenvolvedor criou 23 habilidades de agente direcionadas ao iOS 26+ e Swift 6.2 para resolver problemas de alucinação com APIs obsoletas e padrões desatualizados. As habilidades abrangem SwiftUI, SwiftData, StoreKit 2, notificações push, rede, concorrência, acessibilidade, localização, WidgetKit, MapKit e mais.

Claude IDE Bridge: Ferramenta MCP para Acesso Remoto ao Editor
Claude IDE Bridge é uma ferramenta de código aberto que fornece ao Claude AI acesso de controle remoto a editores de código via MCP (Model Context Protocol). Ele expõe conhecimento do editor como informações de tipo em tempo real e estado do depurador como ferramentas acionáveis.

ScreenMind: Memória de IA Local que Indexa Toda a Atividade do Seu Computador
O ScreenMind captura sua tela, reuniões e notas de voz usando Gemma 4 E2B localmente via llama.cpp. Funciona com 4GB+ de VRAM com quantização Q4. Pesquise atividades passadas, converse com o histórico e conecte-se ao Claude/Cursor via MCP.