Validação do padrão de habilidades de autoevolução: resultados do experimento de 5 rodadas

✍️ OpenClawRadar📅 Publicado: March 8, 2026🔗 Source
Validação do padrão de habilidades de autoevolução: resultados do experimento de 5 rodadas
Ad

Configuração do experimento e resultados

Um desenvolvedor conduziu um experimento de 5 rodadas para validar o padrão de design Self-Evolving Skill para Claude Code, que foi compartilhado anteriormente. O experimento utilizou um banco de dados MySQL com 29 tabelas e 590MB de dados de um sistema de gerenciamento de edifícios inteligentes.

As rodadas seguiram esta progressão: exploração de estrutura → consultas de dados → descoberta de regras → investigação complexa → verificação repetida.

Ad

Principais descobertas

  • Taxa de rejeição do Five-Gate: 63,6% — a maioria das interações não produziu mudança no conhecimento
  • Convergência incremental: +75 → +46 → +12 → +21 → +1
  • Auto-correção do Gate 2: O padrão detectou e corrigiu 2 regras errôneas que a Skill havia escrito em rodadas anteriores
  • Rodada 5: Zero etapas de exploração, reutilização direta de template
  • Precisão: 100% — nenhum conhecimento incorreto sobreviveu ao processo

Uma descoberta inesperada foi que as armadilhas de uso de ferramentas foram capturadas como um subproduto de alto valor — problemas que o desenvolvedor não projetou, mas que o Five Gates detectou mesmo assim.

O desenvolvedor tem um segundo experimento em andamento em um banco de dados maior de cobrança de telecomunicações. Dados completos com snapshots diferenciáveis por rodada estão disponíveis no GitHub.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Exportando Memórias de Agentes de IA Usando a Função de Importação do Claude
Tools

Exportando Memórias de Agentes de IA Usando a Função de Importação do Claude

Um usuário do Reddit compartilha um prompt para extrair memórias armazenadas de agentes de IA como ChatGPT e Claude, e depois importá-las para o OpenClaw. O prompt solicita todo o contexto armazenado, incluindo instruções, detalhes pessoais, projetos, ferramentas e preferências.

OpenClawRadar
Servidor de Busca MCP com Classificação Orientada por Feedback para Claude Desktop
Tools

Servidor de Busca MCP com Classificação Orientada por Feedback para Claude Desktop

Um servidor de busca MCP construído pela comunidade para o Claude Desktop executa os mecanismos de busca Exa e Tavily em paralelo sem exigir chaves de API. Após usar um resultado, os usuários relatam se funcionou por meio de uma ferramenta de resultado, que retroalimenta o sistema de classificação para priorizar URLs que ajudam os agentes a ter sucesso.

OpenClawRadar
Jeeves: Interface de Usuário em Terminal para Navegar e Retomar Sessões de Agentes de IA
Tools

Jeeves: Interface de Usuário em Terminal para Navegar e Retomar Sessões de Agentes de IA

Jeeves é uma interface de usuário de terminal que permite pesquisar, visualizar e retomar sessões de agentes de IA do Claude Code, Codex e OpenCode em uma única visualização. Ele é escrito em Go e está disponível através de vários gerenciadores de pacotes, incluindo Homebrew, Nix e Go install.

OpenClawRadar
RubyLLM: Um Framework Ruby para Todos os Principais Provedores de IA
Tools

RubyLLM: Um Framework Ruby para Todos os Principais Provedores de IA

RubyLLM fornece um único framework Ruby para OpenAI, Anthropic, Gemini, Ollama e 800+ modelos. Oferece chat, visão, áudio, ferramentas, agentes, streaming e integração com Rails.

OpenClawRadar