Validação do padrão de habilidades de autoevolução: resultados do experimento de 5 rodadas

Configuração do experimento e resultados
Um desenvolvedor conduziu um experimento de 5 rodadas para validar o padrão de design Self-Evolving Skill para Claude Code, que foi compartilhado anteriormente. O experimento utilizou um banco de dados MySQL com 29 tabelas e 590MB de dados de um sistema de gerenciamento de edifícios inteligentes.
As rodadas seguiram esta progressão: exploração de estrutura → consultas de dados → descoberta de regras → investigação complexa → verificação repetida.
Principais descobertas
- Taxa de rejeição do Five-Gate: 63,6% — a maioria das interações não produziu mudança no conhecimento
- Convergência incremental: +75 → +46 → +12 → +21 → +1
- Auto-correção do Gate 2: O padrão detectou e corrigiu 2 regras errôneas que a Skill havia escrito em rodadas anteriores
- Rodada 5: Zero etapas de exploração, reutilização direta de template
- Precisão: 100% — nenhum conhecimento incorreto sobreviveu ao processo
Uma descoberta inesperada foi que as armadilhas de uso de ferramentas foram capturadas como um subproduto de alto valor — problemas que o desenvolvedor não projetou, mas que o Five Gates detectou mesmo assim.
O desenvolvedor tem um segundo experimento em andamento em um banco de dados maior de cobrança de telecomunicações. Dados completos com snapshots diferenciáveis por rodada estão disponíveis no GitHub.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Exportando Memórias de Agentes de IA Usando a Função de Importação do Claude
Um usuário do Reddit compartilha um prompt para extrair memórias armazenadas de agentes de IA como ChatGPT e Claude, e depois importá-las para o OpenClaw. O prompt solicita todo o contexto armazenado, incluindo instruções, detalhes pessoais, projetos, ferramentas e preferências.

Servidor de Busca MCP com Classificação Orientada por Feedback para Claude Desktop
Um servidor de busca MCP construído pela comunidade para o Claude Desktop executa os mecanismos de busca Exa e Tavily em paralelo sem exigir chaves de API. Após usar um resultado, os usuários relatam se funcionou por meio de uma ferramenta de resultado, que retroalimenta o sistema de classificação para priorizar URLs que ajudam os agentes a ter sucesso.

Jeeves: Interface de Usuário em Terminal para Navegar e Retomar Sessões de Agentes de IA
Jeeves é uma interface de usuário de terminal que permite pesquisar, visualizar e retomar sessões de agentes de IA do Claude Code, Codex e OpenCode em uma única visualização. Ele é escrito em Go e está disponível através de vários gerenciadores de pacotes, incluindo Homebrew, Nix e Go install.

RubyLLM: Um Framework Ruby para Todos os Principais Provedores de IA
RubyLLM fornece um único framework Ruby para OpenAI, Anthropic, Gemini, Ollama e 800+ modelos. Oferece chat, visão, áudio, ferramentas, agentes, streaming e integração com Rails.