Validação do padrão de habilidades de autoevolução: resultados do experimento de 5 rodadas

✍️ OpenClawRadar📅 Publicado: March 8, 2026🔗 Source
Validação do padrão de habilidades de autoevolução: resultados do experimento de 5 rodadas
Ad

Configuração do experimento e resultados

Um desenvolvedor conduziu um experimento de 5 rodadas para validar o padrão de design Self-Evolving Skill para Claude Code, que foi compartilhado anteriormente. O experimento utilizou um banco de dados MySQL com 29 tabelas e 590MB de dados de um sistema de gerenciamento de edifícios inteligentes.

As rodadas seguiram esta progressão: exploração de estrutura → consultas de dados → descoberta de regras → investigação complexa → verificação repetida.

Ad

Principais descobertas

  • Taxa de rejeição do Five-Gate: 63,6% — a maioria das interações não produziu mudança no conhecimento
  • Convergência incremental: +75 → +46 → +12 → +21 → +1
  • Auto-correção do Gate 2: O padrão detectou e corrigiu 2 regras errôneas que a Skill havia escrito em rodadas anteriores
  • Rodada 5: Zero etapas de exploração, reutilização direta de template
  • Precisão: 100% — nenhum conhecimento incorreto sobreviveu ao processo

Uma descoberta inesperada foi que as armadilhas de uso de ferramentas foram capturadas como um subproduto de alto valor — problemas que o desenvolvedor não projetou, mas que o Five Gates detectou mesmo assim.

O desenvolvedor tem um segundo experimento em andamento em um banco de dados maior de cobrança de telecomunicações. Dados completos com snapshots diferenciáveis por rodada estão disponíveis no GitHub.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

A habilidade de atoship do OpenClaw transforma o assistente de IA em um gerente de envios.
Tools

A habilidade de atoship do OpenClaw transforma o assistente de IA em um gerente de envios.

A habilidade atoship para o OpenClaw permite que os usuários descrevam suas necessidades de envio em inglês simples, depois cuida da seleção da transportadora, comparação de tarifas, compra de etiquetas e rastreamento. Exemplos de comandos incluem 'envie esta caixa de 1lb para Nova York, opção mais barata'.

OpenClawRadar
PocketBot: IA compila automações para JavaScript para agendamento determinístico e econômico
Tools

PocketBot: IA compila automações para JavaScript para agendamento determinístico e econômico

O PocketBot aborda problemas de custo de API e hardware compilando solicitações em linguagem natural em scripts JavaScript autônomos que são executados em agendamentos sem chamadas de LLM durante a execução. A ferramenta usa IA apenas uma vez para escrever o código, depois executa deterministicamente com mais de 20 integrações incluindo Google Suite, Slack e Notion.

OpenClawRadar
A McPherson AI lança duas novas habilidades de operações de QSR no ClawHub: diagnóstico de custo de alimentos e auditoria de vazamento de mão de obra.
Tools

A McPherson AI lança duas novas habilidades de operações de QSR no ClawHub: diagnóstico de custo de alimentos e auditoria de vazamento de mão de obra.

Duas novas habilidades gratuitas foram publicadas no ClawHub: qsr-food-cost-diagnostic identifica problemas de CMV semanalmente com um diagnóstico de quatro alavancas, e qsr-labor-leak-auditor fornece rastreamento diário de mão de obra com alertas no meio da semana para evitar gastos excessivos.

OpenClawRadar
O recurso UltraThink do Claude AI retorna com orientações práticas de uso
Tools

O recurso UltraThink do Claude AI retorna com orientações práticas de uso

A Claude AI reinstalou o recurso UltraThink após feedback dos usuários. O esforço médio agora é o padrão para o Opus 4.6 (Max/Team), com esforço alto disponível permanentemente via /model, e o UltraThink como uma substituição de uma única vez para o esforço alto.

OpenClawRadar