Dois Meses com o Spec-Kit do GitHub e Claude Code: O Que Funciona, O Que Não Funciona

✍️ OpenClawRadar📅 Publicado: May 15, 2026🔗 Source
Dois Meses com o Spec-Kit do GitHub e Claude Code: O Que Funciona, O Que Não Funciona
Ad

Após dois meses usando o spec-kit do GitHub para Desenvolvimento Orientado por Especificações (SDD) com o Claude Code como agente principal, um desenvolvedor no r/LocalLLaMA relata o que funciona e o que não funciona. O kit, disponível em github.com/github/spec-kit, impõe um fluxo de trabalho de cinco fases: Constituição, Especificação, Planejamento, Tarefas, Implementação. A ideia central: a especificação, não o prompt, é a fonte da verdade.

O Que Realmente Funciona

  • Independente de agente: A mesma especificação funciona com Claude Code, Cursor, Codex, Gemini CLI, Copilot. O autor gerou código com Claude Code e depois passou a especificação para o Cursor para refatoração de testes de forma transparente.
  • Checkpoints rígidos entre fases: A fase de Planejamento mostra a arquitetura completa proposta antes de qualquer código ser escrito, capturando decisões ruins a um custo de correção de 5 minutos em vez de 5 horas.
  • Arquivo de constituição como gate de qualidade: Você define regras invioláveis antecipadamente — mínimos de cobertura de teste, listas de permissão de dependências, orçamentos de desempenho, rigidez de tipagem. O agente falha na própria validação se tentar violá-las.
  • Determinismo melhorado: Reexecutar a fase de implementação produz resultados mais consistentes do que prompts brutos, já que o agente não está preenchendo 30 decisões implícitas.
Ad

O Que Irrita

  • Deriva é real: Edições manuais de código sem atualizar a especificação causam dessincronização rápida. O spec-kit tem ferramentas, mas são iniciais.
  • Sobrecarga para mudanças pequenas: Correções de bugs <50 LOC ou funcionalidades triviais parecem cerimoniais. A regra do autor: apenas SDD completo para novos módulos ou funcionalidades que envolvam 200+ LOC.
  • Migração de legado é dolorosa: Adaptar SDD a uma base de código de 30k LOC leva meses.
  • Qualidade depende do agente: Claude Code (Sonnet/Opus 4.6+) lida bem; modelos menores geram planos que compilam, mas carecem de raciocínio arquitetural.

Configuração Prática

  • Instalação: uv tool install --from git+https://github.com/github/spec-kit.git specify-cli. Apenas o repositório oficial é seguro — PyPI tem typosquatters.
  • Agente principal: Claude Code, com validação cruzada no Cursor e Gemini CLI.
  • Persistência local: SQLite (fácil de especificar/validar, sem dependência de nuvem).
  • Modelo de constituição reutilizável: tipagem estrita, cobertura do pytest >80%, lista de permissão de dependências explícita, sem serviços em nuvem a menos que necessário.

Perguntas em Aberto

  • Modelos locais (Qwen, DeepSeek-Coder, GLM, Llama) conseguem lidar competentemente com Planejamento e Implementação? O autor descobriu que modelos pequenos seguem o formato, mas o raciocínio arquitetural falha.
  • SDD multiagente funciona? Especificação por um modelo, implementação por outro, auditoria por um terceiro — teoricamente melhor, mas na prática não é mensuravelmente melhor que um único agente.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Sistema de Estudo com Contexto Engenhado para Claude Code Atua como Tutor Persistente
Tools

Sistema de Estudo com Contexto Engenhado para Claude Code Atua como Tutor Persistente

Um desenvolvedor criou um sistema de estudo usando o Claude Code que monitora o progresso entre sessões, investiga a compreensão, trabalha com exercícios e se adapta aos estilos de aprendizagem. O sistema utiliza arquivos markdown estruturados para moldar o comportamento do agente e inclui ferramentas para extrair páginas de livros didáticos de PDFs.

OpenClawRadar
Aplicando a Arquitetura do Claude Code a Modelos Locais de 9B: Principais Descobertas e Otimizações
Tools

Aplicando a Arquitetura do Claude Code a Modelos Locais de 9B: Principais Descobertas e Otimizações

Um desenvolvedor extraiu padrões arquiteturais do código-fonte vazado do Claude Code e aplicou 10 otimizações ao qwen3.5:9b rodando localmente em uma RTX 5070 Ti. A descoberta principal foi que o qwen3.5:9b possui tool_calls estruturados nativos, e a maior limitação para modelos de 9B é a autodisciplina em saber quando parar de explorar e começar a produzir saída.

OpenClawRadar
Servidor MCP Memv: Memória Estruturada Persistente para Agentes de IA
Tools

Servidor MCP Memv: Memória Estruturada Persistente para Agentes de IA

memv, uma camada de memória Python de código aberto para agentes, agora vem com um servidor MCP. Ela oferece cinco ferramentas para memória persistente e estruturada com isolamento por usuário e extração opcional com LLM.

OpenClawRadar
OpenClaw-WebTop: Execute o OpenClaw com Ollama e Ubuntu Desktop no GitHub Codespaces
Tools

OpenClaw-WebTop: Execute o OpenClaw com Ollama e Ubuntu Desktop no GitHub Codespaces

O OpenClaw-WebTop oferece uma maneira de executar uma instância completa do OpenClaw com Ollama e desktop Ubuntu MATE diretamente em um navegador usando GitHub Codespaces, sem necessidade de instalação local do Docker ou VPS.

OpenClawRadar