Qwen3.6:27b + Agente Go Personalizado: Uma Alternativa Local ao Claude Code

Um desenvolvedor (codehamr) que administra um negócio de integração local de LLMs descreve experimentos com modelos locais como alternativa para o Claude Code. Eles relatam que o Qwen3.6:27b no Q8 em uma RTX 6000 com 96GB e contexto de 128k oferece uma experiência de codificação semelhante ao Claude Code, e observam que uma RTX 5090 (32GB) no Q4_M pode alcançar resultados comparáveis.
Para a camada de agente, eles criaram um único binário Go minimalista chamado codehamr (open source MIT) — sem plugins, sem MCP, sem temas. O agente lida com busca, dependências e manipulação de arquivos através do bash sob demanda. O repositório está disponível em: https://github.com/codehamr/codehamr
Detalhes Principais
- Modelo: Qwen3.6:27b na quantização Q8, rodando em RTX 6000 (96GB) com contexto de 128k — excessivo para um modelo de 30B.
- Alternativa de consumo: RTX 5090 (32GB) no Q4_M deve oferecer experiência de codificação semelhante com boa disciplina de prompts.
- Construção do agente: Binário Go personalizado — minimalista, sem plugins, sem MCP. Usa bash para busca, dependências, operações de arquivo.
- Licença: MIT open source, disponível para fork ou ignorar.
O desenvolvedor enfatiza que cada passo em direção a LLMs locais reduz a dependência de ferramentas em nuvem. Esta configuração, combinada com prompts disciplinados, é a primeira configuração local onde eles não sentem falta do Claude Code.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Plugins de Código Claude de Código Aberto para Protocolos de Comércio Agente
A OrcaQubits lançou oito plugins Claude Code de código aberto que implementam protocolos de comércio agentivo, incluindo UCP, ACP, AP2 e A2A, com licenciamento MIT e suporte para plataformas como Magento 2, BigCommerce e WooCommerce.

Implementação do Agente Local OpenClaw com Cache TurboQuant para Hardware de Médio Porte
Um aplicativo de um clique para o OpenClaw com modelos locais agora roda em dispositivos de médio porte como o MacBook Air com 16GB de RAM usando cache TurboQuant e aquecimento de contexto. A implementação corrige o llama.cpp para chamadas de ferramentas confiáveis e alcança 10-15 tokens por segundo com o Gemma 4 e QWEN 3.5.

Ferramenta Local de Crítica de Imagens com IA Utiliza Modelos de Visão Ollama para Feedback
Um desenvolvedor criou um aplicativo gratuito para desktop que analisa imagens geradas por IA localmente usando modelos de visão do Ollama. A ferramenta fornece relatórios estruturados de feedback incluindo sugestões de melhorias e aprimoramentos de prompts.

ReasonDB: Banco de Dados de Documentos de Código Aberto que Utiliza Navegação em Árvore Guiada por LLM em vez de Busca Vetorial
ReasonDB é um banco de dados de documentos de código aberto que preserva a estrutura do documento como uma hierarquia e usa travessia de árvore guiada por LLM para recuperação, em vez de busca vetorial. Ele usa BM25 para busca inicial, tree-grep para filtragem de estrutura e travessia de busca em feixe, onde o LLM visita aproximadamente 25 nós entre milhões.