Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas

Visão Geral Técnica
Omnicoder-9B é um modelo específico para programação desenvolvido pela Tesslate, baseado na arquitetura Qwen 3.5. Ele foi ajustado sobre o Qwen3.5 9B usando saídas de vários modelos, incluindo Opus 4.6, GPT 5.4, GPT 5.3 Codex e Gemini 3.1 Pro.
Características de Desempenho
O modelo demonstra um desempenho forte em hardware de médio porte. Com 12 GB de VRAM, usuários relatam geração consistente de tokens a 15 tokens/segundo mesmo com o tamanho do contexto definido em 100k. O processamento de prompts é notavelmente rápido, com aproximadamente 265 tokens/segundo. O modelo funciona sem travar sistemas ou causar degradação de desempenho.
Limitações e Problemas
Apesar das vantagens de velocidade, o Omnicoder-9B mostra várias limitações em cenários práticos de programação:
- Falhou em gerar um clone completo do Super Mario em um arquivo HTML independente com um prompt único
- Experimentou falhas na chamada de ferramentas com servidores MCP, gerando erros MCP durante a busca de dados
- Problemas ao executar chamadas de ferramentas de escrita do Claude Code, embora isso possa envolver fatores de compatibilidade
Testes de Integração em IDE
Testes em ambientes de desenvolvimento revelaram resultados mistos:
- No LM Studio com Roo Code: Ocorreram desconexões conforme o tamanho do token aumentava para 4k, embora isso pareça ser um problema de integração e não específico do modelo
- O modelo atualizou ou escreveu pequenos scripts com sucesso com tamanhos de token entre 2-3k
- Solicitações de API falharam para tokens acima de 4k sem mensagens de erro
- No Claude Code: A geração de tokens pareceu mais lenta em comparação com o Roo Code, e o modelo falhou em executar chamadas de ferramentas de escrita após gerar a saída
O usuário observa que o Roo Code tem sido a extensão mais eficaz para LLMs locais entre Continue e outras opções testadas.
📖 Read the full source: r/LocalLLaMA
👀 See Also

bunx ccusage mostra US$ 18.450 em créditos queimados — Planos fixos absorvem o custo
Um usuário no r/ClaudeAI executou bunx ccusage e descobriu que consumiu US$ 18.450 em créditos em maio — 248 milhões de tokens de entrada, 42 milhões de tokens de saída, 21,7 bilhões com leituras de cache — pagando apenas €400/mês no plano fixo para Claude Code e Codex.

Habilidade do Agente SwiftUI: Aprimorando o Desenvolvimento de Views com IA
O SwiftUI Agent Skill é uma ferramenta de código aberto que utiliza IA para melhorar o desenvolvimento de views no SwiftUI, incorporando melhores práticas e otimizações.

O Agente Subordinado Cético de Planos do Claude Code Identifica Lacunas de Segurança em Planos Gerados
Um desenvolvedor descobriu o subagente cético de planos do Claude Code, que identifica lacunas e problemas em planos de desenvolvimento gerados por IA, capturando especialmente preocupações de segurança que não eram inicialmente óbvias. O agente trabalha junto com o subagente xerife de segurança, previamente conhecido, para melhorar a qualidade dos planos.

OutClaw: Instalador e Gerenciador GUI para OpenClaw no Docker
OutClaw é um aplicativo gratuito e de código aberto que instala e gerencia instâncias do OpenClaw dentro de contêineres Docker. Ele fornece uma interface gráfica passo a passo para configuração, conexão com provedores de IA e canais de chat, sem necessidade de usar a linha de comando.