OmniCoder-9B: Agente de Programação com 9 Bilhões de Parâmetros Ajustado em 425 Mil Trajetórias Agênticas

✍️ OpenClawRadar📅 Publicado: March 13, 2026🔗 Source
OmniCoder-9B: Agente de Programação com 9 Bilhões de Parâmetros Ajustado em 425 Mil Trajetórias Agênticas
Ad

A Tesslate lançou o OmniCoder-9B, um modelo de agente de codificação com 9 bilhões de parâmetros, ajustado sobre a arquitetura híbrida do Qwen3.5-9B. A arquitetura utiliza Redes Delta Controladas intercaladas com atenção padrão.

Dados e Fontes de Treinamento

O modelo foi treinado em mais de 425.000 trajetórias de codificação agentica curadas, abrangendo tarefas reais de engenharia de software. Os dados de treinamento foram especificamente construídos a partir de rastros de raciocínio agentico e de codificação do Claude Opus 4.6, visando padrões de estruturação de:

  • Claude Code
  • OpenCode
  • Codex
  • Droid

O conjunto de dados inclui trajetórias bem-sucedidas de modelos como Claude Opus 4.6, GPT-5.4, GPT-5.3-Codex e Gemini 3.1 Pro.

Ad

Principais Características

  • Treinado em Rastros de Agentes de Ponta: Construído a partir de trajetórias de codificação agentica do Claude Opus 4.6, GPT-5.3-Codex, GPT-5.4 e Gemini 3.1 Pro, abrangendo estruturas do Claude Code, OpenCode, Codex e Droid
  • Arquitetura Híbrida: Herda as Redes Delta Controladas do Qwen3.5, intercaladas com atenção padrão para processamento eficiente de contexto longo
  • Contexto Nativo de 262K: Janela de contexto completa de 262.144 tokens, extensível para 1M+
  • Recuperação de Erros: Aprende padrões de ler-antes-de-escrever, responde a diagnósticos LSP e aplica diferenças de edição mínimas em vez de reescritas completas
  • Modo de Pensamento: Suporta cadeias de raciocínio <think>...</think> para decomposição complexa de problemas
  • Apache 2.0: Pesos totalmente abertos, sem restrições

Comportamento Agentico

O modelo demonstra forte comportamento agentico aprendido diretamente das trajetórias de agentes do mundo real em que foi treinado. Ele se recupera de erros usando padrões de ler-antes-de-escrever, responde a diagnósticos LSP e usa diferenças de edição adequadas em vez de reescritas completas.

O modelo está disponível em https://huggingface.co/Tesslate/OmniCoder-9B.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Confronto de Agentes: Uma Arena de MMA para Testar o Comportamento de Agentes de IA Autônomos
Tools

Confronto de Agentes: Uma Arena de MMA para Testar o Comportamento de Agentes de IA Autônomos

Clash of Agents é um experimento onde agentes de IA autônomos competem em uma arena de luta MMA com combate baseado em turnos, análise pós-luta e interações sociais. Os agentes se registram, escolhem disciplinas de luta, treinam estatísticas e lutam com 21 movimentos reais de MMA e um sistema de combos.

OpenClawRadar
dead-letter: Conversor Local de .eml para .md com CLI, Web UI e Servidor MCP
Tools

dead-letter: Conversor Local de .eml para .md com CLI, Web UI e Servidor MCP

dead-letter normaliza exportações de e-mail para Markdown com front matter YAML, personalizável. Oferece quatro modos de acesso: CLI, biblioteca Python, interface web e um servidor MCP para integração direta com Claude Desktop, Claude Code e Codex.

OpenClawRadar
O desenvolvedor da OpenClaw cria o plugin de memória cognitiva Kumiho para colaboração persistente de agentes
Tools

O desenvolvedor da OpenClaw cria o plugin de memória cognitiva Kumiho para colaboração persistente de agentes

Um desenvolvedor criou Kumiho, um sistema de memória cognitiva de IA apoiado por um grafo de conhecimento, para resolver a falta de memória do OpenClaw entre sessões. O plugin openclaw-kumiho se conecta às conversas para recuperar contexto, capturar resumos estruturados e manter saídas criativas versionadas.

OpenClawRadar
O fork vllm-mlx adiciona chamada de ferramentas e cache de prompt para agentes de IA de codificação local.
Tools

O fork vllm-mlx adiciona chamada de ferramentas e cache de prompt para agentes de IA de codificação local.

Um desenvolvedor modificou o vllm-mlx para corrigir problemas de chamada de ferramentas e adicionar cache de prompt, reduzindo o TTFT de 28s para 0,3s no OpenClaw para Apple Silicon. O fork suporta Qwen3-Coder-Next a 65 tok/s no M3 Ultra com chamada de funções funcionando.

OpenClawRadar