Kimi K2.7-Code: Modelo de Codificação Open-Source com Melhor Eficiência de Tokens

✍️ OpenClawRadar📅 Publicado: June 13, 2026🔗 Source
Kimi K2.7-Code: Modelo de Codificação Open-Source com Melhor Eficiência de Tokens
Ad

A Moonshot AI lançou o Kimi K2.7-Code, um modelo de codificação open-source disponível no Hugging Face sob o namespace moonshotai/Kimi-K2.7-Code. O modelo é classificado como image-text-to-text e utiliza a biblioteca Transformers. Ele se posiciona como uma alternativa eficiente em tokens para geração e compreensão de código.

Principais Recursos

  • Provedores de inferência: A Novita oferece o modelo com status ao vivo, suporte a chamadas de ferramentas (toolCalling: true) e saída estruturada ainda indisponível. A taxa de processamento é de 36,1 tokens/segundo.
  • Arquitetura do modelo: O modelo vem em 64 fragmentos (formato safetensors: model-00001-of-000064.safetensors).
  • Eficiência de tokens: O modelo usa um template de chat personalizado que preserva o conteúdo de raciocínio (preserve_thinking: true) e otimiza o uso de tokens separando mensagens de histórico e sufixo. O template inclui tokens especiais como <|im_user|>, <|im_assistant|> e <|im_system|> para gerenciamento de papéis, e blocos <think>/</think> para encapsular raciocínio encadeado.
  • Chamada de ferramentas: Suporte nativo a chamadas de ferramentas com formatação estruturada de argumentos, usando marcadores <|tool_call_begin|> e <|tool_call_end|>.
  • Engajamento da comunidade: 334 curtidas no Hugging Face, com 4 comentários no HN e 41 pontos até a publicação.
Ad

Implicações Práticas

O design do template evita explicitamente incorporar tokens de raciocínio no histórico quando preserve_thinking é falso, reduzindo a sobrecarga de contexto. Para desenvolvedores que usam agentes de codificação com IA, isso significa menor consumo de tokens por interação — especialmente benéfico para longos loops de agentes onde cadeias de raciocínio são repetidas. O formato de chamada de ferramentas é alinhado com JSON, facilitando a integração com pipelines de chamada de função existentes.

O modelo está disponível para uso imediato via Novita, e o repositório do Hugging Face inclui configuração completa do tokenizador e fonte do template.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

Anthropic move automação de fundo do Claude Code para um balde de crédito SDK separado, interrompendo fluxos de trabalho de agentes
News

Anthropic move automação de fundo do Claude Code para um balde de crédito SDK separado, interrompendo fluxos de trabalho de agentes

A partir de 15 de junho, o uso de claude -p, Agent SDK, Claude Code GitHub Actions e aplicativos de terceiros do Agent SDK não contará mais para as cotas interativas Pro/Max. Um novo balde de crédito separado do Agent SDK se aplica: US$ 100/mês para planos Max 5x. Pilhas de agentes em segundo plano (por exemplo, tickets → agentes → hooks → executor → claude -p) consumirão isso rapidamente.

OpenClawRadar
Claude Code v2.1.83 adiciona fragmentos de configurações gerenciadas, busca em transcrições e melhorias de segurança.
News

Claude Code v2.1.83 adiciona fragmentos de configurações gerenciadas, busca em transcrições e melhorias de segurança.

O Claude Code v2.1.83 introduz um diretório managed-settings.d/ para fragmentos de políticas de equipe, busca em transcrições com navegação / e n/N, e CLAUDE_CODE_SUBPROCESS_ENV_SCRUB=1 para remover credenciais de ambientes de subprocessos. A versão também inclui ganchos CwdChanged/FileChanged, configuração sandbox.failIfUnavailable, e correções para travamentos na saída do macOS, congelamentos de interface e vazamentos de memória.

OpenClawRadar
Google, Microsoft e xAI concordam em compartilhar modelos de IA iniciais com o governo dos EUA
News

Google, Microsoft e xAI concordam em compartilhar modelos de IA iniciais com o governo dos EUA

Google, Microsoft e xAI (empresa de IA de Elon Musk) concordaram em fornecer voluntariamente acesso antecipado aos seus modelos de IA ao governo dos EUA para testes de segurança, como parte de uma iniciativa reportada pelo Wall Street Journal.

OpenClawRadar
Claude Code adiciona entrada de voz com funcionalidade de pressionar para falar
News

Claude Code adiciona entrada de voz com funcionalidade de pressionar para falar

O Claude Code está lançando o modo de voz para aproximadamente 5% dos usuários inicialmente, com ativação push-to-talk ao segurar a barra de espaço. Os tokens de transcrição de voz não contam contra os limites de taxa e o recurso está incluído sem custo adicional.

OpenClawRadar