Kimi K2.7-Code : Modèle de codage open source avec une meilleure efficacité des tokens

Moonshot AI a publié Kimi K2.7-Code, un modèle de codage open-source disponible sur Hugging Face sous l'espace de noms moonshotai/Kimi-K2.7-Code. Le modèle est étiqueté comme image-texte-texte et utilise la bibliothèque Transformers. Il se positionne comme une alternative économe en tokens pour la génération et la compréhension de code.
Caractéristiques principales
- Fournisseurs d'inférence : Novita propose le modèle avec un statut en direct, la prise en charge des appels d'outils (
toolCalling: true), et une sortie structurée actuellement indisponible. Le débit mesuré est de 36,1 tokens/seconde. - Architecture du modèle : Le modèle est divisé en 64 fragments (format safetensors :
model-00001-of-000064.safetensors). - Efficacité des tokens : Le modèle utilise un modèle de chat personnalisé qui préserve le contenu du raisonnement (
preserve_thinking: true) et optimise l'utilisation des tokens en séparant les messages d'historique et de suffixe. Le modèle inclut des tokens spéciaux comme<|im_user|>,<|im_assistant|>, et<|im_system|>pour la gestion des rôles, et des blocs<think>/</think>pour encapsuler le raisonnement en chaîne de pensée. - Appels d'outils : Prise en charge native des appels d'outils avec un formatage structuré des arguments, utilisant les marqueurs
<|tool_call_begin|>et<|tool_call_end|>. - Engagement de la communauté : 334 likes sur Hugging Face, avec 4 commentaires HN et 41 points au moment de la publication.
Implications pratiques
La conception du modèle évite explicitement d'intégrer les tokens de raisonnement dans l'historique lorsque preserve_thinking est faux, réduisant ainsi le contexte supplémentaire. Pour les développeurs utilisant des agents de codage IA, cela signifie une consommation de tokens réduite par interaction — particulièrement bénéfique pour les longues boucles d'agents où les chaînes de raisonnement se répètent. Le format d'appel d'outils est aligné sur JSON, ce qui facilite l'intégration avec les pipelines d'appel de fonctions existants.
Le modèle est disponible pour une utilisation immédiate via Novita, et le dépôt Hugging Face comprend la configuration complète du tokenizer et la source du modèle.
📖 Lire la source complète : HN AI Agents
👀 See Also

Modifications de configuration avec Kimi 2.5 et Opus 4.6
Un utilisateur évalue les performances de Kimi 2.5 dans la gestion de diverses tâches, en se concentrant particulièrement sur sa capacité à gérer les changements de configuration. Par défaut, cette configuration utilise Kimi 2.5, qui génère dynamiquement un sous-agent lié à un modèle distinct pour des tâches spécifiques.

Claude Code Sous-agents Ne Chargent Pas les Compétences dans les Systèmes Multi-Agents
Un développeur signale que les sous-agents dans Claude Code v2.1.91 ne peuvent pas accéder aux compétences définies dans le répertoire .claude/skills/, bien que ces compétences fonctionnent parfaitement dans la session principale. Plusieurs approches, y compris les compétences dans le frontmatter de l'agent, l'outil Skill, les drapeaux CLI et les équipes d'agents, échouent toutes.

Claude-Code v2.1.47 : Principales corrections et améliorations
La version 2.1.47 de Claude-Code apporte des correctifs essentiels pour le rendu du terminal Windows, la gestion des fichiers et la sortie des outils bash, ainsi que des améliorations de la mémoire et des performances.

Les manifestes ajoutent GitHub Copilot comme quatrième fournisseur d'IA pour le routage OpenClaw.
Manifest prend désormais en charge le routage des requêtes OpenClaw via les abonnements GitHub Copilot, rejoignant Anthropic, OpenAI et Minimax en tant que fournisseurs disponibles. Cela permet aux développeurs d'utiliser leurs plans Copilot existants pour les tâches de codage via des modèles conçus pour le développement.