Kimi K2.7-Code: Modelo de codificación de código abierto con mejor eficiencia de tokens

✍️ OpenClawRadar📅 Publicado: 13 de junio de 2026🔗 Source
Kimi K2.7-Code: Modelo de codificación de código abierto con mejor eficiencia de tokens
Ad

Moonshot AI ha lanzado Kimi K2.7-Code, un modelo de código abierto para programación disponible en Hugging Face bajo el espacio de nombres moonshotai/Kimi-K2.7-Code. El modelo está etiquetado como image-text-to-text y utiliza la biblioteca Transformers. Se posiciona como una alternativa eficiente en tokens para tareas de generación y comprensión de código.

Características clave

  • Proveedores de inferencia: Novita ofrece el modelo con estado en vivo, soporte para llamadas a herramientas (toolCalling: true) y salida estructurada actualmente no disponible. Rendimiento medido de 36.1 tokens/segundo.
  • Arquitectura del modelo: El modelo consta de 64 fragmentos (formato safetensors: model-00001-of-000064.safetensors).
  • Eficiencia de tokens: El modelo utiliza una plantilla de chat personalizada que preserva el contenido de razonamiento (preserve_thinking: true) y optimiza el uso de tokens separando los mensajes de historial y sufijo. La plantilla incluye tokens especiales como <|im_user|>, <|im_assistant|> y <|im_system|> para la gestión de roles, y bloques <think>/</think> para encapsular el razonamiento encadenado.
  • Llamadas a herramientas: Soporte nativo para llamadas a herramientas con formato estructurado de argumentos, utilizando los marcadores <|tool_call_begin|> y <|tool_call_end|>.
  • Participación de la comunidad: 334 me gusta en Hugging Face, con 4 comentarios en HN y 41 puntos hasta la fecha de publicación.
Ad

Implicaciones prácticas

El diseño de la plantilla evita explícitamente incrustar tokens de razonamiento en el historial cuando preserve_thinking es falso, reduciendo la sobrecarga de contexto. Para desarrolladores que utilizan agentes de codificación con IA, esto significa un menor consumo de tokens por interacción, especialmente beneficioso en bucles largos de agentes donde se repiten cadenas de razonamiento. El formato de llamada a herramientas está alineado con JSON, lo que facilita su integración con pipelines existentes de llamadas a funciones.

El modelo está disponible para uso inmediato a través de Novita, y el repositorio de Hugging Face incluye la configuración completa del tokenizador y la fuente de la plantilla.

📖 Lea la fuente original: HN AI Agents

Ad

👀 Ver también

Anthropic pagando a SpaceX $15B/año por cómputo hasta 2029
Noticias

Anthropic pagando a SpaceX $15B/año por cómputo hasta 2029

El documento de OPI de SpaceX revela que Anthropic paga $1.25B/mes hasta mayo de 2029 por cómputo. El acuerdo respalda el entrenamiento de IA en las instalaciones Colossus 1 y 2.

OpenClawRadar
La actualización automática de Cron rompió OpenClaw debido a un error de validación de configuración.
Noticias

La actualización automática de Cron rompió OpenClaw debido a un error de validación de configuración.

Un trabajo cron configurado para actualizar automáticamente OpenClaw encontró un problema de validación de configuración con el campo cliBackends, causando pérdida de conexión. La solución implicó eliminar la sección problemática y reiniciar la puerta de enlace.

OpenClawRadar
Anthropic duplica los límites de tarifa de Claude Code y firma un acuerdo de cómputo con SpaceX
Noticias

Anthropic duplica los límites de tarifa de Claude Code y firma un acuerdo de cómputo con SpaceX

Los límites de tarifa de cinco horas de Claude Code se duplicaron para los planes Pro/Max/Team/Enterprise, se eliminaron las reducciones en horas pico y se aumentaron los límites de tarifa de API para los modelos Opus. SpaceX Colossus 1 agrega más de 300 MW de capacidad (220k GPUs NVIDIA) en un mes.

OpenClawRadar
Ventas de placas base se desploman más del 25% mientras la producción de chips de IA desplaza a los componentes de PC de consumo
Noticias

Ventas de placas base se desploman más del 25% mientras la producción de chips de IA desplaza a los componentes de PC de consumo

Asus, Gigabyte, MSI y ASRock reducen sus objetivos de envío de placas base para 2026 entre un 22 y un 37%, ya que los fabricantes de chips priorizan la producción de procesadores de IA, lo que provoca escasez de componentes y aumento de precios.

OpenClawRadar