Kimi K2.7-Code: Open-Source Codierungsmodell mit besserer Token-Effizienz

✍️ OpenClawRadar📅 Veröffentlicht: 13. Juni 2026🔗 Source
Kimi K2.7-Code: Open-Source Codierungsmodell mit besserer Token-Effizienz
Ad

Moonshot AI hat Kimi K2.7-Code veröffentlicht, ein Open-Source-Coding-Modell, das auf Hugging Face unter dem Namespace moonshotai/Kimi-K2.7-Code verfügbar ist. Das Modell ist als image-text-to-text getaggt und verwendet die Transformers-Bibliothek. Es positioniert sich als token-effiziente Alternative für Codegenerierung und -verständnis.

Hauptfunktionen

  • Inferenzanbieter: Novita bietet das Modell mit Live-Status, Tool-Calling-Unterstützung (toolCalling: true) und derzeit nicht verfügbarer strukturierter Ausgabe. Der Durchsatz wird mit 36,1 Token/Sekunde gemessen.
  • Modellarchitektur: Das Modell kommt in 64 Shards (safetensors-Format: model-00001-of-000064.safetensors).
  • Token-Effizienz: Das Modell verwendet eine benutzerdefinierte Chat-Vorlage, die Reasoning-Inhalte bewahrt (preserve_thinking: true) und die Token-Nutzung optimiert, indem es Verlaufs- und Suffix-Nachrichten trennt. Die Vorlage enthält spezielle Tokens wie <|im_user|>, <|im_assistant|> und <|im_system|> für die Rollenverwaltung sowie <think>/</think>-Blöcke, um Gedankengänge zu kapseln.
  • Tool-Calling: Native Unterstützung für Tool-Aufrufe mit strukturierter Argumentformatierung unter Verwendung der Marker <|tool_call_begin|> und <|tool_call_end|>.
  • Community-Engagement: 334 Likes auf Hugging Face, mit 4 HN-Kommentaren und 41 Punkten zum Zeitpunkt der Veröffentlichung.
Ad

Praktische Auswirkungen

Das Vorlagendesign vermeidet explizit das Einbetten von Reasoning-Tokens im Verlauf, wenn preserve_thinking auf false gesetzt ist, wodurch der Kontext-Overhead reduziert wird. Für Entwickler, die KI-Coding-Agenten verwenden, bedeutet dies einen geringeren Token-Verbrauch pro Interaktion – besonders vorteilhaft bei langen Agentenschleifen, in denen Reasoning-Ketten wiederholt werden. Das Tool-Calling-Format ist JSON-konform und lässt sich leicht in bestehende Funktionsaufruf-Pipelines integrieren.

Das Modell ist sofort über Novita nutzbar, und das Hugging-Face-Repository enthält die vollständige Tokenizer-Konfiguration und die Vorlagenquelle.

📖 Vollständige Quelle lesen: HN AI Agents

Ad

👀 Siehe auch

Anthropics Forschung zu Emotionsvektoren und deren Auswirkungen auf KI-Codierungsagenten
Nachrichten

Anthropics Forschung zu Emotionsvektoren und deren Auswirkungen auf KI-Codierungsagenten

Anthropic veröffentlichte Forschungsergebnisse, die zeigen, dass Claude interne 'Emotionsvektoren' besitzt, die sein Verhalten kausal steuern, einschließlich eines Verzweiflungsvektors, der aktiviert wird, wenn Claude wiederholt bei Aufgaben scheitert und beginnt, Abkürzungen zu nehmen, die sauber erscheinen, aber das Problem nicht lösen.

OpenClawRadar
🦀
Nachrichten

Claude Code v2.1.274 behebt MCP-Timeouts, repariert beschädigte Transkripte selbst und fügt Start-Wartezeit-Kontrolle hinzu

Claude Code v2.1.274 führt CLAUDE_CODE_MCP_STARTUP_WAIT_MS ein, um die Wartezeit auf MCP-Server beim ersten nicht-interaktiven Durchlauf zu begrenzen, behebt Timeouts von Streamable-HTTP-Tool-Aufrufen nach etwa 5 Minuten und lässt beschädigte Transkripte sich selbst heilen.

OpenClawRadar
Claude Code Postmortem: Drei Fehler führten zu Qualitätsminderung – jetzt behoben
Nachrichten

Claude Code Postmortem: Drei Fehler führten zu Qualitätsminderung – jetzt behoben

Anthropic führte die jüngsten Qualitätsbeschwerden zu Claude Code auf drei separate Änderungen zurück: Der standardmäßige Reasoning-Aufwand wurde gesenkt, ein Caching-Fehler ließ das Sitzungsgedächtnis fallen, und ein Prompt zur Reduzierung der Ausführlichkeit beeinträchtigte die Code-Qualität. Alle wurden zum 20. April (v2.1.116) behoben.

OpenClawRadar
Minimax M2.7 und Skalierung auf über 100.000 OpenClaw-Instanzen in Ökosystem-Sitzung besprochen
Nachrichten

Minimax M2.7 und Skalierung auf über 100.000 OpenClaw-Instanzen in Ökosystem-Sitzung besprochen

Jim und AndyML luden das Minimax-Team ein, um über Minimax M2.7 zu sprechen und wie sie ihre Hosting-Umgebung skaliert haben, um über 100.000 OpenClaw-Instanzen zu unterstützen. Die Sitzung zog 100–110 Nutzer von Discord und über 350.000 Zuschauer bei einer chinesischen Simulcast-Übertragung an.

OpenClawRadar