GLM-5.1 veröffentlicht mit Programmierleistung auf dem Niveau von Claude Opus 4.5

Zhipu AI hat GLM-5.1, sein neuestes Flaggschiff-Modell, veröffentlicht und macht es für alle Coding Plan-Nutzer verfügbar. Dieses Modell zeigt Programmierfähigkeiten, die an die Leistungsstufe von Claude Opus 4.5 heranreichen.
Wichtige Benchmarks und Spezifikationen
Laut Benchmarks vom März 2026:
- SWE-bench-Verified: 77,8 Punkte — höchste Punktzahl unter Open-Source-Modellen
- Terminal Bench 2.0: 56,2 Punkte — ebenfalls Open-Source-Standard
- Übertrifft GPT-4o und nähert sich Claude Opus 4.5 bei Programmieraufgaben
Technische Spezifikationen umfassen:
- 200K-Kontextfenster
- 128K maximale Ausgabe
- 744B Parameter (40B aktiviert)
- 28,5T Vortrainingsdaten
- Native MCP-Unterstützung
Praktische Anwendungen
Das Quellenmaterial deutet darauf hin, dass sich diese Fähigkeiten wie folgt übertragen:
- Autonome mehrstufige Programmieraufgaben mit minimaler Unterstützung
- Refactoring und Debugging von Codebasen mit langem Kontext
- Agentenbasierte Workflows: Planen → Ausführen → Debuggen → Liefern
GLM-5.1 ist jetzt über Zhipu AIs Coding Plan-Stufen verfügbar: Lite, Pro und Max. Die Reddit-Diskussion fordert praktische Testvergleiche mit Claude 4.6 für produktive Programmieraufgaben.
📖 Read the full source: r/openclaw
👀 Siehe auch

OpenClaw-Agent-Ausgabenmuster und fehlende Ausgabenobergrenzen
Ein Entwickler verfolgte die Ausgaben von OpenClaw-Agenten über zwei Monate und stellte fest, dass die meisten Agenten im Durchschnitt 40–80 US-Dollar pro Monat an API- und Dienstgebühren verursachen, wenn sie unbeaufsichtigt bleiben, wobei die Spitzen an Wochenenden und über Nacht auftreten. Das Standardverhalten ist unbegrenzt, ohne integrierte Ausgabenobergrenze.

Delve wird beschuldigt, Sim.ai's Open-Source-Software SimStudio geforkt und als Pathways verkauft zu haben.
Das Compliance-Startup Delve soll angeblich das Open-Source-Agenten-Entwicklungstool SimStudio von Sim.ai geforkt, es in Pathways umbenannt und ohne ordnungsgemäße Lizenzzuweisung oder finanzielle Vereinbarung mit Sim.ai verkauft haben, was möglicherweise gegen die Apache-Lizenzbedingungen verstößt.

Entwickler wechselt von Cursor Composer 2 und Kimi 2.6 zu Qwen3.6:35b-a3b für Unternehmensworkloads
Ein Entwickler berichtet, dass er Qwen3.6:35b-a3b für die tägliche Arbeit an einer Unternehmenssuite mit 500.000–700.000 Codezeilen verwendet, und hebt die bessere Leistung im Vergleich zu Kimi 2.6 und DeepSeek 4 Pro/Flash hervor, bei Kosten von etwa 0,08 $ pro 1 Million Tokens auf OpenRouter.

Claude Code v2.1.186: MCP-CLI-Authentifizierung, Bash-Auto-Antwort und über 20 Fehlerbehebungen
Claude Code v2.1.186 führt CLI-basierte MCP-Authentifizierung, automatische Antworten auf Bash-Befehle und über 20 Fehlerbehebungen ein, darunter Schlafmodus-Wiederherstellung, Subagent-Berechtigungen und Sitzungskostenanzeige.