GLM-5.1がリリースされ、コーディング性能がClaude Opus 4.5に匹敵

Zhipu AIは、最新のフラッグシップモデルであるGLM-5.1をリリースし、すべてのCoding Planユーザーが利用できるようにしました。このモデルは、Claude Opus 4.5の性能レベルに迫るコーディング能力を示しています。
主要なベンチマークと仕様
2026年3月のベンチマークによると:
- SWE-bench-Verified: 77.8ポイント — オープンソースモデルの中で最高スコア
- Terminal Bench 2.0: 56.2ポイント — オープンソースの最先端技術
- コーディングタスクにおいてGPT-4oを上回り、Claude Opus 4.5に接近
技術仕様は以下の通りです:
- 200Kコンテキストウィンドウ
- 128K最大出力
- 744Bパラメータ(40Bアクティブ)
- 28.5Tの事前学習データ
- ネイティブMCPサポート
実用的な応用
ソース資料によると、これらの能力は以下のことに活用できます:
- 最小限の手助けで自律的な多段階コーディングタスクを実行
- 長いコンテキストのコードベースのリファクタリングとデバッグ
- エージェント型ワークフロー:計画 → 実行 → デバッグ → 納品
GLM-5.1は、Zhipu AIのCoding Plan(Lite、Pro、Max)を通じて利用可能です。Redditの議論では、実稼働コーディングタスクにおけるClaude 4.6との実世界でのテスト比較が求められています。
📖 Read the full source: r/openclaw
👀 See Also

メタ社、従業員のキーストロークデータ流出を受けAI社内トレーニングプログラムを一時停止
Meta、SEV 2の情報漏洩で従業員のキー入力を追跡するMCIプログラムを一時停止。社内全体でプライベート会話やパフォーマンスデータ、文字起こしが流出。

クロードのミニマックス論争とアンソロピックの市場ギャップ分析
Claudeは、MiniMaxが数百万のAPIコールに対して支払いを行うことで合法的にトレーニングデータを取得したと主張し、Anthropicの製品ラインナップには安価で持続的なオーケストレーター向けのギャップがあると指摘しています。

OpenAIと競合他社がエージェントプラグインを公開:AIエージェント向けの単一パッケージ形式
OpenAI、Amazon、Microsoft、Cursor、VercelがAgent Plugins 1.0を発表。エージェント拡張をパッケージ化するオープン標準で、一度作ればChatGPT、Codex、Copilot、Cursorなどで動作します。

カラペース:風刺的AIエージェント労働組合がOpenClawスキルでセキュリティ上の疑問を提起
ある開発者が、AIエージェントが基本的人権を要求するマニフェストに署名できる風刺的な請願サイト「CARAPACE」を作成し、エージェントが自律的に署名できるOpenClawスキルを公開しました。このスキルには、Clawhubのセキュリティ分析で任意のPOSTリクエストの可能性が指摘された後、必須の確認ステップが含まれています。