OpenClawモデル性能レビュー:Codex 5.3が首位、GLMモデルは期待外れ

OpenClawにおけるモデルパフォーマンスランキング
開発者が複数のAIモデルをOpenClawでテストし、詳細なパフォーマンス観察結果を共有しました。テストはCodex、Google、Sonnet、Gemini、DeepSeek、Z.aiのGLMモデルを対象とし、ベンチマークではなく実用的な使用体験に焦点を当てています。
最高パフォーマンスモデル
- Codex 5.3 - 評価9/10。開発者のお気に入りモデルで、OpenClaw用に改良されたチャットエージェント機能を備えている可能性があります。ユーザーの意図をよく理解し、一貫して望ましい出力を提供し、中断やバグが最小限です。
- Sonnet 4.6 - 評価8/10。速度と問題解決能力から2番目のお気に入りです。Codex 5.3が利用できない場合に十分な体験を提供し、日常使用に適しています。
- DeepSeek 3.2 Agent - 評価7/10。OpenClaw用に明確にカスタマイズされており、ネイティブエージェントと作業しているような感覚です。Sonnet、Opus、Codexほどコーディング能力は強くありませんが、日常使用のための堅実な代替手段です。中国製代替モデルとしてAPI料金が高い可能性が指摘されています。
中位層モデル
- Google 3.1 Pro(LowおよびHigh) - 評価6/10。antigravity認証でテストされました。OpenClawとの相互作用が弱く、パフォーマンスが遅く、継続的な使用には魅力的ではありません。SonnetとCodexが利用できない場合のみ検討するとしています。
期待外れのパフォーマー
- GLM 4.7 - 評価5/10。安価なAPI料金とプロアカウントでのCodexの3-4倍のクォータを特徴とするSonnet代替品として販売されています。しかし、常に動作が停止し、返信が遅く、メール確認のような単純なタスクでも出力長が一貫しません。新しいセッションでわずか5通のメールを確認するために100万トークンを消費しました。
- GLM 5 - 評価5/10。ベンチマークではOpusやCodex 5.3と競合すると主張されていますが、OpenClawでの体験は一致しません。同じタスクに2-3倍のトークンを使用し、返信が遅く、コーディング回答はSonnet 4.5レベルです。OpenClawに特化した最適化が必要です。主な利点は価格です。
- Gemini 3 Flash - 評価4/10。非常に単純なタスクにのみ適しており、本格的な使用には推奨されません。
開発者は、OpenClawが最適化されていないか、モデルの品質問題による体験の明らかな違いから、適切なモデルを選択することが難しいと指摘しました。Codex以外の多様化を望みながらもGLMモデルに失望を表明し、将来的な改善を期待しています。
📖 Read the full source: r/openclaw
👀 See Also
Ant GroupのAntLing-3.0-flash、OpenRouter経由でOpenClawに登場 – 256Kコンテキスト、8月3日まで無料
Ant GroupのAntLing-3.0-flashが、OpenRouter経由でOpenClaw上で利用可能に。クライアントのアップデートは不要で、設定はopenclaw models set openrouter/inclusionai/ling-3.0-flashを実行するだけ。256Kコンテキストと、長期ツール呼び出しに対する強化学習が特徴。8月3日まで無料(APIのみ、重みは未提供)。

AnyClaw APKを使用して、Android上でOpenClawとCodex CLIをネイティブ実行
開発者がOpenClawとCodex CLIをAndroid APKにパッケージ化し、AnyClawと名付けました。これにより、ゲートウェイとコントロールUIがARM64 Android 7.0以上のデバイスでルート権限なしにローカルで実行可能になりました。このプロジェクトでは、依存関係をソースからビルドし、Android特有の制約に対処するために複数のコンポーネントにパッチを当てる必要がありました。

Reseed CLI: あらゆるサイトからClaude CodeやCursor向けにデザインシステムを抽出
Reseedは、任意のWebサイトからデザイントークン(色、スペーシング、タイプスケール、角丸)を抽出し、Claude CodeやCursorで使用できるtailwind.config.ts、design-system.md、およびリファレンスHTMLを生成するCLIツールです。

Auto-co: Claudeのコードを自律型AI企業に変える50行のBashスクリプト
Auto-coは、Claude Code CLIをループでラップする約50行のbashスクリプトです。CEO、エンジニア、批評家など14のAIエージェントが役割を担い、自律的に実行されます。FormReplyやChangelog.devを含む4つの製品をゼロから構築し、270以上のサイクルで総費用は268ドルでした。