どのAIモデルを使うべきか尋ねるのはやめよう:タスクをHaiku、Sonnet、Opusの階層に振り分けよう

Redditユーザーのu/spencer_kwが、毎日のように見られる「どのモデルを使うべきか?」という質問に、1か月間のタスクタイプ別ルーティングに基づいた具体的な回答を示しています。核心的な洞察は、単一のモデルがすべてに最適というわけではなく、タスクを少なくとも3つの階層に振り分けるべきということです。
タスク別のモデル階層
- ファイルの読み取り、要約、コードに関する質問への回答: 最も安価なモデルを使用 — Haiku、Ollama経由のQwen 3.6、Gemma 4。ファイル読み取りにOpusを使うのは金の無駄です。
- コード、テスト、定型文の作成: Sonnetクラス — GPT-5.5 mini、DeepSeek v4。最先端モデルの数分の一のコストで確かな生成が可能。
- 複数ファイルのリファクタリング、アーキテクチャ、複雑な非同期デバッグ: OpusやGPT-5.5が必要になる唯一の場面。これは作業時間の約15~20%を占めます。
実用的なルーティング設定
u/spencer_kw の現在の配分:
- ~40% のタスク → Haikuクラス(安価なリーダー)
- ~35% → Sonnetクラス(生成)
- ~25% → Opusクラス(複雑な推論)
月間総費用: $30~40(作業量による)。
「デイリードライバー」という枠組みは破綻しています。すべてに最適な1つのモデルを求めるのは、運搬と通勤の両方に使える1台の車両を求めるようなものです。複数のモデルを使い、タスクごとに振り分けましょう。
📖 出典全文: r/openclaw
👀 See Also

V100 SXM2 NVLink ホームラボガイド:約11万円で64GBの統合VRAMを構築する方法
約1,100ドルで64GBのNVLink統合VRAMを備えたV100 SXM2ホームラボを構築する方法について、リバースエンジニアリングされた中国製ハードウェアを使用した包括的なガイド。ハードウェアの調達方法、性能見積もり、ソフトウェア互換性について詳述。

OpenClaw + Ollama ローカルモデルのタイムアウトをデバッグ:サイレント障害に対する5つの修正方法
開発者が、OpenClawエージェントがGemma 4 26BなどのローカルOllamaモデルで暗黙的にタイムアウトする5つの根本原因を特定しました。これには、ブロッキングスラッグジェネレーター、38K文字のシステムプロンプト、隠れたタイムアウトが含まれます。修正には、フックの無効化、設定の変更、Ollama設定の調整が含まれます。

OpenClaw制御UIの接続切断問題の解決
Hostinger VPSでOpenClawを使用している際に発生する「Disconnected (1008): control ui requires HTTPS or localhost」エラーの解決方法を学びましょう。

オープンクローエージェントの自律性問題の修正:スキルファイル、ツール選択、Cron設定
開発者が、初期設定後に自律的に動作しなくなるOpenClawエージェントの解決策を共有しています。主な修正点には、チャット指示の代わりに外部スキルファイルを使用すること、ブラウザツールをAPIベースのツールやPuppeteerスクリプトに置き換えること、cronジョブを適切に設定することが含まれます。