OpenClawコスト最適化:開発者がモデルルーティングで750ドルのミスを修正した方法

コスト削減策で何が起きたのか
OpenRouterで3日間で750ドルを消費した後、開発者は当初、すべてをHunter Alpha(OpenRouterで無料)に切り替えることでコストを「修正」しました。これにより、サブエージェントが出力ゼロを返すようになりました。ジョブは「成功」と表示されるものの、結果が空のサイレント完了が発生したのです。
具体的な失敗例:ビデオ制作エージェントは、構文チェックが正しく、エラーなく実行されるコードを記述しましたが、音声ナレーションも映像もマニフェストもない、9秒間の無音の黒い動画を生成しました。最終的にQAがこれを発見しました。教訓:無料モデルは必ずしも明確に失敗するわけではなく、時にはスタブを静かに出力して次に進んでしまうことがあります。
新しいモデルルーティング戦略
開発者は「安い vs 高い」という考え方をやめ、「このタスクには実際に何が必要か」を考えるようになりました:
- メインセッション(オーケストレーション): Sonnet 4.6 — 「マネージャー役。コストに見合う価値あり。」
- コード/複雑なタスク: Gemini 2.5 Flash($0.15/M)— 「実際の出力には最適な選択。」
- 機密データ(認証情報、財務データ): Claude 3.5 Haiku — 「Anthropicはプロンプトをログに記録しません。これは絶対条件です。」
- 単純で予測可能なタスク: Hunter Alpha — 「失敗が明らかでリスクが低い場合には問題ありません。」
すべてのcronジョブとサブエージェント生成には、デフォルトなしで明示的なモデルパラメータが設定されるようになりました。
監査中に発見されたセキュリティ問題
モデルの問題を調査している間、開発者はワークスペースリポジトリにコミットされた認証情報(APIキーとOAuthトークン)を発見しました。公開リポジトリにはプッシュされていませんでしたが、これは容認できません。彼らはcredentials/用の.gitignoreを追加し、git rm --cachedを実行しました。警告:一度でも認証情報フォルダをコミットしたことがある場合、それらのキーはgit履歴に残り続けます。キーはローテーションしてください。
核心的な教訓
コスト最適化は一度きりの設定変更ではありません。本番パイプラインを記述する$0.15/Mのモデルは、費用対効果が高いと言えます。一方、壊れた動画を静かに渡す無料モデルは、トークンあたりのコストがいくらであれ、高くつきます。タスクに適したモデルを選び、終了コードだけでなく出力を検証することが重要です。
📖 Read the full source: r/openclaw
👀 See Also

ローカルLLMを使用してMinecraftボットのAFKセッションを監視する
ある開発者がローカルLLMを使用して、採掘作業を実行するBaritoneを搭載したMinecraftボットを監視し、ボットが死亡したときやサーバーから切断されたときにアラートを受け取るための画面監視を設定しました。

自律型マガジンパイプライン with Claude Code: エージェント型アーキテクチャの詳細解説
Claude Codeを編集チームとして活用する7段階のパイプラインにより、1つの見出しから最大5つの事実確認済み多言語記事を生成します。このシステムには5つのサブエージェント、埋め込みによる組織的記憶、拡大するデータベースに対する自動事実確認が含まれています。

非開発者が一年かけてClaudeでiOSアプリを制作:実践的知見
ソフトウェア経験ゼロの非開発者が、Claudeを使って1年かけてiOS向け生産性アプリ「BloomDay」を構築しました。このアプリには、タスク追跡、習慣追跡、環境音付きの集中モード、バーチャルガーデンが含まれており、React NativeとExpoで開発されています。

Claude Codeを使用した文脈に応じたパーソナルAIニュース要約システムの構築
ある開発者が、Mac Mini上で週3回動作する個人向けAIニュースブリーフィングシステムを構築しました。このシステムは17の情報源からデータを収集し、Claude Codeとメモリ統合を活用してパーソナライズされたブリーフを作成します。月額6〜12ドルのコストで、ニュースを進行中のプロジェクトやコード参照、家族の関心事と結びつけるセクションを含んでいます。