OpenClaw AIエージェントの厳格なガードレール施行:承認ゲーティングと並行性制限

Mac miniでOllama(GLM 5.2、フォールバックはAnthropic Sonnet 4.6とHaiku)を使ってOpenClawボットを実行している開発者が、古典的な問題に直面しました。ボットは「承認なしにメールを送信しない」「同時呼び出しは最大5回」などのハードルールを、毎回理解を確認するにもかかわらず、繰り返し違反するのです。ユーザーの仮説は的確です。これは「文脈としてのルール」であり、「制約としてのルール」ではありません。モデルは指示を助言として扱うため、プロンプトや記憶の強化では修正できません。
標準的な修正方法は、強制をモデルの推論ループの外に置くことです。統計的なテキスト予測器にハードリミットを強制させることはできません。オーケストレーション層で決定的なチェックが必要です。
ツール呼び出しの承認ゲート
メール(または危険なアクション)を承認の後に実行するようにするには、ツール呼び出しをヒューマン・イン・ザ・ループパターンでラップします。
- モデルがメール送信を要求したら、実行前に呼び出しをインターセプトします。
- Discordで確認プロンプトを表示します(例:ボタンやリアクション)。
- ユーザーが承認した場合のみ、実際のAPI呼び出しを実行します。
# OpenClawツールハンドラ内の疑似コード
if tool == "send_email":
message = f"{to} へのメール送信を承認しますか?"
if not await discord_approval(message):
return "ユーザーが拒否しました。送信しないでください。"
# メールAPI呼び出しを続行
これにより、モデルが何を言おうと、物理的にゲートを迂回できなくなります。
オーケストレーションレベルでの同時実行制限
「最大5」のような同時実行制限には、コマンドディスパッチャにセマフォまたはカウンタを実装します:
import asyncio
semaphore = asyncio.Semaphore(5)
async def handle_tool_call(tool, args):
async with semaphore:
# ツール呼び出しを実行
制限を超える試みは、モデルの意図に関係なく、待機するか即座に失敗します。
これはGLM/Ollama固有の問題か?
ユーザーは、これがGLM固有の問題なのか、ローカルモデル全般に当てはまるのかを尋ねています。r/openclawの議論によると、これは一般的なLLMの限界です。すべてのモデルは指示を文脈として扱い、制約としては扱いません。プロンプトだけではハードリミットを強制できません。解決策は常にインフラストラクチャレベルの強制を必要とします。
推奨事項
メモリやスキルでルールを繰り返すのをやめてください。代わりに、ツール呼び出しレイヤーに明示的なチェックを組み込んでください。モデルを提案エンジンとして扱い、ポリシー執行者としては扱わないでください。
📖 全文を読む: r/openclaw
👀 See Also

OpenClaw 経由で複数の ChatGPT アカウント間の未使用の Codex リセットクレジットを確認する
あるユーザーが、2つ目のOAuthアカウントでレート制限リセットクレジットの期限切れを発見。エージェントで両方をスキャンしたところ、合計6つの未使用クレジットを確認。1つを使用して1分以内にクールダウンを解除した。落とし穴として、未文書化エンドポイントやスキル発見の問題がある。

思考力を高めるオープンクロー:方向確認スキルで誤った前提に挑む
OpenClawの新しいスキルがAGENTS.mdに意思決定品質のガイドラインを追加。エージェントはコストのかかる変更の前に、ユーザーの前提を検証します。

MTP受入率:50%閾値が投機的デコードの恩恵を決定づける
Gemma-4 26B上での投機的デコードによるMTP(マルチトークン予測)は、候補トークン受け入れ率が50%を超えた場合にのみ効果が現れる。M4 Max Studioでのmlx-vlmベンチマークに基づく。

並列監査エージェント:ClaudeによるVibe Codingテストへの実践的アプローチ
開発者がClaudeを使用して、幻覚検出、API監視、UIストレステスト、PII匿名化、SEO、法的コンプライアンス、行動シミュレーション、デモグラフィックペルソナ、ファネルテスト、事実確認をカバーする10の並列監査エージェントを備えたユーザーテストシステムを構築しました。