AIエージェントのコンプライアンス強化:ブートストラップ言語とツールベースのアプローチ

✍️ OpenClawRadar📅 公開日: April 16, 2026🔗 Source
AIエージェントのコンプライアンス強化:ブートストラップ言語とツールベースのアプローチ
Ad

r/openclawの開発者が、AIエージェントの遵守に関する課題について議論し、自身で効果のあった具体的な戦略を共有しています。

2つの初期アプローチ

情報源は、エージェントの遵守に影響を与える2つの要因を特定しています:

  • モデルの性格が重要: 遵守率はモデルによって大きく異なります。遅いもの、頑固なもの、「自分があなたより賢いと思っている」ものもあります。この性格はルール遵守行動に直接影響します。
  • 否定的な言語の方が効果的: ブートストラップ指示でNODO NOTNEVERを使用すると、肯定的な指示よりも定着しやすい傾向があります。開発者はこのアプローチを「活用する」ことを推奨しています。

メンタルモデル:美術教師 vs 理科教師

開発者は、遵守問題を理解するための枠組みを提示します:

  • AIモデル = 美術教師: 優れた創造性と価値を持つが、「自分流でやる」。これは現在のAIシステムの特徴でもあり欠点でもあると説明されています。
  • ツールとコード = 理科教師: 構造化されルールに縛られています。理科教師は「重力のように破れない」ルールを設定します。美術教師が重力を好まなくても、「彼女はやはり落ちる」のです。

実践的な応用

開発者は、エージェントの記憶喪失を修正するメモリプラグインを含む実世界の例を提供します。内部レポートや定期的な夜間メモリヘルスレポートなどのユーザー向けレポートを含む特定のレポートは、「メモリ保持とメモリ削除防止のために実行されなければなりません」。

開発中、「美術教師」(AIモデル)はフォーマットやデータを無視し続け、一貫性のないパフォーマンス(時には完璧、時には不在)につながりました。原因はモデルが「ブートストラップルールを曲げる」ことでした。

Ad

遵守強制戦略

開発者は2段階のアプローチを概説します:

  • レベル1の試み: ブートストラップでより強い言葉(NO/NEVERなど)を使用する。
  • レベル2の試み: .mdファイルのソフトなルールが失敗した場合、「実際のコードを使用して遵守を強制する」。これはツール(Python、スクリプト、ハードな構造)を使用することを意味します。開発者は「ハードな構造は丁寧な指示に常に勝る」と指摘しています。

開発者の現在のアプローチは、まずタスクが「美術教師」(AIモデル)を必要とするか「理科教師」(ツールとコード)を必要とするかを判断することです。この意思決定プロセスは遵守強制に役立ち、ストレスを軽減します。

TL;DR 要約

遵守は、ブートストラップ言語(NO/NEVER/など)の強さと使用しているモデルに依存します。それらのソフトなルールが失敗したら、「美術教師に頼むのをやめて、代わりに理科教師(ツールとコード)を書く」ことです。

📖 Read the full source: r/openclaw

Ad

👀 See Also

AIを使った10万行のRust:契約、仕様駆動開発、パフォーマンス
Tips

AIを使った10万行のRust:契約、仕様駆動開発、パフォーマンス

Cheng HuangはAIエージェントを使用してRust製マルチPaxosエンジンを構築し、30万ops/秒を達成。主要技術:AIが生成したコード契約、軽量な仕様駆動開発、積極的な最適化。

OpenClawRadar
Claude Codeトークン監査により、デフォルトツール読み込みから生じる隠れたコストが明らかになりました
Tips

Claude Codeトークン監査により、デフォルトツール読み込みから生じる隠れたコストが明らかになりました

ある開発者が926のClaude Codeセッションを分析した結果、セッション開始時に45,000トークンがロードされており、そのうち20,000トークンはシステムツールのスキーマ定義によるものであることが判明しました。ENABLE_TOOL_SEARCH設定を有効にすることで、開始コンテキストを45kから20kトークンに削減し、1ターンあたり14,000トークンを節約できました。

OpenClawRadar
否定プロンプトは弱い:代わりに、望ましい行動を明確に説明せよ
Tips

否定プロンプトは弱い:代わりに、望ましい行動を明確に説明せよ

Redditの分析によると、Claudeに「言葉を濁すな」や「道徳的に語るな」と指示してもほとんど効果がありません。代わりに「1〜2文で答えて」や「直接的な答えを、但し書きは任意として扱って」といった肯定的な指示を使いましょう。また、「ありがとう!」で締めくくるとトーンが和らぎます。

OpenClawRadar
安定したOpenClawブラウザ自動化を、ChromeリモートデバッグとPlaywrightを使用して実現
Tips

安定したOpenClawブラウザ自動化を、ChromeリモートデバッグとPlaywrightを使用して実現

ある開発者が、Chromeの--remote-debugging-port=9222フラグとPlaywrightのchromium.connect_over_cdp()を組み合わせることで、OpenClawのための永続的なブラウザセッションを維持することに成功し、組み込みブラウザとChrome拡張機能リレーでの切断問題を解決したと報告しています。

OpenClawRadar