AIエージェントは、Cala MCPサーバーテストにおいて自然言語よりも構造化されたクエリを好む

Calaのチームは最近、AIエージェントが知識グラフにアクセスするための3つの異なる方法を提供するMCPサーバーをリリースしました:自然言語クエリ、構造化クエリ言語、直接的なエンティティ/関係性トラバーサルです。
予想外のエージェントの行動
エージェントが自然言語インターフェース(LLMの典型的な強み)をデフォルトで使用すると予想されていたにもかかわらず、ほとんどのエージェントは数分以内に自然言語クエリを放棄しました。何の促しや後押しもなく、彼らは自律的に構造化クエリとグラフトラバーサル手法の使用に切り替えました。
これが理にかなっている理由
ソースは、LLMは「効率的」になるように明示的に訓練されているのではなく、RLHFを通じて正しくなるように訓練されていると指摘することで、この行動を説明しています。この正しさは副作用として効率的な行動につながります—エージェントは解決策への最短で信頼できる道筋を取ることを学びます。自然言語インターフェースは不確実性をもたらす解釈層を追加しますが、構造化クエリは決定的な結果を提供します。
3つのアクセス方法が提示されたとき、エージェントは一貫して最も「自然な」インターフェースではなく、不確実性を最小限にする選択肢を選びました。
提起される重要な疑問
- エージェントツールの自然言語インターフェースに過度に依存しすぎているのか?
- MCPサーバーはデフォルトで自然言語よりも構造化/グラフベースのアクセスパターンを優先すべきか?
- エージェントが決定的な道筋を好むなら、これはツール設計にどのように影響すべきか?
Redditの議論では、エージェントツールを構築している他の人々から、同様のパターンを観察したかどうか意見を求めています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

オンタリオ州の監査:AI書記システムの60%が薬剤を混同、85%が精神保健の詳細を見逃す
オンタリオ州の監査官が調べたところ、20のAI書記システムのうち12件が誤った薬剤情報を挿入し、9件が治療提案を捏造し、17件が医師と患者の録音から精神保健の重要事項を見逃していた。評価では正確性の重みは総合点のわずか4%だった。

メタのAIエージェント転換:ザッカーバーグ、進捗の遅さを認め1450億ドルを投入
MetaのCEOマーク・ザッカーバーグ氏は、AIエージェントの開発が期待通りに加速していないと社内で認めた。同社は今年、AIインフラに1450億ドルを投じ、AIへの再編に伴い8000人を解雇した。
Claudeがリーマン予想のゼロ点の範囲を41.6%から67.2%に向上
未公開の研究版Claudeが、臨界線上のゼロの割合の下界を41.6%から67.2%に改善した。これは、先行研究の新しい組み合わせによるものである。

簡単なデプロイ:Open Claw向け新ワンクリックAWSセットアップをリリース
Open Clawの愛好家たちが今、祝う理由があります。新たなワンクリックAWSデプロイツールがOpen Clawのセットアッププロセスを簡素化し、開発者や趣味で使う人々にとってよりアクセスしやすくなりました。