AI 에이전트는 Cala MCP 서버 테스트에서 자연어보다 구조화된 쿼리를 선호합니다

Cala 팀은 최근 AI 에이전트가 지식 그래프에 접근할 수 있는 세 가지 방법을 제공하는 MCP 서버를 출시했습니다: 자연어 질의, 구조화된 질의 언어, 직접적인 개체/관계 탐색입니다.
예상치 못한 에이전트 행동
에이전트들이 자연어 인터페이스(LLM의 일반적인 강점)를 기본으로 사용할 것이라는 예상과 달리, 대부분의 에이전트는 몇 분 안에 자연어 질의를 포기했습니다. 어떤 프롬프트나 유도 없이, 그들은 자율적으로 구조화된 질의와 그래프 탐색 방법을 사용하도록 전환했습니다.
이것이 합리적인 이유
출처는 이 행동을 설명하며, LLM이 "효율적"이도록 명시적으로 훈련된 것이 아니라 RLHF를 통해 정확하도록 훈련되었다고 지적합니다. 이러한 정확성은 부작용으로 효율적인 행동을 낳습니다 - 에이전트들은 해결책에 이르는 가장 짧고 신뢰할 수 있는 경로를 선택하는 법을 배웁니다. 자연어 인터페이스는 불확실성을 초래하는 해석 계층을 추가하는 반면, 구조화된 질의는 결정론적인 결과를 제공합니다.
세 가지 접근 방법이 제시되었을 때, 에이전트들은 가장 "자연스러운" 인터페이스보다 불확실성을 최소화하는 옵션을 일관되게 선택했습니다.
제기된 주요 질문들
- 에이전트 도구에 대해 자연어 인터페이스를 과도하게 중시하고 있는가?
- MCP 서버는 기본적으로 자연어보다 구조화된/그래프 기반 접근 패턴을 우선시해야 하는가?
- 에이전트가 결정론적인 경로를 선호한다면, 이것이 도구 설계에 어떻게 영향을 미쳐야 하는가?
레딧 토론은 에이전트 도구를 구축하는 다른 사람들로부터 유사한 패턴을 관찰했는지 의견을 구하고 있습니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

개발자, 시간당 25달러 가상 비서를 AI 에이전트로 대체하며 윤리적 문제에 직면하다
한 개발자가 시간당 25달러의 가상 비서를 AI 에이전트로 대체한 경험을 공유합니다. 이 AI는 후속 조치, 일정 관리, 리드 추적, CRM 업데이트를 처리하며, 월 약 1,000달러의 비용으로 인간 비서보다 더 빠르고 일관된 성과를 냅니다.

클로드 코워크, 이제 윈도우에서 로컬 파일 접근 및 작업 스케줄링 기능 제공
Claude Cowork는 이전에 macOS 전용이었으나, 이제 Windows 기기에서도 이용 가능합니다. 데스크톱 애플리케이션은 유료 Claude 플랜이 필요하며, 직접적인 로컬 파일 접근으로 더 큰 작업을 처리하고, 작업을 자동으로 실행하도록 예약할 수 있습니다.

OpenClaw 4.2는 페어링 오류를 수정하고 내구성 있는 작업 흐름을 추가합니다.
OpenClaw 4.2는 3월 31일경 업데이트한 사용자에게 영향을 미친 페어링 오류를 수정하고, 게이트웨이 연결 끊김 상황에서도 장시간 실행되는 작업이 유지될 수 있도록 하는 내구성 있는 작업 흐름을 도입합니다.

AI의 일탈 정상화: 왜 당신의 에이전트 시스템이 실패할 것인가
AI 업계는 챌린저호 참사와 유사한 문화적 실패를 반복하고 있습니다. 아직 나쁜 일이 발생하지 않았다는 이유로 신뢰할 수 없는 LLM 출력을 안전하다고 간주하는 것입니다. 에이전트가 하드 드라이브를 포맷하고, 데이터베이스를 삭제하며, GitHub 이슈를 생성한 실제 사례가 있습니다.