LLM 숨겨진 에이전시 신호(Â)를 활용한 향상된 도구 호출

Qwen3로 ReAct 에이전트 실패를 디버깅하는 동안, 한 개발자가 도구 호출 직전의 숨겨진 상태가 AUC > 0.94로 비도구 상태와 선형 분리 가능함을 발견했습니다. 이 잠재 공간의 방향은 "에이전시(agency)"를 의미하는 Â로 불리며, 1.7B에서 8B까지 다양한 모델 크기에 걸쳐 존재하며 선형 프로브만 사용하여 도구 호출을 예측합니다.
에이전시 신호 사용 방법
추론 중에 각 숨겨진 상태를 Â에 투영합니다. 투영값이 임계값 θ를 초과하면, 모델이 텍스트로 표현하지 않더라도 도구를 호출하려는 의도를 가집니다. 그런 다음 도구 호출을 강제할 수 있습니다.
# 추론 시 (의사 코드)
hidden_state = get_middle_layer_state(model, input_text)
proj = np.dot(hidden_state, Â)
if proj > threshold:
# 모델이 행동하려 함 → 도구 호출 강제
tool = choose_tool() # 학습 또는 휴리스틱으로 선택 가능
result = execute_tool(tool)
else:
# 일반 생성
output = model.generate(input_text)
성능 결과
Qwen3 모델로 40가지 다양한 작업(검색, 코드, 파일, 통신, 데이터)에서 테스트:
- Qwen3-1.7B: 26.7% → 85% (+58% 향상)
- Qwen3-8B: 52.5% → 76.3% (+23% 향상)
"도구 미사용" 실패 모드가 43%에서 2.6%로 감소했습니다. 작은 모델이 텍스트 디코딩 능력이 약하기 때문에 더 큰 혜택을 보지만, 기하학적 신호는 동등하게 강력합니다.
 추출 방법
세 가지 방법:
- 옵션 1: 자체 추적 데이터에서 - 도구 사용과 비사용 숨겨진 상태 간의 정규화된 평균 차이 계산
- 옵션 2: 대조 프롬프트를 통해 - 모델을 통해 15쌍의 프롬프트(도구 필요 프롬프트와 수동적 프롬프트)를 실행하고 중간 레이어에서 평균 차이 취함
- 옵션 3: 사전 계산된 방향 사용 - 저장소에서 공유된 Qwen3 모델용 추출된 Â 방향 사용
패키지 구현
이 발견은 쉽게 재사용할 수 있도록 라이브러리로 패키징되었습니다:
bash
pip install a-hat-optimizer
python
from a_hat_optimizer import AHat
# 1줄로 모든 HF 모델에서 자동 추출
ahat = AHat.from_model("Qwen/Qwen3-8B")
# 또는 사전 추출된 것 로드
ahat = AHat.from_file("my_ahat_dir/")
# 에이전트에서 사용
should_call, confidence = ahat.predict(hidden_state)
if should_call:
print(f"도구 호출 강제 (신뢰도: {confidence:.2f})")
라이브러리는 대조 프롬프트를 통한 자동 추출, 4가지 보정 전략(중간점, F1, 유덴, 백분위수), 배치 예측, AUC 및 레이어 정보를 포함한 메타데이터와 함께 저장/로드를 처리합니다.
📖 전체 소스 읽기: r/LocalLLaMA
👀 See Also
mcp-memory: SQLite FTS5 + Google의 OKF를 이용한 빠른 에이전트 메모리
mcp-memory는 Google의 OKF 형식과 SQLite FTS5를 사용하여 하위 20ms 조회를 제공하는 AI 에이전트용 영구 메모리 MCP 서버입니다. memory_store, memory_retrieve, memory_search, memory_get_last의 네 가지 도구를 포함합니다.

Apideck CLI: AI 에이전트를 위한 MCP의 저컨텍스트 대안
Apideck CLI는 도구 스키마에 수만 개의 토큰 대신 약 80개의 토큰을 사용하는 AI 에이전트 인터페이스로, MCP의 컨텍스트 윈도우 소비 문제를 해결합니다. 벤치마크 결과, 동일한 작업에서 MCP가 CLI보다 4배에서 32배 더 많은 토큰을 소비할 수 있음을 보여줍니다.

DIY OpenClaw 대안: 헤드리스 모드에서 Claude 코드 사용하기
한 개발자가 헤드리스 모드의 Claude Code에 프롬프트를 전송하는 Python 서버를 구축했습니다. 이 시스템은 Telegram 봇 접근, Hammerspoon 자동화, 그리고 작업, 일정, 메모를 위한 로컬 마크다운 파일 저장 기능을 갖추고 있습니다.

로브스터 케이지: 라즈베리 파이에서 OpenClaw를 셀프 호스팅하기 위한 도커화된 보안 환경
한 개발자가 라즈베리 파이에서 OpenClaw를 자체 호스팅하기 위한 Dockerized 보안 환경인 Lobster Cage를 만들었습니다. 이 프로젝트는 네트워크 접근을 제한하면서 자율 코딩 에이전트를 실험하기 위한 통제된 설정을 제공하는 것을 목표로 합니다.