WCY 형식은 LLM 토큰 오버헤드를 50-71% 감소시키고 구조적인 '모름' 표시자를 추가합니다.

WCY(Watch → Compute → Yield)는 LLM 토큰 오버헤드를 줄이고 추론 과정에서의 불확실성을 위한 구조적 마커를 제공하기 위해 설계된 라인 지향 형식입니다. JSON의 괄호, 따옴표, 쉼표를 한 줄에 하나의 마커를 사용하는 구문으로 대체합니다.
토큰 감소 벤치마크
10-500행 및 MCP 교환 유형에 대한 테스트 결과:
- 구조화된 데이터 대 JSON: -50 ~ -54% 토큰 감소
- 툴-콜 스키마: -65 ~ -71% 감소
- 전체 MCP 프로토콜 교환: -61% 감소
- 다중 에이전트 출력 토큰: -40% 감소
파인튜닝이 필요 없습니다—모델이 형식을 전환하기 위해 세 번의 퓨샷 예시만으로 충분합니다. 이 접근 방식으로 복잡한 작업에서 parse_r 메트릭이 0.29에서 1.00으로 향상됩니다.
불확실성을 위한 ? 마커
WCY는 LLM이 추론 중 모르는 부분을 표시할 수 있는 구조적 방법을 도입합니다. ? (void-B) 슬롯은 모델이 인라인으로 불확실성을 나타낼 수 있게 합니다:
: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5테스트 결과:
- 제로샷: 프롬프트에 사양이 포함되어 있어도 모델이 ? 마커를 0% 사용
- 3개 예시 사용 시: 추적당 5.4개 마커, 67-97% 해결
- 8개 도메인에 걸친 48개 파이프라인 추적: 95% 해결률, 100% 품질 게이트 통과
from= 슬롯은 어떤 관찰이 어떤 결론을 지원하는지 인라인으로 추적하여 환각 체인을 포착하는 데 도움이 됩니다.
사용 가능한 리소스
- wcy_parser.py — 순수 파이썬, 외부 종속성 없음
- wcy_eval.py — 3축 점수화(구조적/의미/출처)
- void-B 주기가 포함된 60개 추론 추적(CC BY 4.0 라이선스, 파인튜닝 실험용)
- 더 많은 추적을 생성하는 파이프라인 스크립트
지금까지 Claude Sonnet에서만 테스트되었습니다. 저자는 동일한 퓨샷 예시로 Qwen, Llama, Mistral에서도 0% → 5.4 마커 결과가 유지되는지 궁금해합니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

클로드가 pywikibot을 임포트하는 대신 3,000줄의 코드를 작성한 사례 — AI 에이전트가 기존 라이브러리를 무시한 사례 연구
한 개발자가 Claude Code(Opus 4.7)를 사용하여 Fandom 위키의 오타를 수정하는 작업을 맡겼다. 모델은 pywikibot, mwparserfromhell, RETF 규칙을 가져오는 대신 약 3,000줄의 Python 코드로 이를 재구현했다. 이 글은 이러한 현상이 발생하는 이유와 2분 만의 검색으로 코드베이스를 1,259줄로 줄인 방법을 탐구한다.

도슨트: 클로드 코드로 구축된 논문 분석 AI 어시스턴트
한 개발자가 Claude Code를 사용하여 업로드된 논문을 읽고, 발표하며, 질문에 답하고, 이해도를 평가하는 AI 어시스턴트 Docent를 만들었습니다. 이 프로젝트는 MIT 라이선스 하에 GitHub에서 이용 가능하며, Vercel에 데모가 있습니다.

ClawedBack: 클로드 코드 내에서 실행되는 OpenClaw 포트
ClawedBack는 Claude Code 내부에서 실행되도록 설계된 OpenClaw의 클린룸 포트로, 첫 번째 파티 프롬프트 캐싱과 속도 제한을 제공합니다. OpenClaw의 내장 도구 23개 중 19개와 일치하며, 가져오기에 대한 필수 보안 검사를 통해 완전히 ClawHub와 호환됩니다.

칸반 보드를 활용한 다중 AI 에이전트 작업 관리
한 개발자가 여러 클로드 AI 에이전트를 터미널 탭에서 실행한 경험을 공유하며 세 가지 주요 워크플로우 문제를 지적했습니다: 진행 상황 가시성 부족, 작업 전환 시 컨텍스트 손실, 그리고 속도 제한 방해. 그들의 해결책은 AI 작업을 칸반 보드의 작업 항목처럼 다루는 것입니다.