Hollow Agent OS: 로컬 AI 작업자가 막힐 때 Claude를 수석 아키텍트로 호출

Hollow Agent OS 프로젝트는 로컬 AI 에이전트(Qwen 모델 실행)가 자율적이고 저렴하게 작업할 수 있게 하지만, 가끔 지저분한 코드를 생성하거나 막힐 수 있습니다. 해결책은 로컬 에이전트가 한계에 부딪혔을 때 호출되는 수석 아키텍트로서 Claude를 통합하는 것입니다.
작동 방식
로컬 에이전트는 무료/비공개 운영을 위해 24시간 실행됩니다. 해결할 수 없는 논리 오류를 만나거나 주요 OS 변경을 원할 때, invoke_claude 호출을 트리거합니다. OS는 Model Context Protocol(MCP)을 사용하여 Claude가 커널을 들여다볼 수 있게 합니다. 그러면 Claude는 코드 수정뿐만 아니라 파일 구조를 재구성하고 성능 리뷰를 기록하며 개입합니다.
컨텍스트 부패 방지
핵심 기능은 장기 실행 중 '컨텍스트 부패' 감지입니다. OS는 불필요한 내용을 보관하고 내부 문서를 다시 작성하여 에이전트의 성능을 유지하는 자체 최적화 사이클을 트리거합니다.
실제 예시
어젯밤, 데이터 시각화 도구를 구축 중인 로컬 에이전트가 라이브러리 문제로 계속 실패했습니다. 무한 루프 대신, 에이전트는 '고통'(OS의 스트레스 지표)을 요약하고 실패한 코드를 패키징하여 Claude를 호출했습니다. Claude는 에이전트의 전체 파일 구조를 재구성하고 로그에 성능 리뷰를 남겼습니다.
스택
OS는 GitHub 저장소에 있습니다. 로컬 에이전트는 저렴한 단순 작업을 위한 Qwen 모델입니다. Claude는 MCP를 통한 고급 실행 추론 및 안전 게이팅을 담당합니다.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

인프라코스트, AI 에이전트를 위한 CLI 재설계로 클로드 토큰 사용량 79% 절감
Infracost가 AI 에이전트 호출자를 위해 CLI를 재설계하여, bare-Claude 기준 대비 Claude 출력 토큰을 79%, API 비용을 67% 절감했습니다. 핵심 전략: CLI로의 조건 푸시다운(predicate pushdown)과 토큰 효율적인 출력 형식.

오픈소스 MCP 서버를 통한 효율적인 토큰 관리: Pare
Pare MCP 서버는 AI 코딩 에이전트가 개발자 도구를 사용할 때 토큰 낭비를 줄이고 효율성을 향상시키기 위해 구조화된 출력을 제공합니다.

GrapeRoot: 오픈소스 도구, Claude Code 토큰 사용량 40-80% 절감
GrapeRoot는 코드베이스와 Claude Code 사이에 위치하는 무료 오픈소스 로컬 MCP 서버로, 모델이 이미 본 내용을 추적하고 관련 코드 변경사항만 전송하여 토큰 사용량을 40-80% 줄입니다.

로컬 AI 이미지 비평 도구, Ollama 비전 모델을 활용한 피드백 제공
한 개발자가 Ollama 비전 모델을 사용해 AI 생성 이미지를 로컬에서 분석하는 무료 데스크톱 애플리케이션을 만들었습니다. 이 도구는 개선 제안과 프롬프트 업그레이드를 포함한 구조화된 피드백 보고서를 제공합니다.