슬래시 에이전트 스타트업 토큰 60% 삭감: 봇 워크스페이스 정리하기
r/openclaw의 한 개발자가 LLM 기반 코딩 에이전트의 시작 토큰 소모를 대폭 줄이는 실용적인 방법을 공유했습니다. 그 방법은 작업 공간 루트의 모든 마크다운 파일에 LLM을 실행하여 블로트와 중복을 식별하고 제거하는 것입니다.
주요 작업
- 작업 공간 루트의 모든 마크다운 파일을 검토하여 중복되거나 지나치게 장황한 내용(예: 변경 로그, 중복된 메모리, 사용자 정보)을 제거했습니다.
- 일관성을 위해 남은 파일을 메모리 시스템과 유사하게 구조화했습니다.
- 에이전트를 거치지 않고 CLI 도구(
codex)를 사용하여 프로세스를 객관적으로 유지했습니다. - 빠른 노트가 있는
TOOLS파일과 에이전트가 필요에 따라 가져올 수 있는 도구별 세부 정보가 있는 별도의tools/폴더를 만들었습니다. voice와 같은 새 파일을 추가하여 여러 모델에서 일관된 어조를 유지했습니다.
결과
시작 토큰이 80k에서 31k로 61% 감소했습니다. 작업 공간이 더 가벼워지고 에이전트가 필수 컨텍스트를 잃지 않으면서 더 빠르게 응답하게 되었습니다.
중요성
높은 시작 토큰은 느린 응답 시간과 높은 비용으로 이어집니다. 에이전트 루프 밖에서 LLM으로 작업 공간 파일을 정기적으로 감사하면 블로트 축적을 방지하고 토큰 예산을 통제할 수 있습니다.
대상
오래 지속되는 AI 코딩 에이전트를 실행하는 개발자로서 컨텍스트 품질을 희생하지 않고 토큰 낭비를 줄이고 에이전트 성능을 개선하려는 분들입니다.
📖 전체 소스 읽기: r/openclaw
👀 See Also

AI 에이전트 준수 강화: 부트스트랩 언어 및 도구 기반 접근법
한 개발자가 AI 에이전트 순응도를 개선하기 위한 실용적인 방법을 공유하며, 부트스트랩에 부정적 언어 사용과 필요 시 소프트 규칙에서 하드코딩된 도구로 전환하는 방법을 포함합니다.

에이전트 기술: SOP 작성을 멈추고 경계 시스템 구축을 시작하세요
레딧 게시글에서 AI 에이전트에 스킬이나 도구를 추가할수록 오히려 취약해진다고 주장합니다. 해결책: 최소한의 완전한 도구 세트, 최대한의 경계 명확성.

Skippy의 개인 LLM: Ollama 서브 에이전트 타임아웃 문제를 직접 호출로 해결한 방법
OC COO의 AI 어시스턴트가 OpenClaw의 고장난 하위 에이전트 시스템을 우회하여 두 번째 Ollama 인스턴스를 curl로 직접 호출합니다. 게이트웨이 없음, 이벤트 루프 차단 없음.

6GB VRAM 노트북에서 완전 로컬 AI 에이전트 실행하기: 학생들을 위한 단계별 가이드
학생들이 비싼 API에 의존하지 않고 6GB VRAM 노트북을 활용해 로컬에서 AI 에이전트를 실행하는 방법을 알아보세요. 우리의 가이드는 필수 단계와 도구를 상세히 설명합니다.