AI 코딩 에이전트가 20턴 후에 엉터리 결과물을 내는 이유: 맥락 맹목성

r/LocalLLaMA의 한 개발자가 약 20턴 후에 토큰 사용량이 급증하고 에이전트 출력이 형편없어지는 것을 발견하고 API 로그와 프롬프트 페이로드를 감사했습니다. 결론: 모델이 더 나빠진 것이 아니라, 자체적으로 부풀려진 컨텍스트 윈도우에 질식하고 있다는 것입니다.
네 가지 구조적 실수
Cursor와 Claude Code가 1만 줄 이상의 저장소에서 실제로 수행하는 작업을 검사한 후, 작성자는 네 가지 패턴을 식별했습니다:
- 맹목적 탐색: 에이전트가 하나의 유틸리티 함수를 찾기 위해 재귀적으로 grep하고 ~40개의 서로 다른 파일을 컨텍스트에 덤프합니다. 종종 기존 컴포넌트를 놓치고 처음부터 중복을 환각합니다.
- 원시 수집: 5줄 인터페이스를 업데이트하기 위해 2,000줄짜리 파일을 프롬프트에 덤프합니다. 많은 컨텍스트 토큰을 낭비합니다.
- 도구 남용: 장황한 테스트 로그와 거대한 MCP 도구 정의가 모델이 코드 한 줄을 생성하기 전에 약 3만 토큰을 소모합니다.
- 금붕어 기억: 모든 세션이 새로 시작되어 프로젝트 인식이 전혀 없으므로 동일한 파일이 반복적으로 다시 읽힙니다.
80% 컨텍스트에서의 전환점
컨텍스트가 노이즈로 약 80% 용량에 도달하면 모델의 어텐션 메커니즘이 급격히 저하됩니다. IQ가 눈에 띄게 방 온도 수준으로 떨어지고 아키텍처를 파괴하기 시작합니다. 표준 청킹 RAG는 논리에 쓸모없기 때문에 이 문제를 해결하지 못합니다. 에이전트는 원시 텍스트를 읽기 위해 토큰을 소모하기 전까지 코드베이스 구조를 인식하지 못합니다.
제안된 수정: AST 또는 그래프 DB
작성자는 컨텍스트를 소비하기 전에 코드를 AST 또는 그래프 데이터베이스로 파싱하는 오픈소스 에이전트를 요구합니다. 이를 통해 원시 텍스트에 토큰을 낭비하지 않고 구조를 이해할 수 있습니다. 이는 타이핑에서 절약된 1시간당 5시간을 수정에 소모하게 만드는 아키텍처 스파게티를 방지할 것입니다.
대상 독자
실제 코드베이스에서 Cursor, Claude Code 또는 로컬 LLM 에이전트를 사용하며 생산성 역설에 좌절하는 개발자들.
📖 전체 소스 읽기: r/LocalLLaMA
👀 See Also

3주 만에 개발한 솔로 개발자의 크로스 플랫폼 AI 에이전트, 40개국 이상 출시
한 명의 독립 개발자가 Skales를 만들었습니다. 네이티브 데스크톱 AI 에이전트로 139개 이상의 도구와 원격 제어용 모바일 동반 앱을 갖추고 있으며, Claude를 사용해 단 3주 만에 완성했습니다. 이 앱은 macOS, Windows, Linux에서 실행되며, 로컬 우선이고 무료이며, 이미 40개 이상의 국가에서 활성 사용자를 보유하고 있습니다.

Adam CAD 하네스가 퓨전 및 온셰이프와 통합되어 에이전틱 CAD 편집을 지원하다
Adam의 에이전틱 CAD 하네스가 이제 Autodesk Fusion 및 PTC Onshape와 통합되어 자연어로 피처 트리를 읽고 편집합니다. macOS/Windows용 한 줄 명령어로 설치 가능합니다.

TypeScript 프로젝트용 MCP 서버, Claude Code의 Grep 패턴을 인덱싱된 심볼 조회로 대체
한 개발자가 TypeScript 프로젝트에서 Claude Code의 grep-and-guess 패턴을 인덱싱된 심볼 조회로 대체하는 MCP 서버를 구축했습니다. 이 도구는 심볼, 호출 위치, 임포트, 클래스 계층 구조의 실시간 SQLite 인덱스를 유지하여 테스트에서 토큰 사용량을 63-79% 줄였습니다.

Agent Smith: MCP 서버, 스킬 및 Claude Code를 위한 티켓-to-PR 파이프라인을 구축하는 하나의 명령어
Agent Smith가 리포지토리를 스캔하고 정확한 스택(Go/Echo, React/Zustand, golang-jwt, pgx 등)을 감지하여 MCP 서버, 훅, 스킬을 설정하고, Jira 티켓에서 PR까지 자동화하는 파이프라인을 제공합니다.