4개 창 iTerm2 설정으로 Claude 코드 CLI의 AI 역할 분리

문제와 해결책
Claude Code CLI를 사용하는 개발자가 두 가지 지속적인 문제에 직면했습니다: 수십 번의 대화 후 세션이 지저분해지고 흐름을 잃는 컨텍스트 드리프트, 그리고 단일 모델이 자신의 코드를 구현하고 감사하여 침묵하는 실패로 이어지는 자기 평가 편향입니다.
해결책은 Claude Code를 위해 특별히 구축된, 각 창이 특정 역할에 전담하는 4개 창 iTerm2 터미널 배열입니다.
창 구성
- AUDIT (Opus, 읽기 전용): 적대적 검토만 수행하며, 파일을 쓸 수 없도록 강제됨
- IMPL (Sonnet): 구현 및 테스트 실행
- PROMPT: 코드와 분리된 프롬프트 엔지니어링 및 반복
- PLAN: 아키텍처 논의 및 문서화, 파일 쓰기 없음
기술적 구현
각 창의 cc 별칭은 올바른 모델, 노력 수준 및 권한으로 Claude를 자동으로 실행합니다. 이 설정은 사용자 정의 환경 변수 대신 $ITERM_PROFILE(iTerm2에서 기본적으로 설정됨)을 사용하므로, 추가 절차 없이 충돌 및 창 배열 복원을 견딥니다.
개발자는 .zshrc 스니펫을 포함한 완전한 구현 세부 사항이 담긴 무료 가이드를 pravindurgani.github.io/claude-code-multipane-iterm2/에 게시했습니다.
📖 전체 소스 읽기: r/ClaudeAI
👀 See Also

맞춤형 llama.cpp 백엔드, Ryzen AI MAX 385의 AMD XDNA2 NPU로 LLM 행렬 곱셈 오프로딩
한 개발자가 Ryzen AI MAX 385(Strix Halo)의 AMD XDNA2 NPU에 GEMM 연산을 직접 전달하는 맞춤형 llama.cpp 백엔드를 구축하여 Meta-Llama-3.1-8B-Instruct Q4_K_M 모델로 0.947 J/tok의 에너지 효율로 43.7 t/s 디코딩 속도를 달성했습니다. NPU 디코딩 경로는 Vulkan 전용 대비 약 10W를 절약하면서 디코딩 처리량을 유지합니다.

오픈소스 LLM 에이전트 자동 메모리 시스템, 94% 회상 정확도 달성
개발자가 LLM 기반 에이전트를 위한 메모리 플러그인을 구축했으며, 이 플러그인은 사용자의 명시적인 명령 없이도 세션 간에 사실을 자동으로 추출, 분류 및 지속적으로 저장합니다. 이 시스템은 벡터 데이터베이스 대신 구조화된 마크다운 파일을 사용하여 52개 체크포인트 회상 벤치마크에서 94.2%의 정확도를 달성했습니다.

AI 에이전트 전화 계층, 오픈소스로 전환: AI에 전화번호를 부여하세요
한 개발자가 AI 에이전트가 전화를 걸고 문자를 보낼 수 있게 하는 오픈소스 전화 계층을 만들었습니다. REST + MCP 기반이며, 프레임워크에 구애받지 않고 OpenClaw 스킬을 포함합니다.

5090에서 Qwen3.6-27B와 Opencode를 이용한 로컬 AI 개발
한 Reddit 사용자가 클라우드 AI 코딩 도구(Claude Code, Cursor)에서 로컬 설정(Opencode + llama-server + Qwen3.6-27B, 128K 컨텍스트, 단일 RTX 5090)으로 전환한 경험을 공유하며, 사용량 제한과 계정 위험에서 자유로워졌다고 말합니다.