좋은 AI 지원 개발은 작업 수준이 아닌 시스템 수준에서 이루어진다

Reddit 사용자 u/johns10davenport의 게시글에 따르면, AI 지원 개발에서 진정한 효과는 프롬프트 개선이 아닌 시스템 변경에서 비롯됩니다. 저자는 흔한 좌절감을 이야기합니다. Phoenix 앱에 새 기능을 추가할 때마다 AI 코딩 에이전트가 기능은 제공하지만 메뉴 항목은 누락한다는 것입니다. 페이지는 존재하고 기능은 작동하지만, 사용자가 접근할 방법이 없습니다.
작업 수준 수정의 문제점
첫 번째 본능은 모델에게 "버튼을 추가하라"고 말하는 것입니다. 효과는 있지만, 여전히 인간이 문제를 진단하고 해결책을 지시하는 사고를 하고 있습니다. 저자는 이를 "Anthropic이 무료 토큰을 주도록 Peloton을 페달링하는 것"이라고 부릅니다. 프롬프트 엔지니어링은 모델에게 무엇을 할지 더 잘 지시하게 만들 뿐, 여전히 모델을 위해 일하고 있는 것입니다.
시스템 수준의 전환
저자는 누락된 버튼을 수정하는 대신, 앞으로 이 실수를 불가능하게 만드는 방법을 고민했습니다. 해결책은 BDD 사양과 Phoenix LiveView 테스트 헬퍼를 사용하는 것입니다. 테스트 프레임워크의 navigate 함수를 사용하면 에이전트가 UI를 거치지 않고도 어떤 페이지로든 직접 이동하여 테스트를 통과할 수 있습니다. 그래서 저자는 에이전트가 navigate를 호출하지 못하도록 하는 린터 규칙을 작성했습니다. 이제 테스트를 알려진 시작 경로에 배치하는 허용된 fixture가 있으며, 에이전트가 새 기능에 도달하는 유일한 방법은 UI를 클릭하는 것입니다. 이는 테스트 통과를 위해 메뉴 항목을 추가하도록 강제합니다.
결과적으로 이 문제는 다시는 발생하지 않습니다. 더 나은 프롬프트 때문이 아니라, 올바른 행동이 유일한 가능한 행동이기 때문입니다.
핵심 요점
모델의 출력물을 수정하는 것을 중단하십시오. 대신 올바른 출력이 최소 저항 경로가 되도록 환경에 제약을 가하십시오. 모든 실수는 다음 실수를 설계적으로 제거할 기회입니다.
📖 전체 원문 보기: r/ClaudeAI
👀 See Also

레거시 코드 현대화를 위한 2단계 AI 워크플로우
레딧 게시물은 레거시 코드와 AI를 함께 사용하기 위한 두 단계의 '리버스 엔지니어링' 접근법을 설명합니다: 먼저 비즈니스 로직을 기술 중립적인 비즈니스 요구사항 문서로 추출한 다음, '마스터 아키텍트' 프롬프트를 사용해 현대적 모범 사례를 바탕으로 처음부터 재구축하는 방법입니다.

OpenClaw 에이전트, 1주일 후 응답 불능: 텔레그램 통합 문제?
레딧 사용자가 OpenClaw 에이전트가 첫 주 이후 침묵한다고 보고하며, Telegram 통합이나 장기 실행 문제를 의심하고 있습니다. 재시작하면 일시적으로 도움이 됩니다.

클로드 코드의 토큰 사용 팁
토큰 소모를 줄이기 위한 Reddit 게시물의 실용적인 조언: 새 채팅 시작하기, 질문 그룹화하기, CLAUDE.md 간결하게 유지하기, 파일 참조를 정확하게 하기, 요약하고 스레드 다시 시작하기, 간단한 작업에는 가벼운 모델 사용하기.

도구 및 메모리 파일 다이어트로 OpenClaw 부트 토큰 43% 절감
TOOLS.md를 인덱스로 전환하고, 도구 세부 정보를 별도 파일로 이동하며, 단계적 메모리 승격을 구현하여 부트 토큰을 약 9,457개에서 약 5,400개로 줄였습니다(43% 감소).