인지적 항복: 이해하지 못하는 코드를 작성하는 AI 에이전트

✍️ OpenClawRadar📅 게시일: August 28, 2026🔗 Source
Ad

대규모 PR에 대해 엔지니어에게 문의합니다. 진짜 아키텍처 질문 하나를 하면, 그들은 답을 못 합니다. 아무도 답을 못 합니다. 거대한 diff, 모두가 바쁘고, 그래서 검토 없이 승인되고 병합됩니다. 이것이 AI가 자신의 코드를 검토하는 모습입니다. 같은 에이전트에게 자신의 작업을 확인하라고 하는 것은 학생이 자신의 시험을 채점하는 것과 같습니다. 항상 통과합니다.

이 시나리오는 Manager.dev의 최근 기사의 핵심입니다. 이 기사는 개발자가 코드 생성뿐만 아니라 의사 결정까지 Claude와 같은 AI 어시스턴트에게 넘겨줄 때 일어나는 일을 탐구합니다. 저자는 "잘 모르겠어요, Claude가 썼어요"라는 응답에 대해 글을 쓰며, 점점 커지는 문제인 인지적 항복을 강조합니다.

인지적 항복이란 무엇인가?

이 기사는 두 가지 용어를 구분합니다:

  • 인지적 오프로딩 — AI에게 위임하지만 여전히 답에 대한 책임은 자신이 지는 것.
  • 인지적 항복 — AI의 출력이 조용히 자신의 출력이 되고, 확인할 것이 남아 있지 않다고 느끼는 것.

소프트웨어 엔지니어에게 이 두 가지 사이의 경계는 매일 흔들리며, 대부분은 그것을 알아차리지 못한 채 넘어갑니다. AI가 생성한 코드가 검토되지 않을 때 문제는 더욱 악화되어, 작성자와 검토자 모두 코드베이스를 이해하지 못하는 상황이 발생합니다.

어떻게 발생하는가

이 기사는 일반적인 시나리오를 설명합니다:

  1. 작은 작업이 아니라서 유명한 슈퍼파워 브레인스토밍 스킬을 사용하여 Claude와 계획 세션을 시작합니다.
  2. 계획을 깊이 읽고 몇 가지 문제를 수정한 후 실행에 넘깁니다.
  3. 코드를 검토하고, 괜찮아 보이며, 몇 가지 프롬프트로 작은 문제를 수정하고 리뷰에 보냅니다.
  4. 다음으로 더 큰 작업이 옵니다. 모호합니다. AI 이전 세계에서는 더 작은 조각으로 나누었겠지만, 서두르고 있습니다.
  5. Claude가 그럴듯한 계획을 생성하고, 바로 실행으로 넘어갑니다. 결과는 작동합니다. 코드를 훑어보고 PR을 열고 다음으로 넘어갑니다.
  6. 실제로 무엇이 일어나고 있는지 이해하는 단계를 건너뛰었습니다.

최선의 경우, 검토하는 엔지니어가 당신이 완전히 이해하지 못하는 질문을 합니다. 최악의 경우, 아주 큰 PR, 모두가 바쁘고, 그냥 승인되고 병합됩니다. 아무도 이해하지 못했습니다 — 작성자도, 검토자도 아닙니다.

Ad

저항하기 어려운 이유

저자는 개인적인 경험을 공유합니다: 야심찬 미션을 위해 Claude와 2-3시간의 계획 세션을 보냈습니다. 실행 중간에 길을 잃었습니다 — 너무 많은 움직이는 부분과 Claude가 내린 결정들. 결국 /clear를 입력하고 모든 것을 재설정했습니다. 두 가지 문제가 있었습니다:

  • 달성하려는 것에 대한 막연한 아이디어로 시작했습니다.
  • 작업하는 영역에 대해 충분히 이해하지 못했습니다.

계획이 모호하고 스스로 결정을 내릴 만큼 알지 못할 때, 결정을 Claude에게 위임하게 됩니다. Google의 엔지니어링 디렉터인 Addy Osmani가 썼듯이, Claude를 사용하는 것과 Claude가 주도하도록 두는 것 사이의 경계는 매우 흐릿하며, 유혹에 저항하는 데 많은 노력이 필요합니다.

한 가지 접근법: 모든 줄 검토

이 기사는 대안적인 접근법을 제시합니다. 내부 AI 에이전트 인프라에 Segment를 통한 이벤트 추적을 추가하는 작은 작업의 경우, 저자는 Claude와 계획을 세운 후 커밋하기 전에 IDE에서 모든 변경 사항을 검토했습니다. 이해하지 못하는 파일에 대해서는 Claude에게 설명을 요청했습니다. 답변이 이해가 안 되면 코드를 변경하고 다시 검토했습니다. 모든 파일 변경을 이해할 때쯤에는 전체 솔루션을 이해하게 되었습니다.

저자는 PR을 열었고 시니어 엔지니어들의 훌륭한 코멘트를 받았습니다 — 그리고 물 속의 물고기처럼 숨지 않고 실제로 응답할 수 있었습니다.

핵심 요점

AI 코딩 에이전트를 사용할 때, 당신이 책임지는 코드를 이해하고 있는지 확인하세요. AI가 모든 결정을 내리도록 두지 마세요. 각 변경 사항을 검토하고, 질문하고, 이해하지 못하는 PR을 열지 마세요.

📖 전체 소스 읽기: HN AI Agents

Ad

👀 See Also

SPLICE 벤치마크 결과, 시각 언어 모델(VLMs)은 시간적 추론에 어려움을 겪고 언어 사전 지식에 의존하는 것으로 나타났습니다.
News

SPLICE 벤치마크 결과, 시각 언어 모델(VLMs)은 시간적 추론에 어려움을 겪고 언어 사전 지식에 의존하는 것으로 나타났습니다.

EMNLP 2025에서 발표된 연구에 따르면, 비전-언어 모델들은 인간이 뛰어난 성과를 보이는 비디오 순서 맞추기 과제에서 낮은 점수를 기록했습니다. Gemini 2.0 Flash 모델은 51%의 정확도를 보인 반면, 인간의 성능은 85%였습니다. 모델들은 진정한 시각적 이해보다는 시각적 지름길과 언어적 설명에 의존하는 경향이 자주 나타났습니다.

OpenClawRadar
3월 16일 이후 전체 할당량이 남아있음에도 OpenAI Codex OAuth에서 429 오류 반환
News

3월 16일 이후 전체 할당량이 남아있음에도 OpenAI Codex OAuth에서 429 오류 반환

OpenAI Codex OAuth가 3월 16일 이후로 지속적으로 429 "할당량을 초과했습니다" 오류를 반환하고 있으며, 대시보드에는 100% 할당량이 남아 있는 것으로 표시됩니다. 사용자들은 재인증, 토큰 취소, 완전한 재구성에도 불구하고 문제가 지속된다고 보고합니다.

OpenClawRadar
레딧 토론에서 AI 생성 코드의 디버깅 어려움을 강조합니다
News

레딧 토론에서 AI 생성 코드의 디버깅 어려움을 강조합니다

r/ClaudeAI의 레딧 토론에서는 AI 생성 코드와 관련된 구체적인 문제들을 다루고 있으며, 여기에는 보안 취약점, 논리 환각, 그리고 수동으로 코드를 작성하는 것보다 더 오래 걸릴 수 있는 디버깅 과정이 포함됩니다.

OpenClawRadar
남아프리카 공화국 내무부 공무원 2명, 정책 보고서 AI 환각 문제로 정직
News

남아프리카 공화국 내무부 공무원 2명, 정책 보고서 AI 환각 문제로 정직

남아프리카공화국 내무부는 시민권, 이민, 난민 보호에 관한 개정 백서의 참고문헌 목록에서 AI 환각 현상이 발견된 후 두 명의 관리를 정직했습니다. 부서는 AI 검사를 시행하고 2022년 11월 이후의 모든 정책 문서를 검토할 예정입니다.

OpenClawRadar