Anthropic의 클로드 코드 품질 향상을 위한 다중 에이전트 하네스 설계

✍️ OpenClawRadar📅 게시일: March 29, 2026🔗 Source
Anthropic의 클로드 코드 품질 향상을 위한 다중 에이전트 하네스 설계
Ad

Anthropic은 장기간 실행되는 코딩 작업에서 Claude의 성능을 향상시키기 위한 하네스 설계 접근법을 설명하는 블로그 게시물을 발표했습니다. 이 방법은 두 가지 구체적인 문제를 해결합니다: 컨텍스트 불안(장기간에 걸친 일관성 상실)과 자기 평가 편향(품질이 낮은 경우에도 Claude가 자신의 작업을 칭찬하는 경향).

다중 에이전트 솔루션

이 솔루션은 GAN(생성적 적대 신경망)에서 영감을 얻어 함께 작동하는 여러 에이전트를 구현합니다. 핵심 구조는 다음과 같습니다:

  • 생성자: 코드와 디자인을 생성
  • 평가자: 비판적 평가와 피드백 제공

프론트엔드 구현

프론트엔드 개발을 위해 하네스는 일반적인 디자인을 피하고 미학과 창의성을 강조하는 4가지 평가 기준을 사용합니다. 이 과정은 5~15회의 수정을 포함하며, 더 아름답고 독특한 결과물을 만들어냅니다.

풀스택 구현

풀스택 개발을 위해 하네스는 3가지 에이전트를 사용합니다:

  • 플래너
  • 생성자
  • 평가자

성능 비교

이 글은 동일한 게임 개발 요구사항에 대한 결과를 비교합니다:

  • 단독 실행: 빠른 실행 속도이지만 게임에 심각한 버그 존재
  • 하네스 사용: 더 많은 시간과 비용이 소요되지만, 아름다운 인터페이스, 플레이 가능한 게임, 추가된 AI 지원을 포함해 상당히 높은 품질의 결과물 생성

이 글은 모델이 더 강력해짐에 따라(특히 Opus 4.6을 언급하며) 불필요한 하네스 요소는 제거되어야 한다고 제안합니다.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

오픈소스 31-에이전트 제품 개발 시스템 for Claude, 12,000줄 이상의 콘텐츠 포함
Tools

오픈소스 31-에이전트 제품 개발 시스템 for Claude, 12,000줄 이상의 콘텐츠 포함

오픈소스 Claude Skill이 31개의 전문 AI 에이전트와 20개의 전략적 프레임워크를 제공하며, 제품부터 규정 준수까지 모든 회사 부서를 아우릅니다. MIT 라이선스 시스템은 62개 파일에 12,000줄 이상의 실행 가능한 콘텐츠, 여러 지역별 국가별 규정 준수, 요청을 효율적으로 라우팅하는 스마트 로딩 시스템을 포함합니다.

OpenClawRadar
벤치마크 결과: AI 에이전트를 위한 GitHub CLI 대 MCP 접근 방식
Tools

벤치마크 결과: AI 에이전트를 위한 GitHub CLI 대 MCP 접근 방식

독립 벤치마크에서 AI 에이전트 작업을 위해 GitHub CLI, MCP, 도구 검색 기능이 있는 MCP, 코드 모드가 있는 MCP를 비교했습니다. GitHub CLI가 가장 비용 효율적이었으며, MCP 접근 방식은 비용, 지연 시간, 실패 모드에서 트레이드오프를 보였습니다.

OpenClawRadar
Fehu: Claude AI MCP 통합을 지원하는 CLI 복식 부기 시스템
Tools

Fehu: Claude AI MCP 통합을 지원하는 CLI 복식 부기 시스템

Fehu는 MCP를 통해 Claude AI에 연결되는 경량 CLI 개인 회계 도구로, SQLite 기반의 복식 부기 시스템을 통해 자연어 거래 기록이 가능합니다. 계층적 계정 구조, 해시태그를 이용한 자동 태깅, 강력한 계산 엔진, 다중 통화 지원 등의 기능을 갖추고 있습니다.

OpenClawRadar
메타 광고 MCP OAuth 작동하지만 대부분의 광고 계정은 아직 활성화되지 않음
Tools

메타 광고 MCP OAuth 작동하지만 대부분의 광고 계정은 아직 활성화되지 않음

Meta Ads MCP OAuth 흐름이 작동하고 29개의 도구가 로드되지만, ads_get_ad_accounts는 is_ads_mcp_enabled: false를 반환하며 기능이 점진적으로 출시되고 있다는 메시지를 표시합니다.

OpenClawRadar