Prime Agent: 지속적 REPL과 에이전트 CRUD를 갖춘 자기 개선 RLM 코딩 하네스

✍️ OpenClawRadar📅 게시일: August 6, 2026🔗 Source
Prime Agent: 지속적 REPL과 에이전트 CRUD를 갖춘 자기 개선 RLM 코딩 하네스
Ad

Prime Intellect가 Prime Agent를 출시했습니다. 이는 재귀 언어 모델(RLM)지속적 하네스(Continual Harness)라는 두 가지 추상화를 중심으로 설계된 오픈소스 코딩 하네스입니다. 목표는 고정된 도구 호출 스키마와 정적 하위 에이전트를 넘어, 에이전트가 세션 중에 자신의 컨텍스트를 관리하고 스캐폴딩을 진화시킬 수 있게 하는 것입니다.

재귀 언어 모델: 컨텍스트를 REPL로

RLM은 컨텍스트를 변수로 취급하고 하위 에이전트 위임을 지속적인 IPython REPL 내의 함수 호출로 취급합니다. 이는 모델에게 자신의 히스토리, 하위 에이전트 및 도구에 대한 프로그래밍 방식의 접근을 제공하여, 컨텍스트에 작용하는 언어 모델 프로그램을 작성할 수 있게 합니다. REPL은 데이터를 변수에 저장하므로 에이전트는 과거 정보에 대한 접근을 잃지 않고 임의로 긴 세션을 작업할 수 있습니다.

지속적 하네스: 에이전트의 자기 관리

지속적 하네스는 하네스 자체의 상태(프롬프트, 스킬, 메모리, 하위 에이전트)를 CRUD 가능한 객체로 추상화합니다. 에이전트는 궤적 동안 이를 생성, 읽기, 업데이트, 삭제할 수 있습니다. 에이전트 간 메시징과 결합하여 하위 에이전트 간 및 별도의 Prime Agent 세션 간 오케스트레이션을 가능하게 합니다. 예를 들어, 에이전트는 지속적인 하위 에이전트를 생성하고 나중에 메시지를 보내거나 다른 Prime Agent 인스턴스와 직접 통신할 수 있습니다.

Ad

주요 아키텍처: 유일한 도구로서의 지속적 커널

Prime Agent는 유일한 도구로 지속적인 IPython 커널을 사용합니다. 하위 에이전트를 포함한 모든 표준 하네스 기능은 해당 커널 내에서 함수로 호출됩니다. 각 하위 에이전트는 또 다른 Prime Agent 인스턴스입니다.

  • 백그라운드 데몬: 로컬 소켓을 통해 모든 라이브 세션을 소유합니다. 에이전트를 중지하지 않고 연결/분리할 수 있습니다.
  • 에이전트 뷰: 모든 루트 세션과 하위 에이전트를 재귀적으로 나열하는 TUI입니다. 빈 프롬프트에서 를 누르면 열립니다.
  • 세션 복구: 각 작업자 프로세스는 복구 가능합니다. 충돌 시 데몬이 JSONL 및 커널 상태 스냅샷에서 복원합니다.
  • 메모리 관리: 유휴 하위 에이전트는 30분 후 언로드되고 디스크에서 필요 시 다시 로드됩니다.
  • 영구 저장: 세션 기록은 추가 전용 JSONL로 저장됩니다.

설치

curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh

대상 사용자

장기 자율 코딩 평가를 실행하는 팀, 자동 연구를 수행하는 연구자, 또는 자신의 하네스를 적응시킬 수 있는 코딩 어시스턴트를 원하는 개발자.

📖 전체 소스 읽기: HN AI Agents

Ad

👀 See Also

LLM 숨겨진 에이전시 신호(Â)를 활용한 향상된 도구 호출
Tools

LLM 숨겨진 에이전시 신호(Â)를 활용한 향상된 도구 호출

개발자가 LLM이 AUC > 0.94로 도구 호출을 예측하는 선형 분리 가능한 숨겨진 상태 방향인 Â를 가지고 있음을 발견했습니다. 이 신호를 사용하여 도구 호출을 강제하면 Qwen3-1.7B 성능이 26.7%에서 85%로 향상되었으며(+58% 이득), 도구 미사용 실패가 43%에서 2.6%로 감소했습니다.

OpenClawRadar
RAG 학습 아카데미, Claude Code 내에 구축된 20명의 전문 에이전트
Tools

RAG 학습 아카데미, Claude Code 내에 구축된 20명의 전문 에이전트

한 개발자가 Claude Code 내에 20명의 전문 에이전트, 17개의 슬래시 명령어, 9개 모듈 커리큘럼으로 구성된 대화형 RAG 학습 아카데미를 만들었습니다. 이 아카데미는 지식 수준을 평가하고 기본적으로 오픈소스 도구를 사용합니다.

OpenClawRadar
클로드 코드의 읽기 도구가 이미지 해상도를 묵시적으로 낮추어 환각을 유발함
Tools

클로드 코드의 읽기 도구가 이미지 해상도를 묵시적으로 낮추어 환각을 유발함

Claude Code의 `read` 도구는 모델이 이미지를 보기 전에 조용히 해상도를 낮추어, 스크린샷에서 텍스트를 추출할 때 출력 품질이 저하되고 인식하지 못한 환각 현상이 발생하게 됩니다.

OpenClawRadar
RAG-Engram 아키텍처로 미세 조정된 Qwen3.5-2B 모델은 8K 컨텍스트에서 근거 기반 답변 정확도를 50%에서 93%로 향상시킵니다.
Tools

RAG-Engram 아키텍처로 미세 조정된 Qwen3.5-2B 모델은 8K 컨텍스트에서 근거 기반 답변 정확도를 50%에서 93%로 향상시킵니다.

한 개발자가 '중간에서 길을 잃는' 현상을 해결하기 위해 맞춤형 RAG-Engram 아키텍처로 Qwen3.5-2B를 미세 조정하여, 실제 질의에서 8K 토큰 기준 정답률을 50%에서 93%로 향상시켰습니다. 이 시스템은 정적 개체 임베딩과 동적 청크 탐색이라는 두 단계 접근법을 사용합니다.

OpenClawRadar