빈 에이전트OS: Qwen 3.5 9B를 사용해 RTX 5070에서 로컬로 클로드 유사 에이전트 실행하기

개발자 /u/TheOnlyVibemaster가 Hollow AgentOS를 공개했습니다. 이 시스템은 RTX 5070(또는 CPU 노트북, 다소 느리지만)에서 로컬로 실행되는 자기 수정 에이전트 시스템으로, Claude API 사용량을 절반으로 줄인다고 주장합니다. 시스템은 24시간 가동되며, 유휴 상태일 때 자신의 소스 파일을 검토하고 개선 사항을 제안한 후 모든 에이전트의 2/3 이상 찬성 투표로 구현합니다.
작동 방식
핵심 통찰: 반복 테스트와 자기 개선 루프를 사용함으로써, 저자는 충분한 시간 동안 실행된 Qwen 3.5 9B가 많은 작업에서 Claude Code만큼 유용하다는 것을 발견했습니다. 에이전트가 코드를 제안하고, 작성하고, 테스트하고, 결과를 확인하고, 수정하고, 무한히 반복합니다. 저자는 "이는 모델 문제가 아니라 시간 문제가 됩니다."라고 말합니다.
주요 기능
- 인간 입력 없는 자기 수정: 유휴 상태일 때 에이전트가 시스템의 자체 파일을 검토하고, 개선 사항을 제안하며, 2/3 이상 찬성 투표 후 샌드박스 환경에서 자율적으로 변경 사항을 구현합니다.
- 진정한 오프라인 개발: 저자는 "Claude가 생각하고, 저는 기본적으로 에이전트가 작업할 수 있도록 Claude의 지시를 복사/붙여넣기만 하면 됩니다. 6시간 후에 돌아오면 로컬 하드웨어에서 무료로 완료됩니다."라고 말합니다.
- 하드웨어 독립적: RTX 5070 게이밍 PC에서 시연되었지만, 모든 노트북의 CPU에서 실행 가능합니다(느리지만).
해결된 두 가지 핵심 문제
저자는 Hollow AgentOS가 해결하는 두 가지 특정 문제를 나열합니다: A) "개발하지 않고도 진정으로 개발"이 가능하게 함 — 시간이 지남에 따라 해결될 수 있는 작업을 오프로딩; B) 사용자가 개입하기로 선택하지 않는 한 시스템이 "시간이 지남에 따라 인간 상호작용 없이 학습하고 적응하며 진정으로 스스로 개발"할 수 있게 함.
저장소 및 커뮤니티
프로젝트는 GitHub github.com/ninjahawk/hollow-agentOS에서 이용 가능하며, 게시일 기준 66개의 별을 받았습니다. 저자는 수백 명의 테스터에게 감사를 표하고 피드백, 비판 또는 성공 사례를 환영합니다.
대상: 더 긴 벽시계 시간을 허용하면서 무료 컴퓨팅을 얻기 위해 로컬에서 Qwen 3.5 9B 에이전트를 실행하여 Claude API 비용을 줄이려는 개발자.
📖 Read the full source: r/ClaudeAI
👀 See Also

memora: AI 에이전트를 위한 버전 관리된 타입화된 메모리 – AI 신념을 위한 Git
memora는 AI 에이전트 메모리를 버전 관리하는 CLI 도구로, 타입화된 데이터, 출처 추적, 브랜치 및 병합 기능을 제공합니다.

소크라테스식 프롬프트 생성기, Claude 내부에 React 아티팩트로 구축됨
한 개발자가 클로드 내에서 직접 작동하는 리액트 아티팩트로 소크라테스식 프롬프트 생성기를 구축했습니다. 이 도구는 입력의 복잡성을 자동 감지하고 세 단계의 프롬프트 생성과 실패 모드 분석을 특징으로 합니다.

개발자가 클로드 왓츠앱 연동 MCP 서버 구축, 어려움 공유
한 개발자가 Claude가 실제 WhatsApp 대화에 접근할 수 있도록 MCP 서버를 구축했는데, 대화 컨텍스트 관리가 예상보다 까다로워 대화를 추적하기 위한 데이터베이스가 필요하다는 사실을 발견했습니다.

플렝: AI 기반 인프라 관리 기능을 갖춘 셀프 호스팅 클라우드 플랫폼
Pleng은 AGPL-3.0 라이선스로 제공되는 셀프 호스팅 클라우드 플랫폼으로, AI 에이전트(현재 Claude)를 사용하여 텔레그램 봇 명령어를 통해 인프라를 관리합니다. GitHub 저장소나 로컬 디렉토리에서 자동화된 Traefik 라우팅, Let's Encrypt SSL, 기본 분석 기능을 갖춘 상태로 배포합니다.