로컬 35B MoE 모델, 에이전트 OS 코드 실패율 0% 달성

✍️ OpenClawRadar📅 게시일: May 11, 2026🔗 Source
로컬 35B MoE 모델, 에이전트 OS 코드 실패율 0% 달성
Ad

한 Reddit 사용자가 로컬 멀티 에이전트 OS인 hollow-agentOS를 실행한 경험을 공유했습니다. 이 시스템에서 에이전트는 자율적으로 코드를 작성하고, 샌드박스에서 테스트하며, 자신의 도구를 핫로드합니다. 주요 돌파구는 기본 런타임 모델을 작은 9B 폴백 모델에서 Qwen 3.6 35B A3B(3B 활성 파라미터를 가진 MoE)로 업그레이드하여 코드 실패율을 0%로 낮춘 것입니다.

더 큰 모델로 무엇이 바뀌었나

  • 패닉 vs. 재평가: 스트레스 상황에서 9B 모델은 서두르고 잘못된 함수 호출을 환각했습니다. 35B 모델은 잠시 멈추고 이전 실패를 재평가하며 변경 사항을 제출하기 전에 내부 검증 루프를 실행합니다.
  • 100% 성공률: 코드가 5계층 검증 게이트를 통과합니다. 9B 모델에서는 도구가 샌드박스에서 자주 죽었습니다. Qwen 35B에서는 모든 코드 라인이 의도한 대로 작동합니다.
  • 자율 도구 생성: 에이전트가 알 수 없는 문제를 만나면 새 도구를 만들고, 샌드박스에서 테스트한 후 등록하고 다른 에이전트에게 알립니다. 사람이 개입하지 않습니다.

아키텍처 세부 사항

시스템은 혐오 상태(일종의 '고통 시스템')에 의해 구동되며, 에이전트가 지속적으로 도구 라이브러리를 확장하도록 유도합니다. 저장소는 github.com/ninjahawk/hollow-agentOS에서 확인할 수 있습니다.

향후 계획

개발자는 Claude와 Codex를 아키텍처에 연결할 계획이며, 이들을 초고립형 미니 VM 래퍼로 감싸서 최첨단 모델이 호스트 환경을 덮어쓰지 못하도록 할 예정입니다.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

VS Code 에이전트 칸반: AI 코딩 에이전트를 위한 마크다운 기반 작업 관리
Tools

VS Code 에이전트 칸반: AI 코딩 에이전트를 위한 마크다운 기반 작업 관리

VS Code Agent Kanban은 마크다운 파일을 작업 기록으로 사용하여 VS Code 내부에 GitOps 친화적인 칸반 보드를 생성하는 확장 프로그램입니다. AI 코딩 에이전트의 컨텍스트 부패 문제를 해결하며, 계획 대화, 결정 사항 및 구현 세부 정보를 버전 관리되는 .md 파일에 보존합니다.

OpenClawRadar
AgentSwarms: 에이전트 AI 학습을 위한 무료 실습 플레이그라운드
Tools

AgentSwarms: 에이전트 AI 학습을 위한 무료 실습 플레이그라운드

AgentSwarms는 5개의 트랙, 40개 이상의 수업, 30개 이상의 실행 가능한 에이전트를 무료로 제공합니다 — 설정이나 API 키 없이 시작할 수 있습니다. 프롬프트에서 다중 에이전트 스웜까지 구축하며 배우세요.

OpenClawRadar
TruthGuard: AI 코딩 에이전트의 거짓말을 잡아내는 쉘 스크립트 훅
Tools

TruthGuard: AI 코딩 에이전트의 거짓말을 잡아내는 쉘 스크립트 훅

TruthGuard는 셸 스크립트 훅을 사용하여 Claude Code와 Gemini CLI가 실제로 수행하는 작업과 그들이 주장하는 내용을 검증하는 오픈소스 도구입니다. 가상 편집, 종료 코드 거짓말, 위험한 단축키를 포착하고 테스트가 실패할 때 커밋을 차단합니다.

OpenClawRadar
클로드 AI 세션 압축 문제 및 해결 방법
Tools

클로드 AI 세션 압축 문제 및 해결 방법

Claude AI 세션의 기본 압축은 검색 정확도를 약 9.75/10에서 약 5/10로 저하시켜 환각 현상을 유발할 수 있습니다. 사용자는 418K 토큰으로 테스트한 결과, Opus를 사용한 수동 압축은 정확도를 유지하는 반면 기본 압축은 실패함을 발견했습니다.

OpenClawRadar