벤치마크: 24GB Mac Mini에서 Gemma4 12B 대 Qwen3 8B 양자화 버전 비교

OpenClaw용 두 로컬 모델의 성능 비교
한 개발자가 24GB Mac Mini에서 Gemma4 12B와 Qwen3:8b-q4_K_M을 직접 비교 테스트했습니다. 테스트에는 "카뷰레이터 작동 원리 설명하기"와 "메모리 누수를 감지하는 파이썬 함수 작성하기"라는 두 가지 프롬프트가 사용되었습니다. Claude가 출력 측정을 위한 grep 명령어 작성에 도움을 주었습니다.
벤치마크 결과
카뷰레이터 설명 작업:
- Qwen3:8b-q4_K_M: 프롬프트 평가: 89.8 t/s, 생성: 19.6 t/s
- Gemma4: 프롬프트 평가: 20.8 t/s, 생성: 27.6 t/s
파이썬 코딩 작업:
- Qwen3:8b-q4_K_M: 프롬프트 평가: 133.8 t/s, 생성: 18.7 t/s
- Gemma4: 프롬프트 평가: 26.1 t/s, 생성: 26.1 t/s
주요 발견 사항
Qwen3는 Gemma4보다 프롬프트를 4-5배 더 빠르게 처리하며, 이는 OpenClaw에서 일반적으로 전송되는 대규모 컨텍스트 프롬프트 때문에 중요합니다. Gemma4는 출력 생성 속도가 약간 더 빠릅니다. 많은 OpenClaw 사용 사례에서 Qwen3가 속도 면에서 우위를 보입니다. 개발자는 Gemma4가 12B 모델이기 때문에 약간 더 나은 출력을 생성할 수 있다고 언급했지만, 이는 테스트되지 않았습니다.
해당 개발자는 cron 작업, 하트비트 모니터링, 메모리 인덱싱 등 다양한 작업을 로컬 모델에서 실행하며, 종종 OpenClaw가 로컬 모델을 실행하는 서브에이전트를 호출하도록 합니다. 이들은 이러한 모든 백그라운드 작업에 대한 로컬 모델로 Gemma4를 테스트하고 있지만, 백그라운드에서 실행되기 때문에 성능 차이를 눈치채지 못할 것으로 예상합니다.
📖 Read the full source: r/openclaw
👀 See Also

NPCterm: AI 에이전트를 위한 MCP 기반 완전 PTY 터미널 에뮬레이터
NPCterm는 MCP를 통해 노출되는 헤드리스, 인메모리 PTY 터미널 에뮬레이터를 통해 AI 에이전트에 완전한 터미널 접근을 제공합니다. 여기에는 터미널 제어, 프로세스 상태 감지 및 TUI 애플리케이션 지원을 위한 15개의 MCP 도구가 포함됩니다.

구글 PM, 벡터 DB 없이 SQLite 저장소를 사용하는 'Always On' 메모리 에이전트 오픈소스 공개
구글의 선임 AI 제품 관리자인 슈밤 사부가 벡터 데이터베이스 대신 SQLite에 구조화된 메모리를 저장하며, Gemini 3.1 Flash-Lite에서 30분마다 예약된 메모리 통합을 실행하는 'Always On Memory Agent'를 오픈소스로 공개했습니다.

OpenJet v0.4: llama.cpp 백엔드를 사용한 제로 설정 로컬 코딩 에이전트
OpenJet v0.4는 로컬 LLM을 위한 오픈소스 터미널 코딩 에이전트로, 하드웨어를 자동 감지하고 llama.cpp를 구성하며 API 키 없이 Claude Code 스타일의 워크플로를 제공합니다.

오픈소스 AI 에이전트 자가 치유 기술은 실패를 자동으로 감지하고 수정합니다.
새로운 오픈소스 스킬은 AI 에이전트가 자동으로 실패를 감지하고 근본 원인을 진단하며 수정 사항을 구현할 수 있게 합니다. 여기에는 크론 작업, 하위 에이전트, 배포 로그를 위한 실패 스캐너와 이전 수정 사항에서 학습하는 데이터베이스가 포함됩니다.