SpruceChat은 llama.cpp를 통해 Miyoo 휴대용 기기에서 0.5B LLM을 온디바이스로 실행합니다.

이것이 무엇인가요
SpruceChat는 llama.cpp를 사용하여 여러 휴대용 게임 콘솔에서 Qwen2.5-0.5B 언어 모델을 완전히 온디바이스로 실행하는 프로젝트입니다. 초기 설정 후에는 클라우드 연결이나 WiFi가 필요하지 않습니다.
주요 세부사항
모델은 첫 부팅 후 RAM에 상주하며, 생성 중에 토큰이 하나씩 스트리밍됩니다. Miyoo A30, Miyoo Flip, Trimui Brick, Trimui Smart Pro에서 실행됩니다.
Miyoo A30(Cortex-A7 쿼드코어 프로세서 탑재)의 성능:
- 모델 로드: 첫 부팅 시 약 60초
- 생성 속도: 초당 약 1-2 토큰
- 프롬프트 평가: 초당 약 3 토큰
개발자는 빠르지 않지만 스트리밍 방식으로 작동하여 생각하는 과정을 볼 수 있다고 언급했습니다. 64비트 장치가 더 빠르다고도 언급했습니다.
이 AI는 "전나무의 성격: 인내심이 강하고, 서두르지 않으며, 모든 것에 조용히 감탄한다"고 묘사됩니다.
장치가 WiFi에 연결되어 있다면, 휴대폰이나 노트북의 브라우저에서 llama-server에 접속하여 실제 키보드로 채팅할 수도 있습니다.
저장소는 https://github.com/RED-BASE/SpruceChat에 있습니다. 이 프로젝트는 Claude의 도움으로 구축되었으며, 이미 장치 지원을 확장하기 위해 협력자가 작업 중입니다. 첫 번째 릴리스는 armhf와 aarch64 바이너리 모두로 출시되었으며 모델이 포함되어 있습니다.
📖 전체 소스 읽기: r/LocalLLaMA
👀 See Also

마이크로소프트 DebugMCP VS Code 확장 프로그램, AI 에이전트에 디버깅 기능 부여
Microsoft DebugMCP는 Model Context Protocol(MCP)을 통해 AI 코딩 에이전트에게 전체 VS Code 디버거를 노출하는 VS Code 확장 프로그램으로, 중단점 설정, 코드 단계별 실행, 변수 검사, 표현식 평가를 가능하게 합니다.

오픈라우터 모델 가격 및 달러당 인텔리전스 분석
한 레딧 사용자가 16개 AI 모델의 OpenRouter API 가격을 정리하고 지능-대비-달러 가치를 계산하여, MiMo-V2-Flash를 100만 토큰당 0.09달러로 최고의 가성비 모델로, GPT-5.4를 100만 토큰당 2.50달러로 가장 지능적인 모델로 선정했습니다.

소피아 메타 에이전트 - AI 에이전트 유지보수용
SOPHIA는 생산 환경에서 AI 에이전트 성능 저하라는 실질적인 문제를 해결하기 위해 설계된 메타 에이전트입니다. 영업, 임상 문서화, 고객 서비스용 에이전트를 운영할 때 프롬프트가 진부해지고, 도구가 변질되며, 사용자 행동이 시간이 지남에 따라 변화할 수 있습니다. SOPHIA는 시스템 내 모든 다른 에이전트를 관찰, 진단, 연구 및 개선안을 제안하는 최고 학습 책임자 역할을 합니다.

클로드 코드용 두 가지 MCP 도구: 아이디어 검증 및 트레이딩 에이전트 메모리
한 개발자가 Claude Code용 두 가지 MCP 도구를 만들었습니다: idea-reality-mcp는 코딩 전에 GitHub과 Hacker News를 확인해 중복을 피하고, tradememory-protocol은 AI 트레이딩 에이전트가 컨텍스트와 함께 거래를 저장하고 전략 성과를 추적할 수 있는 메모리를 제공합니다. 둘 다 오픈 소스이며 PyPI에서 이용 가능합니다.