스케일스: 올라마 지원 데스크톱 AI 에이전트, 300MB 유휴 RAM

Skales는 Windows용 .exe 설치 프로그램과 macOS용 .dmg를 갖춘 네이티브 Electron 앱으로 구축된 데스크톱 AI 에이전트입니다. 창립자는 2년간의 LLM 경험을 가진 디자이너로, 로컬 AI 설정을 위한 Docker와 터미널 명령어로 어려움을 겪은 후 가족과 같은 비기술 사용자도 접근할 수 있는 것을 만들기 위해 개발했습니다.
주요 기능
- 완전한 로컬 추론을 위한 Ollama 또는 OpenRouter, OpenAI, Claude, Gemini, Grok, Mistral, DeepSeek를 포함한 모든 클라우드 제공업체와 함께 작동 (BYOK)
- 이중 시간적 메모리를 갖춘 ReAct 자동 조종
- Playwright를 통한 브라우저 자동화
- 네이티브 통합: Gmail, Telegram, WhatsApp, Discord, Google Calendar
- 다른 모델들이 주제를 토론하는 다중 에이전트 그룹 채팅
- 최소화 시 화면에 상주하며 창 전환 없이 작업을 할당할 수 있는 데스크톱 버디 (Clippy와 유사)
- 보안을 위한 내장 킬스위치 및 웹사이트/검색 블랙리스트
- 약 300MB 유휴 RAM 사용량
- 모든 데이터는 로컬에 ~/.skales-data에 저장
기술적 세부사항
이 앱은 Electron + Next.js + Node.js로 구축되었습니다. BSL-1.1 라이선스 하에 소스 이용 가능하며, 개인 사용은 무료입니다. 창립자는 "대기업이 포크하여 상업적으로 재판매하는 것을 원하지 않았다"고 언급했습니다. GitHub 저장소는 github.com/skalesapp/skales에 있습니다.
창립자는 60세 이상의 어머니가 즉시 실행할 수 있었고, 6살 아이가 내장 코딩 기능을 사용하여 레트로 게임(슈퍼 마리오 한 레벨)을 만들었다고 보고했습니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

GGUF 모델 병합 스크립트 및 Qwen3.5-35B 변형을 위한 워크플로우
레딧 사용자가 최소 손실로 GGUF 모델 파일을 병합하는 파이썬 스크립트를 공유했습니다. 특히 HauhauCS의 Qwen3.5-35B-A3B-Uncensored 모델과 samuelcardillo의 Claude-4.6-Opus-Reasoning-Distilled 버전을 결합합니다. 이 스크립트는 Google Colab Free Tier에서 실행되며 llama-quantize를 통한 양자화 지원을 포함합니다.

Claude Code 에이전트로 GitHub PR 리뷰 자동화하기
한 개발자가 GitHub 멘션을 처리하고, Claude Code 워커를 생성하여 PR을 리뷰하거나 수정하며, 모호한 경우에만 사람에게 에스컬레이션하는 에이전트를 구축했습니다.

에이전트작업메모리: AI 코딩 에이전트를 위한 로컬 메모리 시스템
AgentWorkingMemory(AWM)는 AI 코딩 에이전트의 세션 간 기억 상실 문제를 해결하는 로컬 메모리 시스템입니다. SQLite 데이터베이스, 세 개의 로컬 ML 모델(총 약 124MB)을 사용하며 MCP를 통해 자동으로 통합되어 Claude Code 세션 전반에 걸쳐 지속적이고 상황 인식 메모리를 제공합니다.

클로드 VS 코드 확장 프로그램 추론 노력 슬라이더가 일관되지 않은 값을 전송합니다
Claude VS Code 확장 프로그램의 추론 노력 슬라이더가 모델에 일관되지 않은 숫자 값을 전송하는 버그가 있습니다. 슬라이더 레이블이 안정적인 숫자 값에 대응되지 않으며, 매핑이 비단조적이어서 슬라이더를 '올리는' 것이 실제로는 더 낮은 숫자를 모델에 전송할 수 있습니다.