SCM: macOS에서 사진, 비디오 장면, OCR 및 대화를 아우르는 로컬 AI 검색
SCM(Screen Memories)은 감시 폴더의 사진과 비디오 프레임을 인덱싱하고 로컬 비전, OCR, 음성 모델로 검색할 수 있게 해주는 macOS 앱입니다. 계정도, 클라우드도, 업로드도 없습니다 — 추론은 Mac에서 실행됩니다.
다섯 가지 검색 모드
- Files — 의미 기반으로 전체 사진/비디오를 검색합니다. 첫 키 입력 시 파일명 키워드 사전 검색을 수행한 후 이미지 임베딩에 대한 코사인 유사도를 사용하며, 게이트된 구문 및 파일명 부스트, 모델별로 보정된 정직성 하한, 근접 중복 다양성 필터를 적용합니다. 각 타일에는 “왜 일치했는지” 배지(Visual match / Filename match)가 표시되며, 호버 툴팁에 구성 요소별 점수가 포함됩니다. CJK 쿼리는 겹치는 바이그램으로 검색됩니다 — “台北車站”은 台北과 車站도 일치합니다.
- Scenes — 모든 비디오의 각 장면 세그먼트가 점수화되어 정확한 장면에 적중합니다. 타일에는 타임코드 배지가 있는 장면 포스터가 표시되며, 비디오를 열면 해당 순간으로 점프합니다. 노이즈 게이트는 의미 없는 결과 대신 “장면 일치 없음”을 반환하며, 각 비디오는 최대 3개의 장면만 기여합니다.
- OCR — 이미지와 프레임에 보이는 텍스트를 Tesseract(eng 및 35개 언어 토글)를 사용해 문자 그대로 일치시킵니다. 각 이미지의 OCR 텍스트에 쿼리 토큰이 문자 그대로 보이는 비율을 일치시킵니다.
- Dialogue — Whisper를 통한 정확한 대사 검색으로, 단계별 정확도를 제공합니다.
- LLMs (선택 사항) — Mac이 이미 추출한 대사, OCR, 파일명에 대한 로컬 채팅으로, 출처가 인용된 답변을 제공합니다.
자가 유지 관리 라이브러리
감시 폴더는 자동으로 가져옵니다. 콘텐츠 해시로 이름 변경을 중복 제거합니다. 모델 전환 시 검색을 차단하지 않고 백그라운드에서 다시 임베딩합니다.
설치
Apple Silicon에서 macOS 12+가 필요합니다. Homebrew cask는 설치 및 업그레이드 시 macOS 격리 플래그를 해제하므로 수동 Gatekeeper 단계가 필요 없습니다:
brew tap allenv0/scm
brew trust allenv0/scm
brew install --cask allenv0/scm/scm업그레이드:
brew upgrade --cask allenv0/scm/scm개발 및 빌드
Bun이 패키지 관리자이자 러너입니다. 모델을 처음 사용할 때 가중치(기본 CLIP의 경우 약 435MB)를 다운로드하며, 그 이후에는 완전히 오프라인으로 작동합니다.
bun install
bun run dev # 렌더러 번들 빌드 후 Electron 실행
bun start # 재빌드 없이 Electron 실행
bun run build # 렌더러 번들을 dist/로 재빌드패키징은 dist-app/에 DMG와 ZIP을 생성합니다:
bun run dist # 키체인에 ID가 있으면 서명됨
bun run dist:unsigned # 코드 서명 검색 건너뛰기내부적으로 electron-builder --mac은 새 dist/ 렌더러를 main.js, preload.js, main-lib/, indexer/와 함께 번들링합니다. 이 저장소는 329개의 스타와 16개의 포크를 보유하고 있습니다.
이 도구는 자신의 미디어 라이브러리를 클라우드 서비스에 전송하지 않고 시맨틱 검색을 원하는 macOS 개발자와 파워 유저를 위한 것입니다.
📖 전체 출처 읽기: HN LLM Tools
👀 See Also

PageAgent: Ollama 지원으로 웹 페이지 내에서 실행되는 브라우저 AI 에이전트
PageAgent는 웹 페이지 내부에서 직접 AI 에이전트를 실행하는 JavaScript 라이브러리로, 스크린샷 대신 라이브 DOM을 텍스트로 읽어들입니다. Ollama를 포함한 모든 OpenAI 호환 엔드포인트와 작동하여 브라우저에서 직접 로컬 LLM 호출을 가능하게 합니다.

GPT-5.5 Codex 대 클로드 오퍼스 4.7: 실제 코딩 에이전트 벤치마크
한 개발자가 GPT-5.5 Codex와 Claude Opus 4.7을 두 가지 실제 작업(PR 분류 봇과 실시간 코드 리뷰 UI)으로 비교 테스트했습니다. Claude는 깔끔하게 배포되어 오류가 0건이었고, Codex는 18% 저렴했지만 패치 작업이 한 번 필요했습니다.

Spectr: 픽셀 완벽한 클로드 클론을 위해 화면 녹화에서 앱 스펙을 작성하는 MCP
Spectr은 MCP 서버, CLI, Claude Code 스킬로, iOS 앱의 .mp4/.mov 화면 녹화를 받아 7개 섹션의 spec.md(16진수 색상 코드, 글꼴 두께, 간격, 전환, 탐색 그래프 포함)를 생성하여, 화면당 30분 걸리던 수동 스펙 작성을 없애줍니다.

M1 Ultra에서 1M 토큰 컨텍스트로 Nemotron 3 Super 120B 벤치마킹하기
한 사용자가 M1 Ultra에서 llama.cpp를 사용하여 Q4_K_M 양자화 모델로 Nemotron 3 Super 120B를 테스트했으며, 약 90GB의 VRAM을 소비하는 100만 토큰 컨텍스트 창을 달성했습니다. 성능 벤치마크는 512 프롬프트 처리 시 255 t/s에서 10만 토큰 컨텍스트 시 22.37 t/s까지의 토큰 생성 속도를 보여줍니다.