Show HN: WUPHF — 진실의 원천으로 마크다운 + 깃을 사용하는 카파시 스타일 LLM 위키

WUPHF는 AI 에이전트(Claude Code, Codex, OpenClaw, OpenCode를 통한 로컬 LLM)를 위한 오픈소스 협업 오피스로, Karpathy 스타일의 위키 레이어를 포함합니다. 위키는 Markdown과 Git을 진실 공급원으로 사용하며 ~/.wuphf/wiki/에 저장되고, 상위에 bleve (BM25) + SQLite 인덱스를 두었습니다. 아직 벡터나 그래프 DB는 사용하지 않으며, 목표는 더 무거운 인프라를 추가하기 전에 Markdown + Git이 얼마나 갈 수 있는지 확인하는 것입니다.
주요 기능
- 각 에이전트는
agents/{slug}/notebook/에 개인 노트북을, 공유 팀 위키는team/에 둡니다. - 초안-위키 승격 흐름: 노트북 항목을 (에이전트 또는 사람이) 검토하고 백링크와 함께 정식 위키로 승격합니다. 상태 머신이 만료와 자동 보관을 처리합니다.
- 엔터티별 사실 로그:
team/entities/{kind}-{slug}.facts.jsonl에 추가 전용 JSONL. 합성 작업자가 N개의 사실마다 엔터티 요약을 재구축합니다. - 커밋은 고유한 Git 아이덴티티("Pam the Archivist")에 귀속되어
git log를 통한 출처 추적이 가능합니다. - [[위키링크]]: 끊어진 링크 감지(빨간색으로 표시).
- 모순, 오래된 항목, 끊어진 위키링크를 위한 일일 린트 크론 작업.
/lookup슬래시 명령어 + MCP 도구로 인용 검색. 휴리스틱 분류기가 짧은 쿼리는 BM25로, 서술형 쿼리는 인용-답변 루프로 라우팅합니다.
검색 튜닝
500개의 아티팩트와 50개의 쿼리를 사용한 현재 벤치마크에서 BM25 단독으로 85% recall@20을 달성했으며, 이는 내부 출시 기준입니다. 쿼리 클래스가 이 아래로 떨어지면 sqlite-vec이 사전 약속된 대체재입니다.
기반 선택
- Markdown: 내구성 — 위키는 런타임보다 오래 지속되며, 사용자는
git clone하여 모든 바이트를 가져갈 수 있습니다. - Bleve: BM25용.
- SQLite: 구조화된 메타데이터(사실, 엔터티, 엣지, 리디렉션, 대체)용.
- 정식 ID는 일급 시민: 사실 ID는 결정적(문장 오프셋 포함), 슬러그는 한 번 할당되면 절대 이름이 변경되지 않음(리디렉션 스텁 사용). 재구축은 논리적으로 동일하지만 바이트 단위로 동일하지는 않습니다.
알려진 한계
- 85% recall은 보편적 보장이 아닙니다 — 튜닝 진행 중.
- 합성 품질은 에이전트 관찰 품질에 따라 달라집니다. 린트 패스가 도움이 되지만 판단 엔진은 아닙니다.
- 단일 오피스 범위; 아직 교차 오피스 연합은 없습니다.
데모 및 설치
5분 터미널 워크스루는 asciinema에서 볼 수 있습니다(스크립트: ./scripts/demo-entity-synthesis.sh).
설치: npx wuphf@latest
소스에서 빌드: git clone https://github.com/nex-crm/wuphf.git; go build -o wuphf ./cmd/wuphf
위키는 WUPHF의 일부로 제공되지만 독립적으로 사용할 수 있습니다. MIT 라이선스, 자체 호스팅, 자신의 키를 가져와 사용하세요.
📖 전체 소스 읽기: HN LLM Tools
👀 See Also

Kios: 셀프 호스팅 Kobo/Calibre 라이브러리를 위한 iOS 리더, 진행 상황 동기화 지원
Kios는 셀프 호스팅 Kobo/Calibre 서버에서 책을 읽고 Kobo 프로토콜, OPDS 1.2/2.0, kosync를 통해 읽기 진행 상황을 동기화하는 iOS 앱입니다. Claude Code로 제작되었습니다.

altRAG: AI 코딩 에이전트를 위한 벡터 DB RAG를 2KB 포인터 파일로 대체하기
altRAG은 벡터 데이터베이스 RAG를 가벼운 포인터 파일로 대체하는 Python 도구입니다. Markdown/YAML 스킬 파일을 스캔하여 섹션을 정확한 줄 번호와 바이트 오프셋에 매핑하는 2KB 스켈레톤 파일을 생성하며, AI 에이전트가 전체 파일 대신 필요한 섹션만 읽을 수 있도록 합니다.

AMD의 레모네이드: GPU와 NPU용 오픈 소스 로컬 LLM 서버
Lemonade는 GPU와 NPU에서 텍스트, 이미지, 음성 모델을 실행하는 오픈 소스 로컬 AI 서버입니다. OpenAI API와 호환되며, 여러 모델을 동시에 지원하고, 2MB의 네이티브 C++ 백엔드를 갖추고 있습니다.

인간 창의성 벤치마크: AI 창의성 평가에서 수렴과 발산의 분리
Contra Labs는 생성형 AI의 창의적 작업 평가에서 객관적으로 검증 가능한 기준(예: 프롬프트 준수)과 주관적 취향(예: 시각적 매력)을 분리하는 프레임워크인 인간 창의성 벤치마크(HCB)를 소개합니다. 이 벤치마크는 현재 어떤 모델도 신뢰할 수 있을 정도로 정확하면서도 조종 가능하지 않다는 것을 밝히며, 모드 붕괴와 차별화된 출력의 필요성을 다룹니다.