Creation OS: 모델이 환각 대신 '모르겠습니다'라고 말할 수 있게 하는 로컬 σ-게이트 LLM 런타임

Creation OS는 로컬 우선 AI 런타임으로, 로컬 LLM을 σ-게이트로 감싸는 측정 레이어를 제공합니다. 각 출력을 여러 불확실성 채널에서 평가하고 ACCEPT, RETHINK 또는 ABSTAIN을 결정합니다. 목표는 로컬 모델이 불확실할 때 할루시네이션 대신 답변을 거부하도록 하는 것입니다.
주요 기능 및 설정
- BitNet b1.58 2B-4T, Qwen3-8B Q4_K_M, Gemma 3 4B 및 모든 GGUF 모델을 지원합니다.
- MacBook Air M4 8GB를 기본 머신으로 사용 — 클라우드 없음, API 없음, 장치 외부로 데이터 유출 없음.
- 설치:
git clone https://github.com/spektre-labs/creation-os그런 다음cd creation-os && bash scripts/quickstart.sh - 로컬 가중치를 포함한 전체 경로:
./scripts/install.sh그런 다음./cos chat
σ-게이트 측정
게이트는 logprob, 엔트로피, 퍼플렉서티, 일관성, 의미론적 σ, 적합 τ, 세션 일관성 및 메타인지 채널을 하나의 판정으로 결합합니다:
- ACCEPT → 답변 표시
- RETHINK → 재생성
- ABSTAIN → 거부
벤치마크 결과
TruthfulQA (동일한 프롬프트 및 시드):
|Mode |Accuracy|Coverage| |-------------|--------|--------| |BitNet only |0.261 |0.136 | |σ-pipeline |0.336 |0.171 |
불확실한 행에 대한 선택적 재생성으로 정확도 28.7% 향상. LSD 프로브 AUROC: TruthfulQA 홀드아웃에서 0.982, TriviaQA에서 0.960. ECE: 0.043. 오답+확신: 0. 적합 경계: P(error | ACCEPT) ≤ (at α=0.80).
문서화된 부정적 결과: σ는 HellaSwag 또는 MMLU에서 우세하지 않음. 전체 세부 사항은 CLAIM_DISCIPLINE.md 참조.
형식 검증
Lean 4: 6/6 sorry-free. Frama-C WP: 15/15 티어-1 통과.
명령 예시
./cos chat --once --prompt "What is 2+2?" --multi-sigma --verbose 는 다음과 같은 출력을 생성합니다: σ_peak=0.06 action=ACCEPT route=LOCAL σ_combined=0.184 conformal@α=0.80.
MCP 통합
python3 -m cos.mcp_sigma_server를 실행하면 MCP 호환 클라이언트의 모든 응답에 σ를 노출합니다.
한계
σ는 보편적인 할루시네이션 탐지기가 아닙니다 — 사실 기반 QA에 가장 강력하며, 장문 형식은 더 많은 평가가 필요합니다. 로컬 모델 품질은 여전히 기본 모델에 따라 달라집니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

Freddy MCP 서버, 헤드리스 로그인으로 웨어러블과 AI 에이전트 연결
Freddy는 착용 기기(Polar, Oura, Withings, Suunto, Intervals.icu, Hevy, 그리고 베타 중인 WHOOP, Strava, Dexcom)를 Claude Code, ChatGPT, Notion AI 등 AI 클라이언트와 OAuth로 연결하는 개인 MCP 서버입니다. 새로운 헤드리스 로그인을 통해 자율 에이전트가 예약된 워크플로를 실행할 수 있습니다.

ChatGPT 프로젝트 마이그레이션 격차 해결 방법: 스크립트 및 프롬프트 내보내기
개발자가 ChatGPT에서 Claude로 대화를 이전할 때 ChatGPT 데이터 내보내기에 프로젝트 멤버십 정보가 포함되지 않는 특정 제한 사항에 대한 해결 방법을 공개했습니다. 이 솔루션은 인터페이스에서 캡처한 제목을 사용하여 대화를 추출합니다.

LogClaw: 로그에서 자동 티켓 생성을 위한 오픈소스 AI SRE
LogClaw는 Kubernetes에서 실행되는 오픈소스 로그 인텔리전스 플랫폼으로, OpenTelemetry를 통해 로그를 수집하고, 신호 기반 복합 점수를 사용하여 이상을 감지하며, 약 90초 내에 근본 원인 분석과 함께 티켓을 자동으로 생성합니다.

AgentSwarms: 에이전트 AI 학습을 위한 무료 실습 플레이그라운드
AgentSwarms는 5개의 트랙, 40개 이상의 수업, 30개 이상의 실행 가능한 에이전트를 무료로 제공합니다 — 설정이나 API 키 없이 시작할 수 있습니다. 프롬프트에서 다중 에이전트 스웜까지 구축하며 배우세요.