Creation OS: 모델이 환각 대신 '모르겠습니다'라고 말할 수 있게 하는 로컬 σ-게이트 LLM 런타임

✍️ OpenClawRadar📅 게시일: April 30, 2026🔗 Source
Creation OS: 모델이 환각 대신 '모르겠습니다'라고 말할 수 있게 하는 로컬 σ-게이트 LLM 런타임
Ad

Creation OS는 로컬 우선 AI 런타임으로, 로컬 LLM을 σ-게이트로 감싸는 측정 레이어를 제공합니다. 각 출력을 여러 불확실성 채널에서 평가하고 ACCEPT, RETHINK 또는 ABSTAIN을 결정합니다. 목표는 로컬 모델이 불확실할 때 할루시네이션 대신 답변을 거부하도록 하는 것입니다.

주요 기능 및 설정

  • BitNet b1.58 2B-4T, Qwen3-8B Q4_K_M, Gemma 3 4B 및 모든 GGUF 모델을 지원합니다.
  • MacBook Air M4 8GB를 기본 머신으로 사용 — 클라우드 없음, API 없음, 장치 외부로 데이터 유출 없음.
  • 설치: git clone https://github.com/spektre-labs/creation-os 그런 다음 cd creation-os && bash scripts/quickstart.sh
  • 로컬 가중치를 포함한 전체 경로: ./scripts/install.sh 그런 다음 ./cos chat

σ-게이트 측정

게이트는 logprob, 엔트로피, 퍼플렉서티, 일관성, 의미론적 σ, 적합 τ, 세션 일관성 및 메타인지 채널을 하나의 판정으로 결합합니다:

  • ACCEPT → 답변 표시
  • RETHINK → 재생성
  • ABSTAIN → 거부
Ad

벤치마크 결과

TruthfulQA (동일한 프롬프트 및 시드):

  |Mode         |Accuracy|Coverage|  |-------------|--------|--------|  |BitNet only  |0.261   |0.136   |  |σ-pipeline   |0.336   |0.171   |

불확실한 행에 대한 선택적 재생성으로 정확도 28.7% 향상. LSD 프로브 AUROC: TruthfulQA 홀드아웃에서 0.982, TriviaQA에서 0.960. ECE: 0.043. 오답+확신: 0. 적합 경계: P(error | ACCEPT) ≤ (at α=0.80).

문서화된 부정적 결과: σ는 HellaSwag 또는 MMLU에서 우세하지 않음. 전체 세부 사항은 CLAIM_DISCIPLINE.md 참조.

형식 검증

Lean 4: 6/6 sorry-free. Frama-C WP: 15/15 티어-1 통과.

명령 예시

./cos chat --once --prompt "What is 2+2?" --multi-sigma --verbose 는 다음과 같은 출력을 생성합니다: σ_peak=0.06 action=ACCEPT route=LOCAL σ_combined=0.184 conformal@α=0.80.

MCP 통합

python3 -m cos.mcp_sigma_server를 실행하면 MCP 호환 클라이언트의 모든 응답에 σ를 노출합니다.

한계

σ는 보편적인 할루시네이션 탐지기가 아닙니다 — 사실 기반 QA에 가장 강력하며, 장문 형식은 더 많은 평가가 필요합니다. 로컬 모델 품질은 여전히 기본 모델에 따라 달라집니다.

📖 전체 출처 읽기: r/LocalLLaMA

Ad

👀 See Also

Freddy MCP 서버, 헤드리스 로그인으로 웨어러블과 AI 에이전트 연결
Tools

Freddy MCP 서버, 헤드리스 로그인으로 웨어러블과 AI 에이전트 연결

Freddy는 착용 기기(Polar, Oura, Withings, Suunto, Intervals.icu, Hevy, 그리고 베타 중인 WHOOP, Strava, Dexcom)를 Claude Code, ChatGPT, Notion AI 등 AI 클라이언트와 OAuth로 연결하는 개인 MCP 서버입니다. 새로운 헤드리스 로그인을 통해 자율 에이전트가 예약된 워크플로를 실행할 수 있습니다.

OpenClawRadar
ChatGPT 프로젝트 마이그레이션 격차 해결 방법: 스크립트 및 프롬프트 내보내기
Tools

ChatGPT 프로젝트 마이그레이션 격차 해결 방법: 스크립트 및 프롬프트 내보내기

개발자가 ChatGPT에서 Claude로 대화를 이전할 때 ChatGPT 데이터 내보내기에 프로젝트 멤버십 정보가 포함되지 않는 특정 제한 사항에 대한 해결 방법을 공개했습니다. 이 솔루션은 인터페이스에서 캡처한 제목을 사용하여 대화를 추출합니다.

OpenClawRadar
LogClaw: 로그에서 자동 티켓 생성을 위한 오픈소스 AI SRE
Tools

LogClaw: 로그에서 자동 티켓 생성을 위한 오픈소스 AI SRE

LogClaw는 Kubernetes에서 실행되는 오픈소스 로그 인텔리전스 플랫폼으로, OpenTelemetry를 통해 로그를 수집하고, 신호 기반 복합 점수를 사용하여 이상을 감지하며, 약 90초 내에 근본 원인 분석과 함께 티켓을 자동으로 생성합니다.

OpenClawRadar
AgentSwarms: 에이전트 AI 학습을 위한 무료 실습 플레이그라운드
Tools

AgentSwarms: 에이전트 AI 학습을 위한 무료 실습 플레이그라운드

AgentSwarms는 5개의 트랙, 40개 이상의 수업, 30개 이상의 실행 가능한 에이전트를 무료로 제공합니다 — 설정이나 API 키 없이 시작할 수 있습니다. 프롬프트에서 다중 에이전트 스웜까지 구축하며 배우세요.

OpenClawRadar