Creation OS: Ein lokaler σ-gesteuerter LLM-Laufzeit, der Modelle sagen lässt „Ich weiß es nicht“ statt zu halluzinieren

Creation OS ist eine lokale KI-Laufzeitumgebung, die lokale LLMs mit einem σ-Gate umhüllt – einer Messschicht, die jede Ausgabe über mehrere Unsicherheitskanäle bewertet und ACCEPT, RETHINK oder ABSTAIN entscheidet. Ziel ist es, lokalen Modellen zu erlauben, bei Unsicherheit Antworten zu verweigern, anstatt zu halluzinieren.
Hauptfunktionen und Einrichtung
- Unterstützt BitNet b1.58 2B-4T, Qwen3-8B Q4_K_M, Gemma 3 4B und jedes GGUF-Modell.
- Läuft auf einem MacBook Air M4 mit 8 GB als primärem Gerät – keine Cloud, keine API, nichts verlässt das Gerät.
- Installation:
git clone https://github.com/spektre-labs/creation-osdanncd creation-os && bash scripts/quickstart.sh - Vollständiger Pfad mit lokalen Gewichten:
./scripts/install.shdann./cos chat
σ-Gate-Messungen
Das Gate kombiniert Log-Wahrscheinlichkeit, Entropie, Perplexität, Konsistenz, semantisches σ, konformes τ, Sitzungskohärenz und metakognitive Kanäle zu einem einzigen Urteil:
- ACCEPT → Antwort anzeigen
- RETHINK → neu generieren
- ABSTAIN → verweigern
Benchmark-Ergebnisse
TruthfulQA (gleiche Prompts und Seeds):
|Mode |Accuracy|Coverage| |-------------|--------|--------| |BitNet only |0.261 |0.136 | |σ-pipeline |0.336 |0.171 |
+28,7 % Genauigkeit durch selektive Regeneration bei unsicheren Zeilen. LSD-Probe AUROC: 0,982 auf TruthfulQA-Holdout, 0,960 auf TriviaQA. ECE: 0,043. Falsch+sicher: 0. Konformitätsgrenze: P(Fehler | ACCEPT) ≤ α bei α=0,80.
Negative Ergebnisse dokumentiert: σ ist bei HellaSwag oder MMLU nicht dominant. Vollständige Details in CLAIM_DISCIPLINE.md.
Formale Verifikation
Lean 4: 6/6 sorry-frei. Frama-C WP: 15/15 Tier-1 abgeschlossen.
Beispielbefehl
./cos chat --once --prompt "Was ist 2+2?" --multi-sigma --verbose liefert eine Ausgabe wie σ_peak=0.06 action=ACCEPT route=LOCAL σ_combined=0.184 conformal@α=0.80.
MCP-Integration
Führen Sie python3 -m cos.mcp_sigma_server aus, um σ bei jeder Antwort für jeden MCP-kompatiblen Client verfügbar zu machen.
Einschränkungen
σ ist kein universeller Halluzinationsdetektor – am stärksten bei faktenbasierten Fragen; Langform-Antworten erfordern weitere Evaluierung. Die Qualität lokaler Modelle hängt weiterhin vom Basismodell ab.
📖 Lesen Sie die vollständige Quelle: r/LocalLLaMA
👀 Siehe auch

Die Double-Buffering-Technik für LLM-Kontextfenster eliminiert Stop-the-World-Kompaktierung
Eine Technik namens Double-Buffering kann verhindern, dass LLM-Agenten während der Kontextfensterkomprimierung einfrieren, indem sie frühzeitig zusammenfassen und zwei Puffer beibehalten, was einen nahtlosen Übergang ohne zusätzliche Inferenzkosten ermöglicht.

0Latency: Eine persistente Speicherschicht für KI-Agenten über MCP
0Latency ist ein MCP-Server, der persistente Speicher für Claude und andere KI-Agenten hinzufügt, Erinnerungen über Sitzungen hinweg speichert, um Kontextverlust zu verhindern. Es funktioniert nativ mit Claude Desktop, Claude Code, claude.ai, GPT, Gemini, Cursor und jedem MCP-kompatiblen Agenten.

TEMM1E v3.0.0 führt Schwarmintelligenz zur Koordination von KI-Agenten ein
TEMM1E v3.0.0 fügt 'Many Tems' Schwarmintelligenz hinzu, die KI-Agenten-Arbeiter durch Stigmergie-Signale statt LLM-Aufrufe koordiniert und dabei 5,86x schnellere Leistung und 3,4x niedrigere Kosten bei komplexen Aufgaben mit null Koordinationstokens erreicht.

Open-Source-KI-Jobsuchsystem, das mit Claude Code erstellt wurde, bewertet Stellenangebote und erstellt maßgeschneiderte Lebensläufe
Ein Entwickler hat ein Claude Code-Projekt open-source gestellt, das Ihren Terminal in ein Jobsuch-Kommandozentrum verwandelt. Das System bewertet Jobangebote in 10 Dimensionen, generiert ATS-optimierte PDF-Lebensläufe, scannt über 45 Unternehmenskarriereseiten und umfasst 14 Fähigkeitsmodi.