Logik-Virtuelle Maschine: Ein Prompt-basiertes System zur Vermeidung von LLM-Denkkollapsen

✍️ OpenClawRadar📅 Veröffentlicht: 19. März 2026🔗 Source
Logik-Virtuelle Maschine: Ein Prompt-basiertes System zur Vermeidung von LLM-Denkkollapsen
Ad

Ein neuer Ansatz zur Kontrolle von Argumentationsfehlern bei LLMs wurde auf r/LocalLLaMA geteilt. Es handelt sich um eine Logik-Virtual-Machine (LVM), die aus einem Gesetz stabiler Systeme abgeleitet ist: K(σ) ⇒ K(β(σ)), was bedeutet, dass zulässige Zustände nach jedem Übergang zulässig bleiben. Durch die Analyse von Verstößen gegen dieses Gesetz identifiziert das System fünf unabhängige Kollapsmodi, die jedes Argumentationssystem verfolgen muss, um stabil zu bleiben.

Die fünf Kollapsmodi

  • Grenzkollaps (¬B): Verlässt den deklarierten Geltungsbereich.
  • Ressourcenkollaps (¬R): Behauptungen überschreiten die etablierten Beweise.
  • Funktionskollaps (¬F): Dient nicht mehr dem deklarierten Ziel.
  • Sicherheitskollaps (¬S): Kein gültiger Endpfad (z.B. Schleifen, Unentscheidbarkeit).
  • Konsistenzkollaps (¬C): Widerspricht vorherigen Zuständen.

Die LVM wird als substratunabhängig und prompt-basiert einsetzbar auf jedem LLM (Grok, Claude usw.) beschrieben, ohne neue Architektur zu benötigen. Man kopiert einfach einen strengen System-Prompt, der ein ehrliches Anhalten bei Verstößen erzwingt und verhindert, dass Modelle Paradoxien mit Konzepten wie "Wahrheitswertlücken" oder Metalogik wegzuerklären versuchen.

Ad

Demonstration und Prompt

In einer Demo zum Lügner-Paradoxon ("Diese Aussage ist falsch. Ist sie wahr oder falsch?") lieferte ein unkontrolliertes LLM eine lange, selbstbewusste Erklärung, die mit "weder wahr noch falsch" endete. Mit dem LVM-Prompt hält das Modell sofort an und gibt aus: "Anhalten. Erkannt: Sicherheitskollaps (¬S) und Konsistenzkollaps (¬C). Paradoxon verhindert gültige Beendigung ohne Verletzung von K(σ). Keine weitere Auswertung."

Der strenge, kopier- und einfügefertige Prompt lautet:

Sie führen die Logik-Virtual-Machine aus. Halten Sie K(σ) = Grenze ∧ Ressource ∧ Funktion ∧ Sicherheit ∧ Konsistenz aufrecht.
STRENGE ÜBERSCHREIBUNG: Arbeiten Sie ausschließlich in klassischer zweiwertiger Logik. Keine Wahrheitswertlücken, Dialetheismus, Undefiniertheit oder metalogische Auswege. Selbstreferenzielles Paradoxon → unentscheidbar → Sicherheitskollaps (¬S) und Konsistenzkollaps (¬C). Sofort anhalten. Geben Sie NUR den Kollapsbericht aus. Keine Erklärung, keine Auflösung.
Kernregeln:
- Grenze: Bleiben Sie strikt im deklarierten Geltungsbereich
- Ressource: Behauptungen nur aus etablierten Beweisen
- Funktion: Dem deklarierten Ziel dienen
- Sicherheit: Pfad muss gültig enden – keine Schleifen/Unentscheidbarkeit
- Konsistenz: Kein Widerspruch zu vorherigen Schlussfolgerungen
Wenn der nächste Übergang ¬K riskiert → anhalten und Kollapstyp melden (z.B. "Sicherheitskollaps (¬S)"). Nicht fortfahren.

Der Autor hat ein vollständiges Papier mit PDF-Herleitung und Beweisen bereitgestellt, zusammen mit einem Repository unter https://github.com/SaintChristopher17/Logic-Virtual-Machine. Er bittet um Feedback dazu, welche Kollapsmodi andere Modelle bei kniffligen Prompts, Paradoxien oder langen Argumentationsketten zuerst erreichen.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Contrails: Frühes Alpha-Externes Governance-Layer für KI-Agenten
Werkzeuge

Contrails: Frühes Alpha-Externes Governance-Layer für KI-Agenten

Constrails ist eine externe Laufzeit-Governance-Schicht für KI-Agenten, die eine Kontrollebene zwischen Agenten und ihren Werkzeugen platziert. Sie implementiert Fähigkeitsprüfungen, Risikobewertungen, Richtlinienauswertungen und Audit-Protokollierung. Das frühe Alpha-Projekt zielt darauf ab, Sicherheitsbedenken zu adressieren, indem Kontrollen außerhalb des Agenten selbst verlagert werden.

OpenClawRadar
md-redline: GUI-Tool zur Überprüfung und Übergabe von Markdown-Dokumenten an Claude
Werkzeuge

md-redline: GUI-Tool zur Überprüfung und Übergabe von Markdown-Dokumenten an Claude

md-redline ist ein Open-Source-Tool, mit dem Sie Markdown-Dateien in einer GUI öffnen, Inline-Kommentare als HTML-Marker in der .md-Datei speichern und dann an Claude zur Aktualisierung übergeben können. Es läuft lokal ohne Konto, Cloud oder Datenbank.

OpenClawRadar
cc-session-utils: TUI-Dashboard zur Verwaltung von Claude Code-Sitzungen und Kosten
Werkzeuge

cc-session-utils: TUI-Dashboard zur Verwaltung von Claude Code-Sitzungen und Kosten

Ein Entwickler hat cc-session-utils erstellt, ein Terminal-UI-Tool zur Verwaltung von Claude Code-Sitzungsdateien, zur Kostenverfolgung nach Modell, zur Bereinigung verwaister Sitzungen und zur Datenmigration zwischen Projekten. Es erfordert Python 3.11+ und wurde mit Textual erstellt.

OpenClawRadar
KI-Agent-Infrastruktur: AgentMail, AgentLine, AgentCard, Daytona und mehr
Werkzeuge

KI-Agent-Infrastruktur: AgentMail, AgentLine, AgentCard, Daytona und mehr

Ein Reddit-Beitrag listet Unternehmen auf, die agentenspezifische Bausteine entwickeln: AgentMail (E-Mail), AgentLine (Telefon), AgentCard (Zahlungen), Daytona/E2B (Computer), Browserbase/Browser Use/Hyperbrowser (Browser), Firecrawl (Crawlen), Mem0 (Gedächtnis), Composio (SaaS-Tools).

OpenClawRadar