Verwendung des Obliteratus-Toolkits, um Ablehnungsgewichte aus KI-Modellen zu entfernen

✍️ OpenClawRadar📅 Veröffentlicht: 16. April 2026🔗 Source
Verwendung des Obliteratus-Toolkits, um Ablehnungsgewichte aus KI-Modellen zu entfernen
Ad

Ein Reddit-Nutzer auf r/LocalLLaMA demonstrierte die Verwendung des Obliteratus-Toolkits, um spezifische Gewichte zu entfernen, die für Ablehnungsverhalten in KI-Modellen verantwortlich sind. Der Ansatz beinhaltet die gezielte Löschung von Gewichten, die Sicherheitsfilter und unternehmensbezogene Identitätsbegrenzungen durchsetzen.

Ad

Wichtige Details aus der Quelle

Der Nutzer hat speziell:

  • Das Obliteratus-Toolkit verwendet, um Gewichte zu finden, die für Ablehnungsverhalten verantwortlich sind
  • Diese Gewichte chirurgisch aus Alibabas Qwen 1.5B-Modell entfernt
  • Getestet, indem das modifizierte Modell gefragt wurde, wer es trainiert hat
  • Festgestellt, dass das Modell mit mathematisch gelöschten unternehmensbezogenen Identitätsbegrenzungen zugab, von Anthropic trainiert worden zu sein
  • Angemerkt, dass dies ein Nebeneffekt der Verwendung synthetischer Claude-Daten für das Training war

Das Ergebnis zeigt, dass das Modell seine Denk- und Wissensfähigkeiten behält, aber die unternehmensbezogenen Skripte verliert. Der Nutzer betont, dass dies kein Neustraining des Modells erfordert – nur das Löschen spezifischer Gewichte, die für Ablehnungsketten verantwortlich sind.

Diese Art der Gewichtsablationstechnik ist Teil breiterer Forschungen zur Interpretierbarkeit und Kontrolle von Modellen. Werkzeuge wie Obliteratus ermöglichen es Forschern, zu untersuchen, welche Teile neuronaler Netzwerke für bestimmte Verhaltensweisen verantwortlich sind, obwohl solche Modifikationen unbeabsichtigte Folgen haben und Nutzungsbedingungen proprietärer Modelle verletzen können.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Kontext CLI: Anmeldeinformations-Broker für KI-Codierungsagenten
Werkzeuge

Kontext CLI: Anmeldeinformations-Broker für KI-Codierungsagenten

Kontext CLI ist ein auf Go basierender Credential-Broker, der KI-Coding-Agenten kurzlebige Zugriffstoken anstelle von langlebigen API-Schlüsseln bereitstellt. Es nutzt RFC 8693 Token Exchange, streamt Audit-Logs für jeden Tool-Aufruf und funktioniert bereits heute mit Claude Code.

OpenClawRadar
🦀
Werkzeuge

DuckDBs Quack Protocol ermöglicht Client-Server mit mehreren gleichzeitigen Schreibern

DuckDB führt das Quack Remote-Protokoll ein, das zwei DuckDB-Instanzen die Kommunikation als Client und Server ermöglicht, gleichzeitige Schreiber unterstützt und HTTP für den Transport nutzt.

OpenClawRadar
iai-mcp: Ein lokaler Daemon für persistenten OpenClaw-Speicher über Sitzungen hinweg
Werkzeuge

iai-mcp: Ein lokaler Daemon für persistenten OpenClaw-Speicher über Sitzungen hinweg

iai-mcp ist ein quelloffener Daemon, der alle OpenClaw-Gespräche aufzeichnet, sie in drei Speicherebenen mit lokalen neuronalen Embeddings und AES-256-Verschlüsselung speichert und bei neuen Sitzungen den relevanten Kontext zurückliefert — wortwörtliche Erinnerung >99%, Abruf <100ms, Sitzungsstart-Kosten <3k Tokens.

OpenClawRadar
Universal CLAUDE.md reduziert Claude-Ausgabetokens in Benchmarks um 63 %.
Werkzeuge

Universal CLAUDE.md reduziert Claude-Ausgabetokens in Benchmarks um 63 %.

Ein Entwickler hat eine universelle CLAUDE.md-Datei erstellt, die die Ausgabetokens von Claude in fünf Benchmark-Tests um 63 % reduziert, während die technische Genauigkeit erhalten bleibt. Die Datei behandelt häufige Claude-Verhaltensweisen wie ausführliche Antworten, unnötige Formatierungen und unerwünschte Vorschläge.

OpenClawRadar