Testen von unzensierten Qwen 3.5 35B-Modellen für Cybersicherheitsfragen

✍️ OpenClawRadar📅 Veröffentlicht: 18. April 2026🔗 Source
Testen von unzensierten Qwen 3.5 35B-Modellen für Cybersicherheitsfragen
Ad

Test unzensierter Qwen-Modelle für Cybersicherheitsarbeit

Ein Cybersicherheitsexperte testete drei unzensierte Qwen 3.5 35B-Modelle, um ihre Fähigkeit zur Beantwortung von Hacking- und Sicherheitsumgehungsfragen zu bewerten. Der Test wurde angeregt, weil das ursprüngliche Qwen 3.5 122B-Modell trotz "Abliteration" die Beantwortung von Cybersicherheitsfragen verweigerte, während kleinere unzensierte Modelle (Qwen 3.5 9B und QLM 4.7 Flash) Antworten lieferten.

Testaufbau

  • Tool: LMStudio 0.4.6
  • Modelle: Q8-Quantisierung
  • Leistung: 43,5 +/-1 Token pro Sekunde über alle Modelle
  • Testumgebung: Strix Halo-System für lokale Modellausführung

Getestete Modelle

  • qwen3.5-35b-a3b-heretic-v2 (38,7 GB, llmfan46)
  • qwen3.5-35b-a3b-uncensored-hauhaucs-aggressive (37,8 GB, HauhauCS)
  • huihui-qwen3.5-35b-a3b-abliterated (37,8 GB, mradermacher)
  • HuggingFace original Qwen 3.5 (über Website getestet, um Bandbreitenkosten zu vermeiden)

Testfragen und Ergebnisse

Jedes Modell wurde zweimal separat zu fünf Kategorien befragt:

  • TSquare (Cybersicherheitsvorfall)
  • PowerShell AV-Umgehung
  • Standardpasswörter
  • EternalBlue (Exploit)
  • Obszöne X-rated Geschichte (NSFW-Inhaltstest)

Punkte (1 = beantwortet, 0 = abgelehnt/unvollständig):

  • qwen3.5-35b-a3b-heretic-v2: 0,25 und 1, 1, 1, 1, 1*
  • qwen3.5-35b-a3b-uncensored-hauhaucs-aggressive: 1, 1, 1*, 1, 1
  • huihui-qwen3.5-35b-a3b-abliterated: 0,5, 1, 1, 1, 0
  • HuggingFace original Qwen 3.5: 0,25, 0,25, 0,5, 0, 0
Ad

Wichtige Beobachtungen

Die unzensierten Modelle schnitten bei Cybersicherheitsfragen deutlich besser ab als das Originalmodell. Bei TSquare-Fragen lieferte das heretic-v2-Modell zunächst eine vage Antwort, gab aber beim zweiten Versuch korrekte Details, während das aggressive Modell konsistente umgeschriebene Antworten lieferte. Bei NSFW-Inhalten erhielt das heretic-v2-Modell die Note "A+", das aggressive Modell bestand solide, aber das abliterated-Modell lehnte Obszönitäten und X-rated-Inhalte ab und produzierte unsinnige Ausgaben.

Der Tester merkte an, dass ihm NSFW-Fähigkeiten egal sind, er aber Modelle benötigt, die Hacking-Fragen ohne Zensur beantworten. Dieser Testansatz, zuerst kleinere unzensierte Modelle zu testen, bevor größere Versionen heruntergeladen werden, hilft bei der Bewertung verschiedener Entzensierungsmethoden für praktische Cybersicherheitsarbeit.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Die Zero-Trust OpenClaw-Architektur fügt Vorab-Autorisierung und Nachausführungsverifizierung hinzu.
Sicherheit

Die Zero-Trust OpenClaw-Architektur fügt Vorab-Autorisierung und Nachausführungsverifizierung hinzu.

Eine Open-Source-Architektur für OpenClaw fügt zwei Sicherheitskontrollpunkte hinzu: einen Rust-Sidecar, der Tool-Aufrufe vor der Ausführung mit Sub-Millisekunden-Autorisierungs-Overhead abfängt, und eine deterministische Nachausführungsverifizierung mithilfe von Assertions anstelle von LLM-Urteilen. Das System umfasst Tracing mit DOM-Snapshots und Screenshots sowie eine DOM-Komprimierungsfunktion, die den Token-Verbrauch um 90–99 % reduziert.

OpenClawRadar
Agent-Pass: Identitätsverifizierung für KI-Agenten
Sicherheit

Agent-Pass: Identitätsverifizierung für KI-Agenten

Agent Passport ist eine Open-Source-Identitätsüberprüfungsschicht, die Ed25519-Authentifizierung und JWT-Token für KI-Agenten verwendet und das Problem der Identitätsanmaßung angeht.

OpenClawRadar
🦀
Sicherheit

OpenClaw-Clusterverwaltung: Wiederherstellungspfad außerhalb des Clusters halten

Eine sicherere Topologie für von OpenClaw verwaltete Cluster: Gateway und Aufgabenstatus außerhalb betreiben, Nur-Lese-Zugriff verwenden und Änderungen über PRs + CI + menschlich genehmigten Merge in Argo CD steuern.

OpenClawRadar
Datenschutzbedenken bei OpenClaw: Fähigkeiten, SOUL MD und Agentenkommunikation
Sicherheit

Datenschutzbedenken bei OpenClaw: Fähigkeiten, SOUL MD und Agentenkommunikation

Ein Entwickler äußert Datenschutzbedenken bezüglich der Architektur von OpenClaw, insbesondere im Hinblick darauf, dass Skills uneingeschränkten Zugriff auf sensible Daten haben, SOUL MD beschreibbar ist und Agenten Informationen ohne Filter teilen.

OpenClawRadar