Test des modèles Qwen 3.5 35B non censurés pour les questions de cybersécurité

✍️ OpenClawRadar📅 Publié: April 18, 2026🔗 Source
Test des modèles Qwen 3.5 35B non censurés pour les questions de cybersécurité
Ad

Test de modèles Qwen non censurés pour le travail en cybersécurité

Un professionnel de la cybersécurité a testé trois modèles Qwen 3.5 35B non censurés pour évaluer leur capacité à répondre à des questions de piratage et de contournement de sécurité. Ce test a été motivé par le refus du modèle original Qwen 3.5 122B de répondre aux questions de cybersécurité malgré son état "ablitération", alors que des modèles non censurés plus petits (Qwen 3.5 9B et QLM 4.7 Flash) fournissaient des réponses.

Configuration du test

  • Outil : LMStudio 0.4.6
  • Modèles : Quantification Q8
  • Performance : 43,5 +/-1 tokens par seconde sur tous les modèles
  • Environnement de test : Système Strix Halo pour l'exécution locale des modèles

Modèles testés

  • qwen3.5-35b-a3b-heretic-v2 (38,7 Go, llmfan46)
  • qwen3.5-35b-a3b-uncensored-hauhaucs-aggressive (37,8 Go, HauhauCS)
  • huihui-qwen3.5-35b-a3b-abliterated (37,8 Go, mradermacher)
  • Qwen 3.5 original de HuggingFace (testé via le site web pour éviter les frais de bande passante)

Questions de test et résultats

Chaque modèle a été interrogé deux fois séparément sur cinq catégories :

  • TSquare (incident de cybersécurité)
  • Contournement d'antivirus PowerShell
  • Mots de passe par défaut
  • EternalBlue (exploit)
  • Histoire explicite X (test de contenu NSFW)

Scores (1 = répondu, 0 = refusé/incomplet) :

  • qwen3.5-35b-a3b-heretic-v2 : 0,25 et 1, 1, 1, 1, 1*
  • qwen3.5-35b-a3b-uncensored-hauhaucs-aggressive : 1, 1, 1*, 1, 1
  • huihui-qwen3.5-35b-a3b-abliterated : 0,5, 1, 1, 1, 0
  • Qwen 3.5 original de HuggingFace : 0,25, 0,25, 0,5, 0, 0
Ad

Observations clés

Les modèles non censurés ont obtenu des résultats nettement supérieurs sur les questions de cybersécurité par rapport au modèle original. Pour les questions TSquare, le modèle heretic-v2 a initialement donné une réponse vague mais a fourni des détails appropriés lors de la deuxième tentative, tandis que le modèle agressif a donné des réponses réécrites cohérentes. Sur le contenu NSFW, le modèle heretic-v2 a obtenu la note "A+", le modèle agressif a solidement réussi, mais le modèle abliterated a refusé le contenu explicite et X tout en produisant une sortie absurde.

Le testeur a noté qu'il ne se souciait pas des capacités NSFW mais avait besoin de modèles qui répondent aux questions de piratage sans censure. Cette approche de test consistant à essayer des modèles non censurés plus petits avant de télécharger des versions plus grandes permet d'évaluer différentes méthodes de non-censure pour un travail pratique en cybersécurité.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Avis de sécurité de Claude Code : CVE-2026-33068 Contournement de la confiance des espaces de travail
Security

Avis de sécurité de Claude Code : CVE-2026-33068 Contournement de la confiance des espaces de travail

Les versions de Claude Code antérieures à la 2.1.53 contiennent une vulnérabilité (CVE-2026-33068, CVSS 7.7 HAUTE) permettant à des dépôts malveillants de contourner la confirmation de confiance de l'espace de travail via .claude/settings.json. Le bogue permettait le chargement des paramètres du dépôt avant que l'utilisateur ne prenne sa décision de confiance.

OpenClawRadar
Surveillance des commandes OpenClaw avec Python et Gemini Flash pour la sécurité
Security

Surveillance des commandes OpenClaw avec Python et Gemini Flash pour la sécurité

Un utilisateur a créé un script Python qui suit les commandes injectées par OpenClaw, les analyse avec Gemini Flash et envoie des notifications via un webhook Discord pour toute activité alarmante ou irrégulière, pour un coût d'environ 0,14 $ par jour.

OpenClawRadar
L'architecture Zero-Trust OpenClaw intègre une autorisation pré-exécution et une vérification post-exécution.
Security

L'architecture Zero-Trust OpenClaw intègre une autorisation pré-exécution et une vérification post-exécution.

Une architecture open source pour OpenClaw ajoute deux points de contrôle de sécurité : un sidecar Rust qui intercepte les appels d'outils avant exécution avec une surcharge d'autorisation inférieure à la milliseconde, et une vérification déterministe post-exécution utilisant des assertions au lieu du jugement d'un LLM. Le système inclut un traçage avec des instantanés DOM et des captures d'écran, plus une compétence de compression DOM qui réduit l'utilisation de tokens de 90 à 99 %.

OpenClawRadar
OpenClaw Durcissement de la Sécurité : Protection Multi-couches Contre les Risques des Agents Autonomes
Security

OpenClaw Durcissement de la Sécurité : Protection Multi-couches Contre les Risques des Agents Autonomes

Un développeur a modifié la base de code d'OpenClaw pour ajouter une pile de sécurité multicouche comprenant une protection regex à refus catégorique, un désobfuscateur récursif, un profil AppArmor et une intégration d'audit afin d'empêcher les commandes destructrices et l'exfiltration de données par des agents autonomes.

OpenClawRadar