Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Modell mit LM Studio-Konfiguration veröffentlicht

Modell-Details und Verfügbarkeit
Das Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Q4_K_M-GGUF-Modell ist jetzt auf HuggingFace verfügbar. Dieses Modell wurde durch die Zusammenführung zweier bestehender Modelle erstellt: Jackrongs Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-v2-GGUF und HauhauCS' Qwen3.5-9B-Uncensored-HauhauCS-Aggressive.
Die Zusammenführung bewahrt alle Trainingsdaten und erhält die Genauigkeit der Qwen-3.5-9B-Architektur unter Verwendung von Float32-Präzision während des Zusammenführungsprozesses. Das Modell wurde mit dem Claude-Opus-4.6-Datensatz trainiert, verfügbar unter https://huggingface.co/datasets/Roman1111111/claude-opus-4.6-10000x.
Empfohlene Konfiguration
Für beste Leistung in LM Studio 0.4.7 (Build 4) verwenden Sie diese Einstellungen:
- System-Prompt: https://pastebin.com/pU25DVnB
- Temperatur: 0.7
- Top-K-Sampling: 20
- Wiederholungsstrafe: (deaktiviert) oder 1.0
- Präsenzstrafe: 1.5
- Top-P-Sampling: 0.8
- Min-P-Sampling: 0.0
- Seed: 3407
Leistung und Hardware
Auf einer RTX 3060 erreicht das Modell 42 Tokens pro Sekunde in LM Studio. Der Ersteller merkt an, dass es auf llama-server sogar noch schneller laufen kann. Das Modell wurde als Reaktion auf Anfragen von Nutzern auf Reddit und HuggingFace erstellt, die ein großes Kontextfenster in unzensierter, intelligenter lokaler KI ohne leistungsstarke GPUs wünschten.
Das Modell ist verfügbar unter: https://huggingface.co/LuffyTheFox/Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude Code Fähigkeit refaktorisiert React-Komponenten nach dem "Don't Make Me Think"-Prinzip
Eine neue Claude Code Fähigkeit refraktiert automatisch React-Komponenten für Benutzerfreundlichkeit basierend auf Steve Krugs Prinzipien – entfernt Fülltexte, hebt primäre Handlungsaufforderungen hervor, korrigiert leere/Fehlerzustände und strafft Bezeichnungen.

Token Reducer: Ein Claude-Code-Plugin für intelligente Kontextkomprimierung
Token Reducer ist ein Claude Code-Plugin, das Repository-Kontexte lokal verarbeitet, um die Token-Nutzung durch AST-basiertes Chunking, hybride Abrufmethoden und TextRank-Kompression um 90-98 % zu reduzieren. Es ist unter der MIT-Lizenz verfügbar und über den Plugin-Marktplatz erhältlich.

Datenanalyst baut Prompt-Kalibrierungstool mit Claude, ohne Vorerfahrung im Frontend
Ein Datenanalyst ohne HTML-, CSS- oder JavaScript-Erfahrung entwickelte Prompt Calibrator, ein clientseitiges Webtool, das KI-Prompts über ein Formular mit vier Feldern und vier Modi strukturiert. Das Tool wurde mit Claude als Code-Review-Partner entwickelt und wird auf GitHub Pages gehostet.

StartClaw: Ein kopfoser Browser-Automatisierungstool, das auf ZeroClaw basiert und Claude-Integration bietet
StartClaw ist ein Browser-Automatisierungstool, das auf ZeroClaws Rust-Basis mit Composio v3 für Integrationen aufbaut und darauf ausgelegt ist, ohne lokale Hardware headless in der Cloud zu laufen. Es nutzt ausschließlich Claude für Zuverlässigkeit und verfügt über eine integrierte Kontextkomprimierung, die den Tokenverbrauch um etwa das 5-fache reduziert.