Mistral Medium 3.5 128B veröffentlicht: Dichtes Modell mit konfigurierbarem Reasoning und Vision

Mistral AI hat Mistral Medium 3.5 (128B) veröffentlicht, ein dichtes Transformer-Modell, das Mistral Medium 3.1 und Magistral in Le Chat sowie Devstral 2 in ihrem Coding-Agenten Vibe ersetzt. Es handelt sich um einen einzigen Satz von Gewichten, der Anweisungsbefolgung, Reasoning und Programmierung abdeckt.
Wichtige Funktionen
- Dichte 128B Parameter — kein Mixture of Experts.
- 256k Kontextfenster für lange Eingaben.
- Multimodale Eingabe: akzeptiert Text und Bilder; Ausgabe nur Text. Der Vision-Encoder wurde von Grund auf neu trainiert, um variable Größen und Seitenverhältnisse zu verarbeiten.
- Konfigurierbarer Reasoning-Aufwand: pro Anfrage umschaltbar zwischen sofortiger Antwort (
none) und tiefem Reasoning (high). - Native Funktionsaufrufe und JSON-Ausgabe für agentische Arbeitsabläufe.
- Mehrsprachig: unterstützt Englisch, Französisch, Spanisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Chinesisch, Japanisch, Koreanisch, Arabisch und andere.
- Starke System-Prompt-Befolgung.
Empfohlene Einstellungen
- Reasoning-Aufwand:
nonefür schnelle Antworten;highfür komplexe Prompts und agentische Nutzung (z.B.reasoning_effort="high"). - Temperatur: 0,7 bei
highReasoning; 0,0–0,7 beinoneje nach gewünschter Kreativität.
Lizenz
Veröffentlicht unter einer modifizierten MIT-Lizenz — Open Source für kommerzielle und nicht-kommerzielle Nutzung, mit Ausnahmen für Unternehmen mit hohem Umsatz.
GGUF-Quantisierungen verfügbar
Unsloth hat eine GGUF-Version auf Hugging Face veröffentlicht: unsloth/Mistral-Medium-3.5-128B-GGUF
Dieses Modell ist relevant für Entwickler, die lokale KI-Coding-Agenten betreiben, insbesondere solche, die hochwertige Anweisungsbefolgung, Reasoning und Vision in einem einzigen dichten Modell mit großem Kontextfenster benötigen.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

Slack-Ratenbegrenzungsänderungen unterbrechen die OpenClaw-Kontextabrufe
Slack änderte am 3. März die Ratenbegrenzungen und beschränkte conversations.history und conversations.replies auf 1 Anfrage pro Minute mit maximal 15 Nachrichten für Nicht-Marketplace-Apps. Dadurch verlieren OpenClaw-Agenten 85% ihres Kontextfensters.

Claude 4.6 Adaptive Thinking: Reddit-Benutzer meldet Token-Verschwendung und stellt Deaktivierungsbefehle bereit
Ein Reddit-Nutzer berichtet, dass die neue adaptive Denkfunktion von Claude 4.6 in Claude Code Tokens verschwenden und Latenz hinzufügen kann, und stellt Shell-Befehle bereit, um sie zu deaktivieren oder Denk-Tokens zu begrenzen.

OpenClaw 5.4 fügt /steer- und /side-Befehle hinzu: Agent während der Aufgabe umleiten, ohne Kontext zu verlieren
OpenClaw 5.4 führt die Befehle /steer und /side ein, mit denen Sie die aktuelle Aufgabenrichtung eines Agenten umleiten oder eine Nebensächlichkeit beginnen können, ohne den Sitzungskontext zu verlieren.

Gentoo Bugzilla wegen Überlastung durch KI-Bot-Scraper vom Netz genommen
Gentoo-Maintainer Michał Górny hat Bugzilla offline genommen, weil KI-Bot-Scraper den Server überlasteten. Lesen Sie das vollständige Update.