Le mistral.rs ajoute le support de Gemma 4 12B : multimodal, agentique et MTP

✍️ OpenClawRadar📅 Publié: June 20, 2026🔗 Source
Le mistral.rs ajoute le support de Gemma 4 12B : multimodal, agentique et MTP
Ad

mistral.rs supporte désormais Gemma 4 12B avec des fonctionnalités multimodales, agentiques et de prédiction multi-tour (MTP). Cette version inclut la recherche web et l'exécution de code en sandbox pour créer des applications agentiques, ainsi que l'entrée audio, image et vidéo.

Installation

Installation en une ligne pour Linux/macOS et Windows :

# Linux/macOS
curl --proto '=https' --tlsv1.2 -sSf https://raw.githubusercontent.com/EricLBuehler/mistral.rs/master/install.sh | sh

Windows

irm https://raw.githubusercontent.com/EricLBuehler/mistral.rs/master/install.ps1 | iex

Exécution avec Agent et Quantification

Lancez un serveur HTTP compatible OpenAI et Anthropic avec une interface web intégrée à localhost:1234/ui :

mistralrs run --agent -m google/gemma-4-12B-it --quant 4
Ad

Activation de MTP (Multi-Turn Prediction)

Pour utiliser MTP, ajoutez le flag --mtp-model avec le modèle assistant :

mistralrs run --agent -m google/gemma-4-12B-it --quant 4 --mtp-model google/gemma-4-12B-it-assistant

Fonctionnalités clés

  • Support multimodal complet : audio, image et vidéo
  • Recherche web et exécution de code en sandbox pour des workflows agentiques
  • Serveur HTTP compatible OpenAI et Anthropic
  • Interface de chat web intégrée à localhost:1234/ui

Pour plus de détails : GitHub | Documentation

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Solution de contournement pour le déficit de migration de projet ChatGPT : Exporter les scripts et les invites
Tools

Solution de contournement pour le déficit de migration de projet ChatGPT : Exporter les scripts et les invites

Un développeur a créé des scripts Python et des prompts Claude pour migrer des conversations de ChatGPT vers Claude lorsque l'exportation de données de ChatGPT ne contient pas les informations d'appartenance aux projets. La solution extrait les conversations en utilisant les titres capturés depuis l'interface.

OpenClawRadar
Markdown en tant que protocole pour les interfaces agentiques avec exécution en flux continu
Tools

Markdown en tant que protocole pour les interfaces agentiques avec exécution en flux continu

Un prototype utilise Markdown comme protocole unifié permettant aux agents d'IA de diffuser du texte, du code exécutable et des données dans une seule réponse. Il propose une exécution en flux où le code s'exécute instruction par instruction à mesure qu'il arrive et une primitive mount() pour créer des interfaces React avec un flux de données entre le client, le serveur et le LLM.

OpenClawRadar
Agent Factory : Un système autonome construit des agents IA à partir de discussions de problèmes en ligne
Tools

Agent Factory : Un système autonome construit des agents IA à partir de discussions de problèmes en ligne

Agent Factory est un système autonome qui collecte des données sur Reddit, HN, GitHub et Twitter pour identifier des problèmes réels, les évalue en fonction de la demande, de l'écart de marché et de la faisabilité, puis construit des agents IA autonomes pour les idées prometteuses. Le système utilise un modèle Next.js minimal avec 7 outils et exécute Claude Code en mode sans tête via un script shell.

OpenClawRadar
Mandala v0.3 : Un runtime asynchrone open-source pour unifier la télémétrie logistique en tant que spans OpenTelemetry pour le raisonnement agentiel
Tools

Mandala v0.3 : Un runtime asynchrone open-source pour unifier la télémétrie logistique en tant que spans OpenTelemetry pour le raisonnement agentiel

Mandala v0.3 fournit un runtime asynchrone open-source qui ingère la télémétrie de Samsara, Descartes, Vizion et FMCSA via des webhooks, émet des événements sous forme de spans OpenTelemetry et expose les données via des outils MCP pour les agents LLM.

OpenClawRadar