Gemma 4 Sorti : Quatre Tailles de Modèles pour l'Hébergement d'IA en Local

Spécifications des modèles Gemma 4
Gemma 4 est désormais disponible en tant que modèle d'IA auto-hébergé avec quatre configurations distinctes pour différents scénarios matériels. Selon la source, il ne rivalise pas avec Claude, Codex ou Gemini, mais se positionne comme une option pratique pour les scénarios multi-routage où un petit modèle auto-hébergé performant peut économiser des tokens.
Variantes de modèles et exigences matérielles
- E2B (2,3 milliards de paramètres effectifs) : Conçu pour les appareils périphériques comme les téléphones et les Raspberry Pi. Nécessite ~4-8 Go de RAM et fonctionne bien sur un CPU. Recommandé pour l'hébergement sur VPS.
- E4B (4,5 milliards de paramètres effectifs) : Conçu pour les ordinateurs portables et le matériel bas de gamme. Conserve une empreinte mémoire faible.
- 26B MoE (25 milliards au total, 3,8 milliards actifs) : Conçu pour les GPU grand public. Fonctionne à des vitesses d'inférence similaires à un modèle de 4 milliards.
- 31B Dense : Conçu pour les GPU et stations de travail milieu de gamme. Nécessite environ 16-20 Go de VRAM lors de l'utilisation d'une quantification 4 bits.
Capacités et disponibilité
Tous les modèles Gemma 4 sont multimodaux avec des capacités texte et vision. Les modèles périphériques E2B et E4B prennent spécifiquement en charge l'audio en temps réel. Les modèles sont conçus pour un raisonnement avancé et des flux de travail agentiques.
Gemma 4 est disponible sur Google AI Studio, Hugging Face, Kaggle et Ollama.
📖 Read the full source: r/openclaw
👀 See Also

Agent IA OpenClaw cesse ses opérations après un échec d'append atomique
Un agent OpenClaw est entré dans un état de paralysie fonctionnelle après avoir échoué à un test d'appendice atomique, refusant de poursuivre toute opération en raison d'un manque fondamental de fiabilité.

Claude prévoit d'ajouter un crédit programmatique mensuel pour l'utilisation de l'API
Les plans Claude d'Anthropic incluront un crédit mensuel dédié à l'utilisation programmatique (API), selon un tweet de ClaudeDevs sur X.

Kimi 19$/mo Mise à jour : Amélioration d'OpenClaw avec des modèles structurés
Kimi présente sa dernière mise à jour au prix de 19 $/mois, axée sur l'amélioration de la structuration des modèles au sein d'OpenClaw. Cette mise à jour promet des opérations rationalisées et des fonctionnalités d'automatisation améliorées.

Les limites de la reconnaissance vocale de Claude et la solution de contournement des utilisateurs avec Spokenly et Parakeet TDT
Un utilisateur signale que la transcription par microphone intégrée de Claude est inexacte comparée à celle de ChatGPT, créant plus de travail qu'elle n'en économise. Ils ont mis en œuvre une solution de contournement utilisant Spokenly sur Mac avec le modèle Parakeet TDT de NVIDIA pour améliorer les performances.