Gemma-4 26B-A4B avec Opencode fonctionne efficacement sur MacBook Air M5

✍️ OpenClawRadar📅 Publié: April 14, 2026🔗 Source
Gemma-4 26B-A4B avec Opencode fonctionne efficacement sur MacBook Air M5
Ad

Un développeur a testé Gemma-4-26B-A4B avec Opencode sur un MacBook Air M5 32 Go et a constaté qu'il offre des performances pratiques pour les tâches locales de codage IA.

Benchmarks de performance

La configuration spécifique testée était gemma-4-26B-A4B-it-UD-IQ4_XS fonctionnant sur un MacBook Air M5 32 Go. En mode basse consommation, il a atteint :

  • 300 tokens/seconde pour le traitement des invites
  • 12 tokens/seconde en génération
  • 8 W de consommation d'énergie
  • Aucune chaleur ni bruit de ventilateur pendant le fonctionnement

Le MacBook Air M5 a montré des améliorations significatives par rapport au matériel précédent :

  • ~25 % plus rapide pour le traitement des invites qu'un M1 Max 64 Go (même lorsque le Max n'était pas en mode économie d'énergie)
  • ~6 heures d'autonomie contre ~2 heures sur le M1 Max lors de l'exécution d'Opencode
  • Ceci malgré une batterie plus petite (53,8 Wh contre 70 Wh sur le M1 Max)
Ad

Cas d'utilisation pratiques

Le développeur a trouvé cette configuration "réellement utilisable" pour un comportement de codage agentique depuis un ordinateur portable. Auparavant, l'exécution de LLM sur un M1 Max 64 Go était limitée à des "bidouillages et cas d'utilisation ludiques" et ne pouvait pas gérer efficacement les tâches à contexte long. Bien qu'il puisse créer un simple jeu Snake en Python, le codage agentique ou la contribution à des bases de code plus importantes était "un peu bancal".

Les performances du M5 le rendent pratique pour les cas d'utilisation mobiles où la connectivité Internet pourrait être peu fiable, comme dans les cafés ou lors des trajets en train.

Comparaison avec d'autres modèles

Le développeur a comparé Gemma-4-26B avec Opencode aux alternatives propriétaires :

  • Il ne remplace pas Claude Code ou Antigravity selon leurs tests
  • Gemma-4 nécessite "beaucoup plus d'accompagnement que les modèles propriétaires de pointe actuels"
  • Les réponses sont décrites comme "un peu sèches" par rapport à Claude Code ou Gemini-3.1-Pro avec Antigravity
  • Cependant, ils préféreraient Gemma-4-26B plutôt que de manquer de quota Gemini-2.5-Pro et être obligés d'utiliser Gemini-2.5-Flash

Le développeur note que cela représente des progrès significatifs, car "ce type de codage agentique était à la pointe / pas vraiment possible avec les modèles de pointe fin 2024".

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Layerkit : Éditeur d'Images IA avec Calques Modifiables Développé avec Claude Code
Tools

Layerkit : Éditeur d'Images IA avec Calques Modifiables Développé avec Claude Code

Un développeur a créé Layerkit, un éditeur d'images basé sur le navigateur qui génère des scènes avec des calques modifiables pour éviter de constamment reformuler les prompts. L'outil utilise un pipeline d'IA multi-étapes où un LLM planifie la composition, un modèle d'image génère la scène, et un autre LLM analyse l'image réelle pour placer un texte lisible.

OpenClawRadar
Nelson : Un Plugin Claude Code pour Coordonner les Agents IA Comme une Flotte Navale
Tools

Nelson : Un Plugin Claude Code pour Coordonner les Agents IA Comme une Flotte Navale

Nelson est un plugin Claude Code qui structure la coordination des agents IA en utilisant des principes de flotte navale, avec trois modes d'exécution, un système de classification des risques, une surveillance de l'intégrité de la coque et des portes d'ordres permanents pour prévenir les anti-modèles courants.

OpenClawRadar
Centre de commande : Environnement de codage IA pour ceux qui se soucient de la qualité
Tools

Centre de commande : Environnement de codage IA pour ceux qui se soucient de la qualité

Command Center est un environnement de codage agentique qui se concentre sur les parties difficiles du code généré par l'IA : la révision, le refactoring et le déploiement avec une discipline d'ingénierie traditionnelle. Il comprend des walkthroughs, des agents de refactoring et une récupération par snapshots.

OpenClawRadar
OpenEvol : Pipeline d'auto-amélioration hors ligne pour LLMs utilisant l'historique des conversations
Tools

OpenEvol : Pipeline d'auto-amélioration hors ligne pour LLMs utilisant l'historique des conversations

OpenEvol v0.1.1 est un pipeline hors ligne qui extrait automatiquement l'historique des conversations d'IA pour créer des ensembles de données de fine-tuning sans étiquetage manuel. Il fonctionne initialement sur CPU et prend en charge cinq backends d'enseignants, y compris les API compatibles OpenAI et HuggingFace Transformers.

OpenClawRadar