Test pratique du modèle de Tencent : performant pour les workflows agents, faible pour le codage complexe

Un développeur sur r/openclaw a partagé son expérience de test du modèle de Tencent pour des tâches agentiques et de codage réelles. Le modèle fonctionne bien pour les workflows autonomes d'entrée à intermédiaire, mais atteint un plafond sur la complexité du code.
Usage agentique : 8/10
Le modèle est rapide, fiable et hallucine moins que les anciennes versions de GPT (par exemple, GPT-4.1). Il gère les tâches d'entrée à intermédiaire dans des frameworks agentiques comme OpenClaw avec un minimum de mensonges ou de sorties fabriquées.
Codage : 6/10
Adapté aux tâches isolées et minimales. Cependant, il échoue sur le travail structurel et le débogage approfondi. Le testeur rapporte un échec complet à générer une simple logique de connexion Python, et pire, il a perdu du temps à essayer de corriger un appel API Notion de base et un problème de schéma. Évitez-le pour tout ce qui est structurellement complexe, surtout la logique backend.
Recherche : 7/10
Correct pour les détails d'entreprise et la recherche de prospects commerciaux. Renvoie des données pertinentes avec un minimum de suppositions.
Particularités
Le modèle répond parfois en chinois. Interrogé sur la raison, il a répondu : « J'ai l'habitude de lire des documents chinois. »
Conclusion
Considérez le modèle de Tencent pour les workflows agentiques, mais éloignez-le de vos schémas d'API Notion et de votre code backend.
📖 Read the full source: r/openclaw
👀 See Also

Genèse du Livre Open Source : 20 Compétences de Code Claude pour l'Écriture Autonome de Livres
Book Genesis est un système open-source composé de 20 compétences Claude Code spécialisées qui, à partir d'une idée de livre, produit un manuscrit complet et prêt à publier via un pipeline autonome en 14 phases. Il inclut un 'Moteur du Chaos' pour briser les schémas de prédictibilité de l'IA et a généré un mémoire de 68 000 mots obtenant un score de 9,0/10 sur l'Échelle Genesis.

Microsoft VibeVoice : modèles ASR de 60 min et TTS de 90 min open-sourcés
VibeVoice est une famille de modèles de voix IA open-source de Microsoft incluant ASR (60 minutes en un seul passage, diarisation des locuteurs, plus de 50 langues) et TTS (90 minutes multi-locuteur, streaming en temps réel). Utilise des tokenizers de parole continus à 7,5 Hz et une diffusion de prochain token.

Compétence Moteur de Jeu d'Aventure Textuelle pour Claude Desktop
Un moteur de jeu d'aventure textuelle fonctionne entièrement dans Claude Desktop en tant que compétence, sans serveurs, applications ou code à exécuter. Il inclut des mécaniques de jeu de rôle complètes, un rendu de dés 3D, 19 modules d'extension et des fichiers de sauvegarde portables.

Inférence LLM souveraine au Royaume-Uni : Relax.ai publie des documents publics
Relax.ai a publié la documentation pour l'inférence de LLM souverain britannique, redirigeant vers /docs/getting-started/introduction. Le service a été partagé sur HN avec 104 points.