Schema structuré : Qwen Meetup Draft - Le harnais d'appel de fonction améliore la conformité CoT de 9,91 % à 100 %

✍️ OpenClawRadar📅 Publié: May 2, 2026🔗 Source
Schema structuré : Qwen Meetup Draft - Le harnais d'appel de fonction améliore la conformité CoT de 9,91 % à 100 %
Ad

Un exposé au Qwen Meetup Korea (fin mai) présente une deuxième itération du modèle de harnais d'appel de fonctions. Le harnais original a fait passer qwen3-coder-next de 6,75% à 100% sur la génération de code backend en utilisant la validation de type et les retours du compilateur. Cette mise à jour étend la même idée aux domaines sans compilateur : notes d'investissement, avis juridiques et dossiers cliniques.

Conformité CoT pilotée par schéma

Le mécanisme central est un schéma TypeScript (utilisant les balises typia) qui force le raisonnement du modèle dans une forme requise. Chaque champ doit être rempli, sinon la soumission est rejetée. Exemple de schéma pour une note d'investissement :

import { tags } from "typia";

export interface IInvestmentMemo { recommendation: "BUY" | "HOLD" | "SELL"; thesis: { consensusView: string; differentiatedView: string; }; counterThesis: { bearCase: string; ourResponse: string; }; // bull / base / bear tous requis — empêche de soumettre seulement le scénario de base scenarios: { bull: IScenario; base: IScenario; bear: IScenario; }; // les tableaux vides sont interdits valuationDrivers: IValuationDriver[] & tags.MinItems<1>; killConditions: IKillCondition[] & tags.MinItems<1>; evidenceSources: IEvidenceSource[] & tags.MinItems<1>; }

// Seuils falsifiables uniquement — empêche les formulations libres comme "confiance dans la direction" export type IKillCondition = | { type: "price_drawdown"; percentBelowEntry: number } | { type: "metric_breach"; metric: string; below: number } | { type: "milestone_miss"; expectedBy: string; what: string };

Le schéma est ensuite validé en l'exécutant sur des cas d'investissement historiques — la même idée que le backtesting d'une stratégie de trading sur des données de marché. Le diff montre quels appels passés le schéma aurait réussis et lesquels il a manqués ; vous ajoutez ce qui manque.

Ad

Conformité CoT mesurée

En utilisant la fonctionnalité CoT d'AutoBE (et non l'analyse d'investissement financier elle-même), qwen3.6-27b suit le rythme des modèles frontaliers sur ces schémas de conformité CoT. Le harnais fait passer la conformité de 9,91% à 100%.

À qui cela s'adresse

Développeurs créant des agents IA qui ont besoin d'un raisonnement structuré et vérifiable dans des domaines sans contrôles automatiques de correction (par exemple, finance, droit, médecine).

📖 Lire la source complète : r/LocalLLaMA

Présentation précédente : Partie 1

Ad

👀 See Also

Gemma4 26B-A4B Offre des Performances Locales Rapides avec Recherche Web et Prise en Charge des Images
Tools

Gemma4 26B-A4B Offre des Performances Locales Rapides avec Recherche Web et Prise en Charge des Images

Le modèle gemma-4-26B-A4B atteint environ 145 tokens par seconde sur une RTX 4090 et inclut la recherche web MCP et la prise en charge d'images pour les applications de chat. Un article de blog détaille la configuration et l'utilisation multiplateforme sur Mac et iPhone.

OpenClawRadar
Serveur MCP LocalSynapse Permet à Claude de Rechercher des Documents Locaux Hors Ligne
Tools

Serveur MCP LocalSynapse Permet à Claude de Rechercher des Documents Locaux Hors Ligne

LocalSynapse est un serveur MCP qui indexe et recherche dans des documents locaux (Word, Excel, PowerPoint, PDF) en utilisant une recherche sémantique hybride BM25 + IA. Tout fonctionne localement, sans nécessiter de cloud ni de clés API.

OpenClawRadar
Le plugin Godmode ajoute une boucle d'itération autonome au code Claude et à d'autres agents de codage IA.
Tools

Le plugin Godmode ajoute une boucle d'itération autonome au code Claude et à d'autres agents de codage IA.

Godmode est un plugin open-source qui ajoute une boucle autonome de mesure-modification-vérification à Claude Code, avec des agents parallèles, une mémoire des échecs et 126 compétences incluant l'optimisation, les audits de sécurité et le TDD. Il fonctionne avec Cursor, Codex, Gemini CLI et OpenCode.

OpenClawRadar
Bifrost AI Gateway : Un outil open-source comble les lacunes de l'infrastructure IA
Tools

Bifrost AI Gateway : Un outil open-source comble les lacunes de l'infrastructure IA

Bifrost est une passerelle LLM open-source basée sur Go qui offre un basculement automatique entre les fournisseurs, des plafonds budgétaires qui rejettent les requêtes, une journalisation d'audit et des crochets pour l'évaluation. Les tests de performance montrent qu'elle est environ 50 fois plus rapide que LiteLLM à haut débit.

OpenClawRadar