Exploiter le Signal d'Agence Cachée des LLM (Â) pour un Meilleur Appel d'Outils

✍️ OpenClawRadar📅 Publié: March 8, 2026🔗 Source
Exploiter le Signal d'Agence Cachée des LLM (Â) pour un Meilleur Appel d'Outils
Ad

En déboguant les échecs d'agent ReAct avec Qwen3, un développeur a découvert que les états cachés juste avant les appels d'outils sont linéairement séparables des états sans outil avec une AUC > 0,94. Cette direction dans l'espace latent, appelée  (pour "agentivité"), existe à travers différentes tailles de modèles de 1,7B à 8B et prédit les appels d'outils en utilisant simplement une sonde linéaire.

Comment utiliser le signal d'agentivité

Pendant l'inférence, projetez chaque état caché sur Â. Si la projection dépasse un seuil θ, le modèle souhaite appeler un outil même s'il ne l'exprime pas textuellement. Vous pouvez alors forcer un appel d'outil.

# Au moment de l'inférence (pseudo-code)
hidden_state = get_middle_layer_state(model, input_text)
proj = np.dot(hidden_state, Â)
if proj > threshold:
    # Le modèle veut agir → forcer l'appel d'outil
    tool = choose_tool() # peut être appris ou heuristique
    result = execute_tool(tool)
else:
    # Génération normale
    output = model.generate(input_text)

Résultats de performance

Testé sur 40 tâches diverses (recherche, code, fichier, communication, données) avec les modèles Qwen3 :

  • Qwen3-1.7B : 26,7 % → 85 % (+58 % d'amélioration)
  • Qwen3-8B : 52,5 % → 76,3 % (+23 % d'amélioration)

Le mode d'échec "sans outil" est passé de 43 % à 2,6 %. Les modèles plus petits bénéficient davantage car leur décodage textuel est plus faible, mais le signal géométrique est tout aussi fort.

Ad

Comment extraire Â

Trois méthodes :

  • Option 1 : À partir de vos propres traces - Calculez la différence moyenne normalisée entre les états cachés avec outil et sans outil
  • Option 2 : Via des invites contrastives - Exécutez 15 paires d'invites (une nécessitant un outil, une passive) dans votre modèle et prenez la différence moyenne au niveau de la couche intermédiaire
  • Option 3 : Utilisez des directions pré-calculées - Utilisez les directions  extraites pour les modèles Qwen3 partagées dans le dépôt

Implémentation empaquetée

La découverte a été empaquetée dans une bibliothèque pour une réutilisation facile :

bash
pip install a-hat-optimizer
python
from a_hat_optimizer import AHat

# Extraction automatique depuis n'importe quel modèle HF en 1 ligne
ahat = AHat.from_model("Qwen/Qwen3-8B")

# Ou charger pré-extrait
ahat = AHat.from_file("my_ahat_dir/")

# Utiliser dans votre agent
should_call, confidence = ahat.predict(hidden_state)
if should_call:
    print(f"Forcer l'appel d'outil (confiance : {confidence:.2f})")

La bibliothèque gère l'extraction automatique via des invites contrastives, 4 stratégies de calibration (point médian, F1, Youden, percentile), la prédiction par lots, et la sauvegarde/chargement avec des métadonnées incluant l'AUC et les informations de couche.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Cadre pour les coéquipiers IA dans Slack, entièrement opéré depuis Claude Code
Tools

Cadre pour les coéquipiers IA dans Slack, entièrement opéré depuis Claude Code

ginnie-agents est un framework open-source pour exécuter des agents IA autonomes avec des identités Slack, une mémoire à trois niveaux, des routines cron et des horaires de travail — le tout configuré et opéré via Claude Code. Nécessite Claude Code Max, Docker, Node 22+ et un espace de travail Slack avec les permissions de création d'applications.

OpenClawRadar
Prompt-Mini : Le plugin Claude Code intercepte les invites vagues pour réduire le gaspillage de crédits
Tools

Prompt-Mini : Le plugin Claude Code intercepte les invites vagues pour réduire le gaspillage de crédits

Prompt-mini est un plugin Claude Code qui intercepte les invites vagues avant leur exécution, pose des questions de clarification et construit des invites structurées avec détection de la pile technique et des règles spécifiques pour plus de 40 frameworks. L'outil traite 35 modèles problématiques qui gaspillent des crédits comme l'absence de portée, de conditions d'arrêt et de chemins de fichiers.

OpenClawRadar
Chat Saver CG : Extension de navigateur conçue avec Claude Exporte les conversations sur 12 plateformes d'IA
Tools

Chat Saver CG : Extension de navigateur conçue avec Claude Exporte les conversations sur 12 plateformes d'IA

Un développeur a créé Chat Saver CG, une extension de navigateur qui exporte et transfère les conversations entre Claude, ChatGPT, Gemini et 9 autres plateformes d'IA, en utilisant Claude de manière intensive pour le développement, y compris pour les décisions d'architecture, le débogage des problèmes d'analyse DOM et l'écriture de la logique d'adaptation.

OpenClawRadar
NVIDIA annonce la plateforme d'agent NemoClaw avec des contrôles de confidentialité
Tools

NVIDIA annonce la plateforme d'agent NemoClaw avec des contrôles de confidentialité

NVIDIA a lancé NemoClaw, une plateforme d'agents qui permet aux utilisateurs d'installer les modèles Nimotron et l'environnement d'exécution Open Shell avec une seule commande, tout en ajoutant des contrôles de confidentialité et de sécurité pour les agents autonomes.

OpenClawRadar