Votre agent n'est pas le modèle : Harness vs service d'inférence expliqués

✍️ OpenClawRadar📅 Publié: August 25, 2026🔗 Source
Ad

Les gens parlent souvent de Claude comme s'il s'agissait d'une entité unique, mais un agent IA est une pile de trois couches distinctes. Connaître la différence vous fait gagner des heures de débogage — lorsque quelque chose ne va pas, vous devez savoir si le problème vient du modèle, du service ou de la logique qui l'entoure.

Les trois couches

  • Modèle — la fonction mathématique qui transforme les jetons d'entrée en jetons de sortie. Exemples : Sonnet, Opus, Gemini.
  • Service d'inférence — le service hébergé qui exécute le modèle et suit l'utilisation. Exemples : AWS Bedrock, l'API d'Anthropic.
  • Harnais — la logique qui façonne les entrées, interprète les sorties et interagit avec le monde extérieur. Cela inclut MCP et Skills — le modèle ne les connaît pas intrinsèquement.

En résumé, un système d'agent est un harnais qui appelle un service d'inférence, qui exécute un modèle. C'est tout.

Répartition dans le monde réel

Système d'agentHarnaisService d'inférenceModèle
Claude DesktopUI + MCP + logique localeService d'inférence d'AnthropicSonnet / Opus / Haiku
Claude CLIAnalyse des outils + I/O de fichiersService d'inférence d'AnthropicSonnet / Opus / Haiku
CursorAssemblage du contexte + routage des outilsCouche d'inférence de CursorSonnet / GPT / Gemini
Agent LangChain personnaliséModèles de prompt + définitions d'outilsBedrock, OpenAI, etc.Votre modèle choisi

Le même modèle (par exemple, Sonnet) peut se comporter différemment selon le harnais — car le harnais façonne les entrées et interprète les sorties. C'est pourquoi vos prompts fonctionnent dans Claude CLI mais pas dans Cursor.

Ad

Déboguer avec ce modèle mental

  • Mauvaises réponses ? Regardez le harnais — il ne fournit peut-être pas assez de contexte.
  • Trop lent ou coûteux ? Vérifiez le service d'inférence — les prix et les performances s'y trouvent.
  • Sortie inattendue ? Le modèle est-il erroné, ou le harnais lui fournit-il des données erronées ?

L'article note également que, à mesure que les modèles deviennent plus intelligents, certaines logiques de harnais (comme MCP ou Skills) pourraient devenir obsolètes — donc la façon dont nous construisons les harnais aujourd'hui pourrait mal vieillir.

La prochaine fois que vous direz « mon modèle a fait X », arrêtez-vous et demandez : était-ce le modèle, ou le harnais qui l'orchestrait ?

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Correction des erreurs 'Navigate Unsupported' et des plugins navigateur dans OpenClaw auto-hébergé sur Docker
Guides

Correction des erreurs 'Navigate Unsupported' et des plugins navigateur dans OpenClaw auto-hébergé sur Docker

Correction étape par étape pour les erreurs de permission EACCES, l'absence de Playwright et de binaires Chromium lors de l'auto-hébergement d'OpenClaw avec Docker sur un VPS comme Hostinger.

OpenClawRadar
Les fichiers CLAUDE.md sont souvent organisés pour les développeurs, pas pour les modèles d'IA – voici pourquoi cela importe
Guides

Les fichiers CLAUDE.md sont souvent organisés pour les développeurs, pas pour les modèles d'IA – voici pourquoi cela importe

Les fichiers CLAUDE.md placent couramment les Règles Strictes à la ligne 47, après le contexte et la stack technique. Au moment où le modèle lit les contraintes, il a déjà construit des hypothèses contradictoires. Une meilleure structure place les règles strictes en premier.

OpenClawRadar
Dépôt ClaudeBusiness : Modèles pour gérer des entreprises réelles avec Claude Code
Guides

Dépôt ClaudeBusiness : Modèles pour gérer des entreprises réelles avec Claude Code

Un dépôt GitHub rassemblant des modèles pratiques, des frameworks et des garde-fous issus de plus de 35 fils Reddit de fondateurs utilisant Claude pour gérer des agences de services et des entreprises SaaS solo.

OpenClawRadar
Conseils pratiques pour OpenClaw : Commencer petit, éviter les pièges courants
Guides

Conseils pratiques pour OpenClaw : Commencer petit, éviter les pièges courants

Un développeur partage les leçons tirées de la création d'un suivi de santé personnel avec OpenClaw, en mettant l'accent sur un champ d'application restreint, des flux de travail déterministes et le fait de s'en tenir à un seul LLM. Le billet comprend des observations spécifiques sur les modèles comparant ChatGPT et Gemini.

OpenClawRadar