Acheminer le trafic de l'API Claude pour contrôler les coûts suite au changement d'abonnement Max

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
Acheminer le trafic de l'API Claude pour contrôler les coûts suite au changement d'abonnement Max
Ad

Migration vers la facturation API et implications sur les coûts

Depuis midi heure du Pacifique, l'abonnement Max d'Anthropic ne couvre plus l'utilisation d'outils tiers comme OpenClaw. Tous les utilisateurs d'OpenClaw sont désormais sur la facturation API avec ces tarifs :

  • Claude Opus 4.6 : 5 $ par million de tokens d'entrée, 25 $ par million de tokens de sortie
  • Claude Sonnet 4.6 : 3 $ par million de tokens d'entrée, 15 $ par million de tokens de sortie
  • Claude Haiku 4.5 : 1 $ par million de tokens d'entrée, 5 $ par million de tokens de sortie

Une session intensive d'OpenClaw sur Opus peut coûter 1 à 4 $, tandis que la même session sur Sonnet coûte 0,20 à 0,80 $ avec des résultats similaires pour la plupart des tâches.

Ad

La solution de routage

La plupart des opérations d'OpenClaw ne nécessitent pas Opus : les vérifications de pulsation, les lectures de fichiers, les résumés, les décisions de routage et les appels d'outils courts peuvent tous être gérés par Sonnet. Sans couche de routage, chaque requête atteint votre modèle par défaut, gaspillant potentiellement le budget Opus sur des tâches simples.

Un proxy local route les requêtes Claude par complexité : les tâches simples vont automatiquement vers Sonnet, les tâches complexes sont escaladées vers Opus. Cette approche a significativement réduit les coûts sans perte de qualité sur les tâches importantes.

Le proxy est open source et installable via npm : npm install -g @relayplane/proxy

Une documentation détaillée et des discussions sont disponibles sur r/ClaudeCode, où la solution a reçu 52 000 vues.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Utiliser un LLM local comme sous-agent de code Claude pour réduire l'utilisation du contexte
Tools

Utiliser un LLM local comme sous-agent de code Claude pour réduire l'utilisation du contexte

Un utilisateur de Reddit démontre comment Claude Code peut déléguer des tâches à un LLM local fonctionnant via LM Studio, en gardant le contenu des fichiers hors du contexte de Claude. La configuration utilise un script Python d'environ 120 lignes avec l'API d'appel d'outils de LM Studio pour gérer les opérations sur fichiers localement.

OpenClawRadar
OpenMontage : Système de Production Vidéo Agentique Open-Source pour Assistants de Codage IA
Tools

OpenMontage : Système de Production Vidéo Agentique Open-Source pour Assistants de Codage IA

OpenMontage est un système de production vidéo open-source qui transforme les assistants de codage IA comme Claude Code en studios de production complets. Il gère la recherche, la planification des scènes, l'écriture du scénario, la narration vocale, la sélection musicale, la génération de sous-titres et la validation via des pipelines automatisés.

OpenClawRadar
Warp Terminal devient open source avec un environnement de développement agentique
Tools

Warp Terminal devient open source avec un environnement de développement agentique

Warp est désormais open-source et se rebaptise en tant qu'environnement de développement agentique, avec un agent de codage intégré et la possibilité d'utiliser vos propres agents CLI comme Claude Code, Codex et Gemini CLI.

OpenClawRadar
Galerie d'Architecture LLM : Référence Visuelle pour les Conceptions de Modèles
Tools

Galerie d'Architecture LLM : Référence Visuelle pour les Conceptions de Modèles

La Galerie d'Architectures LLM de Sebastian Raschka rassemble des figures d'architecture et des fiches techniques issues de The Big LLM Architecture Comparison et de A Dream of Spring for Open-Weight LLMs, avec des spécifications détaillées pour des modèles comme Llama 3 8B, DeepSeek V3 et Gemma 3 27B.

OpenClawRadar