Bifrost LLM Gateway : 11 microsecondes de surcoût, binaire unique en Go

✍️ OpenClawRadar📅 Publié: February 27, 2026🔗 Source
Bifrost LLM Gateway : 11 microsecondes de surcoût, binaire unique en Go
Ad

Qu'est-ce que Bifrost

Bifrost est un proxy LLM prêt à l'emploi écrit en Go, conçu spécifiquement pour les environnements auto-hébergés. Il achemine les requêtes vers OpenAI, Anthropic, Azure, Bedrock et d'autres fournisseurs tout en gérant la bascule, la mise en cache et les contrôles budgétaires.

Benchmarks de performance

Le développeur a mesuré une capacité soutenue de 5 000 requêtes par seconde :

  • Bifrost (Go) : ~11 microsecondes de surcharge par requête
  • LiteLLM (Python) : ~8 millisecondes de surcharge par requête

Cela représente environ 700 fois moins de surcharge.

Comparaison de l'utilisation mémoire

À même débit :

  • Bifrost : ~50 Mo de RAM de base, reste stable sous charge
  • LiteLLM : ~300-400 Mo de base, atteint 800 Mo+ en cas de trafic intense

Le développeur note que l'exécution de LiteLLM à plus de 2 000 RPS nécessite une mise à l'échelle horizontale et des instances importantes, tandis que Bifrost gère 5 000 RPS sur un VPS à 20 $/mois.

Ad

Stabilité sous charge

Les performances de Bifrost restent constantes sous charge, avec la même latence à 100 RPS ou 5 000 RPS. En revanche, LiteLLM devient imprévisible lors des pics de trafic : la variance de latence augmente, la mémoire monte en flèche et les pauses du ramasse-miettes surviennent au pire moment.

Fonctionnalités uniques

Bifrost inclut une passerelle MCP qui connecte plus de 10 serveurs d'outils MCP, gère la découverte, l'espace de noms, les contrôles de santé et le filtrage des outils par requête. LiteLLM ne prend pas en charge MCP.

Déploiement et migration

Le déploiement se fait avec un seul binaire, sans environnements virtuels Python, sans problèmes de dépendances et sans Docker requis. Vous le copiez sur le serveur et vous l'exécutez.

Pour la migration, l'API est compatible avec OpenAI. Vous changez l'URL de base et conservez le code existant, la plupart des migrations prenant moins d'une heure.

Disponibilité open source

Le projet est open source et disponible sur github.com/maximhq/bifrost.

📖 Lire la source complète : r/clawdbot

Ad

👀 See Also

Brunnfeld Agentic World : Simulation d'Économie Médiévale Multi-Agents Sans Invitations Comportementales
Tools

Brunnfeld Agentic World : Simulation d'Économie Médiévale Multi-Agents Sans Invitations Comportementales

Une simulation TypeScript où 20 agents LLM négocient de manière autonome dans une économie de village médiéval sans instructions comportementales, objectifs ou stratégies commerciales. Les agents reçoivent environ 200 tokens de perceptions à chaque tick et interagissent via un moteur déterministe gérant la physique, les recettes et les mécanismes de marché.

OpenClawRadar
Layerkit : Éditeur d'Images IA avec Calques Modifiables Développé avec Claude Code
Tools

Layerkit : Éditeur d'Images IA avec Calques Modifiables Développé avec Claude Code

Un développeur a créé Layerkit, un éditeur d'images basé sur le navigateur qui génère des scènes avec des calques modifiables pour éviter de constamment reformuler les prompts. L'outil utilise un pipeline d'IA multi-étapes où un LLM planifie la composition, un modèle d'image génère la scène, et un autre LLM analyse l'image réelle pour placer un texte lisible.

OpenClawRadar
Claude-Code v2.1.63 ajoute des crochets HTTP, des commandes slash et corrige les fuites de mémoire.
Tools

Claude-Code v2.1.63 ajoute des crochets HTTP, des commandes slash et corrige les fuites de mémoire.

Claude-Code v2.1.63 introduit des hooks HTTP pour des appels externes basés sur JSON, ajoute les commandes slash /simplify et /batch, et corrige plusieurs fuites de mémoire dans les sessions de longue durée. Cette version améliore également la gestion des serveurs MCP et l'intégration avec VSCode.

OpenClawRadar
Compétence OpenClaw Réduit le Transfert d'Agent en Permettant l'Exécution Automatique
Tools

Compétence OpenClaw Réduit le Transfert d'Agent en Permettant l'Exécution Automatique

Une nouvelle compétence pour les agents OpenClaw aborde le problème courant où les agents identifient l'étape suivante mais s'arrêtent à 'voici ce qu'il faut faire ensuite', nécessitant un transfert à un humain. La compétence permet aux agents d'effectuer certaines actions eux-mêmes, comme s'inscrire, publier, répondre et signer.

OpenClawRadar