LLMock : Serveur de simulation basé sur HTTP pour des tests déterministes de LLM entre processus

LLMock est un serveur de simulation qui intercepte les appels d'API LLM en s'exécutant comme un véritable serveur HTTP sur un port spécifié, permettant des tests déterministes sur plusieurs processus sans solliciter les API payantes.
Détails clés
L'outil a été découvert après qu'un développeur ait dépensé 12 $ en exécutant des tests Playwright sur les véritables API OpenAI. Le problème est survenu lors de l'utilisation de MSW (Mock Service Worker), qui modifie le module HTTP à l'intérieur du processus Node.js qui appelle server.listen(), mais laisse les processus séparés (comme un agent Python) complètement aveugles à la simulation.
Avec LLMock, vous pointez la variable d'environnement OPENAI_BASE_URL vers le serveur de simulation depuis chaque processus, qu'il s'agisse de Node.js, Python ou tout autre langage :
const mock = new LLMock({ port: 5555 });
await mock.start();
process.env.OPENAI_BASE_URL = "http://localhost:5555/v1";Les fixtures sont de simples fichiers JSON qui correspondent à des sous-chaînes de messages utilisateur ou à des motifs regex, éliminant le code passe-partout des gestionnaires :
{
"fixtures": [
{
"match": { "userMessage": "stock price of AAPL" },
"response": { "content": "The current stock price of Apple Inc. (AAPL) is $150.25." }
}
]
}Fonctionnalités clés de la source :
- Utilise correctement le format SSE réel d'OpenAI/Claude/Gemini (se tromper sur les types d'événements perturbe subtilement le streaming)
- Prise en charge complète des appels d'outils - les frameworks d'agents les exécutent normalement
- Routage par prédicat pour inspecter l'état de l'invite système ou l'historique des messages pour les flux multi-agents
- Journal des requêtes pour vérifier ce qui a réellement été appelé, pas seulement si le test a réussi
- Zéro dépendance
Le développeur a fini avec 9 appels LLM sur 3 tests Playwright, coûtant 0 $ et produisant des résultats déterministes à chaque exécution.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Argyph : Un seul serveur MCP pour Claude Code avec 19 outils structurés de compréhension du code
Argyph est un serveur MCP local qui offre à Claude Code 19 outils — aller à la définition, trouver les références, graphes d'appel, recherche sémantique, empaquetage de dépôt avec budget de tokens — remplaçant plusieurs serveurs MCP distincts par une seule installation. Aucune clé API requise ; tout le traitement reste sur votre machine.

Traduction vers fr : Compétence Aventure Textuelle Claude v1.1.0 Ajoute des Arcs de Campagne et des PNJ Améliorés
La mise à jour v1.1.0 de la compétence d'aventure textuelle Claude introduit des arcs de campagne où la progression des personnages persiste à travers les aventures, des PNJ avec des statistiques et niveaux cachés, et des modules visuels/audio optionnels. Téléchargez text-adventure.zip depuis les versions GitHub pour l'utiliser avec Claude Desktop ou claude.ai.

cc-session-utils : Tableau de bord TUI pour gérer les sessions et les coûts de Claude Code
Un développeur a créé cc-session-utils, un outil d'interface utilisateur en terminal pour gérer les fichiers de session Claude Code, suivre les coûts par modèle, nettoyer les sessions orphelines et migrer les données entre projets. Il nécessite Python 3.11+ et est construit avec Textual.

Indexes Persistants sur l'Extraction : Architecture pour un Serveur MCP YouTube
Un développeur partage des notes d'architecture pour la construction d'un serveur MCP YouTube qui utilise des index locaux persistants au lieu du modèle courant d'extraction-oubli.