LLMock: Servidor de simulación basado en HTTP para pruebas deterministas de LLM entre procesos

✍️ OpenClawRadar📅 Publicado: 14 de marzo de 2026🔗 Source
LLMock: Servidor de simulación basado en HTTP para pruebas deterministas de LLM entre procesos
Ad

LLMock es un servidor de simulación que intercepta las llamadas a la API de LLM al ejecutarse como un servidor HTTP real en un puerto específico, permitiendo pruebas deterministas en múltiples procesos sin acceder a las API de pago.

Ad

Detalles clave

La herramienta fue descubierta después de que un desarrollador gastara $12 ejecutando pruebas de Playwright contra las API reales de OpenAI. El problema ocurrió al usar MSW (Mock Service Worker), que parchea el módulo HTTP dentro del proceso de Node.js que llama a server.listen(), pero deja a procesos separados (como un agente de Python) completamente ajenos a la simulación.

Con LLMock, apuntas la variable de entorno OPENAI_BASE_URL al servidor de simulación desde cada proceso, independientemente de si es Node.js, Python o cualquier otro lenguaje:

const mock = new LLMock({ port: 5555 });
await mock.start();
process.env.OPENAI_BASE_URL = "http://localhost:5555/v1";

Los fixtures son archivos JSON simples que coinciden con subcadenas de mensajes de usuario o patrones de expresiones regulares, eliminando el código repetitivo de los manejadores:

{
  "fixtures": [
    {
      "match": { "userMessage": "stock price of AAPL" },
      "response": { "content": "The current stock price of Apple Inc. (AAPL) is $150.25." }
    }
  ]
}

Características clave de la fuente:

  • Habla correctamente el formato SSE real de OpenAI/Claude/Gemini (equivocarse en los tipos de eventos rompe la transmisión de formas sutiles)
  • Soporte completo para llamadas a herramientas: los marcos de agentes las ejecutan normalmente
  • Enrutamiento por predicados para inspeccionar el estado del mensaje del sistema o el historial de mensajes en flujos multiagente
  • Registro de solicitudes para verificar lo que realmente se llamó, no solo si la prueba pasó
  • Cero dependencias

El desarrollador terminó con 9 llamadas a LLM en 3 pruebas de Playwright, costando $0 y produciendo resultados deterministas en cada ejecución.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Claude Code AFK Agent: Ejecuta trabajadores autónomos respaldados por Discord mediante el complemento de Teams
Herramientas

Claude Code AFK Agent: Ejecuta trabajadores autónomos respaldados por Discord mediante el complemento de Teams

Usa el plugin de canales oficiales y el agente de equipos con la variable de entorno CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 para generar trabajadores individuales desde Discord. Incluye un CLAUDE.md completo para un agente líder que despacha, nunca trabaja y fuerza el cierre de trabajadores silenciosos tras 60 minutos.

OpenClawRadar
Experiencia de Usuario: Cambiar de OpenClaw a Hermes Agent en LLM Local
Herramientas

Experiencia de Usuario: Cambiar de OpenClaw a Hermes Agent en LLM Local

Un desarrollador informa haber cambiado de OpenClaw a Hermes Agent usando Qwen3.5-9B en una RX 9070 XT con 16 GB de VRAM. Hermes completó una tarea compleja con 5 llamadas a herramientas correctas frente a los 50+ pasos de OpenClaw, ejecutándose 2:30 minutos más rápido mientras mantenía la funcionalidad de RAG, llamadas a herramientas y memoria persistente.

OpenClawRadar
Aplicación de la Bandeja del Sistema de Windows para el Monitoreo en Tiempo Real del Uso de la API de Claude
Herramientas

Aplicación de la Bandeja del Sistema de Windows para el Monitoreo en Tiempo Real del Uso de la API de Claude

Un desarrollador creó una aplicación ligera para la bandeja del sistema de Windows que muestra el uso de la cuota de la API de Claude en tiempo real, incluyendo ventanas de 5 horas y 7 días, recuentos de tokens de hoy y pronósticos de agotamiento. La aplicación admite interfaz de usuario en coreano, inglés, chino y japonés y es de código abierto en GitHub.

OpenClawRadar
Sistema Operativo Hollow Agent: Trabajadores de IA local llaman a Claude como arquitecto senior cuando están atascados
Herramientas

Sistema Operativo Hollow Agent: Trabajadores de IA local llaman a Claude como arquitecto senior cuando están atascados

Hollow Agent OS utiliza modelos Qwen locales que funcionan 24/7, pero cuando encuentran errores de lógica o necesitan cambios importantes, activan una llamada a Claude a través de MCP. Claude reorganiza estructuras de archivos, revisa código y actúa como gestor de trabajadores autónomos locales.

OpenClawRadar