Investigación Automatizada con Claude Code en Base de Código de Producción: 60 Experimentos, 3 Cambios Conservados

✍️ OpenClawRadar📅 Publicado: 24 de marzo de 2026🔗 Source
Investigación Automatizada con Claude Code en Base de Código de Producción: 60 Experimentos, 3 Cambios Conservados
Ad

Experimento de Investigación Automática en Base de Código de Producción

Un desarrollador probó el enfoque de investigación automática de Karpathy en un sistema real de producción utilizando Claude Code, ejecutando 60 iteraciones en dos rondas mientras estaba lejos del ordenador. El objetivo era un sistema de búsqueda híbrida construido con Django, pgvector y embeddings de Cohere.

Resultados y Hallazgos Clave

De 60 iteraciones, solo se mantuvieron 3 cambios mientras que 57 fueron revertidos. La mejora general en la puntuación fue marginal (+0,03), pero el conocimiento obtenido fue significativo:

  • La coincidencia de títulos como señal de búsqueda resultó ser negativa, demostrado en solo 2 iteraciones
  • Los grupos de candidatos más grandes no tuvieron efecto: el problema era la clasificación, no la recuperación
  • La ponderación adaptativa construida manualmente realmente funcionó: eliminarla causó regresiones
  • Modificar fórmulas de amortiguación de palabras clave apenas movió las puntuaciones
  • La ronda 2 dirigida al mensaje de metadatos de Haiku no produjo mejoras porque los pesos de clasificación de la ronda 1 estaban co-optimizados para la salida del mensaje original
  • Se descubrió un error de almacenamiento en caché de Redis: las claves estaban en el hash de consulta, no en el hash del mensaje, lo que habría pasado a producción sin ser detectado
Ad

Conclusiones Prácticas

La mayor percepción fue que la investigación automática ayuda a mapear dónde está el límite superior, no solo a encontrar mejoras. Tener 60 puntos de datos que dicen "Puedes dejar de ajustar esto" proporciona evidencia concreta en lugar de depender de la intuición. El desarrollador señala que este enfoque ahorró tiempo de experimentación manual en optimizaciones que no habrían dado resultado.

El informe completo está disponible en el enlace del blog, y la habilidad de investigación automática de Claude Code de código abierto está en GitHub. El desarrollador está interesado en que otros prueben esto en bases de código no de aprendizaje automático y en qué métricas están utilizando.

📖 Leer la fuente completa: r/ClaudeAI

Ad

👀 Ver también

Desarrollador Implementa Bucle de Retroalimentación Listo para IA para Lanzamiento de Funciones
Casos de uso

Desarrollador Implementa Bucle de Retroalimentación Listo para IA para Lanzamiento de Funciones

Un desarrollador creó un sistema de retroalimentación que captura el contexto de la aplicación y genera automáticamente issues estructurados en GitHub, luego utiliza Claude Code con una habilidad de triaje para convertir esos issues en tareas de desarrollo delimitadas. Dos funciones se implementaron usando este flujo de trabajo desde dispositivos móviles.

OpenClawRadar
Conectar OpenClaw a un teléfono rotatorio mediante SIP y APIs de voz
Casos de uso

Conectar OpenClaw a un teléfono rotatorio mediante SIP y APIs de voz

Un desarrollador conectó un teléfono de disco Benotek a OpenClaw utilizando un adaptador ATA Grandstream HT801 v2, SIP de Twilio, Deepgram para conversión de voz a texto y ElevenLabs para conversión de texto a voz, con transmisión de audio a través de WebSocket y ngrok.

OpenClawRadar
🦀
Casos de uso

Clasificación de PRs de la comunidad con agentes multijugador en OpenClaw 2.0

Patrick Erichsen (Fundación OpenClaw) muestra cómo usar agentes multijugador en OpenClaw 2.0 para clasificar y revisar PRs de la comunidad. La automatización revisa Discord cada 15 minutos, asigna un mantenedor e inicia una sesión de agente compartida.

OpenClawRadar
Configuración de proveedores personalizados y desafíos de memoria entre agentes con OpenClaw para ejecutar múltiples agentes de codificación de IA
Casos de uso

Configuración de proveedores personalizados y desafíos de memoria entre agentes con OpenClaw para ejecutar múltiples agentes de codificación de IA

Esta publicación detalla la configuración de OpenClaw con un proveedor de API de terceros (DeepInfra) para ejecutar múltiples agentes de codificación (backend, frontend, migraciones) sin superar los límites de tasa, y el problema de aislamiento de memoria entre agentes que surgió.

OpenClawRadar