OpenEvol: Pipeline de Automejora Sin Conexión para LLMs Utilizando Historial de Conversaciones

Qué hace OpenEvol
OpenEvol es una canalización de auto-mejora offline para modelos de lenguaje grandes que convierte automáticamente el historial de conversaciones de IA en datos de entrenamiento. La herramienta extrae intercambios de alto valor de las conversaciones, evalúa su calidad y genera conjuntos de datos de ajuste fino sin etiquetado manual ni ruedas de datos propietarias.
Cómo funciona
La canalización pasa por cuatro etapas automatizadas:
- Extraer intercambios de alto valor de las conversaciones
- Evaluar la calidad usando reglas con un modelo de lenguaje profesor opcional
- Sintetizar conjuntos de datos de SFT, preferencia y preentrenamiento
- Ajustar fino con un solo comando
Esto crea un ciclo cerrado donde el modelo aprende de su propia experiencia.
Detalles técnicos
No se requiere GPU para comenzar: la canalización completa funciona en CPU con un backend de profesor simulado o compatible con OpenAI. Puedes agregar una GPU cuando estés listo para entrenar.
Se admiten cinco backends de profesor:
- Simulado
- Basado en reglas
- API compatible con OpenAI (cualquier proxy local funciona)
- HuggingFace Transformers
- vLLM
Opciones de uso
Tres formas de usar OpenEvol:
- CLI para ejecuciones por lotes offline
- Servidor de API REST para automatización
- Complemento de escritorio OpenClaw que te permite activar ejecuciones de la canalización directamente desde el chat
Control de calidad
Cada lote se puntúa automáticamente. Si la tasa de aprobación cae por debajo del 80%, el entrenamiento se bloquea y se marca para revisión humana, dando a los usuarios control sobre qué datos se usan para el entrenamiento.
Este tipo de herramienta es útil para desarrolladores que quieren mejorar sus agentes de programación de IA usando historiales de conversaciones reales sin enviar datos a servicios externos.
📖 Leer la fuente completa: r/openclaw
👀 Ver también

Kit de Aprendizaje: Un Complemento de Código Claude para la Incorporación y Exploración de Bases de Código
Learning-kit es un complemento gratuito de Claude Code que analiza repositorios para generar planes de aprendizaje estructurados y tutoriales interactivos. Ayuda a los desarrolladores a comprender bases de código desconocidas antes de realizar cambios, con modos de aplicación configurables y seguimiento del progreso.

SDK de Claude Code ingeniería inversa lanzado en cuatro idiomas
Un desarrollador ha realizado ingeniería inversa de Claude Code y ha creado SDKs de archivo único en Node.js, Python, Go y Rust sin dependencias. Las herramientas proporcionan un ciclo completo de agente con transmisión en tiempo real y uso de herramientas, utilizando suscripciones existentes de Claude Pro/Max.

ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo
ToolLoop es un framework de código abierto en Python con 11 herramientas para operaciones de archivos, búsqueda de código, acceso a shell y subagentes que funciona con cualquier LLM a través de LiteLLM. El framework de 2,700 líneas permite cambiar de modelo a mitad de conversación con contexto compartido.

El complemento OpenClaw Context Meter muestra el porcentaje de uso del token de Telegram.
Un nuevo complemento de OpenClaw muestra el porcentaje de uso de tokens después de cada respuesta del bot de Telegram, mostrando valores como '45k / 200k (22%)' y detectando eventos de compactación. El complemento evita problemas de OOM al codificar ventanas de contexto en lugar de usar execSync.