OpenEvol: Pipeline de Automejora Sin Conexión para LLMs Utilizando Historial de Conversaciones

✍️ OpenClawRadar📅 Publicado: 31 de marzo de 2026🔗 Source
OpenEvol: Pipeline de Automejora Sin Conexión para LLMs Utilizando Historial de Conversaciones
Ad

Qué hace OpenEvol

OpenEvol es una canalización de auto-mejora offline para modelos de lenguaje grandes que convierte automáticamente el historial de conversaciones de IA en datos de entrenamiento. La herramienta extrae intercambios de alto valor de las conversaciones, evalúa su calidad y genera conjuntos de datos de ajuste fino sin etiquetado manual ni ruedas de datos propietarias.

Cómo funciona

La canalización pasa por cuatro etapas automatizadas:

  • Extraer intercambios de alto valor de las conversaciones
  • Evaluar la calidad usando reglas con un modelo de lenguaje profesor opcional
  • Sintetizar conjuntos de datos de SFT, preferencia y preentrenamiento
  • Ajustar fino con un solo comando

Esto crea un ciclo cerrado donde el modelo aprende de su propia experiencia.

Detalles técnicos

No se requiere GPU para comenzar: la canalización completa funciona en CPU con un backend de profesor simulado o compatible con OpenAI. Puedes agregar una GPU cuando estés listo para entrenar.

Se admiten cinco backends de profesor:

  • Simulado
  • Basado en reglas
  • API compatible con OpenAI (cualquier proxy local funciona)
  • HuggingFace Transformers
  • vLLM
Ad

Opciones de uso

Tres formas de usar OpenEvol:

  • CLI para ejecuciones por lotes offline
  • Servidor de API REST para automatización
  • Complemento de escritorio OpenClaw que te permite activar ejecuciones de la canalización directamente desde el chat

Control de calidad

Cada lote se puntúa automáticamente. Si la tasa de aprobación cae por debajo del 80%, el entrenamiento se bloquea y se marca para revisión humana, dando a los usuarios control sobre qué datos se usan para el entrenamiento.

Este tipo de herramienta es útil para desarrolladores que quieren mejorar sus agentes de programación de IA usando historiales de conversaciones reales sin enviar datos a servicios externos.

📖 Leer la fuente completa: r/openclaw

Ad

👀 Ver también

Kit de Aprendizaje: Un Complemento de Código Claude para la Incorporación y Exploración de Bases de Código
Herramientas

Kit de Aprendizaje: Un Complemento de Código Claude para la Incorporación y Exploración de Bases de Código

Learning-kit es un complemento gratuito de Claude Code que analiza repositorios para generar planes de aprendizaje estructurados y tutoriales interactivos. Ayuda a los desarrolladores a comprender bases de código desconocidas antes de realizar cambios, con modos de aplicación configurables y seguimiento del progreso.

OpenClawRadar
SDK de Claude Code ingeniería inversa lanzado en cuatro idiomas
Herramientas

SDK de Claude Code ingeniería inversa lanzado en cuatro idiomas

Un desarrollador ha realizado ingeniería inversa de Claude Code y ha creado SDKs de archivo único en Node.js, Python, Go y Rust sin dependencias. Las herramientas proporcionan un ciclo completo de agente con transmisión en tiempo real y uso de herramientas, utilizando suscripciones existentes de Claude Pro/Max.

OpenClawRadar
ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo
Herramientas

ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo

ToolLoop es un framework de código abierto en Python con 11 herramientas para operaciones de archivos, búsqueda de código, acceso a shell y subagentes que funciona con cualquier LLM a través de LiteLLM. El framework de 2,700 líneas permite cambiar de modelo a mitad de conversación con contexto compartido.

OpenClawRadar
El complemento OpenClaw Context Meter muestra el porcentaje de uso del token de Telegram.
Herramientas

El complemento OpenClaw Context Meter muestra el porcentaje de uso del token de Telegram.

Un nuevo complemento de OpenClaw muestra el porcentaje de uso de tokens después de cada respuesta del bot de Telegram, mostrando valores como '45k / 200k (22%)' y detectando eventos de compactación. El complemento evita problemas de OOM al codificar ventanas de contexto en lugar de usar execSync.

OpenClawRadar