El Ajuste Local de Llama 3.2-1B para la Detección de Secretos Supera al Modelo de Wiz

Un desarrollador ha documentado su exitoso ajuste fino local de Llama 3.2-1B para la detección de secretos en código, superando las métricas de un modelo similar de Wiz. El proyecto se realizó completamente con herramientas de IA locales, evitando APIs propietarias.
Resultados clave y enfoque
El desarrollador buscaba replicar o superar los resultados de Wiz de 86% de precisión y 82% de recuperación. Después de algunos fines de semana de trabajo, logró simultáneamente 88% de precisión y 84.4% de recuperación con un modelo Llama 3.2-1B ajustado. También evaluó los modelos Qwen 3.5-2B y 4B, que superaron al modelo de 1B a costa de un mayor uso de VRAM y tiempos de inferencia más largos.
Conjunto de datos y proceso de entrenamiento
El trabajo se basó únicamente en datos disponibles públicamente, que eran insuficientes, por lo que se utilizó generación procedural para aumentar y mejorar el conjunto de datos. Todo el etiquetado se realizó localmente utilizando el modelo Qwen3-Coder-Next. Un objetivo clave del entrenamiento era que los modelos generaran JSON estructurado. Inicialmente, los modelos sin entrenar (Llama y Qwen) obtuvieron un 0% en cumplimiento del esquema, pero después del entrenamiento, esto mejoró al 98-100%.
Desafíos y aprendizajes
El desarrollador encontró varios problemas durante el proceso:
- Incluyó una clase de alta entropía que fue perjudicial para el entrenamiento; esta fue identificada y eliminada.
- Descubrió que 4,500 de las muestras 'negativas' en el conjunto de datos realmente contenían contraseñas del mundo real, lo que significaba que el modelo estaba siendo entrenado para ignorar secretos. Corregir esto mejoró la recuperación de contraseñas.
El desarrollador ha publicado un informe técnico completo con estadísticas de entrenamiento, ejemplos y un desglose paso a paso del proceso.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

El agente de IA OpenClaw ayuda al equipo a salvar el día de demostración con un prototipo rápido.
Un equipo de desarrollo utilizó el agente de IA de OpenClaw para construir un sitio web de demostración funcional con datos simulados en 10 minutos, después de que su cambio de producto amenazara su participación en el día de demostraciones de South Park Commons.

Cómo reduje los costos de OpenClaw en un 60% mediante el enrutamiento de modelos
Un usuario de OpenClaw redujo los costos de API de $420 a $168 en 20 días al analizar patrones de uso y dirigir tareas a modelos apropiados en lugar de usar Claude Opus para todo. El desglose mostró que el 70% de las tareas eran simples y podían usar modelos más económicos.

Desarrollador construye servidor MCP con Claude Code para automatizar búsqueda de terrenos en Minnesota.
Un desarrollador con experiencia en InfoSec e ingeniería de automatización utilizó Claude Code para construir un servidor Python/FastMCP con 7 herramientas que rastrea Zillow y LandWatch en busca de listados de terrenos rurales en Minnesota. El sistema filtra propiedades según 10 criterios en 21 condados y encontró 29 parcelas únicas en su primera ejecución.

Agente de IA OpenClaw Gestiona el Flujo de Trabajo de Anuncios de LinkedIn con un CTR del 2.65%
Un desarrollador construyó un agente de IA llamado Patrick usando OpenClaw para manejar todo su flujo de trabajo de anuncios de LinkedIn, incluyendo la creación de canalizaciones de datos, generación de copias publicitarias y aprobación mediante una herramienta de revisión personalizada. Un anuncio generado por IA logró una tasa de clics del 2,65%, superando a todos los anuncios manuales.