Ajuste Local Fino do Llama 3.2-1B para Detecção de Segredos Supera o Modelo da Wiz

✍️ OpenClawRadar📅 Publicado: April 16, 2026🔗 Source
Ajuste Local Fino do Llama 3.2-1B para Detecção de Segredos Supera o Modelo da Wiz
Ad

Um desenvolvedor documentou sua bem-sucedida adaptação local do Llama 3.2-1B para detecção de segredos em código, superando as métricas de um modelo similar da Wiz. O projeto foi conduzido inteiramente com ferramentas de IA locais, evitando APIs proprietárias.

Resultados Principais e Abordagem

O desenvolvedor tinha como objetivo replicar ou superar os resultados da Wiz de 86% de precisão e 82% de recall. Após alguns fins de semana de trabalho, eles alcançaram 88% de precisão e 84,4% de recall simultaneamente com um modelo Llama 3.2-1B adaptado. Eles também avaliaram os modelos Qwen 3.5-2B e 4B, que superaram o modelo de 1B ao custo de maior uso de VRAM e tempos de inferência mais longos.

Conjunto de Dados e Processo de Treinamento

O trabalho dependeu exclusivamente de dados publicamente disponíveis, que eram insuficientes, então a geração procedural foi usada para aumentar e melhorar o conjunto de dados. Toda a rotulagem foi feita localmente usando o modelo Qwen3-Coder-Next. Um objetivo de treinamento fundamental era fazer com que os modelos gerassem JSON estruturado. Inicialmente, modelos não treinados (Llama e Qwen) tiveram pontuação de 0% em conformidade com o esquema, mas após o treinamento, isso melhorou para 98-100%.

Ad

Desafios e Aprendizados

O desenvolvedor encontrou vários problemas durante o processo:

  • Incluiu uma classe de alta entropia que foi prejudicial ao treinamento; isso foi identificado e removido.
  • Descobriu que 4.500 das amostras 'negativas' no conjunto de dados realmente continham senhas do mundo real, o que significa que o modelo estava sendo treinado para ignorar segredos. Corrigir isso melhorou o recall em senhas.

O desenvolvedor publicou um relatório técnico completo com estatísticas de treinamento, exemplos e uma explicação passo a passo do processo.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Desafios e Lições do Desenvolvimento de um Sistema de Trading com ML usando Claude
Use Cases

Desafios e Lições do Desenvolvimento de um Sistema de Trading com ML usando Claude

O desenvolvimento de um sistema de trading algorítmico complexo baseado em ML usando o Claude Opus 4.5 revelou problemas de integração com múltiplos motores de ML, enfatizando a importância de uma verificação minuciosa durante o processo de desenvolvimento.

OpenClawRadar
Clonando o harness gerador-avaliador da Anthropic com Kiro CLI: Construção de site em 12 iterações
Use Cases

Clonando o harness gerador-avaliador da Anthropic com Kiro CLI: Construção de site em 12 iterações

Um desenvolvedor replicou o harness Generator-Avaliador multiagente da Anthropic usando Kiro CLI, executando 12 iterações adversariais para construir um site de marketing sem escrever nenhum código manualmente. Principais conclusões incluem contexto compartilhado zero, avaliação visual baseada em Playwright e penalização de padrões genéricos de design de IA.

OpenClawRadar
UPSC StatsBuddy Bot: Interface do Telegram para Dados do Governo Indiano via Claude AI
Use Cases

UPSC StatsBuddy Bot: Interface do Telegram para Dados do Governo Indiano via Claude AI

Um desenvolvedor criou um bot do Telegram chamado UPSC StatsBuddy que se conecta ao servidor MCP do MoSPI da Índia, usando a Claude AI para transformar conjuntos de dados governamentais complexos em respostas claras e citáveis para aspirantes ao UPSC em menos de 30 horas.

OpenClawRadar
Como reduzi os custos do OpenClaw em 60% através do roteamento de modelos
Use Cases

Como reduzi os custos do OpenClaw em 60% através do roteamento de modelos

Um usuário do OpenClaw reduziu os custos de API de US$ 420 para US$ 168 em 20 dias ao analisar padrões de uso e direcionar tarefas para modelos apropriados, em vez de usar o Claude Opus para tudo. A análise mostrou que 70% das tarefas eram simples e poderiam usar modelos mais baratos.

OpenClawRadar