Réglage Fin Local de Llama 3.2-1B pour la Détection de Secrets Surpasse le Modèle de Wiz

Un développeur a documenté son ajustement fin local réussi de Llama 3.2-1B pour la détection de secrets dans le code, dépassant les métriques d'un modèle similaire de Wiz. Le projet a été mené entièrement avec des outils d'IA locaux, évitant les API propriétaires.
Résultats clés et approche
Le développeur visait à répliquer ou à surpasser les résultats de Wiz de 86 % de précision et 82 % de rappel. Après quelques week-ends de travail, il a atteint 88 % de précision et 84,4 % de rappel simultanément avec un modèle Llama 3.2-1B ajusté finement. Il a également évalué les modèles Qwen 3.5-2B et 4B, qui ont surpassé le modèle 1B au prix d'une utilisation de VRAM plus élevée et de temps d'inférence plus longs.
Ensemble de données et processus d'entraînement
Le travail s'est appuyé uniquement sur des données publiquement disponibles, qui étaient insuffisantes, donc une génération procédurale a été utilisée pour augmenter et améliorer l'ensemble de données. Tout l'étiquetage a été effectué localement en utilisant le modèle Qwen3-Coder-Next. Un objectif d'entraînement clé était que les modèles produisent du JSON structuré. Initialement, les modèles non entraînés (Llama & Qwen) ont obtenu 0 % de conformité au schéma, mais après l'entraînement, cela s'est amélioré à 98-100 %.
Défis et apprentissages
Le développeur a rencontré plusieurs problèmes pendant le processus :
- Inclusion d'une classe à haute entropie qui était préjudiciable à l'entraînement ; celle-ci a été identifiée et supprimée.
- Découverte que 4 500 des échantillons « négatifs » dans l'ensemble de données contenaient en réalité des mots de passe du monde réel, ce qui signifiait que le modèle était entraîné à ignorer les secrets. Corriger cela a amélioré le rappel sur les mots de passe.
Le développeur a publié un compte rendu technique complet avec des statistiques d'entraînement, des exemples et une analyse étape par étape du processus.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Flux de Travail de Claude pour le Développement Backend par les Développeurs d'Entreprise
Un développeur backend d'une grande société financière américaine partage son flux de travail avec Claude : fournir des descriptions détaillées des tâches avec spécifications et documents internes, utiliser Claude pour créer un document markdown fonctionnel, puis employer un agent de revue de code avec des directives de style organisationnelles.

Claude Code Agent IA Contrôle un iPhone Physique via les API d'Accessibilité
Un développeur a démontré Claude Code fonctionnant de manière autonome sur un iPhone physique via l'application Mac Blitz, utilisant WebDriverAgent et les API d'accessibilité avec une astuce de balayage à distance nulle pour les appuis.

Claude + Remotion : Créer une vidéo de lancement de produit sans aucune compétence en animation
Un développeur a utilisé la connaissance approfondie de Claude sur l'API de Remotion pour créer une vidéo de lancement de produit animée de 30 secondes pour une application boursière — sans transitions CSS, avec physique à ressort, effets de machine à écrire et animations décalées sur 10 fichiers de scène.

Mémoire de master rédigé principalement avec Claude : un étudiant en économie obtient la meilleure note
Un étudiant en économie a utilisé Claude pour la revue de littérature, l'analyse de données avec des scripts Python et Excel, et la présentation — a obtenu une note proche du niveau doctorat. L'annexe mentionnait l'utilisation de l'IA, aucune question posée.