ローカルでのLlama 3.2-1Bのシークレット検出用ファインチューニングがWizのモデルを上回る

ある開発者が、コード内のシークレット検出のためにLlama 3.2-1Bをローカルでファインチューニングすることに成功し、Wizの類似モデルの指標を上回ったことを文書化しました。このプロジェクトは、独自のAPIを一切使用せず、完全にローカルのAIツールで実施されました。
主な成果とアプローチ
開発者は、Wizの結果である86%の精度と82%の再現率を再現または上回ることを目指しました。数週末の作業の後、ファインチューニングされたLlama 3.2-1Bモデルで、88%の精度と84.4%の再現率を同時に達成しました。また、Qwen 3.5-2Bおよび4Bモデルもベンチマークし、これらは1Bモデルを上回る性能を示しましたが、その代償としてVRAM使用量と推論時間が増加しました。
データセットとトレーニングプロセス
この作業は、公開されているデータのみに依存しましたが、それだけでは不十分だったため、手続き的生成を用いてデータセットを拡張・改善しました。すべてのラベリングは、Qwen3-Coder-Nextモデルを使用してローカルで行われました。重要なトレーニング目標の一つは、モデルに構造化されたJSONを出力させることでした。初期段階では、未トレーニングのモデル(LlamaおよびQwen)はスキーマ準拠性で0%のスコアでしたが、トレーニング後には98-100%に改善しました。
課題と学び
開発者は、このプロセス中にいくつかの問題に直面しました:
- トレーニングに有害な高エントロピークラスが含まれていたため、これを特定して削除しました。
- データセット内の「ネガティブ」サンプル4,500件に実際の実世界のパスワードが含まれていることが判明し、モデルがシークレットを無視するようにトレーニングされていたことが分かりました。これを修正することで、パスワードの再現率が向上しました。
開発者は、トレーニング統計、例、プロセスのステップバイステップの詳細を含む完全な技術文書を公開しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

オープンクローが自らの環境を改善させることで持続可能なワークスペースが生まれる仕組み
経験豊富なOpenClawユーザーは、エージェントが自らの内部ドキュメントを更新し、操作ファイルを編集し、プロンプトを洗練させ、カスタムツールを構築し、スクリプトを書き、教訓を文書化することを許可することから、最大の生産性向上が得られたと発見しました。彼らのワークスペース構造には、行動スタイルのためのSOUL.md、運用規則のためのAGENTS.md、軽量なインデックスとしてのMEMORY.mdといった主要なマークダウンファイルが含まれています。

OpenClawエージェント構造:5つのコアファイルと3つの実用ケース
OpenClawのユーザーが、すべてのエージェントが5つのコアファイル(User、Soul、Agent、Tools、Identity)から構築されていることを発見しました。彼らは、日次AIブリーフィング集約ツール、子供向け数学コーチ、YouTubeショート動画生成ツールを含む3つの実用的なエージェントを共有しました。

UPSC StatsBuddy Bot:Claude AIを介したインド政府データのためのTelegramインターフェース
開発者が、インドのMoSPI MCPサーバーに接続する「UPSC StatsBuddy」というTelegramボットを構築しました。Claude AIを使用して複雑な政府データセットを明確で引用可能な回答に変換し、UPSC志望者に30時間以内で提供します。

コピペからワークスペース統合へ:開発者が経験するAIコーディングの進化
ある開発者が、幻覚ライブラリや文脈管理の問題を抱えた初期のChatGPTでのコーディング試行から、ファイルを直接読み取るClaude Codeのワークスペース統合への移行を説明しています。これにより、手動での文脈再構築が不要になりました。