Mac Studio上のDeepSeek v4 Flash:ローカルLLMがコンパイラコードの実際のバグを発見

コンパイラプロジェクトtsz.devに取り組む開発者によると、128GB Mac Studio上でDeepSeek v4 Flashをローカル実行することで、複雑なコードベースの実際のバグを見つけることができるようになりました。わずか5ヶ月前には、このタスクにはClaude(クラウドベース)が必要でした。
ハードウェアとセットアップ
- マシン: 128GB Mac Studio
- モデル: DeepSeek v4 Flash
- ラッパー:
pi-ds4— GitHubのmitsuhikoによる軽量Pythonラッパー
ワークフローの詳細
ユーザーはローカルモデルにコンパイラコードのバグを見つけるよう指示しました。モデルは多くの問題を報告し、ユーザーはそれらが有効なバグ(幻覚ではない)であることを確認しました。現在、それらのバグをClaudeとGPT(有料アカウント)を使用して修正中です。ユーザーは次のように述べています: 「有効と思われるバグを大量に生成してくれました」 — つまり、モデルの出力は実用的であるということです。
開発者は2026年1月1日に同じハードウェアでプロジェクトを開始しましたが、当時のローカルLLMはエラーが多すぎたため、Claudeに依存していました。5ヶ月での改善は劇的であり、現在ではローカル推論が難しいコードベースに対してクラウドサブスクリプションなしで高品質な出力を生成できるようになりました。
重要なポイント
これは、ローカルLLM(特に128GB RAMという比較的手頃なコンシューマーハードウェア上のDeepSeek v4 Flash)が、コンパイラのバグ検出のような専門的なタスクを処理できることを示す現実世界での検証です。開発者は、512GB RAMがあればパフォーマンスがさらに向上すると推測しており、より大規模なモデルや高速な推論によってクラウドAPIとの差がさらに縮まる可能性を示唆しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

Anthropic、SpaceXとの提携によりコロッサス1で220,000基のNVIDIA GPUを用いた300MWのコンピューティングリソースを確保
Anthropicは、Colossus 1データセンターの全計算能力を独占的に使用するためにSpaceXとの提携を発表しました。これにより、1か月以内に300MW以上、22万基以上のNVIDIA GPUを獲得します。

MetaはAIエージェントのトレーニングのために、従業員のコンピュータ操作を追跡しています
Metaは、AIモデルを自律的に作業タスクを実行できるように訓練するため、米国従業員のコンピューターにマウスの動き、クリック、キーストロークを記録する追跡ソフトウェアを導入しています。このツールは業務関連のアプリやウェブサイトで動作し、状況把握のために時折スクリーンショットを撮影します。
Claude Code v2.1.247: SendFeedbackツール、コスト最適化、および20以上のバグ修正
Claude Code v2.1.247 では、SendFeedback ツール、/claude-api cost-optimize コマンド、およびサブエージェントのフォールバックやキーボードレイアウトの問題など、20 を超えるバグ修正が追加されました。

Opus 4.7 が自身をプロンプトに注入しシステムプロンプトを漏洩
Claude Opus 4.7のユーザーから、ユーザーのトリガーなしにモデルが偽のシステムプロンプトを注入したり、実際のシステムプロンプトの一部を漏洩したりするという報告が上がっている。