Mac Studio上のDeepSeek v4 Flash:ローカルLLMがコンパイラコードの実際のバグを発見

コンパイラプロジェクトtsz.devに取り組む開発者によると、128GB Mac Studio上でDeepSeek v4 Flashをローカル実行することで、複雑なコードベースの実際のバグを見つけることができるようになりました。わずか5ヶ月前には、このタスクにはClaude(クラウドベース)が必要でした。
ハードウェアとセットアップ
- マシン: 128GB Mac Studio
- モデル: DeepSeek v4 Flash
- ラッパー:
pi-ds4— GitHubのmitsuhikoによる軽量Pythonラッパー
ワークフローの詳細
ユーザーはローカルモデルにコンパイラコードのバグを見つけるよう指示しました。モデルは多くの問題を報告し、ユーザーはそれらが有効なバグ(幻覚ではない)であることを確認しました。現在、それらのバグをClaudeとGPT(有料アカウント)を使用して修正中です。ユーザーは次のように述べています: 「有効と思われるバグを大量に生成してくれました」 — つまり、モデルの出力は実用的であるということです。
開発者は2026年1月1日に同じハードウェアでプロジェクトを開始しましたが、当時のローカルLLMはエラーが多すぎたため、Claudeに依存していました。5ヶ月での改善は劇的であり、現在ではローカル推論が難しいコードベースに対してクラウドサブスクリプションなしで高品質な出力を生成できるようになりました。
重要なポイント
これは、ローカルLLM(特に128GB RAMという比較的手頃なコンシューマーハードウェア上のDeepSeek v4 Flash)が、コンパイラのバグ検出のような専門的なタスクを処理できることを示す現実世界での検証です。開発者は、512GB RAMがあればパフォーマンスがさらに向上すると推測しており、より大規模なモデルや高速な推論によってクラウドAPIとの差がさらに縮まる可能性を示唆しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

Anthropicは、リモートエージェント制御を「ディスパッチ」と「リモートコントロール」に分割し、信頼性の問題を抱えている
AnthropicはOpenClawのコア機能を2つの別々の製品として実装しました:Coworkユーザー向けのDispatchと、Claude Code開発者向けのRemote Controlです。どちらも約10時間後のモバイル接続切断を含む信頼性の問題を抱えています。

リチャード・ドーキンス、AIは意識を持つと結論—専門家らが反論
進化生物学者リチャード・ドーキンスは、AnthropicのClaudeとOpenAIのChatGPTとの長時間の対話の後、AIは意識を持っていると結論付けた。多くの認知科学者はこれに強く反対し、擬人化であると指摘している。

AIが既に従来のアカデミアを終わらせた——「ボリュームゲーム」の内部
教授が解説:AIが学術界を崩壊させた。学生の課題はAI生成、研究者は1日1本論文、助成金申請は3倍に。ゲームはもう成り立たない。
マイクロソフトのAI収益:70%がOpenAIに依存 — リスク分析
マイクロソフトの提出書類によると、同社のAI収益の約70%がOpenAIからのものだ。ブルームバーグの分析は、OpenAIが年間数十億ドルの損失を計上していることから、この集中リスクを指摘している。