OmniCoder-9Bのファインチューニングは、8GB VRAMシステム上でのエージェント型コーディングにおいて優れたパフォーマンスを示しています。

✍️ OpenClawRadar📅 公開日: March 13, 2026🔗 Source
OmniCoder-9Bのファインチューニングは、8GB VRAMシステム上でのエージェント型コーディングにおいて優れたパフォーマンスを示しています。
Ad

OpenCodeでのOmniCoder-9Bテストのパフォーマンス結果

r/LocalLLaMAのユーザーが、OpusトレースでトレーニングされたQwen3.5-9Bのファインチューニング版であるOmniCoder-9Bをテストし、限られたVRAMのシステムでもエージェント型コーディングタスクで良好なパフォーマンスを発揮することを報告しました。このモデルはHugging FaceのTesslate/OmniCoder-9Bで利用可能です。

技術的セットアップと構成

ユーザーはik_llamaを使用してQ4_K_M GGUF量子化を以下のコマンドで実行しました:

ik_llama.cpp\build\bin\Release\llama-server.exe -m models/Tesslate/OmniCoder-9B-GGUF/omnicoder-9b-q4_k_m.gguf -ngl 999 -fa 1 -b 2048 -ub 512 -t 8 -c 100000 -ctk f16 -ctv q4_0 --temp 0.4 --top-p 0.95 --top-k 20 --presence-penalty 0.0 --jinja --ctx-checkpoints 0

この構成で約毎秒40トークンの速度を達成しました。ユーザーは、64,000コンテキスト長のQ5_KS量子化でも同様の速度が得られると指摘しています。

Ad

OpenCodeの構成

テストに使用されたOpenCodeの構成:

"local": { "models": { "/models/Tesslate/OmniCoder-9B-GGUF/omnicoder-9b-q4_k_m.gguf": { "interleaved": { "field": "reasoning_content" }, "limit": { "context": 100000, "output": 32000 }, "name": "omnicoder-9b-q4_k_m", "reasoning": true, "temperature": true, "tool_call": true } }, "npm": "@ai-sdk/openai-compatible", "options": { "baseURL": "http://localhost:8080/v1" } }

ユーザーは、完全なプロンプトの再処理を引き起こす可能性のあるバグについて調査中であると述べています。

背景と比較

このテストは、商用AIコーディングツールのクォータ制限と価格変更に関する懸念から動機づけられました。ユーザーは特に8GB VRAMを所有しており、これは通常、エージェント型コーディングに適した速度で能力のあるオープンソースモデルを実行する能力を制限します。MOEモデルはより優れたパフォーマンスを提供する可能性があるが、速度は大幅に遅いと指摘しています。

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

タイトル:SimplePDF Copilot: クライアントサイドAIツールによるPDFフォーム記入支援
Tools

タイトル:SimplePDF Copilot: クライアントサイドAIツールによるPDFフォーム記入支援

SimplePDF Copilot はクライアントサイドのツール呼び出しを使用して、LLM に PDF のフィールド入力、フィールド追加、ページ削除などを実行させます。PDF はブラウザから離れることはありません。

OpenClawRadar
Memex:Claude Cowork用オープンソースメモリプラグイン
Tools

Memex:Claude Cowork用オープンソースメモリプラグイン

Memexは、階層化されたコンテキスト読み込みシステムを使用して、Claude Coworkにセッションをまたいだ永続的なメモリを提供するオープンソースプラグインです。/memex:initを一度実行すると、Claudeはセッションごとに約20秒で自己ブリーフィングを行い、前回の続きから作業を開始します。

OpenClawRadar
AMD R9700上でVS Code Copilotを使用してQwen3.6-35B-A3B-UD-Q5_K_XLをローカル実行
Tools

AMD R9700上でVS Code Copilotを使用してQwen3.6-35B-A3B-UD-Q5_K_XLをローカル実行

あるユーザーが、Qwen3.6-35B-A3B-UD-Q5_K_XL を AMD R9700 1枚と Vulkan を使って llama.cpp で動作させ、最小限のプロンプトで完全なウェブサイトと Playwright テストを生成した事例をシェアしています。

OpenClawRadar
Sandbox0: AIエージェントのためのオープンソースKubernetesネイティブサンドボックスインフラストラクチャ
Tools

Sandbox0: AIエージェントのためのオープンソースKubernetesネイティブサンドボックスインフラストラクチャ

Sandbox0は、JuiceFSによる永続ストレージと自動スケーリングを備えたKubernetes上に構築された、AIエージェント向けのオープンソースサンドボックスインフラストラクチャです。既存ソリューションに見られる同時実行数の制限や一時的な実行といった課題に対応しています。

OpenClawRadar