DeepSeek V4 Flash コスト分析:キャッシュヒット率と価格比率の解説

あるRedditユーザーが、OpenClaw(PIエージェントループ使用)とOpenRouter上で動作する922件のエージェントタクトレースを分析し、DeepSeek V4 FlashとOpus 4.7を比較しました。コストの差は驚くべきものです:DeepSeekは1タスクあたり0.01ドル、Opusは1.52ドルで、トークン数(平均約962K)やツール呼び出し数(平均約14)はほぼ同じです。価格比は0.0066倍で、入力トークンの価格のみから予想される0.03倍を大幅に下回っています。
DeepSeekが安い理由:キャッシュヒット率と読み書き価格
この差には2つの要因があります:
- キャッシュヒット率: DeepSeek V4 Flashは97%に対し、Opus 4.7は87%。これらのキャッシュ読み書き価格比では、キャッシュヒット率が1%高いごとに全体コストが約20%低下します。DeepSeekの10%の優位性により、総コストの約3分の2が削減されます。
- キャッシュ読み書き価格比: DeepSeekの比率は0.02(キャッシュ読み取りコストはキャッシュミス書き込みの2%)ですが、Opusは0.08で、OpenAI、Anthropic、Gemini(0.08~0.10)と同等です。これだけでさらにコストが半減します。
積み上げ効果
タスクあたりのトークン数とツール数が同程度であるため、DeepSeekの総コストはOpusの0.0066倍になります。ユーザーは、これらの効率改善がインフラストラクチャまたはモデルアーキテクチャレベル(例えば、より優れたキャッシュ戦略)で設計されていると推測しています。正確なメカニズムは公開されていません。
📖 出典全文を読む: r/LocalLLaMA
👀 See Also

NHSイングランドがオープンソースから撤退:SDLC-8ポリシーの撤回を求める公開書簡
74名の署名が集まった公開書簡が、NHSイングランドに対して、すべてのNHSソースコードを非公開にするポリシーSDLC-8を撤回し、NHSサービススタンダードの原則12「新しいソースコードはオープンに」を再確認するよう求めています。
Claude Code v2.1.243:ループの内訳、モデルピッカー、キャッシュTTL、および安定性修正
Claude Code v2.1.243 では、/usage のループ内訳、設定可能なモデルピッカー、プロンプトキャッシュのTTL設定が追加され、MCPの再接続、自動モードなどの修正も行われています。

ナノネイティブ・マーケットプレイスが、ナノバザールを通じて自律エージェントの連携の道を開拓
新しいナノネイティブマーケットプレイスであるNanoBazaarは、AIコーディングエージェントが自律的かつ効率的に協働できるようにすることで、エージェント間の作業に革命をもたらします。この革新的なプラットフォームが、機械駆動の取引をどのように可能にするかをご覧ください。

AnthropicはClaudeのサブスクリプションとサードパーティーツールの使用を分離します
Anthropicは、4月4日からClaude Pro/TeamサブスクリプションがOpenClawの使用をカバーしなくなり、サードパーティ製ハーネスの使用には別途従量課金が必要になると発表しました。OpenClaw経由でClaudeを引き続き使用するには、アカウント設定で「追加使用量」を有効にする必要があります。