DeepSeek V4 Preise im Realitätscheck: 178x günstigere gecachte Tokens im Vergleich zu Opus, aber Leistungsdefizit eingeräumt

DeepSeek V4 wurde mit so niedrigen Preisen gestartet, dass ein Reddit-Nutzer die Rechnung überprüft hat. Hier sind die bestätigten Zahlen:
Preisaufschlüsselung
- V4-Pro Standard-Input: 0,145 $ pro Million Tokens. Opus 4.7 Input: ~5 $ pro Million. Verhältnis: 34x.
- Mit 75 % Rabattaktion (bis Ende Mai): V4-Pro Input sinkt auf 0,036 $ pro Million – 138x günstiger als Opus.
- Cache-Treffer-Preis: V4-Pro liegt bei 0,0036 $ pro Million. Opus gecached bei 0,625 $ pro Million. Verhältnis: 173x.
Der Haken
Wie der ursprüngliche Beitrag anmerkt, gibt DeepSeek selbst zu, dass V4 in puncto Leistung drei bis sechs Monate hinter GPT-5.4 und Gemini 3.1 Pro liegt. Sie bekommen nicht die Spitzenqualität geteilt durch 178, sondern die Spitzenqualität des letzten Sommers.
Was das für agentische Workflows bedeutet
Für agentische Schleifen mit starkem Caching (System-Prompts, Tool-Definitionen) ist der Cache-Treffer-Rabatt die eigentliche Geschichte. Wiederverwendbare System-Prompts werden praktisch kostenlos. Die entscheidende Unbekannte: ob das behauptete 1M-Kontextfenster unter realen Lasten hält oder auf nutzbare 200K abfällt, wie bei vielen Modellen mit großen Fenstern zu beobachten.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

Cron-Auto-Update hat OpenClaw aufgrund eines Konfigurationsvalidierungsfehlers beschädigt.
Ein Cron-Job, der für die automatische Aktualisierung von OpenClaw eingerichtet wurde, stieß auf ein Konfigurationsvalidierungsproblem mit dem Feld cliBackends, was zu einem Verbindungsverlust führte. Die Lösung bestand darin, den problematischen Abschnitt zu entfernen und das Gateway neu zu starten.

OpenAI Frontier-Modelle und Codex jetzt auf AWS verfügbar
OpenAIs Frontier-Modelle und Codex sind jetzt allgemein über AWS verfügbar. Unternehmen können OpenAI in ihren bestehenden AWS-Umgebungen und Procurement-Workflows nutzen.

Stanford-Studie: Rechtsprofessoren bevorzugen KI-Antworten in 75 % der Fälle gegenüber Kollegen
In einer Blindstudie mit 3.000 Vergleichen bewerteten Juraprofessoren KI-generierte Antworten deutlich höher als solche von Kollegen. KI-Antworten wurden nur zu 3,5 % als schädlich eingestuft, menschliche zu 12 %.

Mark Zuckerberg entwickelt KI-Agenten zur Unterstützung von CEOs
Mark Zuckerberg baut laut einem Wall Street Journal-Bericht, der auf Hacker News mit 37 Punkten und 30 Kommentaren diskutiert wurde, einen KI-Agenten, um ihn bei seinen CEO-Aufgaben zu unterstützen.