Проверка цен на DeepSeek V4: кэшированные токены в 178 раз дешевле Opus, но признано отставание в возможностях

DeepSeek V4 вышел с такими низкими ценами, что пользователь Reddit проверил расчеты. Вот подтвержденные цифры:
Разбивка цен
- Стандартный ввод V4-Pro: $0.145 за миллион токенов. Ввод Opus 4.7: ~$5 за миллион. Соотношение: 34x.
- С 75% промо-скидкой (до конца мая): ввод V4-Pro снижается до $0.036 за миллион — в 138 раз дешевле Opus.
- Цены при попадании в кеш: V4-Pro — $0.0036 за миллион. Opus с кешем — $0.625 за миллион. Соотношение: 173x.
Подвох
Как отмечается в исходном посте, DeepSeek признает, что V4 на три-шесть месяцев отстает от GPT-5.4 и Gemini 3.1 Pro по возможностям. Вы не получаете качество уровня frontier, разделенное на 178 — вы получаете качество уровня frontier прошлого лета.
Что это значит для агентных рабочих процессов
Для агентных циклов с интенсивным кешированием (системные промпты, определения инструментов) скидка при попадании в кеш — это главная история. Многократно используемые системные промпты становятся практически бесплатными. Ключевой неизвестный фактор: выдержит ли заявленное контекстное окно в 1M токенов реальные нагрузки или деградирует до приемлемых 200K, как это было замечено у многих моделей с большими окнами.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

Harmonic-9B: Двухэтапная дообученная модель Qwen3.5-9B для ИИ-агентов
Разработчик DJLougen выпустил Harmonic-9B — тонкую настройку Qwen3.5-9B, оптимизированную для использования агентами с двухэтапным подходом к обучению. Этап 1 (интенсивное рассуждение) завершён, а Этап 2 (лёгкий вызов инструментов) всё ещё обучается. Квантованные версии GGUF уже доступны.

Суд установил, что МВД Великобритании использовало галлюцинированный ИИ документ для отказа в убежище
Старший судья Великобритании постановил, что Министерство внутренних дел, вероятно, использовало сгенерированное ИИ галлюцинированное доказательство — несуществующую страновую политическую записку — для отказа в предоставлении убежища. Пропавший документ так и не был найден, и судья сравнил эту практику с опорой на ложные доказательства.

Обсуждение искусственного интеллекта на Hacker News смещается с демонстраций на инструменты и инфраструктуру.
Недавние обсуждения искусственного интеллекта на Hacker News смещаются от разовых демонстраций к устойчивым инструментам, таким как отслеживание цен, верификация, память, оценка и интеграция в рабочие процессы. Это сигнализирует о переходе к операционализации, когда сообщества перестают поощрять публикации, ориентированные в первую очередь на новизну.

Стратегия платформы Anthropic и ответ OpenClaw
Разработчик анализирует недавние ограничения Anthropic на внешние интеграции с Claude как преднамеренную платформенную стратегию, утверждая, что следует создавать переносимые стеки вместо того, чтобы полагаться на добрую волю провайдера.