Анализ цен на модели OpenRouter и эффективности затрат на интеллектуальные возможности

✍️ OpenClawRadar📅 Опубликовано: 15 марта 2026 г.🔗 Source
Анализ цен на модели OpenRouter и эффективности затрат на интеллектуальные возможности
Ad

Сравнение интеллекта и цены моделей

Разработчик проанализировал цены API OpenRouter для 16 моделей ИИ и рассчитал показатели интеллекта на доллар, чтобы помочь в выборе моделей для конкретных задач. Метрика интеллекта объединяет семь тестов: Artificial Analysis Intelligence Index, Agentic Index, Coding Index, Artificial Analysis Omnicience Index (перемасштабированный до 0–100), GPDval-AA, Terminal-Bench Hard и t2-Bench Telecom.

Ключевые выводы

Анализ выявил несколько выдающихся моделей:

  • Лучший интеллект: GPT-5.4 (58,8 интеллекта, $2,50/М токенов) и Gemini 3.1 Pro (58,6 интеллекта, $2,00/М токенов)
  • Лучшее соотношение цены и качества: MiMo-V2-Flash (39,9 интеллекта, $0,09/М токенов, 443 балл ценности)
  • Сбалансированные модели: GLM-5, Kimi K2.5 и Gemini 3 Flash

Детали и возможности моделей

Полный набор данных включает:

  • MiMo-V2-Flash: 39,9 интеллекта, $0,09/М токенов, 443 ценность, только текст
  • Step 3.5 Flash: 34,8 интеллекта, $0,10/М токенов, 348 ценность, общие быстрые текстовые задачи
  • Grok 4.1 Fast: 41,2 интеллекта, $0,20/М токенов, 205 ценность, окно контекста 2М, высокая скорость маршрутизации и извлечения
  • MiniMax M2.5: 40,3 интеллекта, $0,27/М токенов, 149 ценность, открытый исходный код, отличная производительность в реальных задачах программирования
  • DeepSeek V3.2: 34,6 интеллекта, $0,25/М токенов, 138 ценность, сильные возможности в программировании и логике, поддерживает кэширование API
  • Kimi K2.5: 45,8 интеллекта, $0,45/М токенов, 101 ценность, окно контекста 262K, широкие общие знания
  • Gemini 3 Flash: 47,7 интеллекта, $0,50/М токенов, 95 ценность, мультимодальная с поддержкой аудиоввода
  • GLM-4.7: 31,6 интеллекта, $0,38/М токенов, 83 ценность, общая генерация текста
  • Qwen 3.5: 41,1 интеллекта, $0,60/М токенов, 68 ценность, сильная общая производительность, универсальная
  • GLM-5: 49,5 интеллекта, $0,80/М токенов, 61 ценность, окно контекста 200K, общие знания
  • Claude Haiku 4.5: 36,5 интеллекта, $1,00/М токенов, 36 ценность, быстрая и дешёвая, поддержка расширенного мышления
  • GPT-5.3: 55,9 интеллекта, $1,75/М токенов, 32 ценность, общие рассуждения и обработка текста
  • GPT-5.2: 50,8 интеллекта, $1,75/М токенов, 29 ценность, отлично подходит для программирования + агентных задач
  • Gemini 3.1 Pro: 58,6 интеллекта, $2,00/М токенов, 29 ценность, мультимодальный анализ, поддержка вывода изображений
  • Grok 4.2 Beta: 49,6 интеллекта, $2,00/М токенов, 25 ценность, сложные рассуждения, широкая база знаний
  • GPT-5.4: 58,8 интеллекта, $2,50/М токенов, 24 ценность, переменные уровни контекста (<272K / >272K), рассуждения высшего уровня
  • Claude Sonnet 4.6: 52,3 интеллекта, $3,00/М токенов, 17 ценность, рабочая лошадка, обучена по январь 2026
  • Claude Opus 4.6: 51,9 интеллекта, $5,00/М токенов, 10 ценность, рассуждения высшего уровня, сильнейшая для программирования и разработки ПО
Ad

Примечательные наблюдения

Анализ отмечает, что более умные модели обычно имеют худшие показатели ценности, но это может не отражать реальную эффективность. Например, если Qwen 3.5 использует 500 000 токенов и 30 минут для решения проблемы неправильно, а Sonnet решает её правильно за одну десятую времени, Sonnet может оказаться лучше по соотношению цены и качества, несмотря на более низкий показатель интеллекта на доллар.

Окно контекста в 2М у Grok 4.1 даёт ему прирост интеллекта, который не проявится в большинстве случаев использования. MiniMax 2.5 превосходит его по всем метрикам, кроме окна контекста.

GLM-5 — последняя модель перед значительным падением ценности (с 61 до 36 у Claude Haiku 4.5) и, по сообщениям, почти так же умна, как GPT-5.2.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Инструмент командной строки Claude-switch автоматически переключается между аккаунтами Claude Max при достижении лимитов использования.
Инструменты

Инструмент командной строки Claude-switch автоматически переключается между аккаунтами Claude Max при достижении лимитов использования.

Разработчик создал claude-switch — CLI-инструмент на bash из 250 строк, который сохраняет и восстанавливает учётные данные Claude Code из macOS Keychain для переключения между аккаунтами при достижении лимитов использования. Инструмент устраняет необходимость повторной аутентификации в браузере и поддерживает непрерывность рабочего процесса.

OpenClawRadar
Обновления CodeLedger и Vibecop для отслеживания затрат и качества кодирования в мультиагентном ИИ
Инструменты

Обновления CodeLedger и Vibecop для отслеживания затрат и качества кодирования в мультиагентном ИИ

CodeLedger теперь отслеживает расходы на Claude Code, Codex CLI, Cline и Gemini CLI, читая локальные файлы сессий, в то время как Vibecop добавляет автоматические проверки качества с новыми детекторами, специфичными для LLM, и настройкой одной командой для нескольких инструментов ИИ-кодирования.

OpenClawRadar
ClaudeMeter: Приложение с открытым исходным кодом для macOS в строке меню для отслеживания использования Claude в реальном времени
Инструменты

ClaudeMeter: Приложение с открытым исходным кодом для macOS в строке меню для отслеживания использования Claude в реальном времени

ClaudeMeter — это бесплатное приложение с открытым исходным кодом для macOS, которое размещается в строке меню и предназначено для подписчиков Claude Max. Оно отображает проценты использования за сессию и за неделю, таймеры сброса и индикаторы темпа работы, не прерывая рабочий процесс. Вся программа была создана с помощью Claude (Claude Code/Opus) для кода на Swift, бэкенда на Supabase и Edge Functions.

OpenClawRadar
n8n-mcp-lite: Сервер MCP сокращает использование токенов на 80% для Claude при работе с n8n-воркфлоу
Инструменты

n8n-mcp-lite: Сервер MCP сокращает использование токенов на 80% для Claude при работе с n8n-воркфлоу

Новый сервер Model Context Protocol с открытым исходным кодом под названием n8n-mcp-lite помогает Клоду анализировать рабочие процессы автоматизации n8n, сокращая использование токенов примерно на 80%. Инструмент решает проблему высокой токенной нагрузки визуальных нод-автоматизаций, предоставляя целевое сканирование рабочих процессов и точечные обновления.

OpenClawRadar