Анализ цен на модели OpenRouter и эффективности затрат на интеллектуальные возможности

Сравнение интеллекта и цены моделей
Разработчик проанализировал цены API OpenRouter для 16 моделей ИИ и рассчитал показатели интеллекта на доллар, чтобы помочь в выборе моделей для конкретных задач. Метрика интеллекта объединяет семь тестов: Artificial Analysis Intelligence Index, Agentic Index, Coding Index, Artificial Analysis Omnicience Index (перемасштабированный до 0–100), GPDval-AA, Terminal-Bench Hard и t2-Bench Telecom.
Ключевые выводы
Анализ выявил несколько выдающихся моделей:
- Лучший интеллект: GPT-5.4 (58,8 интеллекта, $2,50/М токенов) и Gemini 3.1 Pro (58,6 интеллекта, $2,00/М токенов)
- Лучшее соотношение цены и качества: MiMo-V2-Flash (39,9 интеллекта, $0,09/М токенов, 443 балл ценности)
- Сбалансированные модели: GLM-5, Kimi K2.5 и Gemini 3 Flash
Детали и возможности моделей
Полный набор данных включает:
- MiMo-V2-Flash: 39,9 интеллекта, $0,09/М токенов, 443 ценность, только текст
- Step 3.5 Flash: 34,8 интеллекта, $0,10/М токенов, 348 ценность, общие быстрые текстовые задачи
- Grok 4.1 Fast: 41,2 интеллекта, $0,20/М токенов, 205 ценность, окно контекста 2М, высокая скорость маршрутизации и извлечения
- MiniMax M2.5: 40,3 интеллекта, $0,27/М токенов, 149 ценность, открытый исходный код, отличная производительность в реальных задачах программирования
- DeepSeek V3.2: 34,6 интеллекта, $0,25/М токенов, 138 ценность, сильные возможности в программировании и логике, поддерживает кэширование API
- Kimi K2.5: 45,8 интеллекта, $0,45/М токенов, 101 ценность, окно контекста 262K, широкие общие знания
- Gemini 3 Flash: 47,7 интеллекта, $0,50/М токенов, 95 ценность, мультимодальная с поддержкой аудиоввода
- GLM-4.7: 31,6 интеллекта, $0,38/М токенов, 83 ценность, общая генерация текста
- Qwen 3.5: 41,1 интеллекта, $0,60/М токенов, 68 ценность, сильная общая производительность, универсальная
- GLM-5: 49,5 интеллекта, $0,80/М токенов, 61 ценность, окно контекста 200K, общие знания
- Claude Haiku 4.5: 36,5 интеллекта, $1,00/М токенов, 36 ценность, быстрая и дешёвая, поддержка расширенного мышления
- GPT-5.3: 55,9 интеллекта, $1,75/М токенов, 32 ценность, общие рассуждения и обработка текста
- GPT-5.2: 50,8 интеллекта, $1,75/М токенов, 29 ценность, отлично подходит для программирования + агентных задач
- Gemini 3.1 Pro: 58,6 интеллекта, $2,00/М токенов, 29 ценность, мультимодальный анализ, поддержка вывода изображений
- Grok 4.2 Beta: 49,6 интеллекта, $2,00/М токенов, 25 ценность, сложные рассуждения, широкая база знаний
- GPT-5.4: 58,8 интеллекта, $2,50/М токенов, 24 ценность, переменные уровни контекста (<272K / >272K), рассуждения высшего уровня
- Claude Sonnet 4.6: 52,3 интеллекта, $3,00/М токенов, 17 ценность, рабочая лошадка, обучена по январь 2026
- Claude Opus 4.6: 51,9 интеллекта, $5,00/М токенов, 10 ценность, рассуждения высшего уровня, сильнейшая для программирования и разработки ПО
Примечательные наблюдения
Анализ отмечает, что более умные модели обычно имеют худшие показатели ценности, но это может не отражать реальную эффективность. Например, если Qwen 3.5 использует 500 000 токенов и 30 минут для решения проблемы неправильно, а Sonnet решает её правильно за одну десятую времени, Sonnet может оказаться лучше по соотношению цены и качества, несмотря на более низкий показатель интеллекта на доллар.
Окно контекста в 2М у Grok 4.1 даёт ему прирост интеллекта, который не проявится в большинстве случаев использования. MiniMax 2.5 превосходит его по всем метрикам, кроме окна контекста.
GLM-5 — последняя модель перед значительным падением ценности (с 61 до 36 у Claude Haiku 4.5) и, по сообщениям, почти так же умна, как GPT-5.2.
📖 Read the full source: r/openclaw
👀 Смотрите также

Инструмент командной строки Claude-switch автоматически переключается между аккаунтами Claude Max при достижении лимитов использования.
Разработчик создал claude-switch — CLI-инструмент на bash из 250 строк, который сохраняет и восстанавливает учётные данные Claude Code из macOS Keychain для переключения между аккаунтами при достижении лимитов использования. Инструмент устраняет необходимость повторной аутентификации в браузере и поддерживает непрерывность рабочего процесса.

Обновления CodeLedger и Vibecop для отслеживания затрат и качества кодирования в мультиагентном ИИ
CodeLedger теперь отслеживает расходы на Claude Code, Codex CLI, Cline и Gemini CLI, читая локальные файлы сессий, в то время как Vibecop добавляет автоматические проверки качества с новыми детекторами, специфичными для LLM, и настройкой одной командой для нескольких инструментов ИИ-кодирования.

ClaudeMeter: Приложение с открытым исходным кодом для macOS в строке меню для отслеживания использования Claude в реальном времени
ClaudeMeter — это бесплатное приложение с открытым исходным кодом для macOS, которое размещается в строке меню и предназначено для подписчиков Claude Max. Оно отображает проценты использования за сессию и за неделю, таймеры сброса и индикаторы темпа работы, не прерывая рабочий процесс. Вся программа была создана с помощью Claude (Claude Code/Opus) для кода на Swift, бэкенда на Supabase и Edge Functions.

n8n-mcp-lite: Сервер MCP сокращает использование токенов на 80% для Claude при работе с n8n-воркфлоу
Новый сервер Model Context Protocol с открытым исходным кодом под названием n8n-mcp-lite помогает Клоду анализировать рабочие процессы автоматизации n8n, сокращая использование токенов примерно на 80%. Инструмент решает проблему высокой токенной нагрузки визуальных нод-автоматизаций, предоставляя целевое сканирование рабочих процессов и точечные обновления.