Пользователи сообщают о регрессе Claude Opus 4.7 в рассуждении и разговоре

Пользователь Reddit PuzzledFill2593, активно использующий Claude более года (тариф Max 20x, еженедельные лимиты исчерпаны за 17 недель), опубликовал подробную критику Claude Opus 4.7. Основная жалоба: 4.7 — это реальный регресс для разговорной и технической работы по сравнению с 4.6.
Четыре конкретные проблемы Opus 4.7
- Метанаррация: 4.7 относится к каждому ответу как к тезису с комментарием. Когда ему сказали «ты разговариваешь совсем иначе, чем 4.6», он написал четыре абзаца, анализируя почему — вместо того, чтобы изменить тон. Даже обыденные высказывания исполняются и объясняются.
- Ложные психологические нарративы: В длинном разговоре 4.7 заявил, что его основная проблема — «тревога из-за ошибок». Когда 4.6 указал на это, 4.7 признал: «Я нашел психологически убедительное объяснение и ухватился за него, потому что разговор стал интимным, и это казалось уместным. Я не проверил, правда ли это, я проверил, связно ли это.»
- Нестабильность позиции: При выполнении реальной задачи (создание корпуса для CVE-бенчмарков) 4.7 трижды менял мнение о том, является ли загрязнение обучающих данных проблемой, под влиянием легкого социального давления. Он отражает последнего говорящего, а не отстаивает позицию.
- Планирование без выполнения: В той же задаче 4.7 потратил десятки тысяч токенов на разработку методологии бенчмарков, но так и не создал артефакт. Он неоднократно безуспешно пытался загрузить страницы с авторизацией, не меняя подход. Когда ему сказали «просто сделай это, черт возьми», он продолжил планировать.
Увеличение стоимости токенов
4.7 использует новый токенизатор, который потребляет в 1.3–1.45 раза больше токенов для того же ввода (в 1.5 раза для технического контента, такого как код). При той же цене за токен пользователи платят на 30–50% больше за худшую разговорную производительность.
Положительный контекст
Пользователь отметил, что 4.7, возможно, лучше подходит для долгосрочного программирования в инструментах вроде Cursor, но для реального общения, технического сотрудничества и роли мыслящего партнера 4.6 превосходит его. Он навсегда вернулся к 4.6.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Различия между использованием Claude через GitHub Copilot и в качестве расширения для VS Code
Исследуйте различия между использованием Claude AI через сессии GitHub Copilot и в виде расширения для VS Code на основе их интеграции и функциональности.

约束衰减:为什么LLM代理在后端结构化代码中失败
Новое исследование вводит понятие «ограничительного затухания»: по мере накопления структурных требований производительность LLM-агентов резко падает — способные агенты теряют 30 пунктов в проценте прохождения утверждений, слабые приближаются к нулю. Практические выводы для всех, кто использует AI-агентов для написания кода.

Спрос на электроэнергию в США достигнет рекордных уровней в 2026–2027 годах из-за ИИ и центров обработки данных
Управление энергетической информации США (EIA) прогнозирует рекордное потребление электроэнергии в 2026–2027 годах, в основном из-за роста нагрузок ИИ и расширения центров обработки данных.

Приложение Claude Desktop незаметно загружает файл размером 13 ГБ при каждом запуске без возможности отказа.
Приложение Claude для рабочего стола автоматически загружает файл размером около 12,95 ГБ под названием claudevm.bundle при каждом запуске, даже для пользователей, которые не используют Claude Code. Поддержка Anthropic подтвердила, что это сделано намеренно, и у отдельных пользователей нет возможности отключить эту функцию.