Пользователь Reddit сравнивает Claude Sonnet 4.6 и GPT-5 по 10 задачам для ведения блога.

Пользователь Reddit провёл прямое сравнение между Claude Sonnet 4.6 и GPT-5, протестировав обе модели на одних и тех же 10 промптах для блога без дополнительных инструкций или системных промптов.
Методология тестирования
Тестировщик использовал Claude в качестве основного инструмента для письма, но хотел объективно сравнить производительность. Он запустил обе модели на одних и тех же 10 промптах в один день, используя только сырой вывод без дополнительных инструкций.
Протестированные задачи
- Зацепляющий/вводный абзац
- Полный пост в блоге на 800 слов
- Перефразирование скучного корпоративного абзаца
- Написание раздела от первого лица "Моё мнение"
- Введение к сравнительной таблице
- Мета-описание (до 155 символов)
- Объяснение RAG полному новичку
- Раздел FAQ (5 вопросов)
- Статья-список ("7 вещей, о которых большинство людей не знает о Claude")
- Заключение с мягким призывом к действию (CTA)
Ключевой вывод
Наиболее полезным результатом теста оказалась разница во времени редактирования между выводами двух моделей. Это говорит о различиях в том, сколько пост-генерационного редактирования требовалось для ответов каждой модели.
Для разработчиков, использующих AI-агентов для кодинга, такое практическое сравнение предоставляет конкретные данные о том, какая модель может требовать меньше времени на редактирование для различных типов задач генерации контента.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Cursor's Composer 2.0, судя по данным конечной точки API, использует модель Kimi 2.5.
Анализ сетевого трафика показывает, что Cursor's Composer 2.0 отправляет запросы на конечную точку, содержащую 'kimi-k2p5-rl-0317-s515-fast', что указывает на использование Kimi 2.5 в качестве основы. Модифицированная лицензия MIT, согласно сообщениям, требует указания авторства, но налагает минимальные другие обязательства.

ИИ-агенты убивают ревью кода — объяснение проблемы «принципал-агент»
Внедрение AI-агентов в традиционный процесс проверки кода удваивает нагрузку на ревью, разрушает сигналы доверия и создает неустойчивый дисбаланс — это проблема принципала-агента в применении к разработке ПО.
Настройки системы Claude Code v2.1.139: Документация платформы Claude на AWS, безопасность обобщения, инструменты PowerShell
CC 2.1.139 (+2 248 токенов): добавлены справочные документы Claude Platform на AWS с аутентификацией SigV4, безопасное обобщение разговоров с сохранением инструкций, таблица соответствия команд Unix и PowerShell, а также ряд улучшений навыков и промптов.

Anthropic отреагировала на утечку кода, связанную с ИИ-агентом Claude
Anthropic работает над сдерживанием утечки кода, связанного с его ИИ-агентом Claude, согласно отчету WSJ, обсуждавшемуся на Hacker News с 13 баллами и 6 комментариями.