Пользователь Reddit сравнивает Claude Sonnet 4.6 и GPT-5 по 10 задачам для ведения блога.

Пользователь Reddit провёл прямое сравнение между Claude Sonnet 4.6 и GPT-5, протестировав обе модели на одних и тех же 10 промптах для блога без дополнительных инструкций или системных промптов.
Методология тестирования
Тестировщик использовал Claude в качестве основного инструмента для письма, но хотел объективно сравнить производительность. Он запустил обе модели на одних и тех же 10 промптах в один день, используя только сырой вывод без дополнительных инструкций.
Протестированные задачи
- Зацепляющий/вводный абзац
- Полный пост в блоге на 800 слов
- Перефразирование скучного корпоративного абзаца
- Написание раздела от первого лица "Моё мнение"
- Введение к сравнительной таблице
- Мета-описание (до 155 символов)
- Объяснение RAG полному новичку
- Раздел FAQ (5 вопросов)
- Статья-список ("7 вещей, о которых большинство людей не знает о Claude")
- Заключение с мягким призывом к действию (CTA)
Ключевой вывод
Наиболее полезным результатом теста оказалась разница во времени редактирования между выводами двух моделей. Это говорит о различиях в том, сколько пост-генерационного редактирования требовалось для ответов каждой модели.
Для разработчиков, использующих AI-агентов для кодинга, такое практическое сравнение предоставляет конкретные данные о том, какая модель может требовать меньше времени на редактирование для различных типов задач генерации контента.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Claude Opus 4.6 Memory Fails: Agent Forgets Everything Except File Rename
Разработчик документирует 228 записей лога, 95 действий агента и 38 выполнений кода от Claude Opus 4.6, которые породили всего одно воспоминание: строку 'Agent Zero Tune-Up'.

Политика Википедии в отношении ИИ: Запрет на использование LLM для создания статей, исключения для редактирования и перевода
Википедия запрещает использование LLM для создания или переписывания статей, за узкими исключениями для базовой корректуры и перевода. Нарушения могут привести к быстрому удалению (G15) и удалению AI-сгенерированных комментариев со страниц обсуждения.
Claude Code v2.1.281: assume_role для Bedrock, Guardrails и длинный список исправлений возобновления
Claude Code v2.1.281 добавляет assume_role для Bedrock-апстримов, guardrails для каждого запроса, телеметрические метки, настройку "attribution": false и исправляет множество ошибок возобновления сессий и проксирования потоков.

Gemma 4: Ранние признаки. Упор на практическое внедрение, а не на хайп, для локальных рабочих процессов с агентами.
Запуск Gemma 4 подчеркивает развертывание на различных уровнях аппаратного обеспечения с официальной позицией для персонального оборудования и периферийных/мобильных устройств, квантование NVIDIA NVFP4 демонстрирует 4-кратное сжатие с сохранением 99,7% базовых показателей на GPQA, а рейтинги Arena помещают плотную модель 31B примерно на 27-е место.