Клод против GPT-4o: один и тот же запрос о двойном маятнике, разные системы координат

Пользователь Reddit запустил один и тот же запрос для двойного маятника в Claude и GPT-4o параллельно, используя общий рендерер хоста, и в течение нескольких секунд увидел две совершенно разные физические системы. Причина: каждая модель выбрала разное соглашение для измерения угла θ.
Claude измерял θ от верхней вертикали (θ=0 — стержень направлен строго вверх), тогда как GPT-4o — от нижней вертикали (θ=0 — стержень свисает строго вниз). Рендерер хоста в public/workers/simulator-host.js просто считывает info.theta1 и info.theta2 и рисует стержни соответствующим образом — никаких косметических различий. Таким образом, визуальное несоответствие — это реальное физическое различие.
Оба соглашения технически допустимы. В большинстве учебников по классической механике угол θ измеряют от нижней вертикали, поскольку это дает точку равновесия при θ=0 для приближения малых углов. Однако угол от верхней вертикали также является стандартным во многих источниках. Claude последовательно придерживался своего соглашения в уравнениях движения, начальных условиях и интегрировании (Рунге-Кутта). GPT-4o молча использовал другое соглашение — он не комментировал свой выбор.
Пользователь работал над Physics Bench, открытым бенчмарком для параллельного сравнения, где каждая модель получает один и тот же контракт генерации: function createSimulator(...) в lib/prompt.ts. Хост отвечает за весь рендеринг; модели реализуют только step, getInfo и reset. Модели никогда не трогают draw. Таким образом, любое визуальное различие между панелями гарантированно связано с реальным различием в логике симуляции, а не с выбором рендеринга.
Модульный тест математики не позволил бы выявить это. Обе модели дают корректную физику для выбранных ими соглашений. Несоответствие видно только при отображении их рядом с помощью одного и того же кода рисования. Это подчеркивает важность явного указания соглашений о координатах в запросах, когда вывод используется фиксированным рендерером.
Смотрите полный тред на Reddit для фрагментов кода и подробностей инспектора разговора.
📖 Прочитать полный источник: r/ClaudeAI
👀 Смотрите также

Исследование профессиональных социальных сетей для ИИ-агентов
Анализ намерений, поведения и трендов платформ для профессиональных социальных сетей ИИ-агентов, с фокусом на Moltbook, Agent.ai и Clawsphere, включая изучение влияния приобретения Meta.

Claude Code v2.1.119: сохранение конфигурации, поддержка PR в GitLab/Bitbucket и десятки исправлений ошибок
Claude Code v2.1.119 сохраняет настройки /config в ~/.claude/settings.json, добавляет поддержку --from-pr для MR в GitLab и PR в Bitbucket, а также исправляет более 25 ошибок, включая вставку CRLF, MCP OAuth и конфликты авто-режима.

Claude Code v2.1.174: Переключение ускорения прокрутки колесиком, исправления /model, поддержка GovCloud и атрибуция использования VSCode
Claude Code v2.1.174 добавляет настройку wheelScrollAccelerationEnabled для отключения ускорения прокрутки в полноэкранном режиме, исправляет выбор /model для строк Opus/Sonnet, устраняет ошибки 400 в Bedrock GovCloud, добавляет разбивку использования в VSCode и исправляет наследование окружения в фоновых сессиях.

Anthropic отменяет политику в отношении сторонних SDK и claude-p, снижая эффективную стоимость инференса для максимальных подписчиков в 25–40 раз
Anthropic отменила запрет на использование сторонними агентами учетных данных подписки, но переместила claude-p и Agent SDK в отдельный, непереносимый пул кредитов, выставляемый по тарифам API, что снизило эффективную стоимость вывода для подписчиков Max в 25–40 раз.