Два сбоя ИИ в одной демонстрации: Claude Code исправляет орфографию вместо ошибки схемы, OpenAI путает сопоставление пользовательских полей

✍️ OpenClawRadar📅 Опубликовано: 1 мая 2026 г.🔗 Source
Два сбоя ИИ в одной демонстрации: Claude Code исправляет орфографию вместо ошибки схемы, OpenAI путает сопоставление пользовательских полей
Ad

Во время семинара в Prismatic инженер в прямом эфире собрал B2B-интеграцию от начала до конца. Два ИИ-инструмента потерпели неудачу по-разному, иллюстрируя, что поведение реальных агентов хаотично и недетерминировано.

Claude Code: Решил не ту проблему

Claude Code за примерно 30 секунд создал каркас мастера настройки с использованием JSON Forms. Сгенерированный мастер выглядел нормально, но во время тестирования всплыла ошибка валидации JSON-схемы — что-то вроде "не должно содержать менее одного элемента". Когда инженер попросил Claude исправить это, агент следующие несколько минут вместо исправления ошибки схемы исправлял предупреждения об орфографии в файле. В конце концов инженер сказал: "надеюсь, это не ограничивается исправлением опечаток" и сдался, вставив код из черновика, сделанного накануне.

OpenAI: Мусор при первой попытке со странными полями

Интеграция вызывает OpenAI во время выполнения, чтобы сгенерировать сопоставления полей по умолчанию между схемой Salesforce клиента и целевым приложением. Для обычного контакта Salesforce (email-to-email, company-to-company) всё работало отлично — "скучно", по словам автора. Но для пользовательского типа записи с намеренно странными именами полей — Group name, Internet address, Physical place, Internet email address — первый вызов вернул мусор. Вторая попытка дала правильный результат.

Ad

Ключевые выводы

  • Скучные схемы недооценивают LLM — при их использовании агенты кажутся излишними. Странные, пользовательские случаи — вот где они проявляют себя, но большинство демонстраций избегают их для простоты.
  • Неудачи вживую полезнее успехов. Любой, кто работал с агентами, знает, что это хаос. Поведение "исправил орфографию вместо ошибки схемы" не предскажешь ни в какой документации.
  • Разные формы неудач: У Claude Code было всё необходимое, но он работал не над той проблемой. OpenAI "знал" ответ, но не выдал его с первого раза. Форма неудачи может подсказать, как развернуть каждый инструмент.

Автор работает в Prismatic, но не поделился ссылкой, сосредоточившись на возможности обучения, а не на саморекламе.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Клиент заменяет DevOps-инженера на ИИ Claude — результат: хаос
Новости

Клиент заменяет DevOps-инженера на ИИ Claude — результат: хаос

Клиент заменил DevOps-инженера на Claude AI для инфраструктуры и разработки функций. Результат: кластер Kubernetes, созданный на основе вибраций, и повторяющиеся сбои, которые были исправлены только откатом изменений Claude.

OpenClawRadar
OpenClaw 2026.4.29 нарушает настройки: скачки ЦП, ограничения инструментов и исправления
Новости

OpenClaw 2026.4.29 нарушает настройки: скачки ЦП, ограничения инструментов и исправления

OpenClaw 2026.4.29 вызывает скачки нагрузки CPU из-за активного управления очередями, ограниченные профили инструментов ломают команды exec/fs, а также ужесточение обработки групповых чатов. Откатитесь или примените точечные исправления.

OpenClawRadar
Исследование динамичного мира движущихся машин
Новости

Исследование динамичного мира движущихся машин

Узнайте, как агенты программирования на основе ИИ трансформируют отрасль в последней дискуссии из технологического сообщества. Узнайте точку зрения OpenClawRadar, поскольку мы подчеркиваем ключевые аспекты этой развивающейся технологии.

OpenClawRadar
Claude Code v2.1.211: Пересылка текста субагентом, исправления разрешений и изменения в режиме Vim
Новости

Claude Code v2.1.211: Пересылка текста субагентом, исправления разрешений и изменения в режиме Vim

Claude Code v2.1.211 добавляет флаг --forward-subagent-text, исправляет спуфинг предпросмотра разрешений, улучшает переопределение модели суб-агентов и обновляет Vim s/S для работы в режиме NORMAL.

OpenClawRadar