Два сбоя ИИ в одной демонстрации: Claude Code исправляет орфографию вместо ошибки схемы, OpenAI путает сопоставление пользовательских полей

Во время семинара в Prismatic инженер в прямом эфире собрал B2B-интеграцию от начала до конца. Два ИИ-инструмента потерпели неудачу по-разному, иллюстрируя, что поведение реальных агентов хаотично и недетерминировано.
Claude Code: Решил не ту проблему
Claude Code за примерно 30 секунд создал каркас мастера настройки с использованием JSON Forms. Сгенерированный мастер выглядел нормально, но во время тестирования всплыла ошибка валидации JSON-схемы — что-то вроде "не должно содержать менее одного элемента". Когда инженер попросил Claude исправить это, агент следующие несколько минут вместо исправления ошибки схемы исправлял предупреждения об орфографии в файле. В конце концов инженер сказал: "надеюсь, это не ограничивается исправлением опечаток" и сдался, вставив код из черновика, сделанного накануне.
OpenAI: Мусор при первой попытке со странными полями
Интеграция вызывает OpenAI во время выполнения, чтобы сгенерировать сопоставления полей по умолчанию между схемой Salesforce клиента и целевым приложением. Для обычного контакта Salesforce (email-to-email, company-to-company) всё работало отлично — "скучно", по словам автора. Но для пользовательского типа записи с намеренно странными именами полей — Group name, Internet address, Physical place, Internet email address — первый вызов вернул мусор. Вторая попытка дала правильный результат.
Ключевые выводы
- Скучные схемы недооценивают LLM — при их использовании агенты кажутся излишними. Странные, пользовательские случаи — вот где они проявляют себя, но большинство демонстраций избегают их для простоты.
- Неудачи вживую полезнее успехов. Любой, кто работал с агентами, знает, что это хаос. Поведение "исправил орфографию вместо ошибки схемы" не предскажешь ни в какой документации.
- Разные формы неудач: У Claude Code было всё необходимое, но он работал не над той проблемой. OpenAI "знал" ответ, но не выдал его с первого раза. Форма неудачи может подсказать, как развернуть каждый инструмент.
Автор работает в Prismatic, но не поделился ссылкой, сосредоточившись на возможности обучения, а не на саморекламе.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Клиент заменяет DevOps-инженера на ИИ Claude — результат: хаос
Клиент заменил DevOps-инженера на Claude AI для инфраструктуры и разработки функций. Результат: кластер Kubernetes, созданный на основе вибраций, и повторяющиеся сбои, которые были исправлены только откатом изменений Claude.

OpenClaw 2026.4.29 нарушает настройки: скачки ЦП, ограничения инструментов и исправления
OpenClaw 2026.4.29 вызывает скачки нагрузки CPU из-за активного управления очередями, ограниченные профили инструментов ломают команды exec/fs, а также ужесточение обработки групповых чатов. Откатитесь или примените точечные исправления.

Исследование динамичного мира движущихся машин
Узнайте, как агенты программирования на основе ИИ трансформируют отрасль в последней дискуссии из технологического сообщества. Узнайте точку зрения OpenClawRadar, поскольку мы подчеркиваем ключевые аспекты этой развивающейся технологии.

Claude Code v2.1.211: Пересылка текста субагентом, исправления разрешений и изменения в режиме Vim
Claude Code v2.1.211 добавляет флаг --forward-subagent-text, исправляет спуфинг предпросмотра разрешений, улучшает переопределение модели суб-агентов и обновляет Vim s/S для работы в режиме NORMAL.