Опасно пропускать чтение кода: когда LLM пишут код быстрее, чем вы можете его прочитать

✍️ OpenClawRadar📅 Опубликовано: 24 мая 2026 г.🔗 Source
Опасно пропускать чтение кода: когда LLM пишут код быстрее, чем вы можете его прочитать
Ad

Предпосылка проста: что, если мы вообще перестанем читать код, сгенерированный LLM? Относиться к нему как к ассемблеру, байт-коду или транспилированному JavaScript — исходный код на высокоуровневом языке становится еще одной формой машинного кода. Эта идея взята из отчета ретрита Thoughtworks и поста в блоге Факундо Олано.

Почему это имеет смысл

LLM выдают недетерминированный вывод и генерируют код намного быстрее, чем человек может его прочитать. Проверять каждый diff больше нецелесообразно. Вместо того чтобы отказываться от строгости, перенесите ее в другое место: в спецификации и тесты.

Организационное условие

Это решение не для отдельного разработчика или команды — оно должно быть принято на уровне организации. Применим закон Амдала: максимальное ускорение генерации кода без реструктуризации процессов не дает реального прироста. Нельзя, чтобы одни разработчики выдавали по 20 тысяч строк мусора в день, а другие все еще читали и утверждали его.

Требования включают:

  • Убрать человека из цикла, сократить согласования и бюрократию
  • Практически бесконечный поток требований, инженеры автономно владеют своими потоками работы
  • Переделка почти бесплатна, поэтому не предотвращайте неверную работу — выявляйте ее через спецификации/тесты
Ad

Предлагаемый рабочий процесс

Используйте стандартизированную спецификацию в Markdown как новую единицу знаний. Владельцы продукта и инженеры совместно работают над спецификацией и тестовыми сценариями для бизнес-правил. Заносите их в репозиторий вместе с реализующим кодом.

Автоматические проверки пул-реквеста верифицируют:

  • Тесты проходят
  • Код соответствует спецификации

Спецификация — а не код — это то, что команда понимает, проверяет и за что отвечает.

Ключевое различие

Спецификации — это не промпты. Тесты — не TDD. Речь идет о переносе строгости на уровень контракта, а не на уровень реализации.

📖 Читать источник: HN AI Agents

Ad

👀 Смотрите также

Сравнение бенчмарков Qwen3.6 Plus с западными моделями SOTA
Новости

Сравнение бенчмарков Qwen3.6 Plus с западными моделями SOTA

Qwen3.6 Plus набирает 78,8 баллов в SWE-bench Verified, 90,4 в GPQA/GPQA Diamond, 28,8 в HLE (без инструментов) и 78,8 в MMMU-Pro, что делает его конкурентоспособным по сравнению с такими моделями, как GPT-5.4, Claude Opus 4.6 и Gemini 3.1 Pro Preview.

OpenClawRadar
Бизнес-стратегия Anthropic: Доходы от API определяют ограничения потребительского уровня
Новости

Бизнес-стратегия Anthropic: Доходы от API определяют ограничения потребительского уровня

Потребительские подписки Anthropic работают в убыток, субсидируются для создания доли рынка в сфере ИИ, в то время как их API-бизнес приносит доход. Уровень Pro за $20 намеренно ограничен, чтобы направлять пользователей к более ценным подпискам Max.

OpenClawRadar
ThermoQA: Открытый эталон для инженерной термодинамики, тестирующий большие языковые модели на 293 расчетных задачах
Новости

ThermoQA: Открытый эталон для инженерной термодинамики, тестирующий большие языковые модели на 293 расчетных задачах

ThermoQA — это открытый бенчмарк с 293 задачами по инженерной термодинамике, разделёнными на три уровня, который проверяет большие языковые модели на точные численные расчёты. Claude Opus 4.6 лидирует с совокупным результатом 94,1%, в то время как DeepSeek-R1 демонстрирует наибольшую вариативность между запусками — ±2,5%.

OpenClawRadar
🦀
Новости

Беспроигрышный коготь конфликтует с OpenClaw 2.0; отключение восстанавливает стабильность длительных задач

Пользователь сообщает, что обновление до OpenClaw 2.0 привело к остановке 8-часовых рабочих процессов. Отключение Lossless Claw восстановило стабильность, но подчеркнуло его важность для длительных задач.

OpenClawRadar