Детерминированная vs вероятностная генерация кода: почему конверсия Bun в Rust через Vibe-Coding вызывает тревогу

✍️ OpenClawRadar📅 Опубликовано: 20 мая 2026 г.🔗 Source
Детерминированная vs вероятностная генерация кода: почему конверсия Bun в Rust через Vibe-Coding вызывает тревогу
Ad

Ной Холл, пишущий для The Tech Enabler, проводит четкую границу между детерминированной и вероятностной генерацией кода. В качестве предостережения он использует недавнюю конвертацию миллионной кодовой базы Bun с Zig на Rust, выполненную в стиле «vibe coding». Его главный аргумент: детерминированные системы дают согласованные, проверяемые результаты; LLM вносят неопределенность, делающую проверку кода в масштабе невозможной.

Детерминированная генерация кода

Холл указывает на устоявшиеся детерминированные инструменты: Python 2to3 для миграции с Python 2 на 3, и транспиляторы для таких языков, как Elm, PureScript и TypeScript, которые всегда выдают одинаковый JavaScript. Его собственный язык Derw может выводить JavaScript, TypeScript или английский; Tegan выводит JavaScript или Go; Mojie нацелен на JavaScript, Python или английский. Все они основаны на AST-to-AST трансформации — при одинаковом входе вы всегда получаете одинаковый выход. Согласованность имеет значение: «Если баг согласован, мы можем его исправить. Если баг несогласован, его исправление становится экспоненциально сложнее».

Ad

Вероятностная генерация кода

LLM каждый раз выдают разный результат — иногда A, иногда B. Три года назад Холл создал neuro-lingo как пародию: люди пишут только сигнатуры функций и комментарии, а LLM генерируют реализацию заново при каждой компиляции. Пример:

function add(a: number, b: number): number {
  // Сложить два числа
}
function main() {
  // Вывести "Hello World" в консоль
  // Вывести результат add(2, 3)
}

«Каждый раз, когда компилируется neuro-lingo, код генерируется заново LLM. Он каждый раз немного отличается. Иногда вносит баги. Иногда он чистый и простой. Иногда хаотичный». Холл утверждает, что полностью управляемые ИИ потоки кода делают именно это, но отправляют в продакшн с ответственностью на человеке.

Ловушка «у нас есть тесты»

Одних тестов недостаточно для гарантии качества. Холл приводит SQLite как самую протестированную кодовую базу: 155,8 KSLOC кода на C против 92 053,1 KSLOC тестового кода (в 590 раз больше). Несмотря на 100% покрытие ветвей, миллионы тестовых случаев и обширные обвязки, SQLite все равно полагается на проверку человеком. «Невозможно проверить 1 миллион строк изменений за 9 дней. Bun не проверял код, который они слили в master».

Холл заключает, что детерминированная генерация кода все равно требует валидации, а вероятностная генерация создает риск, масштабируемый с количеством строк. Исходная статья глубже раскрывает каждый пример.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

🦀
Новости

Deloitte признает, что ИИ написал части отчета для совета Веллингтона, но настаивает на выводах

Мэр Веллингтона сообщил, что «большие куски» отчёта Deloitte стоимостью 435 000 долларов были написаны искусственным интеллектом. В отчёте утверждалось о 330 лишних сотрудниках, но ошибки в данных выявили ошибочные предположения.

OpenClawRadar
Бенчмарк торговых стратегий: Более дешёвые модели ИИ превосходят Claude Opus 4.6
Новости

Бенчмарк торговых стратегий: Более дешёвые модели ИИ превосходят Claude Opus 4.6

В ходе тестирования 10 крупных языковых моделей на разработку торговых стратегий более дешёвые модели, такие как Minimax 2.5 и Gemini 3.1, показали лучшие результаты, чем Claude Opus 4.6, несмотря на его стоимость в 10 раз выше. Эксперимент проводился трижды с одинаковыми результатами.

OpenClawRadar
Claude Code v2.1.51 изменил тарификацию за контекст в 1 млн токенов без уведомления.
Новости

Claude Code v2.1.51 изменил тарификацию за контекст в 1 млн токенов без уведомления.

Обновление Anthropic Claude Code v2.1.51 незаметно изменило тарификацию для контекстных окон в 1 млн токенов на планах Max. Теперь токены контекста свыше 200K обходят лимиты подписки и напрямую списываются как дополнительные расходы, даже когда бюджет подписки ещё не исчерпан.

OpenClawRadar
Anthropic приостанавливает изменение кредитов Claude Agent SDK после отзывов пользователей
Новости

Anthropic приостанавливает изменение кредитов Claude Agent SDK после отзывов пользователей

Anthropic сообщил пользователям по электронной почте, что приостанавливает запланированные изменения, которые перевели бы Agent SDK, claude-p и сторонние приложения на выделенный ежемесячный кредит вместо использования лимитов подписки.

OpenClawRadar