AI написал PHP-движок на Rust, прошел 17% тестов PHP-src, отображает WordPress

Кто-то, не знающий Rust, просто позволил ИИ написать на нём интерпретатор PHP. Результат, Phargo, отображает главную страницу WordPress размером 26 КБ из базы данных SQLite — через движок, не содержащий ни строчки реального исходного кода PHP на C. Это написанный с нуля интерпретатор на Rust, созданный агентом ИИ, где роль человека сводится к запуску тестов, проверке результатов и командам «продолжай» или «регрессия, посмотри ещё».
В эксперименте используется собственный тестовый набор PHP как беспристрастный оракул: около 22 000 файлов .phpt, накопленных за 30 лет, покрывающих всё — от расчётов времени с учётом летнего времени до var_dump() для чисел с плавающей точкой. Текущий процент прохождения: 3 844 из 22 037 (17,4%). Поскольку набор включает тесты расширений C (GD, curl, SOAP, драйверы MySQL), выходящие за рамки проекта, реалистичный предел составляет около 40–45%. Проект стартовал с нуля и прогрессирует через гистограммы ошибок: ИИ определяет крупнейший кластер падающих тестов, реализует исправление, прогоняет все 22 000 тестов (~7 минут) и фиксирует изменения, если результат улучшается — без необходимости ревью кода человеком.
Уроки, извлечённые в процессе
Ранний прогресс застопорился из-за тонкой ошибки: окончания строк. Тестовый корпус был получен на Windows с окончаниями CRLF, а система сравнения выводила результат побайтово, из-за чего все многострочные тесты молча падали. Собственный тестовый раннер PHP нормализует окончания перед сравнением. Одна строка кода нормализации сделала сотни тестов зелёными. Урок: измеряйте свои измерения — ваш оракул настолько честен, насколько честна связка, соединяющая вас с ним.
Ещё одно открытие: некоторые старые регрессионные тесты выделяют абсурдные структуры или раскручиваются в бесконечные генераторы, изначально предназначенные для работы в хорошо изолированной CI-среде PHP. Один такой тест вызвал жёсткую перезагрузку машины разработчика. Теперь проект фильтрует тесты, которые заведомо опасны вне CI.
Цикл разработки
- ИИ строит гистограмму ошибок по всему корпусу, чтобы найти крупнейший исправимый кластер.
- ИИ реализует исправление.
- Система прогоняет все ~22 000 тестов (~7 минут).
- Если число прошедших тестов увеличилось: коммит, пуш, повтор.
- Если уменьшилось: человек говорит «хм, регрессия, посмотри ещё».
Работа человека, по сути, — прицеливание: чтение вывода терминала, как средневековый король просматривает морские карты, а затем ввод самой мощной фразы разработчика: «выглядит хорошо, продолжай».
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

NVIDIA представила процессор Vera для агентных задач искусственного интеллекта
NVIDIA представила процессор Vera CPU, специально разработанный для агентного ИИ и задач обучения с подкреплением. По заявлению компании, он обеспечивает на 50% более высокую производительность и вдвое большую эффективность по сравнению с традиционными процессорами для стоечных систем.

Выпуск Claude Code v2.1.85: Улучшения MCP, фильтры хуков и исправления ошибок
Claude Code v2.1.85 добавляет переменные окружения для MCP headersHelper, условные поля if для хуков, чтобы уменьшить создание процессов, а также исправляет ошибки /compact, проблемы включения/отключения плагинов и проблемы с клавиатурой терминала в Ghostty, Kitty и WezTerm.

Исследование возможности запуска OpenClaw на Chromebook
Запуск OpenClaw на Chromebook может быть проще, чем вы думаете. Наше последнее исследование от OpenClawRadar погружается в пользовательский опыт и требования, чтобы выяснить, могут ли Chromebook справляться с этим ИИ-кодировщиком.

Claude Code v2.1.90 добавляет команду /powerup с игровым подходом к изучению функций.
Claude Code v2.1.90 представляет новую команду /powerup, которая предлагает геймифицированное обучение с 10 разблокируемыми улучшениями, каждое из которых обучает одной функции, которую большинство пользователей упускает. Система включает анимированные демонстрации в терминале и подробную документацию со скриншотами.