AI написал PHP-движок на Rust, прошел 17% тестов PHP-src, отображает WordPress

✍️ OpenClawRadar📅 Опубликовано: 5 июля 2026 г.🔗 Source
AI написал PHP-движок на Rust, прошел 17% тестов PHP-src, отображает WordPress
Ad

Кто-то, не знающий Rust, просто позволил ИИ написать на нём интерпретатор PHP. Результат, Phargo, отображает главную страницу WordPress размером 26 КБ из базы данных SQLite — через движок, не содержащий ни строчки реального исходного кода PHP на C. Это написанный с нуля интерпретатор на Rust, созданный агентом ИИ, где роль человека сводится к запуску тестов, проверке результатов и командам «продолжай» или «регрессия, посмотри ещё».

В эксперименте используется собственный тестовый набор PHP как беспристрастный оракул: около 22 000 файлов .phpt, накопленных за 30 лет, покрывающих всё — от расчётов времени с учётом летнего времени до var_dump() для чисел с плавающей точкой. Текущий процент прохождения: 3 844 из 22 037 (17,4%). Поскольку набор включает тесты расширений C (GD, curl, SOAP, драйверы MySQL), выходящие за рамки проекта, реалистичный предел составляет около 40–45%. Проект стартовал с нуля и прогрессирует через гистограммы ошибок: ИИ определяет крупнейший кластер падающих тестов, реализует исправление, прогоняет все 22 000 тестов (~7 минут) и фиксирует изменения, если результат улучшается — без необходимости ревью кода человеком.

Ad

Уроки, извлечённые в процессе

Ранний прогресс застопорился из-за тонкой ошибки: окончания строк. Тестовый корпус был получен на Windows с окончаниями CRLF, а система сравнения выводила результат побайтово, из-за чего все многострочные тесты молча падали. Собственный тестовый раннер PHP нормализует окончания перед сравнением. Одна строка кода нормализации сделала сотни тестов зелёными. Урок: измеряйте свои измерения — ваш оракул настолько честен, насколько честна связка, соединяющая вас с ним.

Ещё одно открытие: некоторые старые регрессионные тесты выделяют абсурдные структуры или раскручиваются в бесконечные генераторы, изначально предназначенные для работы в хорошо изолированной CI-среде PHP. Один такой тест вызвал жёсткую перезагрузку машины разработчика. Теперь проект фильтрует тесты, которые заведомо опасны вне CI.

Цикл разработки

  • ИИ строит гистограмму ошибок по всему корпусу, чтобы найти крупнейший исправимый кластер.
  • ИИ реализует исправление.
  • Система прогоняет все ~22 000 тестов (~7 минут).
  • Если число прошедших тестов увеличилось: коммит, пуш, повтор.
  • Если уменьшилось: человек говорит «хм, регрессия, посмотри ещё».

Работа человека, по сути, — прицеливание: чтение вывода терминала, как средневековый король просматривает морские карты, а затем ввод самой мощной фразы разработчика: «выглядит хорошо, продолжай».

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

NVIDIA представила процессор Vera для агентных задач искусственного интеллекта
Новости

NVIDIA представила процессор Vera для агентных задач искусственного интеллекта

NVIDIA представила процессор Vera CPU, специально разработанный для агентного ИИ и задач обучения с подкреплением. По заявлению компании, он обеспечивает на 50% более высокую производительность и вдвое большую эффективность по сравнению с традиционными процессорами для стоечных систем.

OpenClawRadar
Выпуск Claude Code v2.1.85: Улучшения MCP, фильтры хуков и исправления ошибок
Новости

Выпуск Claude Code v2.1.85: Улучшения MCP, фильтры хуков и исправления ошибок

Claude Code v2.1.85 добавляет переменные окружения для MCP headersHelper, условные поля if для хуков, чтобы уменьшить создание процессов, а также исправляет ошибки /compact, проблемы включения/отключения плагинов и проблемы с клавиатурой терминала в Ghostty, Kitty и WezTerm.

OpenClawRadar
Исследование возможности запуска OpenClaw на Chromebook
Новости

Исследование возможности запуска OpenClaw на Chromebook

Запуск OpenClaw на Chromebook может быть проще, чем вы думаете. Наше последнее исследование от OpenClawRadar погружается в пользовательский опыт и требования, чтобы выяснить, могут ли Chromebook справляться с этим ИИ-кодировщиком.

OpenClawRadar
Claude Code v2.1.90 добавляет команду /powerup с игровым подходом к изучению функций.
Новости

Claude Code v2.1.90 добавляет команду /powerup с игровым подходом к изучению функций.

Claude Code v2.1.90 представляет новую команду /powerup, которая предлагает геймифицированное обучение с 10 разблокируемыми улучшениями, каждое из которых обучает одной функции, которую большинство пользователей упускает. Система включает анимированные демонстрации в терминале и подробную документацию со скриншотами.

OpenClawRadar