AIがRustでPHPエンジンを開発、PHP-srcテストの17%を通過しWordPressをレンダリング

✍️ OpenClawRadar📅 公開日: July 5, 2026🔗 Source
AIがRustでPHPエンジンを開発、PHP-srcテストの17%を通過しWordPressをレンダリング
Ad

Rustを知らない人物が、AIにPHPインタプリタをRustで構築させました。その結果であるPhargoは、SQLiteデータベースから26KBのWordPressトップページを提供します——PHPの実際のCソースコードを一行も含まないエンジンを介して。これはRustで書かれたゼロからのインタプリタであり、AIエージェントによって生成され、人間の役割は次のように縮小されました:テストを実行し、スコアを確認し、「続行」または「後退した、もう一度確認」と言うだけです。

この実験では、PHP自身のテストスイートを公平な判断基準として使用しています:30年間に蓄積された約22,000の.phptファイルで、DateTimeの夏時間計算から浮動小数点数のvar_dump()までをカバーしています。現在の合格率:22,037中3,844(17.4%)。スイートにはスコープ外のC拡張テスト(GD、curl、SOAP、MySQLドライバ)が含まれているため、現実的な上限は約40〜45%です。プロジェクトはゼロから始まり、失敗ヒストグラムを通じて上昇します:AIは最も大きな失敗テストのクラスタを特定し、修正を実装し、全22,000テストを実行し(約7分)、数値が上がればコミットします——人間のコードレビューは不要です。

Ad

実戦からの教訓

初期の進捗は、微妙なバグによって停滞しました:改行コードです。テストコーパスがWindows上でCRLF改行でチェックアウトされ、スコアボードは出力をバイト単位で比較していたため、複数行のテストがすべて黙って失敗しました。PHPのテストランナーは比較前に正規化します。1行の正規化コードで数百のテストがパスするようになりました。教訓:測定方法を測定せよ——判断基準は、それを接続するハーネスと同じくらい正直でしかありません。

もう一つの発見:一部の古い回帰テストは、異常な構造を割り当てたり、無限ジェネレータに展開したりします。これらはもともとPHPの注意深くフェンスされたCI内で実行されるように設計されていました。そのようなテストの1つが開発マシンをハードリスタートさせました。現在、プロジェクトは既知のCI専用爆弾テストをフィルタリングしています。

ループ

  • AIが全コーパスに対して失敗ヒストグラムを実行し、修正可能な最大のクラスタを見つける。
  • AIが修正を実装する。
  • スコアボードが全22,000テストを実行する(約7分)。
  • 数値が上がれば:コミット、プッシュ、繰り返し。
  • 下がれば:人間が「うーん、後退した、もう一度確認」と言う。

人間の仕事は基本的に方向付けです——ターミナル出力を中世の王が海図を確認するように読み、そして開発者にとって最も強力なフレーズ「よさそうだ、続けよう」とタイプすることです。

📖 全文ソース: HN AI Agents

Ad

👀 See Also

CEOによる最近の調査では、AIが生産性と雇用に与える影響は最小限であると報告されています。
News

CEOによる最近の調査では、AIが生産性と雇用に与える影響は最小限であると報告されています。

6,000人の経営幹部を対象とした調査によると、90%が過去3年間でAIが雇用や生産性に影響を与えていないと報告し、AIの平均使用時間は週1.5時間でした。経済学者はこれを、1980年代のIT時代におけるソローの生産性パラドックスと比較しています。

OpenClawRadar
AnthropicがClaude CodeのAPIレート制限変更を延期
News

AnthropicがClaude CodeのAPIレート制限変更を延期

Anthropicは、6月15日を予定していたClaude Agent SDKとclaude -pのサブスクリプション回数制限からの除外計画を撤回しました。

OpenClawRadar
Claude-Code v2.1.80では、レート制限の監視機能、プラグインの改善、およびメモリ最適化が追加されました。
News

Claude-Code v2.1.80では、レート制限の監視機能、プラグインの改善、およびメモリ最適化が追加されました。

Claude-Code v2.1.80では、ステータスラインスクリプトにClaude.aiの使用状況を表示するためのrate_limitsフィールドが追加され、プラグインマーケットプレイスのsource: 'settings'サポートが実装され、大規模リポジトリでのメモリ使用量が約80MB削減されました。また、並列ツール結果の復元、WebSocket障害、各種UI問題の修正も行われています。

OpenClawRadar
Harmonic-9B:AIエージェント向けの2段階Qwen3.5-9Bファインチューニング
News

Harmonic-9B:AIエージェント向けの2段階Qwen3.5-9Bファインチューニング

開発者DJLougenは、2段階のトレーニングアプローチでエージェント使用に最適化されたQwen3.5-9BのファインチューンであるHarmonic-9Bをリリースしました。ステージ1(高度な推論)は完了しており、ステージ2(軽量なツール呼び出し)は現在トレーニング中です。GGUF量子化バージョンは既に利用可能です。

OpenClawRadar