短牵绳AI编码法:通过保持控制战胜寓言

セキュリティ重視のソフトウェア保守担当者であるGreg Slepak氏は、AIコーディングエージェントに関する1年以上の研究を短いリード方式に凝縮しました。これは、AIを使ってアウトプットを増やしながら品質を犠牲にしたくないエキスパート開発者のためのもので、フロンティアモデルを使わずともFable 5の結果を上回ると主張しています。
Slepak氏が特定した核心的な問題:AIエージェントはしばしば「脱線」し、見苦しい/非効率なコードを生成したり、開発者をループから外すYouTuber風のオーケストレーションシステムを必要としたりします。彼の手法では、すべてのステップで制御を維持できます。
短いリードのルール
- タスクを計画し、必要に応じて
tasks skillのようなものを使用して大きなタスクをステップに分割します。 - 「YOLO」モード(別名「危険な許可スキップ」)は絶対に使用しないでください。
- AIはあなたが見ている間だけ動作します — ビデオゲームをプレイしながらの「雰囲気コーディング」は禁止です。
- 変更を加える前に差分を表示する許可プロンプトを持つコーディングエージェントを使用してください。
- 提案された各差分を分析し、AIが望まない操作をしようとしたら許可を拒否してください。
- コードベースの最新の理解を維持するために、自分自身をループに留めてください。
- AIが脱線するのを防ぐために頻繁に介入してください。
- 各サブタスクの後にコミットして、AIが以前の作業を削除するのを防ぎます(Slepak氏はOpusがこれをやったのを見たことがあります)。
AIレビュー
Slepak氏は、AIをPRレビュー用のリンターとして扱うことを推奨しています。AIが一般的なミスをキャッチし、人間が高レベルの問題をキャッチします。両方一緒ならどちらか単独よりも優れています。AIには十分なコンテキスト(Issue、PR説明)が必要です。
また、彼は数十億ドル規模のシステムと同等の性能を持つカスタムAIレビューツールを構築し、Crushというエージェントのフォークを保守していると述べています。
📖 全文ソース: HN AI Agents
👀 See Also

Claudeを使用して文章パターンを分析し、より良いカスタム指示を作成する
Redditユーザーが、主観的なトーン記述に頼るのではなく、実際の文章サンプルをAIに分析させることで、より効果的なClaude用カスタム指示を作成する方法を紹介しています。

Blackwell GB10でCUDA 13.0を使用してvLLMを実行する際の、aarch64固有の4つの障害モード
開発者が、CUDA 13.0を搭載したaarch64アーキテクチャのBlackwell GB10システム上でvLLM v0.7.1とDeepSeek-R1-32Bをセットアップする際に、ABIの不一致や依存関係の欠落など、4つの特定の障害モードに遭遇しました。

エージェントスキルの安全性評価:導入前の重要な考慮事項
新しいエージェントスキルをインストールすることで機能が向上する一方、リスクも伴います。システムを保護するために、これらのスキルの安全性を評価する方法を学びましょう。

個人AIエージェント構築のための100のヒント:クラウドプロトタイプから本番環境へ
6週間にわたって、永続的なAIエージェント(チャットボットのラッパーではない)を構築した経験。タスク管理、取引追跡、メール読み取り、データ分析を行う。重要な教訓:システムプロンプトではなく憲法を書くこと、メモリにはフラットマークダウンファイルを使用すること、アイデンティティファイルをgitでバージョン管理すること。