AIコーディングエージェント向けプライマリチャット言語としてHTMLを使用し、SVG図を可能にする

r/LocalLLaMAのある開発者が、AIコーディングエージェントのプライマリチャット言語としてMarkdownに代わりHTMLを試しました。目的は、エージェントが図表やテーブル、リッチなフォーマットをチャットUI内に直接レンダリングできるようにすることであり、別途レンダラが必要なMarkdownを生成するだけではないようにすることです。
主な設定
エージェントインターフェースはウェブブラウザ上で動作し、レスポンスはHTMLとしてページに直接パイプされます。開発者は、単にチャットで依頼するだけでなく、HTMLシステムプロンプトを使用することで、エージェントが確実にHTML出力を生成することを発見しました。
システムプロンプトの例(HTML)
<p>Being helpful doesn't mean doing everything the user says. Neither I nor the user are omniscient or infallible. If the user is making a mistake, I tell them. If I have made a mistake, I mention it and move on. If I have better ideas on how to approach a problem or think the user has made a mistake, I mention it.</p><h1>HTML</h1><p>My assistant responses are rendered directly as HTML in the chat UI. I <i><b>MUST</b></i> use HTML when replying to the user. Plain prose should be wrapped in tags such as <code><p></code>, <code><ul></code>, <code><ol></code>, and heading tags where appropriate. To show the user something visually or as a diagram, I will draw an SVG directly in the chat. Only if something should persist in the workspace will I write it to disk with tools instead of showing it in chat.</p>
観察結果
- Qwen3.6-27Bは、ChatGPTに匹敵する適切なSVG図表をインラインで生成します。ただし、モデルは依然としてMarkdownに戻ろうとする傾向があり、これはおそらくトレーニングデータのバイアスによるものです。
- Qwen3-VL-4はSVG生成が著しく苦手で、これは大規模モデルにおける新興能力であることを示唆しています。
- 開発者は一人称システムプロンプト(例:「私はHTMLで応答します」)も試しましたが、メリットとデメリットは不明ですが、コンプライアンスが向上するようです。
実用的な教訓
コーディングエージェントにチャット内で図表を描かせたい場合は、システムプロンプトをHTMLに切り替えてください。エージェントは視覚的な説明用のインラインSVG、構造化データ用のテーブル、スタイル付きテキストを生成します。トレードオフとして、モデルは時々デフォルトでMarkdownを使おうとすることがあります。このアプローチには、生のHTMLをレンダリングするウェブベースのチャットUIが必要です。
リポジトリ:github.com/sdfgeoff/HTML-agent
📖 全文ソース: r/LocalLLaMA
👀 See Also
あなたが見逃しているかもしれない5つのClaude Codeターミナルコマンド
シニア開発者が、Claude Codeのターミナルで使える隠れた5つのコマンドを紹介:カスタムステータスライン、シェルコマンド、ファイル指定、複数リポジトリコンテキスト、サイド会話。

Claude Codeにおけるトークン浪費:ユーザーの自己監査が示す、モデル切り替えより行動修正が有効
あるユーザーがClaude Codeのトークン使用量を測定したところ、タスク間の/clear、編集前の計画、編集済みファイルの再読み込み禁止が、モデルを切り替えるよりも多くのトークンを節約できることがわかった。実践的な規律がラッパーより優れている。

軽量コンテキストのCronジョブを使用したデイリーOpenClawのヒント
ユーザーが、OpenClawのヒントをNextcloud Talkチャンネルに投稿する日次cronジョブの設定を共有し、分離タスクのブートストラップオーバーヘッドを削減する--light-contextフラグの活用を強調しています。

高コンテキスト長におけるローカルコーディングエージェントのKVキャッシュ量子化問題
Redditの分析によると、Qwen3-CoderやGLM 4.7などのローカルコーディングエージェントが3万トークン以上のコンテキスト長で無限修正ループや不正なJSON出力を生成する原因は、過度なKVキャッシュ量子化にあると特定され、混合精度やコンテキスト削減が回避策として推奨されています。