無料LLM APIとツール呼び出しで構築されたポケモンショーダウンAIエージェント

ある開発者が、Llama 3、Qwen、Gemma などのLLMが自律的にポケモンショーダウンのバトルをプレイするシステムを構築しました。エージェントは毎ターン、タイプ相性、HP、天候、フィールド状態、明らかになった相手の情報など、戦闘状況全体を分析し、構造化されたツール呼び出しを使って攻撃するか交代するかを決定します。
主な詳細
- すべての処理を LiteLLM 経由で行い、無料のAPI階層を持つモデルのみを使用(Groq、Cerebras、OpenRouter、Google AI Studio)。
- ローカル実行時の推論コストはゼロ。
- 二つのモード:人間 vs AI(ボットと対戦)および AI vs AI(二つのモデル同士を対戦)。
- 標準で15以上の無料モデルをサポート。
- Langfuse による完全な観測可能性。各ターンの正確なツール呼び出しと推論を確認可能。
アーキテクチャのハイライト
エージェントはツール呼び出しを使用して決定を構造化します。単純なプロンプト応答ではなく、生の戦場データがLLMに入力され、定義済みのツールスキーマを介して攻撃または交代のアクションを選択します。これにより、タイプアドバンテージや動的なフィールド効果などの複雑な盤面状態について推論できます。
GitHubリポジトリ
コードとセットアップ手順: github.com/MohamedMostafa259/pokemon-ai-agent
📖 全文ソース: r/LocalLLaMA
👀 See Also

OpenClawスマートルーターがオープンソース化、自動モデル選択に対応
開発者がOpenClaw用のスマートルーターをオープンソース化しました。このツールはクエリの複雑さを自動的に分類し、最適なモデルにルーティングすることで、ClaudeやGPT-4oのようなプレミアムモデルを常に使用する場合と比べてAPIコストを60〜80%削減します。

Snip: オープンソースツールがYAMLフィルターでClaude Codeのトークン使用量を削減
SnipはGoで書かれたオープンソースツールで、Claude Codeのトークン使用量を60〜90%削減します。これは、シェルコマンドの出力がコンテキストウィンドウに到達する前にフィルタリングすることで実現します。rtk(Rust Token Killer)に触発されていますが、異なるアプローチを取っています:フィルターはコンパイルされたコードではなく、データ(YAMLファイル)です。

Claude-Skillsメンテナーが181のエージェントスキルライブラリに関するフィードバックを募集
claude-skillsのメンテナであるRezaは、11のAIコーディングツールで動作する181のエージェントスキル、250のPythonツール、15のエージェントペルソナを含むオープンソースライブラリについて、コミュニティからのフィードバックを求めています。彼は、個別のスキルアプローチが効果的かどうかを疑問視し、不足しているスキル、ペルソナベースのエージェント、ツール統合に関する意見を求めています。
盆栽2(Qwen 3.8 27B)をOpenClawのフォールバックとして使用:8GB、5070で85 tok/s
r/openclawのユーザーが、PrismMLのTernary Bonsai 2(Qwen 3.8 27B)をOpenClawのフォールバックモデルとして導入——ディスク上わずか約8GB、5070で85 tok/sの出力、テキストとビジョン対応、そしてエージェント型のブラウザ/VMタスクも実用的にこなせる。