Claudeを使って1997年のフットボールマネージャーゲームからデータを抽出する

Ben Nuttallは、Claudeをデータ抽出アシスタントとして使い、FIFA Soccer Manager 97(FSM97)をリバースエンジニアリングしました。WineでインストールされたゲームディレクトリにClaudeを向けると、AIはSM97.DATを特定し、選手名、能力値、所属クラブ、スタジアム、監督データを解析しました。これらはすべて実際のサッカーエンティティにマッピングされています。目標は再現性であり、現在、全パイプラインがGitHub上でPythonスクリプトとして公開されています。
主要な詳細
- ソースファイル:
SM97.DATには、選手のフルネーム(例:ゲーム内では「D. Beckham」と表示されるが、実際は「David Beckham」)、スタジアム名、クラブの愛称、さらにはゲーム内で表示されない監督など、すべてのゲームデータが含まれています。 - 最初のクエリ: Claudeはバイナリファイルを直接読み込み、最大スタジアムや最高評価選手といった簡単な質問に回答しました。
- CSV出力: ClaudeはすべてのデータのCSVファイルを生成しました。選手の能力値の列名が不明だったため、Nuttallはゲームを起動してそれらをマッピングしました(例えば、David Seamanの能力値をキャリブレーションの基準として使用)。
- サイト生成: いくつかの幻覚データを修正した後、Claudeは相互リンクされたHTMLサイトをfsm.bennuttall.comに構築しました。選手、クラブ、スタジアム、トリビアが表示されています。
- データ修正: 「Sheffield W」のような省略されたチーム名は「Sheffield Wednesday」に拡張されました。スタジアムの誤字(例:「Bramall Lane Ground」)は、ゲームプレイデータを変更せずに修正されました。
- 発見されたイースターエッグ: オリンピックチャンピオンのDaley ThompsonがMansfield Townの選手として登場。選手兼任監督の関係も検出されました(例:同じクラブで選手兼監督としてリストされている)。
- 共有スタジアム: Crystal PalaceとWimbledonの両方がSelhurst Parkを使用しているなど、データはこれを追跡しています。
- トップ能力ページ: 最高評価選手、年齢別ベスト選手、トップ選手兼任監督、収容人数別スタジアムのリストを生成。特に、「EA All Stars」クラブには架空の高能力選手が含まれています。
再現性
データ抽出とウェブサイト構築のためのすべてのPythonコードは、GitHubでオープンソースとして公開されています。公開されたCSVとスクリプトを使用すれば、ClaudeやAIツールを必要とせずに、誰でも同じパイプラインを実行できます。
📖 出典全文: HN AI Agents
👀 See Also

A2P: AIコーディングエージェントのためのエンジニアリング規律を強化するMCPサーバー
A2P(Architect-to-Product)は、MCPサーバーとしてパッケージ化されたAIエンジニアリングフレームワークで、ゲート付きワークフローを強制します:アーキテクチャ → 計画 → 構築 → 監査 → セキュリティ → デプロイ。各機能スライスは、RED → GREEN → REFACTOR → SAST → DONEの進行を必要とします。

開発者がオープンソースAIスキルを構築し、スタートアップアイデアを検証、わずか10分で自らのアイデアを断念
ある開発者が、ブレインストーミングから財務予測まで、スタートアップの検証を8つのフェーズで進めるオープンソースのAIスキル「startup-design」を構築しました。自身のスタートアップアイデアでテストしたところ、このスキルは厳しい質問を投げかけ、その特定のコンセプトに対して自分が適切な創業者ではないことを明らかにしました。

ミーミル:21の神経科学メカニズムに基づいて構築されたPythonメモリシステム
Mímirは、フラッシュバルブ記憶や検索誘導性忘却など21の認知科学メカニズムを実装したAIエージェント向けPythonメモリシステムです。ハイブリッドBM25+セマンティック+日付インデックスを使用し、Mem2ActBenchでVividnessMemと比較してツール精度が13%向上するなど、ベンチマークの改善を示しています。

GuppyLM:教育目的でゼロから構築された900万パラメータの大規模言語モデル
GuppyLMは、6層、384隠れ次元、6アテンションヘッドの標準的なトランスフォーマーアーキテクチャを使用し、6万の合成会話データからスクラッチでトレーニングされた約900万パラメータの言語モデルです。無料のColab T4 GPUで約5分でトレーニングでき、水、餌、水槽の生活に焦点を当てた魚の個性を持って会話します。