大規模コードベースのローカライズとLLM:4,500のUIキーに対する開発者のワークフロー

開発者が、約4,500のUIキーを含む500KBのen-US.jsonファイルで構成される大規模なゲームプロジェクトのローカライズプロセスを記録しました。抽出、翻訳、品質向上を処理する多段階のLLMワークフローを使用しました。
初期の抽出と翻訳の試み
まず、Claudeを使用してコードベースをスキャンし、ハードコードされたUI文字列を抽出してi18n標準に移行し、ロケールファイルを作成しました。イタリア語への翻訳では、最初にClaudeとGemini Pro(Gemini CLIとAntigravity経由)を試しました。どちらのクラウドモデルも許容できない品質の翻訳を生成しました。Gemini Proは大きなファイルでエラーが発生し、10の小さなチャンクに分割する必要がありました。
ローカルモデルへの移行とコンテキストの突破口
次に、LM Studio経由でローカルにTranslateGemmaを試し、キーごとに翻訳しました。わずかに改善されたものの、品質はまだ許容できるものではありませんでした。重要な洞察は、UIの単語はしばしば曖昧であり、翻訳には曖昧さの解消と使用コンテキストが必要だということでした。
これを解決するために、Claudeに戻って2つ目のファイルを生成しました。4,500のキーそれぞれについて、Claudeはコードの使用状況を調査してコンテキストを提供しました:文字列が表示される場所、その機能(ボタンラベル、説明、入力ヒント)、ゲームプレイでの効果などです。
最終的な翻訳パイプライン
以下のステップで自動化された翻訳パイプラインを構築しました:
- 生成されたコンテキストと共にキーをバッチ処理。
- 機能的な(文字通りのものではない)翻訳に焦点を当てたプロンプトを使用。
- プレースホルダーとタグの保持を強制。
- LM Studio経由でローカルモデルにリクエストを送信。
TranslateGemmaはコンテキストが豊富なプロンプト形式を処理できなかったため、モデルを切り替えました。M1 Mac Mini(16GB統合メモリ)でテストしました。
モデルのパフォーマンスと結果
モデルのパフォーマンスと結果
Qwen 3 4Bは良好に動作しましたが、Qwen 3 8Bが最適なポイントで、文法ミスが少なく、より良い言い回しを生成しながら、ローカルで実行可能な範囲に収まりました。最終的なパイプラインは4,500以上のキーを複数の言語に翻訳でき、彼らのマシンではロケールごとに約8時間かかります。量子化モデルを使用しているため、バックグラウンドで実行しながら作業を続けることができます。
開発者は、このアプローチがリリースに十分な品質を生み出し、これまで見てきた多くの自動翻訳プロジェクトよりも優れていると感じたと述べています。
📖 詳細はこちら: r/LocalLLaMA
👀 See Also

AIエージェントの分割によるコンテキストの消失防止
ある開発者が、コンテキストウィンドウの制限に対処するために、単一のAIエージェントを複数の専門エージェントに分割して管理するアプローチについて説明しています。1つのエージェントが仕事の受信箱、個人のカレンダー、コードレビュー、夕食の計画を同時に処理しようとした際にコンテキストの欠落が始まり、分割を促しました。

ClaudeとChatGPTを使ったモバイルアプリ構築:非技術系開発者のワークフロー
コンピューターサイエンスのバックグラウンドを持たない開発者が、失業中にClaudeとChatGPTを主要な開発ツールとして使用し、BloomDayという完全なモバイルアプリケーションを構築しました。

Claude Codeでファンタジーベースボール分析アプリを構築:法学部生の経験談
2017年にコンピュータサイエンスの学位を取得した法学部生が、Claude Codeを実装に使用し、すべての製品およびドメインの決定を行いながら、Ball Knowerという完全なファンタジーベースボール分析iOSアプリを構築しました。このアプリには1,313のMLB選手プロファイル、毎日のストリーミング投手ピック、およびダイナスティランキングが含まれており、バックエンドでは9つのデータソースからデータを取得する30のcronジョブが実行されています。

Mac Studio ローカルLLM構成:GLM 5.1、Kimi K2.6、そしてClaude Codeでのコーディングに効果的なもの
開発者が2026年5月のMac Studio (M3 Ultra) セットアップで、量子化GLM 5.1 (380GB, 17 tps デコード)、Kimi K2.6 (460GB, 21 tps デコード)、Minimax 2.7、Gemma 4 31B、Qwen 3.5 9Bに関するメモ、そしてDeepseek/Mimoサポート待ちについて共有しています。