大規模コードベースのローカライズとLLM:4,500のUIキーに対する開発者のワークフロー

開発者が、約4,500のUIキーを含む500KBのen-US.jsonファイルで構成される大規模なゲームプロジェクトのローカライズプロセスを記録しました。抽出、翻訳、品質向上を処理する多段階のLLMワークフローを使用しました。
初期の抽出と翻訳の試み
まず、Claudeを使用してコードベースをスキャンし、ハードコードされたUI文字列を抽出してi18n標準に移行し、ロケールファイルを作成しました。イタリア語への翻訳では、最初にClaudeとGemini Pro(Gemini CLIとAntigravity経由)を試しました。どちらのクラウドモデルも許容できない品質の翻訳を生成しました。Gemini Proは大きなファイルでエラーが発生し、10の小さなチャンクに分割する必要がありました。
ローカルモデルへの移行とコンテキストの突破口
次に、LM Studio経由でローカルにTranslateGemmaを試し、キーごとに翻訳しました。わずかに改善されたものの、品質はまだ許容できるものではありませんでした。重要な洞察は、UIの単語はしばしば曖昧であり、翻訳には曖昧さの解消と使用コンテキストが必要だということでした。
これを解決するために、Claudeに戻って2つ目のファイルを生成しました。4,500のキーそれぞれについて、Claudeはコードの使用状況を調査してコンテキストを提供しました:文字列が表示される場所、その機能(ボタンラベル、説明、入力ヒント)、ゲームプレイでの効果などです。
最終的な翻訳パイプライン
以下のステップで自動化された翻訳パイプラインを構築しました:
- 生成されたコンテキストと共にキーをバッチ処理。
- 機能的な(文字通りのものではない)翻訳に焦点を当てたプロンプトを使用。
- プレースホルダーとタグの保持を強制。
- LM Studio経由でローカルモデルにリクエストを送信。
TranslateGemmaはコンテキストが豊富なプロンプト形式を処理できなかったため、モデルを切り替えました。M1 Mac Mini(16GB統合メモリ)でテストしました。
モデルのパフォーマンスと結果
モデルのパフォーマンスと結果
Qwen 3 4Bは良好に動作しましたが、Qwen 3 8Bが最適なポイントで、文法ミスが少なく、より良い言い回しを生成しながら、ローカルで実行可能な範囲に収まりました。最終的なパイプラインは4,500以上のキーを複数の言語に翻訳でき、彼らのマシンではロケールごとに約8時間かかります。量子化モデルを使用しているため、バックグラウンドで実行しながら作業を続けることができます。
開発者は、このアプローチがリリースに十分な品質を生み出し、これまで見てきた多くの自動翻訳プロジェクトよりも優れていると感じたと述べています。
📖 詳細はこちら: r/LocalLLaMA
👀 See Also

ローカルLLMを使用してMinecraftボットのAFKセッションを監視する
ある開発者がローカルLLMを使用して、採掘作業を実行するBaritoneを搭載したMinecraftボットを監視し、ボットが死亡したときやサーバーから切断されたときにアラートを受け取るための画面監視を設定しました。

ノンコーディングAIエージェントをClaude Codeで構築する:3つの実践例
RedditユーザーがClaude Codeを使用してAIエージェントを作成する個人セットアップを共有し、3つの具体的な実装を詳細に説明しています:メール、ToDo、カレンダーから情報を取得する自動朝のブリーフィングエージェント、Substack記事をキャプチャするtmuxベースのパイプライン、会議の要約エージェントです。

コミュニティからの実用的なOpenClawの使用例
開発者やチームは、OpenClawをコールドアウトリーチ、SEOコンテンツ自動化、ソーシャルメディア管理、顧客データクエリ、ウェブサイトテスト、サーバー監視、領収書処理、自動車購入交渉、ポッドキャスト章作成、日々の目標計画に使用しています。

Claude AI、破損した12TB BTRFSアレイから99.94%のデータを回復
開発者が、ネイティブの回復ツールが失敗した後、Claude AIを使用して破損した12TBのBTRFSアレイから99.94%のデータを回復したと報告しました。Claudeは80%で破壊されたインデックステーブルを診断し、ファイルシステムツリーを手動で再構築し、8.4TBのデータから7MBのゴミファイルのみを失いました。