Lokalisierung großer Codebasen mit LLMs: Ein Entwickler-Workflow für 4.500 UI-Schlüssel

Ein Entwickler dokumentierte seinen Prozess zur Lokalisierung eines großen Spielprojekts mit etwa 4.500 UI-Schlüsseln, die in einer 500KB großen en-US.json-Datei gespeichert sind. Er verwendete einen mehrstufigen LLM-Workflow, um Extraktion, Übersetzung und Qualitätsverbesserung zu handhaben.
Erste Extraktions- und Übersetzungsversuche
Zunächst nutzte er Claude, um seine Codebasis zu durchsuchen, hartcodierte UI-Strings zu extrahieren und sie auf i18n-Standards zu migrieren, wodurch die Lokalisierungsdatei erstellt wurde. Für die Übersetzung ins Italienische probierte er zunächst Claude und Gemini Pro (über Gemini CLI und Antigravity). Beide Cloud-Modelle lieferten inakzeptable Übersetzungsqualität. Gemini Pro hatte zudem Probleme mit der großen Datei, sodass sie in 10 kleinere Teile aufgeteilt werden musste.
Umstellung auf lokale Modelle und der Kontext-Durchbruch
Anschließend probierte er TranslateGemma lokal über LM Studio aus, indem er schlüsselweise übersetzte. Obwohl etwas besser, war die Qualität immer noch nicht akzeptabel. Die entscheidende Erkenntnis war, dass UI-Wörter oft mehrdeutig sind und die Übersetzung Disambiguierung und Nutzungskontext erfordert.
Um dies zu lösen, ging er zurück zu Claude, um eine zweite Datei zu generieren. Für jeden der 4.500 Schlüssel untersuchte Claude die Code-Nutzung, um Kontext bereitzustellen: wo der String erscheint, seine Funktion (Button-Beschriftung, Beschreibung, Eingabehinweis) und seine Auswirkung auf das Gameplay.
Die finale Übersetzungspipeline
Er baute eine automatisierte Übersetzungspipeline mit folgenden Schritten:
- Schlüssel zusammen mit ihrem generierten Kontext bündeln.
- Einen Prompt verwenden, der auf funktionale (nicht wörtliche) Übersetzung fokussiert.
- Platzhalter und Tag-Erhaltung erzwingen.
- Anfragen an ein lokales Modell über LM Studio senden.
TranslateGemma konnte das kontextreiche Prompt-Format nicht verarbeiten, also wechselte er die Modelle. Er testete auf einem M1 Mac Mini mit 16 GB Unified Memory.
Modellleistung und Ergebnisse
Qwen 3 4B funktionierte gut, aber Qwen 3 8B war der Sweet Spot, produzierte weniger Grammatikfehler und bessere Formulierungen, während es lokal noch handhabbar blieb. Die finale Pipeline kann die 4.500+ Schlüssel in mehrere Sprachen übersetzen, was auf seiner Maschine etwa 8 Stunden pro Sprache in Anspruch nimmt. Er verwendet ein quantisiertes Modell, sodass er weiterarbeiten kann, während es im Hintergrund läuft.
Der Entwickler merkt an, dass dieser Ansatz eine Qualität lieferte, die gut genug zum Veröffentlichen war, und sich besser anfühlte als viele automatisch übersetzte Projekte, die er gesehen hat.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Chuck Jones' Roadrunner-Regeln als Designprinzipien für KI-Agenten-Identität
Ein Reddit-Beitrag analysiert, wie Chuck Jones' 9 Regeln für Road Runner-Cartoons auf das Design von KI-Agenten-Identitäten übertragen werden können, wobei Regel 2 zu internen Fehlermodi, Regel 3 zur Vermeidung von Optimierungsschleifen und Regel 9 zu elegantem Scheitern hervorgehoben werden.

Homelab KI-Entwicklungsplattform: OpenCode + GitOps für sicherere Container-Updates
Ein Entwickler richtet OpenCode mit Git-Zugriff, PR-Review-Gate und GitOps-Bereitstellung für sicherere Heimserver-Container-Updates ein. KI schreibt Änderungen, Besitzer prüft via PR, Arcane deployed.

Erstellung eines KI-Entlassungstrackers mit Claude Cowork: Praktische Implementierungsdetails
Ein Entwickler hat einen Live-Tracker für Entlassungen erstellt, der Unternehmen erfasst und anzeigt, die KI als Grund für Stellenstreichungen im Jahr 2026 angeben. Dabei nutzte er Claude Cowork, um Tabellenstrukturen zu generieren, Filterlogik zu debuggen und die mobile Zugänglichkeit zu optimieren.

OpenClaw-Benutzer kämpfen mit der KI-Agenten-Automatisierung nach erfolgreicher Claude-Code-Pipeline
Ein Inhaber einer Marketingagentur hat erfolgreich eine Pipeline zur Bildrekonstruktion mit Claude Code in einer Stunde erstellt, stieß jedoch auf Probleme, als er versuchte, denselben Prozess einem KI-Agenten in OpenClaw, der auf Gemini 3.1 Pro läuft, beizubringen. Die Probleme umfassten schlechte Argumentationsfähigkeiten, langsame Antwortzeiten und fehlerhafte Ausgaben.