Selbstaktualisierendes Übersetzungssystem für OpenClaw verwaltet Fachglossare automatisch

Kernübersetzungssystem
Ein Python-Skript umschließt die Kimi2.5-API, um .srt-Untertiteldateien zu übersetzen, während Blockindizes, Zeitstempel und Segmentierung erhalten bleiben. Das Skript lädt Projektprofile aus projects/<name>/-Ordnern, die drei Schlüsseldateien enthalten:
glossary.json— gesperrte Begriffszuordnungen für bestimmte Schreibweisen von Namen, Wettbewerbsnamen und Fachjargonstyle.md— Sprachrichtlinien, Formatierungsregeln und kulturelle Hinweisememory.jsonl— angesammelter Kontext aus vorherigen Übersetzungen
Während der Übersetzung erzwingt das Skript gesperrte Begriffe vor der Auslieferung. Eine QA-Prüfung validiert die SRT-Struktur auf keine Überschneidungen, steigende Zeitcodes und keine verirrten Indizes.
Selbstaktualisierendes Glossarsystem
Ein Cron-Job läuft alle 6 Stunden und scannt offizielle Quellseiten in allen Sprachen. Er extrahiert neue Terminologiekandidaten, vergleicht sie mit bestehenden Glossareinträgen und fügt Deltas zu glossary_deltas.jsonl hinzu. Dies ermöglicht es dem Glossar, sich organisch mit der Entwicklung des Bereichs zu erweitern und offizielle Namen, aufkommende Terminologie oder sich ändernde institutionelle Sprache ohne manuelle Überprüfungszyklen zu erfassen.
Das System verwaltet auch eine separate Wissensdatenbankdatei mit Kontextmomentaufnahmen – aktuelle Nachrichten, offizielle Mitteilungen und Produktaktualisierungen –, die durch die Bereitstellung aktuellen Kontexts für das Modell in die Übersetzungsqualität zurückfließt.
Verwendung und Ergebnisse
Verwendungsbefehl:
python3 scripts/translate_srt.py \
--input source.srt \
--output output.en.srt \
--to English \
--project clientnameGesperrte Begriffe werden in einem Nachbearbeitungsschritt normalisiert, dann läuft die strukturelle QA vor der Dateiauslieferung. Das System läuft headless: Datei rein, übersetzte Datei raus, während das Glossar im Hintergrund still aktualisiert wird.
Ergebnisse umfassen konsistente Terminologie über 100+ Untertiteldateien hinweg, keine Abweichung in Namensschreibweisen oder technischem Vokabular und frischen Kontext ohne manuelle Quellenüberwachung.
📖 Read the full source: r/openclaw
👀 Siehe auch

Open-Source-Agenten-Fähigkeit für TypeScript-, React- und Next.js-Muster
Ein Entwickler hat eine 4.000 Zeilen lange, 17 Dateien umfassende strukturierte Markdown-Referenz veröffentlicht, die für KI-Agenten wie Claude Code entwickelt wurde, um sie bei der Erstellung oder Überprüfung von TypeScript-, React- und Next.js-Code zu befolgen. Sie behandelt häufige Probleme wie unzureichende Validierung von API-Antworten und falsche Verwendung von 'use client'-Direktiven.

Ich entwerfe jetzt mehr mit Claude als mit Figma — Jane-Street-Designer-Workflow
Ein Designer von Jane Street beschreibt, wie Claude Code Figma für Prototyping ersetzt hat und damit Wochen der Hin- und Her-Kommunikation einspart. Die Prototypen werden als echter Code ausgeliefert, nicht als Mockups.

Offline-Sprache-zu-Text-Tool für macOS mit lokalem Whisper über MLX
Ein Entwickler hat whisper-dictate als Open-Source veröffentlicht, ein macOS-Tool, das vollständig offline Spracherkennung in Text mit Echtzeit-Übersetzungsfunktionen bietet, indem es Whisper lokal über MLX auf Apple Silicon ausführt. Die Transkription dauert etwa 500 ms, nachdem das Sprechen beendet wurde.

MCP-Server für semantische Suche in Obsidian-Vaults
Ein Entwickler hat einen MCP-Server erstellt, der Obsidian-Vaults in Qdrant mit lokalen Embeddings indiziert, um semantische Suche anstelle von Schlüsselwortabgleich zu ermöglichen. Er teilt Markdown nach Überschriften auf, verwendet BAAI/bge-small-en-v1.5-Embeddings und funktioniert mit Claude Code, Cursor, Windsurf oder jedem MCP-Client.