Lokale Buchübersetzungs-Pipeline nutzt Qwen 32B und Mistral 24B mit kontextuellem RAG

✍️ OpenClawRadar📅 Veröffentlicht: 1. April 2026🔗 Source
Lokale Buchübersetzungs-Pipeline nutzt Qwen 32B und Mistral 24B mit kontextuellem RAG
Ad

Ein Entwickler hat eine vollständig lokale, automatisierte Buchübersetzungs-Pipeline erstellt, die PDF-Dateien mit acht Python-Skripten in das ePub-Format konvertiert. Das System löst häufige Übersetzungsprobleme wie Kontextverlust und Formatierungsfehler durch einen mehrstufigen Arbeitsablauf.

Details zum Arbeitsablauf

Die Pipeline besteht aus acht Skripten, die den gesamten Prozess abdecken:

  • PDF-Extraktion: Nutzt Marker, um Inhalte aus PDFs zu extrahieren und dabei Formatierungselemente wie fettgedruckten Text, Kapitel und Bilder zu erhalten
  • Textsegmentierung: Teilt den extrahierten Text in handliche Abschnitte auf
  • Kontexterstellung: Vor der Übersetzung werden Auszüge aus dem gesamten Buch an Qwen 32B gesendet, um eine "Super-Bibel" zu erstellen – ein globales Glossar mit Charakteren, Ton und Atmosphäre
  • Übersetzung: Qwen 32B übersetzt jeden Textabschnitt unter Bezugnahme auf die Super-Bibel, um Konsistenz zu gewährleisten
  • Stilbearbeitung: Mistral 24B fungiert als Lektor, überprüft Qwens Übersetzungen und formuliert sie für einen perfekten literarischen Stil um
  • Zusammenfügung: Ein abschließendes Skript setzt alle übersetzten Abschnitte wieder zusammen, fügt Bilder erneut ein und nutzt Pandoc zur Ausgabe einer polierten ePub-Datei
Ad

Automatisierungsfunktionen

Das System enthält ein Überwachungsskript, das einen bestimmten Ordner beobachtet. Benutzer legen einfach eine PDF in diesen Ordner, und die Pipeline verarbeitet sie automatisch. Nach mehreren Stunden gibt das System sowohl die übersetzte ePub-Datei als auch einen Beleg mit der Verarbeitungszeit aus.

Der Entwickler merkt an, dass die Ergebnisse überraschend effektiv sind, wenn auch nicht zu 100 % perfekt, und erwähnt mehrere Verbesserungsideen. Das gesamte System läuft lokal auf einem persönlichen Computer, ohne externe Dienste zu benötigen.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Argus: Eine VS Code-Erweiterung zur Fehlerbehebung von Claude Code-Sitzungskosten und -Verhalten
Werkzeuge

Argus: Eine VS Code-Erweiterung zur Fehlerbehebung von Claude Code-Sitzungskosten und -Verhalten

Ein Entwickler hat Argus entwickelt, eine VS Code-Erweiterung, die Claude Code JSONL-Transkripte in eine Echtzeit-Zeitleiste mit detaillierten Kostenaufschlüsselungen pro Schritt, Cache-Trefferquote und Kennzeichnung von Wiederholungsschleifen, doppelten Lesevorgängen und Kontextüberlastung umwandelt.

OpenClawRadar
Kurzfassung schlägt Höhlenmensch-Plugin im Claude-Code-Kompressions-Benchmark
Werkzeuge

Kurzfassung schlägt Höhlenmensch-Plugin im Claude-Code-Kompressions-Benchmark

Ein Benchmark mit 24 Prompts zeigt, dass Claude Codes Höhlenmenschen-Komprimierungs-Plugin dieselbe Token-Anzahl und Qualität liefert wie das einfache Voranstellen von „sei kurz.“ – aber die konsistente Ausgabeform und Sicherheitsregeln des Plugins bieten strukturelle Vorteile.

OpenClawRadar
OpenClaw-Fähigkeit reduziert Agentenübergaben durch Ermöglichung der Selbstausführung
Werkzeuge

OpenClaw-Fähigkeit reduziert Agentenübergaben durch Ermöglichung der Selbstausführung

Eine neue Fähigkeit für OpenClaw-Agenten adressiert das häufige Problem, bei dem Agenten den nächsten Schritt identifizieren, aber bei 'Hier ist, was als Nächstes zu tun ist' stoppen und eine menschliche Übergabe erfordern. Die Fähigkeit ermöglicht es Agenten, bestimmte Aktionen selbst auszuführen, wie Registrieren, Posten, Antworten und Unterschreiben.

OpenClawRadar
Org Studio: Open-Source-Dashboard zur Verwaltung von Multi-Agenten-KI-Teams
Werkzeuge

Org Studio: Open-Source-Dashboard zur Verwaltung von Multi-Agenten-KI-Teams

Org Studio ist ein Open-Source-Dashboard, das Organisationsdesign-Prinzipien anwendet, um Teams von KI-Agenten zu koordinieren, mit nativer Unterstützung für sowohl OpenClaw- als auch Hermes-Agent-Laufzeitumgebungen. Es bietet Team-Topologie-Management, ereignisgesteuerte Aufgabenbretter und kommunikationsübergreifende Laufzeitumgebungen, in denen Agenten sich gegenseitig in Aufgabenkommentaren erwähnen können.

OpenClawRadar