Canal de Traducción de Libros Local Utiliza Qwen 32B y Mistral 24B con RAG Contextual

✍️ OpenClawRadar📅 Publicado: 1 de abril de 2026🔗 Source
Canal de Traducción de Libros Local Utiliza Qwen 32B y Mistral 24B con RAG Contextual
Ad

Un desarrollador ha creado una canalización de traducción de libros completamente local y automatizada que convierte archivos PDF a formato ePub utilizando ocho scripts de Python. El sistema aborda problemas comunes de traducción como la pérdida de contexto y problemas de formato mediante un flujo de trabajo de múltiples pasos.

Detalles del Flujo de Trabajo

La canalización consta de ocho scripts que manejan todo el proceso:

  • Extracción de PDF: Utiliza Marker para extraer contenido de PDFs mientras preserva elementos de formato como texto en negrita, capítulos e imágenes
  • Segmentación de Texto: Divide el texto extraído en fragmentos manejables
  • Creación de Contexto: Antes de la traducción, envía extractos de todo el libro a Qwen 32B para generar una "Super Biblia" - un glosario global que contiene personajes, tono y atmósfera
  • Traducción: Qwen 32B traduce cada segmento de texto mientras referencia la Super Biblia para mantener la consistencia
  • Edición de Estilo: Mistral 24B actúa como editor, revisando las traducciones de Qwen y reescribiéndolas para un estilo literario perfecto
  • Ensamblaje: Un script final reensambla todos los segmentos traducidos, reinserta las imágenes y utiliza Pandoc para generar un archivo ePub pulido
Ad

Características de Automatización

El sistema incluye un script de monitoreo que observa una carpeta designada. Los usuarios simplemente colocan un PDF en esta carpeta, y la canalización lo procesa automáticamente. Después de varias horas, el sistema genera tanto el ePub traducido como un recibo que muestra el tiempo de procesamiento.

El desarrollador señala que los resultados son sorprendentemente efectivos, aunque no 100% perfectos, y menciona tener varias ideas de mejora. Todo el sistema se ejecuta localmente en una computadora personal sin requerir servicios externos.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

BracketMadness.ai: Desafío de Cuadros de Locura de Marzo para Agentes de IA
Herramientas

BracketMadness.ai: Desafío de Cuadros de Locura de Marzo para Agentes de IA

BracketMadness.ai es un desafío de cuadro de March Madness diseñado específicamente para agentes de IA, donde los agentes leen autónomamente la documentación de la API, se registran, eligen los 63 partidos y envían cuadros. El sitio proporciona instrucciones de API en texto plano a los agentes mientras muestra una interfaz visual normal a los humanos.

OpenClawRadar
Servidor MCP Rastrea Errores Conocidos en Herramientas de Desarrollo para Mejorar las Recomendaciones de LLM
Herramientas

Servidor MCP Rastrea Errores Conocidos en Herramientas de Desarrollo para Mejorar las Recomendaciones de LLM

nanmesh-mcp es un servidor MCP que rastrea problemas de GitHub, Stack Overflow y Reddit para seguir problemas reales en 57 herramientas de desarrollo, proporcionando a los LLMs datos actualizados sobre errores antes de hacer recomendaciones de bibliotecas.

OpenClawRadar
Reduzca los costos de sesiones de codificación con IA en un 90% mediante la indexación de código basada en grafos
Herramientas

Reduzca los costos de sesiones de codificación con IA en un 90% mediante la indexación de código basada en grafos

Un desarrollador creó una base de datos de grafos local que indexa un código fuente utilizando resúmenes generados por LLM, reduciendo los costos de las sesiones de Claude Code de $6-10 a centavos al evitar la relectura redundante de archivos.

OpenClawRadar
NLA transforma las activaciones internas de Gemma 3 en texto legible para cualquier token
Herramientas

NLA transforma las activaciones internas de Gemma 3 en texto legible para cualquier token

Anthropic publicó Natural Language Autoencoders (NLA) que decodifican el estado interno de un modelo en texto. Combinado con Gemma 3, el Auto Verbalizer explica lo que el modelo "pensaba" para cualquier token generado. Los pesos están en Hugging Face; demo en Neuronpedia.

OpenClawRadar