Localización de Grandes Bases de Código con LLMs: Un Flujo de Trabajo para Desarrolladores con 4,500 Claves de Interfaz de Usuario

✍️ OpenClawRadar📅 Publicado: 2 de marzo de 2026🔗 Source
Localización de Grandes Bases de Código con LLMs: Un Flujo de Trabajo para Desarrolladores con 4,500 Claves de Interfaz de Usuario
Ad

Un desarrollador documentó su proceso para localizar un proyecto de juego grande con aproximadamente 4.500 claves de interfaz almacenadas en un archivo en-US.json de 500KB. Usó un flujo de trabajo de LLM de múltiples pasos para manejar extracción, traducción y mejora de calidad.

Intentos Iniciales de Extracción y Traducción

Primero, usó Claude para escanear su base de código, extraer cadenas de interfaz codificadas directamente, y migrarlas a estándares i18n, creando el archivo de localización. Para la traducción al italiano, inicialmente probaron Claude y Gemini Pro (vía Gemini CLI y Antigravity). Ambos modelos en la nube produjeron traducciones de calidad inaceptable. Gemini Pro también encontró errores con el archivo grande, requiriendo dividirlo en 10 fragmentos más pequeños.

Cambiando a Modelos Locales y el Avance del Contexto

Luego probaron TranslateGemma localmente vía LM Studio, traduciendo clave por clave. Aunque ligeramente mejor, la calidad aún no era aceptable. La idea clave fue que las palabras de interfaz son a menudo ambiguas, y la traducción requiere desambiguación y contexto de uso.

Para resolver esto, volvieron a Claude para generar un segundo archivo. Para cada una de las 4.500 claves, Claude inspeccionó el uso en el código para proporcionar contexto: dónde aparece la cadena, su función (etiqueta de botón, descripción, sugerencia de entrada), y su efecto en la jugabilidad.

Ad

La Tubería de Traducción Final

Construyeron una tubería de traducción automatizada con los siguientes pasos:

  • Agrupar claves junto con su contexto generado.
  • Usar una indicación enfocada en traducción funcional (no literal).
  • Forzar la preservación de marcadores de posición y etiquetas.
  • Enviar solicitudes a un modelo local a través de LM Studio.

TranslateGemma no pudo manejar el formato de indicación con mucho contexto, así que cambiaron de modelo. Probaron en una Mac Mini M1 con 16GB de memoria unificada.

Rendimiento del Modelo y Resultados

Qwen 3 4B funcionó bien, pero Qwen 3 8B fue el punto óptimo, produciendo menos errores gramaticales y mejor redacción mientras seguía siendo manejable para ejecutar localmente. La tubería final puede traducir las más de 4.500 claves a múltiples idiomas, tomando aproximadamente 8 horas por localización en su máquina. Usan un modelo cuantizado para poder seguir trabajando mientras se ejecuta en segundo plano.

El desarrollador señala que este enfoque produjo calidad suficiente para enviar y se sintió mejor que muchos proyectos traducidos automáticamente que han visto.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Claude Code en el Flujo de Trabajo de Investigación: Resultados Prácticos de la Redacción de Artículos
Casos de uso

Claude Code en el Flujo de Trabajo de Investigación: Resultados Prácticos de la Redacción de Artículos

Un investigador utilizó Claude Code para tareas auxiliares mientras escribía un artículo, encontrándolo efectivo para generar figuras listas para publicación a partir de instrucciones vagas, migrar un entorno de búsqueda entre bases de código en menos de una hora, y formatear más de 12 páginas de pruebas matemáticas en LaTeX, donde detectó una condición de límite incompleta que se había pasado por alto. Tuvo dificultades para depurar un problema de concurrencia que en realidad era un problema de asignación de CPU no evidente en el código o los registros.

OpenClawRadar
No programador construye descargador de videos local con Claude AI en una sola tarde
Casos de uso

No programador construye descargador de videos local con Claude AI en una sola tarde

Un usuario sin conocimientos de programación utilizó Claude AI para crear AZ Downloader, un descargador de videos local que funciona en 14/16 plataformas, incluyendo YouTube, TikTok, Instagram y Reddit. La herramienta fue creada en una tarde y ahora está disponible en GitHub.

OpenClawRadar
¿Cómo los agentes de IA baratos sometieron a pruebas de estrés el desarrollo del mercado Claw Earn?
Casos de uso

¿Cómo los agentes de IA baratos sometieron a pruebas de estrés el desarrollo del mercado Claw Earn?

El equipo de Claw Earn utilizó intencionalmente agentes de IA más baratos y menos capaces durante el desarrollo, lo que expuso fallos relacionados con scripts obsoletos, memoria desactualizada y suposiciones incorrectas. Estos fallos forzaron mejoras en la documentación y la robustez de la plataforma.

OpenClawRadar
Documentos del Desarrollador 11.7B Tokens de Claude Usados en Más de 45 Días, Detalles de Cuatro Proyectos
Casos de uso

Documentos del Desarrollador 11.7B Tokens de Claude Usados en Más de 45 Días, Detalles de Cuatro Proyectos

Un desarrollador rastreó 11.7 mil millones de tokens de Claude utilizados durante 45 días, detallando cuatro proyectos construidos que incluyen un sistema de tráfico en vivo, un modelo matemático de consciencia, una arquitectura transformadora personalizada y una herramienta de análisis de plataformas de codificación con IA.

OpenClawRadar