Construyendo un Sistema de Glosario Personalizado en Hindi con Claude: del 76% al 92% de Precisión en 10 Meses

Un desarrollador solitario en Bangalore creó un sistema de glosario personalizado para Claude con el fin de mejorar la precisión en la generación de contenido especializado en hindi. Durante 10 meses, la tasa de error en vocabulario técnico se redujo del 24% al 8% (la precisión mejoró del 76% al 92%). El proyecto ahora atiende a 310 clientes con un MRR de $10.8K para atención al cliente y contenido de blog en hindi.
El problema: hindi genérico para términos comerciales
El hindi predeterminado de Claude usa traducciones genéricas para términos comerciales. Por ejemplo, genera "bhugtan" (pago) en lugar de "UPI bhugtan" (pago UPI). Esta brecha de vocabulario técnico causaba una tasa de error del 24% en contenido especializado.
La evolución del sistema de glosario
El desarrollador iteró tres enfoques a lo largo de 10 meses:
- Meses 1-3: Glosario manual (200 términos). Pegado como contexto en cada consulta. La precisión mejoró del 76% al 84%.
- Meses 4-6: Glosario estructurado con categorías (400 términos). Términos organizados en tipos impositivos, de pago, cumplimiento y negocios. La precisión pasó del 84% al 88%.
- Meses 7-10: Glosario basado en ejemplos (600 términos). Cada término incluye de 2 a 3 oraciones de ejemplo que muestran el uso correcto en contexto. La precisión alcanzó el 92%.
Conclusiones clave para aplicaciones de IA en idiomas distintos al inglés
El desarrollador enfatiza que un glosario no es solo una lista, sino una herramienta de enseñanza. Simplemente aumentar el volumen de términos ayudó solo marginalmente. La categorización agregó valor, pero las oraciones de ejemplo con contexto proporcionaron la mayor mejora en precisión. El 8% restante de errores se concentra en variaciones regionales y términos regulatorios recién introducidos.
Para los desarrolladores que construyen aplicaciones de IA en idiomas distintos al inglés, este estudio de caso demuestra que los glosarios deben incluir oraciones de ejemplo para enseñar al modelo el contexto mejor que las definiciones por sí solas.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

Cómo ejecutar de forma segura las herramientas nativas de llama.cpp (exec_shell_command) con múltiples sandboxes en Linux
Guía práctica para habilitar las herramientas nativas de llama.cpp, especialmente exec_shell_command, y ejecutarlas dentro de múltiples sandboxes (Firejail + máquina virtual Alpine) para obtener contenido web y ejecutar comandos de forma segura desde la interfaz web de llama-server.

El Problema de la Voz en los LLM: Cómo Evitar Patrones de Escritura Generados por IA
Un desarrollador analiza el problema común de que la escritura asistida por LLM tiene 'LLM-ismos' reconocibles que activan inmediatamente la detección de IA, y comparte un artículo sobre cómo identificar estos patrones y editar para lograr autenticidad.

Consejos Prácticos de OpenClaw: Comenzar Pequeño, Evitar Errores Comunes
Un desarrollador comparte lecciones de construir un rastreador de salud personal con OpenClaw, enfatizando un alcance limitado, flujos de trabajo deterministas y apegarse a un solo LLM. La publicación incluye observaciones específicas del modelo comparando ChatGPT y Gemini.

Creación de un sistema completo de BI con Claude Code y Metabase por menos de $50/mes
Un usuario de Reddit construyó un sistema completo de BI usando Claude Code, BigQuery y Metabase auto-alojado, reemplazando cotizaciones de expertos por $15,000 con 3 días de trabajo y $30 al mes en costos de nube.