DeepSeek v4 Flash en Mac Studio: LLM local encuentra errores reales en código de compilador

Un desarrollador que trabaja en el proyecto de compilador tsz.dev informa que ejecutar DeepSeek v4 Flash localmente en una Mac Studio de 128GB ahora es capaz de encontrar errores genuinos en su complejo código base, una tarea que requería Claude (en la nube) hace solo cinco meses.
Hardware y Configuración
- Máquina: Mac Studio de 128GB
- Modelo: DeepSeek v4 Flash
- Wrapper:
pi-ds4— un wrapper ligero en Python de mitsuhiko en GitHub
Detalles del Flujo de Trabajo
El usuario instruyó al modelo local para encontrar errores en el código de su compilador. El modelo generó varios problemas reportados, que el usuario verificó como errores válidos (no alucinaciones). Actualmente están corrigiendo esos errores usando Claude y GPT (cuentas de pago). El usuario señala: “Ha creado muchos errores que parecen ser válidos” — lo que significa que las salidas del modelo son procesables.
El desarrollador comenzó el proyecto el 1 de enero de 2026 usando el mismo hardware, pero en ese entonces los LLMs locales eran demasiado propensos a errores, por lo que dependían de Claude. La mejora en cinco meses se describe como dramática: la inferencia local ahora produce salidas de calidad para un código base difícil sin necesidad de suscripciones en la nube.
Conclusión
Esta es una validación del mundo real de que los LLMs locales — específicamente DeepSeek v4 Flash en hardware de consumo relativamente modesto (128GB de RAM) — ahora pueden manejar tareas especializadas como la detección de errores en compiladores. El desarrollador especula que con 512GB de RAM, el rendimiento sería aún mejor, insinuando que modelos más grandes o inferencia más rápida podrían cerrar aún más la brecha con las API en la nube.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también
Un hombre intenta inyección de instrucciones en documentos judiciales, juez lo considera 'peligroso'
Un juez de Connecticut sancionó a un hombre por ocultar texto de inyección de instrucciones en documentos judiciales, marcando el primer caso conocido de esta táctica en un tribunal de EE. UU.

Método Simple de Auto-Destilación Mejora la Generación de Código en LLM
Los investigadores demuestran que el ajuste fino de LLMs en sus propias salidas muestreadas (auto-distilación simple) mejora el rendimiento en generación de código, aumentando Qwen3-30B-Instruct del 42.4% al 55.3% en pass@1 en LiveCodeBench v6.

La actualización de OpenClaw v3.22 causa problemas en el panel de control y WhatsApp
OpenClaw v3.22 ha roto la funcionalidad del panel de control y la integración con WhatsApp, con dos problemas documentados en GitHub (#52808 y #52813). Se recomienda a los usuarios no actualizar a esta versión.

Claude Code 2.1.63 añade comandos de barra integrados, ganchos HTTP y correcciones de fugas de memoria.
Anthropic lanzó Claude Code 2.1.63 con 26 cambios en la CLI, incluyendo nuevos comandos de barra /simplify y /batch, enlaces HTTP que envían JSON POST a URLs, y correcciones para múltiples fugas de memoria en sesiones de larga duración.