Extensión de Visual Studio 2022 Agrega Integración Nativa de Ollama para LLMs Locales

Un desarrollador ha lanzado una extensión nativa para Visual Studio 2022 que integra LLMs locales a través de Ollama, abordando preocupaciones de privacidad para desarrolladores empresariales que trabajan con bases de código propietarias.
Características Principales
- Operación 100% sin conexión: Conéctese a un endpoint local de Ollama en
http://localhost:11434/api/generatey seleccione modelos como DeepSeek o Llama 3 para asistencia de IA completamente privada. - Manipulación avanzada de texto: Seleccione bloques de código e instruya al modelo local para realizar tareas como "Eliminar duplicados", "Modificar y replicar variables" o limpiar código.
- Respaldo en la nube: Cambie a proveedores en la nube como GPT-4o o Claude 3 Opus para proyectos personales a través de la configuración de la extensión.
- Instalación: Disponible gratis en el mercado oficial de Visual Studio. Instálelo abriendo Visual Studio 2022, yendo al Administrador de extensiones y buscando "Local LLM Plugin Modern".
La extensión elimina la necesidad de cambiar entre terminal/navegador y Visual Studio cuando se usan modelos locales, manteniendo la continuidad del flujo de trabajo mientras se mantiene el código privado.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

SkyClaw v2.2 Runtime de Agente de IA en Rust Agrega OAuth de OpenAI y Creación de Herramientas Personalizadas
SkyClaw v2.2 introduce autenticación OAuth de OpenAI utilizando suscripciones ChatGPT Plus/Pro, creación de herramientas personalizadas donde los agentes escriben sus propias herramientas bash/python/node en tiempo de ejecución, y modo daemon para operación en segundo plano. El runtime basado en Rust tiene benchmarks de 31ms de arranque en frío, 15MB de RAM en reposo y 9.3MB de tamaño de binario.
Investigador Desarrolla Habilidad de Verificación de Veracidad para Código Claude, Encuentra Alucinaciones en su Propia Documentación
Un investigador creó una habilidad de Claude Code llamada /veracity-tweaked-555 que descompone documentos en afirmaciones atómicas y verifica cada una mediante búsqueda web utilizando 16 agentes paralelos en 4 oleadas. Al auditarse a sí misma, la habilidad obtuvo 62/100 debido a estadísticas fabricadas y afirmaciones exageradas en su propia documentación.

Benchmark Flash-MOE en M5 Max: 12.99 tok/s con Qwen3.5-397B
Una evaluación comparativa del modelo Qwen3.5 de 397 mil millones de parámetros ejecutándose localmente en un MacBook Pro M5 Max con 128 GB de RAM logró 12.99 tokens por segundo utilizando cuantización de 4 bits y cache-io-split 4, tres veces más rápido que la evaluación original de 48 GB.

Tiempo de inactividad LLM se activa a los 2 minutos en N100/WSL2 a pesar de la configuración timeoutSeconds
Un usuario informa que el watchdog inactivo en OpenClaw se dispara después de 2 minutos en hardware N100/WSL2, ignorando la configuración timeoutSeconds=300, debido a un inicio lento de la puerta de enlace (más de 45 segundos) y a la falta de un noOutputTimeoutMs configurable.