inclusionAI lanza Ling-2.6-1T: Modelo de billón de parámetros con arquitectura híbrida, atención dispersa y pensamiento rápido

inclusionAI ha lanzado como código abierto Ling-2.6-1T, un modelo insignia con un billón de parámetros de la familia Ling, orientado a tareas complejas del mundo real. El modelo introduce una arquitectura híbrida que combina Atención Latente Multi-Cabeza (MLA) y Atención Lineal para mejorar la eficiencia de inferencia, reduciendo la latencia y el uso de VRAM en contextos largos mientras mantiene la expresividad.
Razonamiento Rápido mediante Estrategia de Recompensa
El post-entrenamiento utiliza una estrategia de recompensa de Supresión de Redundancia de Procesos Contextuales, que fomenta salidas más cortas y directas — un mecanismo de "razonamiento rápido" que reduce la dependencia de cadenas de pensamiento verbosas. Esto reduce el consumo de tokens mientras mantiene el rendimiento.
SOTA en Benchmarks
Ling-2.6-1T logra el SOTA de código abierto en benchmarks intensivos en ejecución:
- AIME26 (razonamiento)
- SWE-bench Verified (ingeniería de software)
- BFCL-V4 (llamadas a funciones)
- TAU2-Bench (finalización de tareas)
- IFBench (seguimiento de instrucciones)
Integración con Agentes
El modelo está diseñado para flujos de trabajo de ingeniería de extremo a extremo — desde generación de código hasta corrección de errores — y se integra con frameworks de agentes principales como Claude Code, OpenClaw, OpenCode y CodeBuddy. Maneja restricciones de múltiples herramientas y múltiples pasos en entornos empresariales.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Análisis: Los costos reales de cómputo de Anthropic para los usuarios de Claude Code son mucho más bajos que la cifra reportada de $5,000.
Un artículo reciente analiza la afirmación de que el plan Claude Code Max de $200/mes de Anthropic consume $5,000 en cómputo, encontrando que los costos reales de inferencia son aproximadamente el 10% de los precios de la API al comparar con modelos de peso abierto competitivos en OpenRouter.

Análisis de Problemas de Evaluación Comparativa de TB2 en la Tarea de Recuperación de WAL de la Base de Datos
Un análisis de Reddit revela problemas con la tarea db-wal-recovery de Terminal Bench 2.0, donde los agentes pueden destruir accidentalmente evidencia al abrir bases de datos SQLite, y muestra cómo la inyección de prompts afecta los resultados del ranking.

Claude-Code v2.1.30 lanzado con mejoras en PDF y OAuth.
Claude-Code v2.1.30 introduce mejoras en la lectura de PDF, OAuth preconfigurado para servidores MCP y varias correcciones y mejoras.

Competencia de Proteómica de Bohrium AI 2026 con Premio de $13K y Soporte de Computación
Bohrium está organizando una competencia de proteómica con IA en 2026 con un premio de $13,000, oportunidades de pasantías y soporte de cómputo. La competencia fue discutida en Hacker News con 17 puntos y 5 comentarios.