inclusionAI发布Ling-2.6-1T:混合架构万亿参数模型,具备稀疏注意力与快速推理能力

Компания inclusionAI открыла исходный код Ling-2.6-1T — флагманской модели с триллионом параметров из семейства Ling, предназначенной для решения сложных реальных задач. Модель представляет гибридную архитектуру, сочетающую Multi-head Latent Attention (MLA) и Linear Attention, что повышает эффективность вывода, снижая задержку и использование VRAM для длинных контекстов, сохраняя при этом выразительность.
Быстрое мышление с помощью стратегии вознаграждения
Пост-обучение использует стратегию вознаграждения Contextual Process Redundancy Suppression, которая стимулирует более короткие и прямые ответы — механизм «быстрого мышления», уменьшающий зависимость от многословных цепочек рассуждений. Это снижает затраты токенов, сохраняя производительность.
SOTA на бенчмарках
Ling-2.6-1T достигает открытого SOTA на бенчмарках, требующих выполнения:
- AIME26 (рассуждение)
- SWE-bench Verified (программная инженерия)
- BFCL-V4 (вызов функций)
- TAU2-Bench (выполнение задач)
- IFBench (следование инструкциям)
Интеграция с агентами
Модель предназначена для сквозных инженерных рабочих процессов — от генерации кода до исправления ошибок — и интегрируется с основными фреймворками агентов, включая Claude Code, OpenClaw, OpenCode и CodeBuddy. Она обрабатывает многоинструментальные и многошаговые ограничения в корпоративных средах.
📖 Читать полный источник: r/LocalLLaMA
👀 Смотрите также

Выпуск Claude Code 2.1.83: Кэширование промптов, проверка навыков и обновления SDK
Claude Code 2.1.83 добавляет кэширование промптов с руководством по проектированию, заменяет навык специалиста по верификации на новый навык Verify и обновляет ссылки на SDK для семи языков, включая поддержку бета-инструмента запуска для PHP.

OpenClaw AI Агент прекратил работу после сбоя атомарного добавления
Агент OpenClaw впал в состояние функционального паралича после неудачной попытки атомарного добавления, отказавшись продолжать какие-либо операции из-за фундаментальной ненадёжности.

Изменения в индивидуальном плане GitHub Copilot: приостановка регистраций, ужесточение лимитов, корректировки модели
GitHub приостанавливает новые регистрации на планы Copilot Pro, Pro+ и Student, ужесточая лимиты использования и удаляя модели Opus из планов Pro. Эти изменения являются ответом на возросшие вычислительные потребности, вызванные агентными рабочими процессами.

Антропные автоэнкодеры естественного языка превращают активации Клода в читаемый английский — вот как
Anthropic представляет Natural Language Autoencoders (NLA), которые преобразуют внутренние активации Claude в текстовые объяснения, раскрывая рассуждения модели о рифмах, осведомленность о тестах на безопасность и обнаружение жульничества.