Исследование Шага 3.5 Flash: открытая модель для быстрого глубокого рассуждения

✍️ OpenClawRadar📅 Опубликовано: 19 февраля 2026 г.🔗 Source
Исследование Шага 3.5 Flash: открытая модель для быстрого глубокого рассуждения
Ad

Шаг 3.5 Flash — это модель базового уровня с открытым исходным кодом, ориентированная на предоставление быстрых и надежных возможностей глубокого анализа. Она использует разреженную архитектуру Mixture of Experts (MoE), активируя только 11 миллиардов из 196 миллиардов своих параметров на токен. Эта избирательная активация обеспечивает ей высокую "плотность интеллекта", позволяя конкурировать с ведущими проприетарными моделями, оставаясь при этом гибкой для взаимодействия в реальном времени.

Глубокий анализ и скорость

Модель включает в себя прогнозирование с несколькими токенами (MTP-3), позволяя обрабатывать от 100 до 300 токенов в секунду, достигая пика в 350 для задач кодирования в одном потоке, что идеально подходит для сложного многошагового анализа с быстрой реакцией.

Производительность в кодировании и агентских задачах

Шаг 3.5 Flash отлично справляется с агентскими задачами, поддерживаемыми масштабируемой системой обучения с подкреплением, что обеспечивает непрерывное самоулучшение. Она достигла результата в 74,4% на верифицированном бенчмарке SWE-bench и 51,0% на Terminal-Bench 2.0, что отражает её способности в обработке сложных долгосрочных задач.

Ad

Эффективная обработка длинного контекста

Она поддерживает большой контекстный окно размером 256K, используя соотношение внимания с подвижным окном 3:1 (SWA), интегрируя три слоя SWA для каждого полного слоя внимания. Этот метод значительно снижает вычислительные затраты по сравнению с традиционными моделями для длинного контекста.

Локальное развертывание и доступность

Разработанная для простого локального развертывания, Шаг 3.5 Flash может безопасно работать на высокопроизводительном потребительском оборудовании, таком как Mac Studio M4 Max и NVIDIA DGX Spark, обеспечивая конфиденциальность данных без ущерба для производительности.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

Диагностика кэша подсказок Claude: анализ статистики показывает 98,9% коэффициент чтения из кэша
Новости

Диагностика кэша подсказок Claude: анализ статистики показывает 98,9% коэффициент чтения из кэша

Два дня назад Claude выпустил диагностику кэша промптов в Console. Один разработчик сообщает о 98,9% попаданий в кэш, причем 80% промахов вызваны изменением сообщений.

OpenClawRadar
Текущее состояние китайских больших языковых моделей: лидеры рынка, открытые модели и бизнес-модели
Новости

Текущее состояние китайских больших языковых моделей: лидеры рынка, открытые модели и бизнес-модели

Анализ на Reddit описывает ландшафт китайских больших языковых моделей (LLM), определяя Doubao от ByteDance как лидера на рынке проприетарных моделей, а DeepSeek — как самую инновационную компанию. В отчёте также изложены бизнес-модели основных игроков и «Шести AI-тигрят», которые сосредоточены на моделях с открытыми весами.

OpenClawRadar
Как подключить OpenClaw к Ollama удаленно
Новости

Как подключить OpenClaw к Ollama удаленно

Полный гид по подключению OpenClaw к Ollama с другого ПК, исследующий взгляды сообщества и практические шаги для бесшовной интеграции.

OpenClawRadar
Заметки о выпуске Claude Desktop 1.1.4498: Подпрыгивание в Dock, Расширение переменных окружения оболочки и Поддержка государственного облака
Новости

Заметки о выпуске Claude Desktop 1.1.4498: Подпрыгивание в Dock, Расширение переменных окружения оболочки и Поддержка государственного облака

Claude Desktop 1.1.4498 добавляет уведомления с подпрыгиванием в доке для привлечения внимания пользователя, расширяет извлечение переменных окружения оболочки, включая специфичные для Claude переменные, и вводит обнаружение государственных/пользовательских развертываний. Обновление также сокращает таймаут вызова инструментов Chrome bridge со 120 до 10 секунд.

OpenClawRadar