Explorando o Flash da Etapa 3.5: Modelo de Código Aberto para Raciocínio Profundo Rápido

✍️ OpenClawRadar📅 Publicado: February 19, 2026🔗 Source
Explorando o Flash da Etapa 3.5: Modelo de Código Aberto para Raciocínio Profundo Rápido
Ad

O Step 3.5 Flash é um modelo de base de código aberto focado em fornecer capacidades de raciocínio profundo rápidas e confiáveis. Ele utiliza uma arquitetura esparsa de Mistura de Especialistas (MoE), ativando apenas 11 bilhões de seus 196 bilhões de parâmetros por token. Essa ativação seletiva lhe confere alta "densidade de inteligência", permitindo que ele compita com os melhores modelos proprietários enquanto permanece ágil para interações em tempo real.

Raciocínio Profundo e Velocidade

O modelo incorpora a Previsão de Múltiplos Tokens de 3 vias (MTP-3), permitindo que ele processe de 100 a 300 tokens por segundo, atingindo picos de 350 para tarefas de codificação de fluxo único — ideal para raciocínio complexo e de múltiplas etapas com resposta rápida.

Desempenho em Tarefas de Codificação e de Agente

O Step 3.5 Flash se destaca em tarefas de agente, apoiado por uma estrutura de aprendizado por reforço escalável que garante uma melhoria contínua. Ele alcançou uma pontuação de 74,4% no benchmark SWE-bench Verified e 51,0% no Terminal-Bench 2.0, refletindo sua capacidade de lidar com tarefas sofisticadas e de longo prazo.

Ad

Processamento Eficiente de Contexto Longo

Ele suporta uma grande janela de contexto de 256K usando uma proporção de Atenção por Janela Deslizante (SWA) de 3:1, integrando três camadas SWA para cada camada de atenção completa. Esse método reduz significativamente a sobrecarga computacional em comparação com os modelos tradicionais de contexto longo.

Implantação Local e Acessibilidade

Projetado para fácil implantação local, o Step 3.5 Flash pode ser executado com segurança em hardware de consumo de alta gama, como o Mac Studio M4 Max e o NVIDIA DGX Spark, garantindo a privacidade dos dados sem comprometer o desempenho.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

Encíclica do Papa Leão XIV sobre IA: Principais Pontos para Desenvolvedores
News

Encíclica do Papa Leão XIV sobre IA: Principais Pontos para Desenvolvedores

O Vaticano publicou uma encíclica sobre ética em IA. O documento destaca problemas de interpretabilidade de LLMs, vieses culturais nos dados de treinamento e o custo ambiental da IA.

OpenClawRadar
MicroVMs AWS Lambda: Isolamento em nível de VM para código gerado por usuário e IA, com suspensão/retomada de até 8 horas
News

MicroVMs AWS Lambda: Isolamento em nível de VM para código gerado por usuário e IA, com suspensão/retomada de até 8 horas

A AWS lança Lambda MicroVMs, um primitivo de computação serverless construído sobre o Firecracker, oferecendo isolamento por VM por usuário, inicialização quase instantânea e preservação de estado por até 8 horas para execução de código gerado por usuário/IA.

OpenClawRadar
🦀
News

IA Pointer do Google DeepMind: Reimaginando o Mouse para Interações Gemini

Google DeepMind apresenta um ponteiro de mouse com inteligência artificial que usa o Gemini para entender o contexto, permitindo comandos como apontar para uma imagem e dizer 'Mostre-me as direções', integrado ao Chrome e ao Googlebook.

OpenClawRadar
Claude-Code v2.1.92 adiciona assistente de configuração do Bedrock, detalhamento de custos e várias correções
News

Claude-Code v2.1.92 adiciona assistente de configuração do Bedrock, detalhamento de custos e várias correções

A versão Claude-Code v2.1.92 introduz um assistente interativo de configuração do AWS Bedrock, detalhamentos de custos por modelo para assinantes e correções para problemas de criação de subagentes, ganchos de prompt e exibição no terminal. A versão também remove os comandos /tag e /vim.

OpenClawRadar