Mercúrio 2: Modelo Baseado em Difusão para Codificação em IA em Tempo Real

O que é o Mercury 2
O Mercury 2 é um modelo de IA baseado em difusão que gera tokens em paralelo, em vez de sequencialmente, usando um processo que refina a saída ao longo de várias etapas. Essa abordagem difere dos modelos autoregressivos tradicionais que decodificam tokens um por um.
Especificações Técnicas
- Método de geração: Geração baseada em difusão em vez de decodificação sequencial token por token
- Abordagem de processamento: Gera tokens em paralelo e os refina ao longo de algumas etapas
- Desempenho: Afirma 1.009 tokens/seg em GPUs NVIDIA Blackwell
- Preços: US$ 0,25 por 1 milhão de tokens de entrada, US$ 0,75 por 1 milhão de tokens de saída
- Janela de contexto: 128K tokens
- Capacidade de raciocínio: Raciocínio ajustável
- Integração de ferramentas: Uso nativo de ferramentas com saída JSON alinhada ao esquema
- Compatibilidade com API: Compatível com API OpenAI
Casos de Uso Alvo
Os desenvolvedores estão posicionando o Mercury 2 para:
- Assistentes de programação
- Loops agentivos (cadeias de inferência de múltiplas etapas)
- Sistemas de voz em tempo real
- Pipelines de RAG/busca com recuperação multi-hop
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

A Ferramenta MCI da Meta Captura Interações de Funcionários para Treinamento de IA
A Meta está instalando um software de rastreamento chamado Model Capability Initiative (MCI) nos computadores dos funcionários nos EUA para capturar movimentos do mouse, digitações, cliques e capturas de tela ocasionais para treinamento de modelos de IA. Os dados visam melhorar a capacidade da IA de replicar interações humanas com computadores, como seleção em menus suspensos e atalhos de teclado.

A Conformidade do Prompt do Sistema Claude se Degrada em Conversas Longas
Agentes baseados em Claude mostram conformidade degradada com prompts do sistema após 40-50 mensagens, com regras de formatação sendo ignoradas e restrições esquecidas. O problema surge porque os prompts do sistema competem com o histórico da conversa pelo peso de atenção na janela de contexto.

OpenClaw v2026.6.10: Modo Rápido Automático, Correções de Roteamento de Modelo e Políticas de Ferramentas Confiáveis
OpenClaw v2026.6.10 adiciona modo rápido automático, corrige roteamento de modelo para Z.ai GLM-5, melhora a identidade de sessão entre canais e torna as políticas de ferramentas confiáveis mais robustas.

Zumbificação da IA nas Universidades: Um Relato em Primeira Mão de Trapaças com LLMs em Faculdades de Elite
Uma análise de como os LLMs estão sistematicamente destruindo a integridade acadêmica em universidades de elite, com exemplos específicos da UChicago: lacunas de 40 pontos entre provas para casa e presenciais, alunos fotografando exames durante as provas e professores escrevendo aulas com ChatGPT.