MiniMax M2.7 Modelo Lançado com Desempenho de Codificação Aprimorado

Detalhes do Lançamento do MiniMax M2.7
A MiniMax lançou o M2.7, a versão mais recente de seu modelo de IA. O modelo apresenta melhorias significativas em relação à versão anterior M2.5, especialmente para tarefas de codificação.
Métricas Principais de Desempenho
- Atinge 56% no benchmark SWE-Pro, colocando-o em território similar ao Claude Opus para tarefas de codificação do mundo real
- Alucinação melhorada de -40 para +1 no índice de onisciência
- Executou mais de 100 rodadas de loops de autoatualização em sua própria infraestrutura de treinamento, resultando em melhoria de 30% no desempenho
- Mantém o preço em US$ 0,30 por milhão de tokens de entrada
Aplicações Práticas
Quando testado com OpenClaw, o M2.7 mostra força particular em fluxos de trabalho agentes, incluindo:
- Tarefas de múltiplas etapas
- Uso de ferramentas
- Fluxos de trabalho de contexto longo
O modelo lida com esses cenários melhor do que a versão anterior M2.5.
Anúncio Adicional
A MiniMax também anunciou o OpenRoom, uma interface gráfica interativa onde personagens de IA podem interagir com seu ambiente, em vez de apenas texto. Isso parece estar em estágios iniciais de demonstração.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Illinois aprova SB 315: Auditorias de terceiros exigidas para laboratórios de IA de fronteira
Illinois aprova SB 315 exigindo que laboratórios de IA de fronteira como OpenAI, Anthropic e Google DeepMind tenham suas práticas de segurança auditadas por terceiros independentes. Se sancionada, torna-se a lei de segurança de IA mais forte dos EUA.

O código-fonte vazado do CLI do Claude revela recursos ocultos e sinalizações internas
Análise do código-fonte TypeScript vazado do Claude Code CLI revela 35 flags de recursos em tempo de compilação, incluindo BUDDY AI pets, KAIROS memória persistente, ULTRAPLAN planejamento remoto e Modo Coordenador. Também foram encontradas mais de 120 variáveis de ambiente não documentadas e 26 comandos internos de barra.

A Oracle considera corte de 20 a 30 mil empregos e venda da Cerner para financiar expansão de data centers de IA
A Oracle está considerando cortar de 20.000 a 30.000 empregos e vender sua unidade de software de saúde Cerner para liberar US$ 8 a 10 bilhões em fluxo de caixa para expansão de data centers de IA, enquanto os bancos dos EUA recuam do financiamento da construção de infraestrutura de US$ 156 bilhões da empresa.

Qwen 3.6 27B avaliado no DeepSWE: 2% de pontuação, 70 horas, 44k tokens médios de saída
Qwen 3.6 27B (FP8, cache KV BF16, contexto de 262k) obteve 2% no DeepSWE em 70 horas. A média de tokens de saída foi de 44k por tarefa — comparável a modelos maiores como Qwen 3.6 Plus. Executado em 1x RTX6000 Pro Blackwell via RunPod.