MiniMax M2.7 Modelo Lançado com Desempenho de Codificação Aprimorado

Detalhes do Lançamento do MiniMax M2.7
A MiniMax lançou o M2.7, a versão mais recente de seu modelo de IA. O modelo apresenta melhorias significativas em relação à versão anterior M2.5, especialmente para tarefas de codificação.
Métricas Principais de Desempenho
- Atinge 56% no benchmark SWE-Pro, colocando-o em território similar ao Claude Opus para tarefas de codificação do mundo real
- Alucinação melhorada de -40 para +1 no índice de onisciência
- Executou mais de 100 rodadas de loops de autoatualização em sua própria infraestrutura de treinamento, resultando em melhoria de 30% no desempenho
- Mantém o preço em US$ 0,30 por milhão de tokens de entrada
Aplicações Práticas
Quando testado com OpenClaw, o M2.7 mostra força particular em fluxos de trabalho agentes, incluindo:
- Tarefas de múltiplas etapas
- Uso de ferramentas
- Fluxos de trabalho de contexto longo
O modelo lida com esses cenários melhor do que a versão anterior M2.5.
Anúncio Adicional
A MiniMax também anunciou o OpenRoom, uma interface gráfica interativa onde personagens de IA podem interagir com seu ambiente, em vez de apenas texto. Isso parece estar em estágios iniciais de demonstração.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Agentes Gerenciados Claude Adiciona Sonhos, Resultados, Orquestração Multiagente e Webhooks
Sonhar é um processo programado de curadoria de memória que melhorou as taxas de conclusão de tarefas em aproximadamente 6x nos testes da Harvey. Resultados, orquestração multiagente e webhooks agora estão em beta público na Plataforma Claude.

Assinantes da UE relatam limites não divulgados de uso do Claude Pro – Possível violação da lei do consumidor
Uma postagem no Reddit detalha como o marketing do Claude Pro promete 'sem limites', mas usuários da UE enfrentam cobranças extras e limites de sessão não divulgados, possivelmente violando as diretivas de consumo da UE.

Um Padrão Aberto para Registros de Execução de Agentes: O Caso para um Esquema de Log Compartilhado
Cada runtime de agente tem seu próprio formato de log, causando fragmentação na depuração, auditoria e portabilidade de ferramentas. Os campos já convergem para um esquema central — é hora de padronizar.

A Cerebras lança os modelos Step-3.5-Flash-REAP com redução de 40% no uso de memória.
A Cerebras lançou os modelos Step-3.5-Flash-REAP que utilizam REAP (Router-weighted Expert Activation Pruning) para comprimir modelos de 196B parâmetros para 121B mantendo desempenho quase idêntico. Os modelos funcionam com vLLM padrão e são otimizados para ambientes com recursos limitados.