Dois novos modelos aparecem no OpenRouter, possivelmente variantes do DeepSeek V4

Dois novos modelos apareceram no OpenRouter que podem ser versões de teste do DeepSeek V4. Os modelos são chamados healer-alpha e hunter-alpha, com descrições sugerindo que um é uma versão Lite e o outro parece ser um modelo completo.
Especificações dos Modelos
A versão completa supostamente tem 1TB de parâmetros e 1M de contexto, o que corresponde às informações vazadas sobre o DeepSeek V4. A versão Lite é descrita como uma variante mais leve da mesma família de modelos.
Resultados dos Testes Iniciais
Um usuário conduziu testes de roleplay para avaliar os níveis de filtragem e o desempenho:
- Ambos os modelos tiveram desempenho impressionante em cenários de roleplay
- Nenhum dos modelos recusou mensagens durante os testes
- A versão Lite é visivelmente mais rápida que a versão completa
- A versão completa é mais lenta, mas ainda responsiva
- Ambos os modelos geram a mesma quantidade de tokens em menos da metade do tempo em comparação com o GLM 5.0
- A versão Lite é um pouco mais fraca em desempenho, mas não significativamente
- Ambos os modelos mantêm consistência de personagem e lidam bem com conteúdo "picante"
Os modelos estão atualmente na fase alfa, o que pode explicar a falta de filtragem de mensagens observada durante os testes. A comunidade está discutindo se estes são realmente variantes do DeepSeek V4 e compartilhando resultados adicionais de testes.
📖 Read the full source: r/LocalLLaMA
👀 See Also

O modelo ternário Bonsai 1.7B atinge 442 T/s no M4 Max com kernels Metal ajustados autonomamente
O agente autônomo ata otimizou kernels Metal para Bonsai 1.7B Q2_0, alcançando 442 t/s decodificação (+42%) e 4622 t/s prefill (+9%) no M4 Max vs llama.cpp não modificado.

Investimento de US$ 200 bilhões da Micron visa a restrições de memória para IA
Micron compromete US$ 200 bilhões para resolver gargalos de memória em IA, visando aprimorar as capacidades de processamento de inteligência artificial.

Cliente OpenClaw Adiciona Rastreamento de Custos e Limites de Gastos por Agente
Novo lançamento adiciona limites de gastos por agente, interface de uso ao vivo com barra de progresso circular, gerenciamento de subagentes, alternância de habilidades e seleção de modelo por agente.

Exame de Arquiteto Certificado Claude Foundations (CCA-F): Nota 985/1000 — Guia de Estudo e Teste Simulado
Um usuário do Reddit compartilha ter obtido 985/1000 no novo exame Claude Certified Architect Foundations (CCA-F). Inclui insights práticos sobre engenharia de prompt, janelas de contexto e fluxos de trabalho Humano-no-Loop, além de links para cursos de treinamento, cookbook e um simulado gratuito.