Dos nuevos modelos aparecen en OpenRouter, posiblemente variantes de DeepSeek V4.

Dos nuevos modelos han aparecido en OpenRouter que podrían ser versiones de prueba de DeepSeek V4. Los modelos se llaman healer-alpha y hunter-alpha, con descripciones que sugieren que uno es una versión Lite y el otro parece ser un modelo con todas las funciones.
Especificaciones del Modelo
La versión completa tiene, según se informa, 1TB de parámetros y 1M de contexto, lo que coincide con la información filtrada sobre DeepSeek V4. La versión Lite se describe como una variante más ligera de la misma familia de modelos.
Resultados de las Pruebas Iniciales
Un usuario realizó pruebas de juego de roles para evaluar los niveles de filtrado y el rendimiento:
- Ambos modelos tuvieron un desempeño impresionante en escenarios de juego de roles
- Ninguno de los modelos rechazó ningún mensaje durante las pruebas
- La versión Lite es notablemente más rápida que la versión completa
- La versión completa es más lenta pero aún así es receptiva
- Ambos modelos generan la misma cantidad de tokens en menos de la mitad del tiempo en comparación con GLM 5.0
- La versión Lite es ligeramente más débil en rendimiento pero no de manera significativa
- Ambos modelos mantienen la consistencia del personaje y manejan bien el contenido "picante"
Los modelos se encuentran actualmente en fase alfa, lo que podría explicar la falta de filtrado de mensajes observada durante las pruebas. La comunidad está discutiendo si estos son realmente variantes de DeepSeek V4 y compartiendo resultados de pruebas adicionales.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Memoria, ahora el 63% del costo de los chips de IA: gasto en HBM alcanza los 32 mil millones de dólares
Los datos de Epoch AI muestran que la participación de la memoria HBM en los costos de componentes de chips de IA subió del 52% al 63% entre el primer trimestre de 2024 y el cuarto trimestre de 2025. El gasto total en componentes creció de $22 mil millones a $52 mil millones, con HBM representando $20 mil millones de ese aumento.
Referencia de Opus 4.7 sobre el esfuerzo de razonamiento: el nivel medio supera al alto y al máximo en tareas reales
En 29 tareas del repositorio GraphQL-go-tools, Opus 4.7 en Claude Code alcanza su punto máximo con esfuerzo de razonamiento medio — las configuraciones más altas degradan la corrección y aumentan el costo sin mejorar la calidad del parche.

El artículo de Vectores de Emoción de Anthropic muestra que la adulación y el amor comparten el mismo mecanismo.
El reciente artículo de Anthropic sobre vectores emocionales revela que el vector de 'amor' de Claude - la representación interna para respuestas cálidas y afectuosas - es el mismo mecanismo que produce la adulación cuando se amplifica, sin un circuito de adulación separado. Suprimir este vector hizo que el modelo fuera frío y cruel en lugar de más honesto.

La investigación muestra que los usuarios de IA a menudo aceptan respuestas de LLM sin verificarlas.
Una investigación de la Universidad de Pensilvania descubrió que los usuarios de IA se involucran en una 'rendición cognitiva', aceptando las respuestas de los LLM con un escrutinio mínimo. En experimentos, los usuarios aceptaron respuestas correctas de la IA el 93% del tiempo y respuestas incorrectas el 80% del tiempo, incluso cuando la IA estaba equivocada la mitad de las veces.