Dos nuevos modelos aparecen en OpenRouter, posiblemente variantes de DeepSeek V4.

Dos nuevos modelos han aparecido en OpenRouter que podrían ser versiones de prueba de DeepSeek V4. Los modelos se llaman healer-alpha y hunter-alpha, con descripciones que sugieren que uno es una versión Lite y el otro parece ser un modelo con todas las funciones.
Especificaciones del Modelo
La versión completa tiene, según se informa, 1TB de parámetros y 1M de contexto, lo que coincide con la información filtrada sobre DeepSeek V4. La versión Lite se describe como una variante más ligera de la misma familia de modelos.
Resultados de las Pruebas Iniciales
Un usuario realizó pruebas de juego de roles para evaluar los niveles de filtrado y el rendimiento:
- Ambos modelos tuvieron un desempeño impresionante en escenarios de juego de roles
- Ninguno de los modelos rechazó ningún mensaje durante las pruebas
- La versión Lite es notablemente más rápida que la versión completa
- La versión completa es más lenta pero aún así es receptiva
- Ambos modelos generan la misma cantidad de tokens en menos de la mitad del tiempo en comparación con GLM 5.0
- La versión Lite es ligeramente más débil en rendimiento pero no de manera significativa
- Ambos modelos mantienen la consistencia del personaje y manejan bien el contenido "picante"
Los modelos se encuentran actualmente en fase alfa, lo que podría explicar la falta de filtrado de mensajes observada durante las pruebas. La comunidad está discutiendo si estos son realmente variantes de DeepSeek V4 y compartiendo resultados de pruebas adicionales.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Perspectivas del Proyecto Rust sobre la IA: Ideas Prácticas de los Colaboradores
Un documento de resumen recopila perspectivas de colaboradores de Rust sobre el uso de herramientas de IA, destacando que una integración efectiva de IA requiere ingeniería cuidadosa y mostrando casos de uso específicos como navegación de bases de código, asistencia en revisión de código y procesamiento de datos semiestructurados.

Memoria, ahora el 63% del costo de los chips de IA: gasto en HBM alcanza los 32 mil millones de dólares
Los datos de Epoch AI muestran que la participación de la memoria HBM en los costos de componentes de chips de IA subió del 52% al 63% entre el primer trimestre de 2024 y el cuarto trimestre de 2025. El gasto total en componentes creció de $22 mil millones a $52 mil millones, con HBM representando $20 mil millones de ese aumento.

xAI pierde desafío legal contra la ley de divulgación de datos de IA en California
xAI ha perdido su intento de bloquear la ley de divulgación de datos de IA de California, que requiere que las empresas revelen las fuentes de datos de entrenamiento y otros detalles sobre sus sistemas de IA. La decisión judicial significa que la ley procederá según lo programado.

Predicción Multi-Token MTP: Generación de Tokens 2x Más Rápida en AMD Strix Halo y Radeon 9700 AI Pro
MTP acelera la inferencia de LLM hasta 2x, especialmente para agentes de código. El video cubre la mecánica de MTP y el rendimiento en Qwen 3.6 con AMD Strix Halo y Dual Radeon 9700.