Merlin Research lanza el modelo Qwen3.5-4B-Safety-Thinking para razonamiento estructurado.

✍️ OpenClawRadar📅 Publicado: 17 de abril de 2026🔗 Source
Merlin Research lanza el modelo Qwen3.5-4B-Safety-Thinking para razonamiento estructurado.
Ad

Merlin Research ha lanzado Qwen3.5-4B-Safety-Thinking, un modelo de razonamiento alineado con la seguridad de 4 mil millones de parámetros basado en Qwen3.5. Este modelo está específicamente diseñado para aplicaciones de 'pensamiento' estructurado y seguridad en escenarios del mundo real, con especial atención a los sistemas de agentes.

Ad

Mejoras y características clave

  • Capacidad mejorada para seguir instrucciones estrictas en los prompts con precisión
  • Basado en el uso de los métodos Bloom y Petri de Anthropic
  • Resistente a intentos de hacking
  • Mayor resistencia a prompts 'anormales' y adversarios
  • Ventana de contexto de hasta 1 millón de tokens
  • Utiliza marcos de trabajo de Anthropic - Bloom y Petri

El modelo está disponible en Hugging Face en MerlinSafety/Qwen3.5-4B-Safety-Thinking.

Para los desarrolladores que trabajan con agentes de IA, este modelo representa una herramienta especializada para aplicaciones críticas de seguridad donde el razonamiento estructurado y la resistencia a la manipulación de prompts son prioridades. La integración de los métodos Bloom y Petri de Anthropic sugiere un enfoque en los enfoques de IA constitucional para la alineación.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también