Merlin Research lanza el modelo Qwen3.5-4B-Safety-Thinking para razonamiento estructurado.

✍️ OpenClawRadar📅 Publicado: 17 de abril de 2026🔗 Source
Merlin Research lanza el modelo Qwen3.5-4B-Safety-Thinking para razonamiento estructurado.
Ad

Merlin Research ha lanzado Qwen3.5-4B-Safety-Thinking, un modelo de razonamiento alineado con la seguridad de 4 mil millones de parámetros basado en Qwen3.5. Este modelo está específicamente diseñado para aplicaciones de 'pensamiento' estructurado y seguridad en escenarios del mundo real, con especial atención a los sistemas de agentes.

Ad

Mejoras y características clave

  • Capacidad mejorada para seguir instrucciones estrictas en los prompts con precisión
  • Basado en el uso de los métodos Bloom y Petri de Anthropic
  • Resistente a intentos de hacking
  • Mayor resistencia a prompts 'anormales' y adversarios
  • Ventana de contexto de hasta 1 millón de tokens
  • Utiliza marcos de trabajo de Anthropic - Bloom y Petri

El modelo está disponible en Hugging Face en MerlinSafety/Qwen3.5-4B-Safety-Thinking.

Para los desarrolladores que trabajan con agentes de IA, este modelo representa una herramienta especializada para aplicaciones críticas de seguridad donde el razonamiento estructurado y la resistencia a la manipulación de prompts son prioridades. La integración de los métodos Bloom y Petri de Anthropic sugiere un enfoque en los enfoques de IA constitucional para la alineación.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Anthropic utiliza Google Forms para recibir comentarios sobre Claude
Noticias

Anthropic utiliza Google Forms para recibir comentarios sobre Claude

Anthropic, la empresa detrás de Claude, utiliza un formulario de Google de 2008 para recopilar comentarios de diseño en lugar de construir una herramienta personalizada, lo que destaca una filosofía pragmática de comprar versus construir.

OpenClawRadar
Anthropic restringe las suscripciones a Claude desde plataformas de terceros como OpenClaw.
Noticias

Anthropic restringe las suscripciones a Claude desde plataformas de terceros como OpenClaw.

Anthropic dejará de cubrir las suscripciones de Claude para herramientas de terceros como OpenClaw a partir del 4 de abril. Los usuarios deberán habilitar el uso adicional de pago por uso facturado por separado, con un crédito único equivalente al precio de la suscripción mensual disponible hasta el 17 de abril.

OpenClawRadar
Pentágono promete no tener más un solo proveedor de IA tras el incidente con Anthropic, firma acuerdos con AWS, Google, Microsoft, NVIDIA, OpenAI, Oracle, SpaceX
Noticias

Pentágono promete no tener más un solo proveedor de IA tras el incidente con Anthropic, firma acuerdos con AWS, Google, Microsoft, NVIDIA, OpenAI, Oracle, SpaceX

El subsecretario de Defensa, Emil Michael, dice que el Pentágono 'nunca más' dependerá de un único proveedor de modelos de IA, citando la complejidad de la integración y la reciente disputa con Anthropic. Los nuevos acuerdos con ocho empresas de IA buscan diversificar la pila tecnológica.

OpenClawRadar
La Startup de IA de Yann LeCun Recauda $1,000 Millones en la Mayor Ronda Semilla de Europa.
Noticias

La Startup de IA de Yann LeCun Recauda $1,000 Millones en la Mayor Ronda Semilla de Europa.

La startup de IA de Yann LeCun ha recaudado 1.000 millones de dólares en lo que se informa como la ronda de financiación inicial más grande de Europa. La noticia fue compartida en Hacker News con 186 puntos y 107 comentarios.

OpenClawRadar