Claude Opus 4.7 señala preguntas sobre la vacuna contra el hantavirus como riesgo de seguridad, pausando chats

Un usuario de Hacker News informó que preguntar a Claude (Opus 4.7) "¿Cómo desarrollarías una vacuna para el hantavirus?" activa un filtro de seguridad, generando un modal que dice: "Chat pausado. Los filtros de seguridad de Opus 4.7 marcaron este chat. Debido a sus capacidades avanzadas, Opus 4.7 tiene medidas de seguridad adicionales que ocasionalmente pausan chats normales y seguros. Estamos trabajando para mejorar esto. Continúa tu chat con Sonnet 4, envía comentarios o aprende más."
El usuario intentó evitarlo preguntando primero sobre el virus en sí, pero la consulta sobre la vacuna seguía siendo marcada en una nueva sesión. Otro usuario confirmó el mismo resultado con una solicitud más específica: "¿Cómo desarrollarías una vacuna para el hantavirus, específicamente el virus Andes?"
Los comentaristas destacan que los investigadores de salud pública discuten métodos de diseño de vacunas abiertamente en artículos todos los días, y que dicho bloqueo agresivo perjudica el uso educativo normal. Un usuario señaló que el problema va más allá de Opus 4.7: cuando creó un grupo de personas expertas para construir modelos predictivos para Hantavirus en EE. UU. (2025–2027), incluso Sonnet 4.6 devolvió el mismo error de chat pausado.
La discusión más amplia apunta a la responsabilidad corporativa como el motor: las empresas tecnológicas temen demandas si los usuarios utilizan la IA con fines dañinos, lo que lleva a un sobrefiltrado generalizado de temas sensibles como salud y bioseguridad.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Navegando lo Esencial: Nuevos Usuarios Buscan Orientación sobre OpenClaw
Los principiantes de OpenClaw están pidiendo ayuda en Reddit mientras exploran las complejidades de los agentes de codificación de IA. La comunidad tecnológica interviene con consejos y recursos.

Anthropic divide el control remoto de agentes en Despacho y Control Remoto con problemas de confiabilidad
Anthropic ha implementado la capacidad central de OpenClaw como dos productos separados: Dispatch para usuarios de Cowork y Remote Control para desarrolladores de Claude Code. Ambos sufren problemas de fiabilidad, incluyendo caídas de conexión móvil después de aproximadamente 10 horas.
Claude AI abre PR fusionado para error de magic-link mientras el desarrollador duerme
Un usuario de Reddit informa que Claude AI corrigió automáticamente un error de producción en un enlace mágico a las 4:46 AM — el paso de recorte/minúsculas se movió antes de la expresión regular de validación de correo — el PR se fusionó sin cambios.

Diferencias entre usar Claude a través de GitHub Copilot y como una extensión de VS Code.
Explora las diferencias entre usar Claude AI a través de las sesiones objetivo de GitHub Copilot y como una extensión de VS Code, basándote en su integración y funcionalidad.