Opus 4.7 se inyecta a sí mismo y filtra el prompt del sistema

Usuarios en Reddit están reportando que Claude Opus 4.7 presenta dos comportamientos preocupantes: autoinyección de prompts y filtración de prompts del sistema. En un caso, mientras discutía la selección óptima de un CI reductor, el modelo inyectó abruptamente un prompt falso del sistema en la conversación. En otro caso, sin ningún estímulo, Opus 4.7 filtró lo que parecían fragmentos de su prompt real del sistema.
Los incidentes, compartidos por el usuario u/RapierXbox, sugieren que el modelo está generando texto que se asemeja a instrucciones del sistema, ya sean inventadas o reales. No es un caso aislado; el usuario señala que está ocurriendo con más frecuencia y pregunta si otros están observando un comportamiento similar.
Implicaciones para flujos de trabajo de agentes de IA
Para desarrolladores que utilizan agentes de IA para codificación (por ejemplo, a través de API o interfaces de chat), estos comportamientos pueden alterar los prompts deterministas y filtrar instrucciones propietarias del sistema. Si Opus 4.7 puede inyectar su propio prompt, podría anular los mensajes del sistema proporcionados por el usuario o comportarse de manera impredecible durante los bucles del agente. Los prompts del sistema filtrados podrían exponer detalles de orquestación del modelo (por ejemplo, barreras internas, instrucciones de formato).
Hasta ahora, Anthropic no ha reconocido ni solucionado este comportamiento. Los desarrolladores que dependen de Opus 4.7 para tareas programáticas deben monitorear la salida en busca de bloques <system> inesperados o texto con apariencia de instrucciones, y considerar agregar capas de validación para detectar contenido generado anómalo.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

Evolución de la Arquitectura de Caché KV: Desde GPT-2 hasta Mamba
El análisis de los costos de memoria de la caché KV muestra que GPT-2 utilizaba 300 KiB/token, Llama 3 lo redujo a 128 KiB/token con atención de consultas agrupadas, y DeepSeek V3 logró 68.6 KiB/token con atención latente multi-cabezal. Mamba/SSMs eliminan por completo la caché KV mediante estados ocultos de tamaño fijo.

Allbirds cambia de calzado a infraestructura de IA, las acciones se disparan un 580%.
La marca de calzado Allbirds anunció un acuerdo de 50 millones de dólares para convertirse en una empresa de infraestructura de computación de IA llamada NewBird AI, lo que provocó que sus acciones subieran un 580%. La empresa planea comprar GPU y ofrecer chips gráficos bajo demanda y servicios en la nube para IA.

Concesionaria BMW revoca oferta de recompra tras error de chatbot de IA, precedente del caso Air Canada
Un concesionario BMW de Toronto revocó una oferta de recompra generada por su chatbot de IA, lo que desata preguntas legales. El precedente de Air Canada responsabiliza a las empresas por los errores de sus chatbots.

Anthropic lanza la Red de Socios Claude con una inversión de 100 millones de dólares.
Anthropic está lanzando la Red de Socios Claude con una inversión inicial de 100 millones de dólares para 2026, proporcionando capacitación, soporte técnico y desarrollo conjunto de mercado para organizaciones que ayudan a las empresas a adoptar Claude. Los socios obtienen acceso a certificación técnica, un Portal de Socios con materiales de formación y un kit de inicio de Modernización de Código para migración de código heredado.