Los marcas de agua de IA en texto siempre serán triviales de eliminar

El Artículo 50 de la Ley de IA de la UE, aplicable desde agosto de 2026, exige que los proveedores de LLM marquen el texto generado por IA. Pero la marca de agua en texto es un desafío fundamentalmente distinto al de las imágenes, y eliminarla sigue siendo trivial. Aquí tienes el desglose técnico.
Por qué es difícil marcar el texto
Las imágenes tienen ruido donde puedes ocultar marcas de agua; el texto no. No puedes modificar una frase sin que un humano lo note. Esto lo convierte en un problema de esteganografía donde el texto plano no puede manipularse arbitrariamente. Un enfoque ingenuo como "cada quinta letra es 'e'" comprometería la calidad de la salida.
¿Podría el propio modelo manejar la marca de agua? Los modelos potentes pueden, pero consume tokens de razonamiento y degrada la calidad de la salida, un mal equilibrio.
Por qué falla la detección mediante re-ejecución del modelo
Pasar el texto por el modelo para comprobar las probabilidades de los tokens no funciona: el espacio de texto humano que se lee como salida de IA es enorme, los falsos positivos abundan, y es prohibitivamente caro para que cada ciudadano de la UE obtenga una verificación gratuita.
Cómo funciona SynthID
SynthID de Google es la única marca de agua de texto pública. Asigna a cada token una puntuación basada en los tokens anteriores, por ejemplo, la suma de IDs de tokens módulo 5. Al muestrear, el modelo elige el token con mayor puntuación entre las cinco opciones probables. La detección agrega la puntuación en un bloque de texto; una puntuación agregada sospechosamente alta señala generación por IA.
Esto es como la heurística del guion largo, pero basada en patrones matemáticos sutiles que los humanos no pueden detectar.
El inconveniente
Pero cualquier marca de agua que preserve la diversidad léxica se puede eliminar mediante paráfrasis simple, sustitución de tokens o incluso traducción. Mientras el texto deba leerse de forma natural, se puede eliminar la señal con un esfuerzo mínimo. La robustez de SynthID es limitada: está diseñada para detección masiva, no para resistir la eliminación deliberada.
Espera que la UE aplique un requisito que es técnicamente insatisfactorio. Los laboratorios cumplirán con la letra, pero cualquiera que quiera podrá eludirlo en segundos.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Usuario de Reddit Argumenta que los Desarrolladores Deberían Cambiar de la Codificación Limpia a la Arquitectura de Modelos con Agentes de IA
Una publicación de Reddit argumenta que los desarrolladores que utilizan agentes de codificación con IA como Claude deberían dejar de centrarse en escribir código limpio y convertirse en 'arquitectos de modelos' que orquesten sistemas de IA. El autor comparte técnicas específicas, incluyendo crear 'mapas lógicos' antes de codificar y tratar los prompts como revisiones de diseño.

Claude Code v2.1.162 incluye información de espera de sesión, corrección de tiempo de espera de MCP y renovación de la vista de Agentes
Claude Code v2.1.162 añade `waitingFor` a la salida `--json`, corrige el error de timeout de MCP por debajo de 1000ms, mejora el renderizado del terminal para la vista de agentes y más. Detalles dentro.

Microsoft cancela licencias de Claude Code: agentes de IA demasiado costosos para escalar
Microsoft cancela la mayoría de las licencias directas de Claude Code y traslada a sus ingenieros a GitHub Copilot CLI. Uber agotó su presupuesto de IA para 2026 en 4 meses. El costo por tarea en tokens puede aumentar a pesar de la reducción de precios.

Anthropic Rechaza las Demandas del Pentágono para Eliminar Medidas de Seguridad, Pierde Contratos Federales
Anthropic rechazó las exigencias del Pentágono de eliminar las salvaguardas de seguridad de Claude para aplicaciones militares, lo que llevó a la cancelación de un contrato de 200 millones de dólares y a una orden presidencial que prohíbe el uso de su tecnología por parte de las agencias federales.