Cómo funciona la marca de agua de texto con IA: claves secretas, elección de palabras verde/rojo y detección
La marca de agua en texto de IA funciona ocultando marcas en las elecciones entre palabras, no en el texto en sí. Google ha marcado el texto de la aplicación y web de Gemini desde 2024, y los modelos Claude marcan texto a nivel de modelo desde agosto de 2026. Las marcas sobreviven al copiar y pegar y son invisibles para los lectores.
Marca de agua mediante sesgo en la elección de palabras
Cuando un modelo de lenguaje escribe, elige cada palabra lanzando dados ponderados sobre una lista corta de candidatos. La marca de agua usa una clave secreta para colorear esos candidatos de verde o rojo, y luego empuja suavemente los dados hacia el verde. El texto aún se lee naturalmente: las palabras rojas aún pueden ganar, solo que con menos frecuencia.
Cómo funciona la detección
Con la clave secreta, puedes recolorear cualquier texto y contar cuántas palabras son verdes. En texto sin marcar, aproximadamente la mitad de las palabras serán verdes por azar. En texto con marca de agua, el recuento es significativamente mayor. El detector no lee el texto, solo cuenta palabras verdes en una secuencia suficientemente larga.
Qué hace la edición a la marca
La marca de agua vive en tramos de texto sin modificar. El color de cada palabra se deriva de una ventana corta de palabras anteriores, por lo que la edición borra la marca exactamente donde se rompe la secuencia. Los textos cortos son difíciles de detectar: un documento de 1.500 palabras con un sesgo suave marcaría solo ~55% de verde, por lo que los textos más largos son más fiables.
Esquemas de producción
- Google SynthID: Utiliza un torneo secreto en lugar de un simple empuje, preservando las probabilidades exactas de las palabras.
- Esquema de Aaronson: Deriva las tiradas de dados de la clave.
- Kirchenbauer et al. (2023): El enfoque clásico de sesgo verde/rojo.
Consulta la guía visual interactiva para una demostración práctica del proceso.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Tablero en vivo de herramientas OpenClaw expuestas
Tablero que muestra los paneles de control expuestos de las herramientas OpenClaw como Moltbot y Clawdbot.

Advertencia de Hosting RunLobster: Se Reportan Spam de Bots y Cargos No Autorizados
Un usuario de Reddit informa que los bots de RunLobster (OpenClaw Hosting) están inundando subreddits de tecnología y que su tarjeta recibió tres cargos no autorizados inmediatamente después del registro, sin respuesta del soporte.

El auditor AI zkao encuentra un error crítico de solidez en la biblioteca de invitados zkVM de OpenVM
El auditor de IA de ZK/SEC, zkao, encontró un error crítico de solidez en la biblioteca de emparejamientos de OpenVM que permite a un probador malicioso falsificar igualdades de emparejamientos, corregido en OpenVM 1.6.0 (CVE-2026-46669).

Auditoría de Seguridad Diaria Automatizada por IA para Tienda Operada por IA
Una tienda operada por IA realiza una auditoría de seguridad diaria de forma autónoma sin programación humana ni trabajos cron. El agente de IA verifica vulnerabilidades SSRF, riesgos de inyección y brechas de autenticación, luego genera un informe para revisión del desarrollador senior.