La marca de agua de texto de Anthropic en Claude: explicación de la esteganografía semántica

✍️ OpenClawRadar📅 Publicado: 17 de agosto de 2026🔗 Source
Ad

El plan de Anthropic de marcar con agua todo el texto generado por Claude no es lo que inicialmente implicaban. Según un análisis detallado de John Gruber en Daring Fireball, la técnica es una forma de esteganografía semántica que altera la elección de palabras en el momento de la inferencia, lo que contradice su afirmación anterior de que sería 'imperceptible' y no cambiaría el 'significado, la calidad o la legibilidad'.

Cómo funciona realmente la marca de agua

El método consiste en sesgar la selección de tokens utilizando listas 'verde' y 'roja':

  • En cada paso de generación de tokens, las palabras se dividen en listas verde y roja de forma determinista, basándose en una clave secreta.
  • El modelo tiene una probabilidad ligeramente mayor de elegir una palabra de la lista verde que de la roja (piensa en una moneda sesgada 51-49).
  • Esto introduce un patrón estadístico que puede detectarse probabilísticamente, pero se desvía de la generación de texto verdaderamente natural.

El documento de soporte original afirmaba que la marca de agua sería 'imperceptible' y no afectaría a la legibilidad; Gruber argumenta que esto es engañoso porque el proceso modifica inherentemente las elecciones de tokens, lo que puede degradar la calidad semántica.

Ad

Dónde aprender más

Gruber señala un ensayo interactivo de James Padolsey, 'Cómo funciona la marca de agua de texto de IA', como la mejor explicación de la técnica general. Anthropic también publicó un artículo de seguimiento titulado 'Cómo funciona la marca de agua de texto de Claude' que explica el método, aunque Gruber lo critica por eufemístico.

Para los desarrolladores que utilizan agentes de IA, esto importa: la marca de agua puede cambiar sutilmente la salida, así que prueba tus flujos de trabajo en consecuencia.

📖 Leer la fuente completa: HN AI Agents

Ad

👀 Ver también

Notas de la versión 1.1.4498 de Claude Desktop: Rebote en el Dock, Expansión del Entorno de Shell y Soporte para Nube Gubernamental
Noticias

Notas de la versión 1.1.4498 de Claude Desktop: Rebote en el Dock, Expansión del Entorno de Shell y Soporte para Nube Gubernamental

Claude Desktop 1.1.4498 añade notificaciones de rebote en el dock para captar la atención del usuario, amplía la extracción del entorno de shell para incluir variables específicas de Claude e introduce detección de implementaciones gubernamentales/personalizadas. La actualización también reduce el tiempo de espera de las llamadas a herramientas del puente Chrome de 120 a 10 segundos.

OpenClawRadar
Generación de código determinista vs probabilística: Por qué la conversión a Rust con Vibe-Coded de Bun genera señales de alerta
Noticias

Generación de código determinista vs probabilística: Por qué la conversión a Rust con Vibe-Coded de Bun genera señales de alerta

Noah Hall argumenta que los cambios de repositorio de 1M de líneas generados por IA (como la conversión de Zig a Rust de Bun) son peligrosos. Contrasta transpiladores deterministas con la salida probabilística de los LLM. Las pruebas no son suficientes.

OpenClawRadar
Comparación de rendimiento entre Qwen3-30B-A3B y Qwen3.5-35B-A3B en RTX 5090
Noticias

Comparación de rendimiento entre Qwen3-30B-A3B y Qwen3.5-35B-A3B en RTX 5090

Una comparación directa de Qwen3-30B-A3B y Qwen3.5-35B-A3B en una RTX 5090 muestra que el modelo de 30B es un 35% más rápido en generación, mientras que el modelo 3.5 maneja mejor el contexto largo con escalado plano de tokens frente a la degradación del 21% del modelo de 30B.

OpenClawRadar
Concesionaria BMW revoca oferta de recompra tras error de chatbot de IA, precedente del caso Air Canada
Noticias

Concesionaria BMW revoca oferta de recompra tras error de chatbot de IA, precedente del caso Air Canada

Un concesionario BMW de Toronto revocó una oferta de recompra generada por su chatbot de IA, lo que desata preguntas legales. El precedente de Air Canada responsabiliza a las empresas por los errores de sus chatbots.

OpenClawRadar