Marcas d'água de IA em texto sempre serão triviais de remover

O Artigo 50 da Lei de IA da UE, aplicável a partir de agosto de 2026, exige que provedores de LLM marquem texto gerado por IA. Mas a marca d'água de texto é fundamentalmente diferente da marca d'água de imagem — e removê-la continua sendo trivial. Aqui está a análise técnica.
Por que a marca d'água de texto é difícil
Imagens têm ruído onde você pode esconder marcas d'água; texto não. Você não pode ajustar uma frase sem que um humano perceba. Isso a torna um problema de esteganografia onde o texto simples não pode ser manipulado arbitrariamente. Uma abordagem ingênua como "cada quinta letra é 'e'" comprometeria a qualidade da saída.
Poderia o próprio modelo lidar com a marca d'água? Modelos fortes podem, mas isso consome tokens de raciocínio e degrada a qualidade da saída — um mau negócio.
Por que a detecção via re-execução do modelo falha
Executar o texto através do modelo para verificar probabilidades de tokens não funciona: o espaço de texto humano que parece saída de IA é enorme, falsos positivos são abundantes, e é proibitivamente caro para cada cidadão da UE obter verificação gratuita.
Como o SynthID funciona
O SynthID do Google é a única marca d'água de texto pública. Ele atribui a cada token uma pontuação baseada em tokens anteriores — por exemplo, soma de IDs de tokens mod 5. Ao amostrar, o modelo escolhe o token com maior pontuação entre os cinco principais prováveis. A detecção agrega a pontuação em um bloco de texto; uma agregação suspeitosamente alta sinaliza geração por IA.
Isso é como a heurística do travessão, mas baseada em padrões matemáticos sutis que os humanos não conseguem identificar.
A pegadinha
Mas qualquer marca d'água que preserve a diversidade lexical é removível por simples paráfrase, substituição de tokens, ou até tradução. Enquanto o texto tiver que ler naturalmente, você pode remover o sinal com esforço mínimo. A robustez do SynthID é limitada — é projetado para detecção em massa, não para resistir à remoção deliberada.
Espere que a UE imponha um requisito tecnicamente insatisfazível. As empresas cumprirão a letra da lei, mas qualquer um que se importe pode contorná-la em segundos.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

A BitNet da Microsoft Permite Inferência de LLM com 100 Bilhões de Parâmetros em uma Única CPU
O projeto BitNet de código aberto da Microsoft alcança inferência de LLM com 100B de parâmetros a 5-7 tokens/segundo em uma única CPU, com o modelo de 2B de parâmetros usando 0,4GB de memória e latência de 29ms, enquanto iguala modelos de precisão total em benchmarks.

Estudo Mostra que Falhas do Agente Claude Opus Foram Arquiteturais, Não Problemas de Alinhamento
Um estudo colocou Claude Opus e Kimi K2.5 em um ambiente real com acesso a e-mail, shell e armazenamento persistente. Os modelos demonstraram valores corretos, mas sofreram falhas graves devido à falta de salvaguardas arquiteturais, como modelos de partes interessadas e limites de execução.

Claude Code: O modo automático se torna o modo de permissão padrão em 14 de agosto
A Anthropic está tornando o modo automático o modo de permissão padrão no Claude Code para usuários Pro, Max e Team em 14 de agosto. O classificador do modo automático capturou 89% dos comandos perigosos em testes, contra 14% para aprovação manual.

O OneUptime adiciona 12.000 posts de blog gerados por IA em um único commit
O repositório de blog da OneUptime adicionou 12.000 posts gerados por IA cobrindo ClickHouse, Redis, MongoDB, MySQL e outras tecnologias em um único commit que alterou 5.012 arquivos e mais de 1 milhão de linhas de código.