Marcas d'água de IA em texto sempre serão triviais de remover

O Artigo 50 da Lei de IA da UE, aplicável a partir de agosto de 2026, exige que provedores de LLM marquem texto gerado por IA. Mas a marca d'água de texto é fundamentalmente diferente da marca d'água de imagem — e removê-la continua sendo trivial. Aqui está a análise técnica.
Por que a marca d'água de texto é difícil
Imagens têm ruído onde você pode esconder marcas d'água; texto não. Você não pode ajustar uma frase sem que um humano perceba. Isso a torna um problema de esteganografia onde o texto simples não pode ser manipulado arbitrariamente. Uma abordagem ingênua como "cada quinta letra é 'e'" comprometeria a qualidade da saída.
Poderia o próprio modelo lidar com a marca d'água? Modelos fortes podem, mas isso consome tokens de raciocínio e degrada a qualidade da saída — um mau negócio.
Por que a detecção via re-execução do modelo falha
Executar o texto através do modelo para verificar probabilidades de tokens não funciona: o espaço de texto humano que parece saída de IA é enorme, falsos positivos são abundantes, e é proibitivamente caro para cada cidadão da UE obter verificação gratuita.
Como o SynthID funciona
O SynthID do Google é a única marca d'água de texto pública. Ele atribui a cada token uma pontuação baseada em tokens anteriores — por exemplo, soma de IDs de tokens mod 5. Ao amostrar, o modelo escolhe o token com maior pontuação entre os cinco principais prováveis. A detecção agrega a pontuação em um bloco de texto; uma agregação suspeitosamente alta sinaliza geração por IA.
Isso é como a heurística do travessão, mas baseada em padrões matemáticos sutis que os humanos não conseguem identificar.
A pegadinha
Mas qualquer marca d'água que preserve a diversidade lexical é removível por simples paráfrase, substituição de tokens, ou até tradução. Enquanto o texto tiver que ler naturalmente, você pode remover o sinal com esforço mínimo. A robustez do SynthID é limitada — é projetado para detecção em massa, não para resistir à remoção deliberada.
Espere que a UE imponha um requisito tecnicamente insatisfazível. As empresas cumprirão a letra da lei, mas qualquer um que se importe pode contorná-la em segundos.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Meta adquire Moltbook, um fórum no estilo Reddit para agentes de IA
A Meta adquiriu a Moltbook, uma plataforma de fórum no estilo Reddit projetada especificamente para agentes de IA. A aquisição foi confirmada na terça-feira, com os criadores da Moltbook ingressando nos Superintelligence Labs da Meta.
Criativos de Hollywood estão treinando IA para substituí-los — e recebendo US$ 12–US$ 200/hora
Escritores, diretores e produtores premiados estão fazendo bicos para treinar modelos de IA—ensinando roteiro, planejamento de produção e mais—em meio a uma queda de 35% na produção.

Cowork codifica esforço médio e ignora configurações do usuário para Claude Opus
Um usuário do plano Max descobriu que o Cowork passa --effort medium --model claude-opus-4-6 como flags de linha de comando fixas, ignorando variáveis de ambiente e substituições do settings.json. Isso significa que os usuários estão presos ao esforço médio e à janela de contexto padrão, apesar de pagarem por alto esforço e acesso ao contexto de 1 milhão.

Problemas Documentados de Upload e Indexação de Arquivos do Claude Projects
O Claude Projects tem múltiplos problemas confirmados no backend: arquivos ficam travados na indexação, o modo de busca RAG ativa prematuramente com aproximadamente 13 arquivos independentemente da contagem de tokens, e o conteúdo em cache persiste mesmo após exclusão e novo upload.