Como Funciona a Marca d'Água de Texto por IA: Chaves Secretas, Escolhas de Palavras Verde/Vermelho e Detecção
A marca d'água em texto de IA funciona escondendo marcas nas escolhas entre palavras, não no próprio texto. O Google aplica marca d'água no texto do Gemini (app e web) desde 2024, e os modelos Claude marcam o texto no nível do modelo desde agosto de 2026. As marcas sobrevivem a copiar e colar e são invisíveis para os leitores.
Marca d'água por viés na escolha de palavras
Quando um modelo de linguagem escreve, ele escolhe cada palavra rolando dados ponderados sobre uma lista de candidatos. A marca d'água usa uma chave secreta para colorir esses candidatos de verde ou vermelho e, em seguida, empurra levemente os dados para o verde. O texto ainda parece natural — palavras vermelhas ainda podem vencer, só que com menos frequência.
Como funciona a detecção
Com a chave secreta, você pode recolorir qualquer texto e contar quantas palavras são verdes. Em texto sem marca, cerca de metade das palavras será verde por acaso. Em texto com marca, a contagem é significativamente maior. O detector não lê o texto — ele apenas conta palavras verdes em uma sequência suficientemente longa.
O que a edição faz com a marca
A marca d'água vive em trechos de texto não editados. A cor de cada palavra é derivada de uma pequena janela de palavras anteriores, então a edição apaga a marca exatamente onde a sequência é quebrada. Textos curtos são difíceis de avaliar — um documento de 1.500 palavras com um viés leve acusaria apenas cerca de 55% de verde, por isso textos mais longos são mais confiáveis.
Esquemas em produção
- Google SynthID: Usa um torneio secreto em vez de um simples viés, preservando as probabilidades exatas das palavras.
- Esquema de Aaronson: Deriva os próprios lançamentos de dados da chave.
- Kirchenbauer et al. (2023): A abordagem clássica de viés verde/vermelho.
Confira o guia visual interativo para uma demonstração prática do processo.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Lacuna de Segurança do OpenClaw Solucionada pela Especificação do Poder de Procuração Agente (APOA)
Um desenvolvedor publicou uma especificação aberta chamada Procuração Agente (APOA) para abordar preocupações de segurança no OpenClaw, onde os agentes atualmente acessam serviços como e-mail e calendário com apenas instruções em linguagem natural como barreiras de proteção. A especificação propõe permissões por serviço, acesso limitado no tempo, trilhas de auditoria, revogação e isolamento de credenciais.

Clawndom: Um Gancho de Segurança para o Código Claude para Bloquear Pacotes npm Vulneráveis
Um desenvolvedor criou o Clawndom, um hook de código aberto para o Claude Code que verifica pacotes npm no banco de dados de vulnerabilidades OSV.dev antes da instalação, bloqueando pacotes vulneráveis conhecidos enquanto mantém a autonomia do agente.

A AWS relata que ataque aprimorado por IA comprometeu mais de 600 firewalls FortiGate
Cibercriminosos usaram ferramentas de IA generativa prontas para uso para comprometer mais de 600 firewalls FortiGate expostos à internet em 55 países durante uma campanha de um mês, de acordo com a AWS. Os atacantes escanearam interfaces de gerenciamento expostas, tentaram credenciais fracas e usaram IA para gerar playbooks de ataque e scripts.

SCION: A Alternativa Segura da Suíça ao Protocolo de Roteamento BGP
SCION (Escalabilidade, Controle e Isolamento em Redes de Próxima Geração) é uma arquitetura de roteamento da internet desenvolvida na ETH Zürich que substitui a base do BGP com segurança integrada e roteamento de múltiplos caminhos. Diferente de correções do BGP como RPKI e BGPsec, o SCION estabelece dezenas ou centenas de caminhos paralelos com reroteamento em milissegundos quando ocorrem falhas.