Desenvolvedores criam ferramentas para remover marcas d'água de textos do Claude
Poucas horas após a Anthropic implementar marcas d'água invisíveis (via tecnologia SynthID) para identificar conteúdos gerados por IA, desenvolvedores já criaram métodos para burlar o sistema. As técnicas incluem a reescrita do texto por outros modelos, tradução para idiomas com estruturas semânticas diferentes e a manipulação de caracteres. A Anthropic admitiu que edições pesadas e paráfrases podem remover o padrão estatístico, enquanto a comunidade técnica debate se a marca d'água é uma solução eficaz para evitar falsos positivos em ferramentas de correção de texto.
O desafio da transparência
A implementação da marca d'água pela Anthropic visa atender a exigências de transparência, como as do AI Act da União Europeia. No entanto, ferramentas como o 'watermarksremover' no GitHub já demonstram que o padrão estatístico pode ser facilmente alterado por processos de paráfrase ou tradução. Especialistas alertam que, embora a marca d'água não afete a legibilidade humana, a eficácia das ferramentas de remoção ainda precisa ser testada contra a API de detecção oficial da Anthropic.