Anthropic lança marca d'água para identificar textos gerados pelo Claude
A Anthropic introduziu uma marca d'água baseada em padrões estatísticos para identificar conteúdos produzidos pelo modelo Claude. A iniciativa visa atender às regulamentações de transparência do AI Act europeu, funcionando como um sinal de procedência probabilística, embora não seja considerada uma prova forense definitiva de autoria, especialmente em textos curtos ou que passaram por edições humanas significativas.
Transparência e Conformidade
A marca d'água não utiliza metadados ou caracteres ocultos, mas altera a fonte de aleatoriedade do modelo para criar um padrão estatístico associado a uma chave privada da empresa. O objetivo é facilitar a identificação de conteúdos gerados por IA em larga escala, auxiliando no cumprimento de normas regulatórias.
Limitações Técnicas
A eficácia da detecção diminui em textos curtos, respostas factuais ou códigos de programação, onde o modelo tem menos liberdade de escolha linguística. Além disso, edições humanas significativas podem remover ou comprometer a detecção da marca d'água.