Desvendando o mecanismo de Watermarking de Texto por IA e como ele diferencia textos gerados por inteligência artificial
Entenda o sistema de marca d'água em textos de IA da Anthropic, que opera por meio de estatísticas de escolha de palavras em vez de ocultar dados
Em meio ao uso disseminado da inteligência artificial, a questão de distinguir textos gerados por IA tornou-se crucial, especialmente quando empresas desenvolvedoras como a Anthropic, criadora do Claude, começaram a adotar sistemas de marcas d'água legíveis por máquina (Machine-readable watermarks) em conformidade com a Lei de IA da UE para aumentar a transparência.
De acordo com análises técnicas e fontes de código aberto, o mecanismo de marca d'água de texto por IA (AI Text Watermarking) funciona de maneira totalmente diferente da inserção de metadados ou de caracteres especiais ocultos, como Unicode invisível.
O princípio real é o uso de um "padrão estatístico" (Statistical Bias) no nível de seleção de tokens. Enquanto o modelo gera texto, ele utiliza uma chave secreta para influenciar o modelo a escolher certas palavras com significados semelhantes, em vez de selecionar apenas a palavra com a maior probabilidade natural. Isso equivale a criar uma impressão digital estatística embutida no conteúdo.
No entanto, esse sistema tem pontos fortes e limitações. A marca d'água permanece no texto mesmo após o copiar e colar (Copy/Paste), mas a precisão da detecção depende do comprimento do texto. Se o texto for curto demais, a detecção se torna difícil. Além disso, o sinal estatístico pode ser corrompido e desaparecer se houver edições pesadas ou paráfrases (Paraphrasing).
Essa tecnologia é importante para usuários na Tailândia e no mundo entenderem como agências e plataformas começarão a verificar a origem de conteúdos gerados por IA, além de conscientizar sobre as limitações técnicas em que as marcas d'água podem ser facilmente distorcidas pela reescrita de textos.