Código promete remover marca d’água invisível do Claude

Wait 5 sec.

A Anthropic anunciou na semana passada que passaria a incluir marcas d’água invisíveis e legíveis por máquinas em conteúdos gerados pelos modelos Claude. A medida foi apresentada como forma de cumprir novas regras da União Europeia, mas, em poucas horas, desenvolvedores começaram a divulgar métodos que prometem remover a identificação de textos produzidos pela inteligência artificial.Em até quatro horas após a confirmação da Anthropic, o desenvolvedor Guillaume Meyer publicou um código para retirar as marcas d’água de textos do Claude. O projeto ganhou mais de 20 mil marcações no X, passou a ter mais de 100 colaboradores no GitHub e começou a ser incorporado a outros projetos. As informações são da WIRED.Como funciona a marca d’água do Claude?A Anthropic utiliza um método que insere a marcação de forma imperceptível na escolha de palavras e frases feita pelo modelo. Para o leitor, o texto permanece aparentemente normal, mas um sistema preparado para procurar o padrão pode identificar que o conteúdo foi produzido pelo Claude.A técnica utilizada é chamada SynthID e foi desenvolvida pelo Google. A tecnologia já é usada desde 2023 para marcar conteúdos gerados por inteligência artificial. Um método semelhante chegou a ser proposto pelo cientista da computação Scott Aaronson durante seu trabalho na OpenAI, mas não foi implementado pela empresa devido a preocupações sobre o impacto das marcas d’água no produto.A Anthropic afirma que a marcação não altera o significado, a qualidade ou a legibilidade das respostas. A empresa também está desenvolvendo uma API para detecção dos textos marcados.A Anthropic quer transformar textos gerados pelo Claude em conteúdos com uma espécie de assinatura invisível – Imagem: PhotoGranary02/ShutterstockDesenvolvedores tentam contornar identificaçãoO método publicado por Meyer utiliza outro modelo de linguagem sem marca d’água para produzir várias versões do mesmo conteúdo. O processo substitui palavras por sinônimos e reorganiza levemente o texto, com o objetivo de eliminar o padrão usado na identificação.Outros desenvolvedores também apresentaram alternativas. O engenheiro de software Erik Hughes criou uma ferramenta que remove caracteres invisíveis e semelhantes, reorganiza frases dentro de parágrafos e troca algumas palavras por sinônimos. Já Leon Chlon, Visiting Fellow da Universidade de Oxford, afirma que também é possível remover as marcas condensando a resposta ou traduzindo o conteúdo para um idioma com semântica diferente e depois retornando ao idioma original.A própria Anthropic reconhece que conteúdos fortemente editados, parafraseados ou traduzidos podem deixar de carregar a marca d’água. A empresa, porém, ainda não disponibilizou o software responsável pela detecção, o que impede confirmar se os métodos divulgados são efetivamente capazes de remover a identificação em todos os casos.Debate sobre os riscosMeyer afirmou à WIRED que algumas pessoas tentam contornar o sistema por discordarem da ideia de que todo conteúdo produzido por IA deveria ser identificado. Outros desenvolvedores, segundo ele, estão interessados principalmente no desafio técnico. Escritores freelancers e criadores de conteúdo para redes sociais também teriam procurado Meyer em busca de ajuda para utilizar o código.O desenvolvedor também questiona possíveis falsos positivos e a dificuldade de diferenciar diferentes níveis de uso de inteligência artificial. Ele citou seu próprio caso, como falante nativo de francês que utiliza Claude e ferramentas como o Grammarly para editar textos.Segundo Meyer, usar a marca d’água como evidência poderia resultar em rejeições injustas de candidatos a empregos ou em acusações exageradas contra pesquisadores. Isso ocorre porque a própria Anthropic admite que a identificação fornece uma probabilidade de o texto ter sido manipulado pelo Claude, e não uma certeza absoluta.As novas regras europeias determinam que fornecedores de modelos, como Anthropic e OpenAI, identifiquem conteúdos sintéticos de áudio, imagem, vídeo ou texto de forma que possam ser detectados por máquinas. O descumprimento pode resultar em multas de até 3% do faturamento anual. Ao mesmo tempo, segundo a reportagem da WIRED, não há restrição legal para ferramentas independentes de contorno.A Anthropic afirmou à WIRED que pretende disponibilizar em breve uma ferramenta para detectar marcas d’água em textos e que continua trabalhando no aprimoramento do sistema. Até que o mecanismo oficial de detecção seja lançado, ainda não é possível determinar a eficácia dos métodos de remoção apresentados pelos desenvolvedores.O post Código promete remover marca d’água invisível do Claude apareceu primeiro em Olhar Digital.