Código promete remover marca d’água invisível do Claude

Facebook
Twitter
LinkedIn
Threads
WhatsApp
Código promete remover marca d’água invisível do Claude

A Anthropic anunciou na semana passada que passaria a incluir marcas d’água invisíveis e legíveis por máquinas em conteúdos gerados pelos modelos Claude. A medida foi apresentada como forma de cumprir novas regras da União Europeia, mas, em poucas horas, desenvolvedores começaram a divulgar métodos que prometem remover a identificação de textos produzidos pela inteligência artificial.

Continua após a publicidade

Em até quatro horas após a confirmação da Anthropic, o desenvolvedor Guillaume Meyer publicou um código para retirar as marcas d’água de textos do Claude. O projeto ganhou mais de 20 mil marcações no X, passou a ter mais de 100 colaboradores no GitHub e começou a ser incorporado a outros projetos. As informações são da WIRED.

Como funciona a marca d’água do Claude?

A Anthropic utiliza um método que insere a marcação de forma imperceptível na escolha de palavras e frases feita pelo modelo. Para o leitor, o texto permanece aparentemente normal, mas um sistema preparado para procurar o padrão pode identificar que o conteúdo foi produzido pelo Claude.

A técnica utilizada é chamada SynthID e foi desenvolvida pelo Google. A tecnologia já é usada desde 2023 para marcar conteúdos gerados por inteligência artificial. Um método semelhante chegou a ser proposto pelo cientista da computação Scott Aaronson durante seu trabalho na OpenAI, mas não foi implementado pela empresa devido a preocupações sobre o impacto das marcas d’água no produto.

A Anthropic afirma que a marcação não altera o significado, a qualidade ou a legibilidade das respostas. A empresa também está desenvolvendo uma API para detecção dos textos marcados.

A Anthropic quer transformar textos gerados pelo Claude em conteúdos com uma espécie de assinatura invisível – Imagem: PhotoGranary02/Shutterstock

Desenvolvedores tentam contornar identificação

O método publicado por Meyer utiliza outro modelo de linguagem sem marca d’água para produzir várias versões do mesmo conteúdo. O processo substitui palavras por sinônimos e reorganiza levemente o texto, com o objetivo de eliminar o padrão usado na identificação.

Outros desenvolvedores também apresentaram alternativas. O engenheiro de software Erik Hughes criou uma ferramenta que remove caracteres invisíveis e semelhantes, reorganiza frases dentro de parágrafos e troca algumas palavras por sinônimos. Já Leon Chlon, Visiting Fellow da Universidade de Oxford, afirma que também é possível remover as marcas condensando a resposta ou traduzindo o conteúdo para um idioma com semântica diferente e depois retornando ao idioma original.


A própria Anthropic reconhece que conteúdos fortemente editados, parafraseados ou traduzidos podem deixar de carregar a marca d’água. A empresa, porém, ainda não disponibilizou o software responsável pela detecção, o que impede confirmar se os métodos divulgados são efetivamente capazes de remover a identificação em todos os casos.

Debate sobre os riscos

Meyer afirmou à WIRED que algumas pessoas tentam contornar o sistema por discordarem da ideia de que todo conteúdo produzido por IA deveria ser identificado. Outros desenvolvedores, segundo ele, estão interessados principalmente no desafio técnico. Escritores freelancers e criadores de conteúdo para redes sociais também teriam procurado Meyer em busca de ajuda para utilizar o código.

O desenvolvedor também questiona possíveis falsos positivos e a dificuldade de diferenciar diferentes níveis de uso de inteligência artificial. Ele citou seu próprio caso, como falante nativo de francês que utiliza Claude e ferramentas como o Grammarly para editar textos.

Continua após a publicidade

Segundo Meyer, usar a marca d’água como evidência poderia resultar em rejeições injustas de candidatos a empregos ou em acusações exageradas contra pesquisadores. Isso ocorre porque a própria Anthropic admite que a identificação fornece uma probabilidade de o texto ter sido manipulado pelo Claude, e não uma certeza absoluta.

As novas regras europeias determinam que fornecedores de modelos, como Anthropic e OpenAI, identifiquem conteúdos sintéticos de áudio, imagem, vídeo ou texto de forma que possam ser detectados por máquinas. O descumprimento pode resultar em multas de até 3% do faturamento anual. Ao mesmo tempo, segundo a reportagem da WIRED, não há restrição legal para ferramentas independentes de contorno.

A Anthropic afirmou à WIRED que pretende disponibilizar em breve uma ferramenta para detectar marcas d’água em textos e que continua trabalhando no aprimoramento do sistema. Até que o mecanismo oficial de detecção seja lançado, ainda não é possível determinar a eficácia dos métodos de remoção apresentados pelos desenvolvedores.

Ana Luiza Figueiredo

Ana Luiza Figueiredo

Ana Figueiredo é repórter de tecnologia do Olhar Digital. É formada em jornalismo pela Universidade Federal de Uberlândia (UFU).

Ver todos os artigos →


!function(f,b,e,v,n,t,s){
if(f.fbq)return;
n=f.fbq=function(){n.callMethod?n.callMethod.apply(n,arguments):n.queue.push(arguments)};
if(!f._fbq)f._fbq=n;n.push=n;n.loaded=!0;n.version=’2.0′;
n.queue=[];t=b.createElement(e);t.async=!0;
t.src=v;s=b.getElementsByTagName(e)[0];
s.parentNode.insertBefore(t,s)
}(window, document,’script’, ‘https://connect.facebook.net/en_US/fbevents.js’);
fbq(‘init’, ‘1221644929160171’);
fbq(‘track’, ‘PageView’);

Fonte Original | Notícias – Olhar Digital

Contribua com o Portal para mantermos ele sempre ativo com as melhores informações

Deixe uma resposta

Veja também