Anthropic implementa marca d’água invisível para identificar textos gerados pelo Claude, seguindo regulamentação europeia.
A Anthropic, empresa por trás do modelo de linguagem Claude, anunciou o desenvolvimento de uma tecnologia de marca d’água invisível para identificar textos criados por sua inteligência artificial. A novidade se baseia no SynthID-Text, uma inovação do Google DeepMind, e visa garantir a rastreabilidade do conteúdo gerado, atendendo às novas diretrizes da Lei de Inteligência Artificial da União Europeia.
Essa regulamentação, em vigor desde 2 de agosto, exige que conteúdos produzidos por ferramentas de IA sejam detectáveis. A iniciativa da Anthropic sinaliza uma tendência que deverá ser seguida por outros grandes players do mercado de inteligência artificial, promovendo maior transparência e segurança no uso dessas tecnologias.
O SynthID, já conhecido por sua aplicação em mídias como vídeo, imagem e áudio, funciona alterando sutilmente os dados de forma imperceptível ao olho humano. No caso do texto, a tecnologia atua diretamente no padrão de escolha das palavras pelo modelo, sem comprometer a qualidade final do conteúdo. A empresa pretende disponibilizar em breve uma API para que terceiros possam verificar a origem dos textos.
Como funciona a marca d’água invisível do Claude
A identificação de textos gerados pelo Claude ocorre durante o processo de criação da resposta. Modelos de linguagem constroem frases sequencialmente, calculando a probabilidade estatística de cada palavra com base no contexto. A marca d’água interfere sutilmente nesse processo.
Por exemplo, em uma frase como “O tempo hoje estava frio e…”, a IA prevê palavras prováveis como “nublado” ou “cinzento”. Quando há múltiplas opções de sinônimos com probabilidades semelhantes, o modelo escolhe uma aleatoriamente. Com a marca d’água, uma chave criptográfica passa a orientar essa escolha, criando um padrão que pode ser posteriormente verificado.
A Anthropic garante que essa técnica não resulta na inserção de palavras artificiais ou estranhas no texto. Testes internos e estudos do Google DeepMind sobre o SynthID-Text indicam que a qualidade e a fluidez do conteúdo final **não são afetadas** pela marca d’água.
Limitações e falhas na detecção da marca d’água
Apesar da inovação, a detecção da marca d’água invisível pode apresentar falhas em determinadas circunstâncias. Por atuar no padrão de escrita, edições simples ou alterações significativas na estrutura do texto podem **interferir ou remover a marcação**.
Além disso, a identificação pode ser comprometida em situações como:
- Trechos de texto muito curtos, dificultando a análise do padrão.
- Respostas baseadas em dados factuais e exatos, onde a variação é mínima.
- Operações matemáticas e códigos de programação, que possuem estruturas lógicas específicas.
- Textos originalmente criados por humanos, mas que passaram por revisão do assistente de IA.
A iniciativa da Anthropic com o Claude demonstra um compromisso com a **transparência e a regulamentação** no uso de inteligência artificial, especialmente em um cenário onde a legislação sobre IA ganha cada vez mais força globalmente.