ChatGPT vai esconder uma marca nos textos para provar que foram feitos por IA

OpenAI prepara sistema de identificação de textos com marca invisível e detector próprio para verificar a origem do conteúdo

ChatGPT
Créditos: Unsplash

Lilian Campos 2 minutos de leitura
Favoritar no Google

A OpenAI anunciou uma nova tecnologia para identificar textos produzidos ou processados por seus modelos de inteligência artificial. 

A empresa vai adicionar uma marca-d’água invisível às respostas elegíveis do ChatGPT e do Codex na União Europeia, criando um sinal que poderá ser analisado por ferramentas de detecção.

A novidade faz parte da estratégia da empresa para cumprir as exigências do AI Act da União Europeia, que determina que conteúdos gerados por inteligência artificial sejam identificáveis de forma legível por máquinas. 

Segundo a OpenAI, a implementação será gradual e começará pelas ferramentas usadas na região.

Leia também: ChatGPT ganha modo de voz que pode executar tarefas no celular

CHATGPT VAI ESCONDER UMA MARCA NO TEXTO

A tecnologia, chamada textGrain, modifica estatisticamente a escolha de palavras feita pelo modelo durante a geração do texto. Para quem lê, não haverá caracteres, espaços ou símbolos visíveis indicando a presença da marca.

Um detector desenvolvido pela OpenAI poderá procurar esse padrão e avaliar se determinado trecho contém uma marca-d’água associada aos modelos da empresa. Inicialmente, o acesso ao detector ficará restrito a pesquisadores e organizações especializadas aprovados pela OpenAI.

A OpenAI afirma que o sistema apresentou bons resultados nos testes. Em textos de 200 tokens, o detector identificou cerca de 80% das marcas quando configurado para uma taxa de falsos positivos de 1%. 

Em textos de 400 tokens, a taxa chegou a aproximadamente 95% em determinados conteúdos.

MARCA PODE DESAPARECER COM EDIÇÕES

Apesar dos resultados, a própria OpenAI reconhece que a tecnologia possui limitações. Textos muito curtos ou com pouca liberdade de escolha de palavras são mais difíceis de identificar.

As edições também podem enfraquecer o sinal. Nos testes da empresa, substituir 10% das palavras por sinônimos reduziu a detecção de cerca de 92% para 66%. Com alterações em 25% das palavras, o índice caiu para 17%.

Por isso, encontrar uma marca-d’água pode indicar que um sistema da OpenAI gerou ou processou parte de um texto, mas não comprova quem escreveu o conteúdo nem quanto uma pessoa participou da produção. 

Da mesma forma, a ausência da marca não prova que um texto foi escrito por um humano.

Leia também: Codex: conheça a ferramenta do ChatGPT para ajudar na programação

OPENAI SEGUE MOVIMENTO JÁ ADOTADO PELA ANTHROPIC

A iniciativa da OpenAI acompanha uma estratégia semelhante adotada pela Anthropic no Claude. A empresa também passou a utilizar marcas-d’água invisíveis para sinalizar textos produzidos ou processados por seus modelos.

A Anthropic afirma que sua marcação não adiciona caracteres ocultos e não altera o significado ou a qualidade do texto. O sinal também não identifica o usuário, a organização ou a conversa responsável pelo conteúdo.

No caso da OpenAI, a implementação inicial ficará restrita à União Europeia. A empresa afirma que, nas próximas semanas, vai adicionar a marca-d’água às respostas elegíveis do ChatGPT e do Codex na região, sem transformar o recurso em padrão global neste primeiro momento.

Já clientes da API poderão optar pela marcação em determinados modelos a partir de agora, independentemente do país. A função ficará desativada por padrão na API. 

A OpenAI também pretende disponibilizar o textGrain em código aberto e ampliar o acesso ao detector conforme avaliar a confiabilidade da tecnologia.


SOBRE A AUTORA

Lilian Campos é jornalista colaboradora da Fast Company Brasil. saiba mais