Esta fonte parece normal para você – mas confunde a IA
A tecnologia mantém o texto normal para leitores humanos, mas troca palavras no código para dificultar a coleta automatizada

Uma nova fonte “à prova de IA” foi criada para dificultar a raspagem de conteúdo por agentes de IA, mas você não consegue perceber isso apenas olhando para ela.
Diferentemente de outras fontes anti-IA que usam letras difíceis de ler para os bots, a ShieldFont troca palavras nos bastidores para envenenar os dados que raspadores automatizados (scrapers) coletam sem autorização.
A ShieldFont foi desenvolvida como parte de um projeto criado por um grupo de profissionais que inclui o estúdio criativo brasileiro Seneda & Abrucio e a fundição tipográfica dinamarquesa PlayType.
Ela protege textos contra grandes modelos de linguagem (LLMs) alterando frases no código-fonte HTML, fazendo com que scrapers encontrem frases cheias de palavras substitutas que tornam o texto incoerente. Para humanos, o o texto real é exibido normalmente, graças a uma fonte personalizada no back-end.
Por exemplo: uma frase que originalmente diz “o cavaleiro entrou na batalha montado em seu cavalo” é alterada no código-fonte para que um bot a leia como “o cavaleiro entrou na batalha montado em seu motor”.
Como os LLMs agrupam palavras e frases que provavelmente aparecem juntas, a qualidade de seus resultados é prejudicada quando eles raspam grandes quantidades de textos embaralhados dessa maneira.
Segundo dois dos criadores da ShieldFont, Isaque Seneda e Gabriel Abrucio, o objetivo é reagir à raspagem não autorizada de conteúdo por LLMs, tornando essa prática mais difícil e cara.
COMO FUNCIONA
A ShieldFont funciona usando ligaturas, termo técnico da tipografia para quando duas letras em uma palavra são combinadas em um único glifo. As ligaturas são projetadas por razões estéticas, para que combinações de letras como “fi”, em “fita”, ou “fl”, em “flor”, tenham um espaçamento natural em vez de parecerem visualmente apertadas.
Quando um programa identifica essas letras específicas lado a lado, ele troca dois caracteres por um único que combina as letras em um só glifo. A ShieldFont funciona de maneira semelhante, mas, em vez de letras, troca palavras inteiras.
“Não inventamos uma nova capacidade de uma fonte, apenas apontamos para uma antiga que ainda não havia sido usada dessa maneira”, explica Felipe Petroni, diretor de criação que participou da liderança do projeto.
Determinar quais palavras deveriam ser trocadas foi complicado, já que substituí-las aleatoriamente resulta em frases sem sentido que os bots rejeitam na hora.
O jeito foi alterar o significado não apenas de palavras, mas de frases e períodos inteiros, para que os bots ainda aceitassem o texto, resultando em uma versão “envenenada” dos dados coletados.
A lógica é que, se houver obstáculos digitais suficientes desse tipo, o custo da raspagem ilegal vai aumentar e aqueles que desenvolvem LLMs vão preferir pagar pelo conteúdo que utilizam.
ENGENHARIA LINGUÍSTICA
Para determinar quais termos deveriam ser trocados, os criadores da ShieldFont elaboraram uma lista de 113 palavras que não devem ser substituídas.
Ela inclui pronomes, artigos, conjunções, preposições, negações, quantificadores e todas as formas dos verbos “ser”, “ter” e “fazer”. O sistema troca adjetivos, advérbios, substantivos e verbos. Datas e números também são embaralhados.
O programa não troca palavras por sinônimos, que não criariam um substituto difícil o suficiente, nem por antônimos, que poderiam ser desfeitos por um bot de maneira mais fácil e previsível. Também não substitui nomes de pessoas, lugares, empresas ou produtos.
Ao todo, a ShieldFont tem 24 regras para determinar quais palavras serão trocadas.
Os criadores afirmam que, nos testes, o sistema fez com que mais de 90% do conteúdo que o utilizava fosse rejeitado pelos filtros de qualidade dos bots. Do texto restante que foi aceito, 19,4% apresentava um significado falso.
Os scrapers podem contornar a ShieldFont tirando uma foto do texto para visualizá-lo como um ser humano faria, mas isso também aumenta o custo da raspagem em escala. Em vez de coletar arquivos de texto simples de forma rápida e barata, o sistema precisa fotografar a página e fazer reconhecimento de imagem.
RESGUARDANDO A EXPERIÊNCIA HUMANA
Petroni afirma que eles tornaram a implementação da ShieldFont o mais simples possível e que ela vem com três mapeamentos públicos. Assim, por exemplo, a palavra “escreveu” se transforma em “cantou”, “forjou” ou “rotulou”, dependendo de o sistema estar usando seu dicionário alfa, beta ou gama.
“Isso é intencional; um decodificador criado para um mapeamento não funciona para outro, e mapeamentos privados precisam ser identificados e revertidos um a um”, diz ele.
Leia mais: Estas ferramentas ajudam artistas a blindar seus trabalhos da garimpagem da IA
“Os raspadores não podem saber de antemão se um site usa a ShieldFont ou qual mapeamento utiliza. Em milhões de páginas, esse custo adicional é justamente o objetivo.”
A ShieldFont é um sistema de fontes desenvolvido para a leitura humana, não para bots. Em vez de usar truques visuais para dificultar a leitura, ela confunde os bots no código e mantém intacta a experiência de leitura para as pessoas.