Pangram, uma ferramenta praticamente infalível para detectar textos e romances criados por IA

Foto: Hasnain Sajid Hakeem/Unplash

Mais Lidos

  • Como seria o país de Flávio Bolsonaro. Artigo de Luís Nassif

    LER MAIS
  • Trump tem dado um apoio muito forte à eleição de governos de extrema-direita e está também chantageando o Brasil, alerta a jornalista

    Eleições 2026 em xeque pelo fascismo americano: os vermes da extrema-direita e sua ameaça constante à democracia. Entrevista especial com Cristina Serra

    LER MAIS
  • “É mais fácil gerar consenso social contra o corpo trans ou migrante do que contra a destruição da biosfera”. Entrevista com Paul Preciado

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

26 Setembro 2026

Este programa causou um alvoroço no mundo literário francês após ser usado para identificar um livro best-seller como artificial.

A reportagem é de Jordi Pérez Colomé, publicada por El País, 25-09-2026.

O livro C'était ça ou mourir recebeu o Prêmio Fnac de Romance, o Prêmio Medusa e vários outros, vendeu mais de 35 mil exemplares e está entre os concorrentes aos principais prêmios literários deste outono. A partir de quarta-feira, o livro ganhou mais uma distinção: é o primeiro grande escândalo francês envolvendo literatura supostamente criada com inteligência artificial (IA). Seu autor, o haitiano-canadense Thélyson Orélien, nega as acusações. Ele afirma ter finalizado o primeiro rascunho em 2019 (o ChatGPT foi lançado no fim de 2022) e que sua formação literária “haitiana e caribenha” pode ter causado confusão, pois “as imagens, repetições e ritmo transmitem uma palavra viva”, explicou à imprensa francesa. Sua editora, Grasset, está lhe dando apoio. A denúncia contra Orélien partiu de uma conta anônima no X.

C'était ça ou mourir, livro de Thélyson Orélien. (Éditions Grasset, 2026) 

O problema de Orélien é que os dias em que nenhum detector de texto gerado por IA era realmente eficiente na identificação de culpados já passaram. Porque agora existe um que é altamente preciso: o Pangram, lançado em 2024 nos EUA. E é multilíngue. "O Pangram funciona bem em 20 outros idiomas principais além do inglês, incluindo espanhol e francês", explicou Max Spero, cofundador do Pangram, ao EL PAÍS.

O Pangram ostenta uma taxa de precisão superior a 99%: apenas 1 em cada 24 mil amostras está incorreta, segundo a empresa. A comunidade científica também confirmou que o Pangram tem um desempenho melhor do que as alternativas. "Não há razão para pensar que esses modelos não funcionam, porque são treinados com uma quantidade enorme de dados, tanto escritos por humanos quanto gerados por IA", afirma Tuhin Chakrabarty, professor de Ciência da Computação na Universidade Stony Brook (EUA) e especialista em texto gerado por IA.

O Pangram também é uma IA. É um modelo treinado para detectar textos gerados por máquinas. Ele é exposto a uma vasta quantidade de artigos, romances, ensaios e outros textos semelhantes gerados por IA até reconhecer as diferenças estilísticas. Desde 2024, a empresa vem lançando novas versões do seu software. Há um período de teste gratuito disponível, mas o serviço funciona por assinatura. Em agosto de 2025, a empresa tinha apenas 7 mil usuários; no mês passado, esse número chegou a 222 mil.

🔍 Adicione o Instituto Humanitas Unisinos – IHU às suas fontes favoritas do Google

A professora Marzena Karpinska, da Universidade Simon Fraser (Canadá), confirmou a precisão de uma versão anterior em um artigo científico de 2025 sobre como as pessoas que mais usam o ChatGPT são as melhores em detectar seu estilo de escrita: “A versão atual do Pangram, a versão 4, é muito mais precisa. É como a diferença entre o GPT-4 e o GPT-6. Eles se esforçaram para garantir que sua ferramenta não tenha os mesmos vieses observados em outras, como rotular como IA os textos de pessoas cuja língua materna não é o inglês”, explica ela.

As dúvidas em torno de Orélien não se restringem a um único escritor. O mundo literário francês cobriu o romance de elogios e prêmios. Como o Pangram pode afirmar categoricamente que o romance de Orélien foi gerado por IA e ninguém percebeu? Porque não usam IA e não sabem como ela escreve, acredita Chakrabarty. “Os críticos detestam IA. Nunca leram prosa gerada por IA. Como vão reconhecê-la? Um dos motivos pelos quais nossas instituições não conseguem detectar prosa gerada por IA é justamente a falta de familiaridade com ela. Pessoas como eu, que trabalham nisso 24 horas por dia, 7 dias por semana, não fazem parte de júris de premiações. Li este romance francês e ele apresenta os mesmos padrões da má ficção inglesa: paralelos negativos, metáforas misturadas, clichês. É tudo muito exagerado”, explica. Nos EUA, também houve diversas controvérsias envolvendo livros e artigos sinalizados pelo Pangram.

Desde que essas ferramentas se popularizaram, houve uma corrida para evitar a detecção: adicionando erros de digitação, "humanizando" frases com outros softwares e encontrando dicas que enganam o detector, como pedir que ele imite o estilo de um escritor famoso. Este jornal testou exemplos de textos obtidos de Claude, mas escritos no estilo de Javier Marías ou David Trueba: o Pangram determinou que eram 100% IA. "Já fiz esse experimento inúmeras vezes", diz Chakrabarty. O EL PAÍS também testou os dois primeiros capítulos do livro de Santos Cerdán, A Queda, e o Pangram indicou entre 70% e 100% de certeza de que se tratava de IA. "Esses números são suficientes para afirmar que houve uso intensivo de IA", diz Spero. Cerdán não respondeu às mensagens deste jornal.

Os truques mais sofisticados exigem habilidades em informática incomuns entre escritores. “Se você ajustar um modelo usando os livros de um escritor famoso, algo que eu já fiz, talvez seja possível trapacear. Mas ninguém faz isso porque é muito caro e exige muito conhecimento técnico. Esses escritores não são cientistas da computação; eles simplesmente acessam o ChatGPT, dão um comando e pedem para ele escrever cada capítulo”, diz Chakrabarty.

Um dos principais problemas dessa ferramenta é que seus criadores podem negar indefinidamente o uso de IA, tornando impossível comprovar seu uso. Sem uma confissão, tudo permanece envolto em suspeitas. Isso também pode desencadear uma caça às bruxas caso haja falsos positivos. Recentemente, as redes sociais na França foram inundadas com o agora famoso gráfico do Pangram, com pessoas alegando que mensagens de texto anteriores ao lançamento do ChatGPT foram geradas por IA. Em um caso, Spero ofereceu US$ 100 ao autor de uma dessas capturas de tela, um jornalista conhecido, para que ele fornecesse o texto utilizado. O jornalista, pelo menos publicamente, recusou-se a entregá-lo.

O Pangram é menos eficaz na detecção de textos curtos, com apenas uma ou algumas frases. Quanto mais parágrafos de exemplo, mais confiável ele se torna. O uso extensivo em todos os capítulos de um livro é um grande sinal de alerta, quase indefensável: “O Pangram funciona melhor com textos mais longos. Abaixo de 50 palavras, ele é pouco confiável, e quanto mais texto, melhor. Da mesma forma, funciona melhor com escrita criativa do que com receitas, por exemplo”, diz Karpinska, que realizou um teste adicional com Orélien, cuja defesa é que seu estilo é distinto, muito distante das tradições dominantes. “Alguns sugeriram que o problema é o francês haitiano específico do autor. Encontrei um artigo dele de 2015 e o analisei. O resultado foi que ele era humano, então não parece, pelo menos neste exemplo, que o Pangram esteja detectando qualquer particularidade do dialeto”, acrescenta Karpinska.

Leia mais