Por que o Turnitin marcou as minhas referências?

Dois relatórios diferentes, duas coisas diferentes sendo medidas, e só um dos dois pode colocar cor numa bibliografia. Veja como descobrir qual deles você tem em mãos, por que uma frase com uma citação dentro ainda pode ser marcada e onde o Turnitin diz que se concentram os próprios falsos positivos.

Equipe HumanPen

· 8 min de leitura

Primeiro, descubra qual relatório você está vendo

O Turnitin exclui bibliografias ao processar o AI Writing Report, e os destaques de escrita por IA simplesmente não aparecem no Similarity Report. Ou seja: uma lista de referências destacada é uma correspondência de similaridade, não uma marcação de IA, e não foi a sua bibliografia que elevou o seu percentual de IA.

Essa única distinção resolve a maior parte dessas perguntas antes de você precisar pensar em qualquer outra coisa. De um único envio, o Turnitin produz duas coisas separadas, e elas medem propriedades diferentes. O Similarity Report encontra no seu texto trechos que coincidem com texto de outro lugar. O AI Writing Report estima quanto da sua prosa foi gerada por IA. A documentação do Turnitin descreve os dois como independentes entre si e afirma que os destaques de escrita por IA não aparecem no Similarity Report. Nenhum dos dois números alimenta o outro.

Existe um motivo prático para você acabar sem saber qual relatório tem diante de si. Só professores e administradores podem ver os indicadores de escrita por IA; os estudantes não podem. Um professor pode baixar um PDF do relatório de IA e compartilhar, então o que costuma chegar ao estudante é esse PDF, ou uma captura de tela encaminhada sem nada que indique de qual relatório ela saiu.

Pergunte antes de qualquer coisa qual relatório era. Todos os caminhos abaixo dependem da resposta.

Para uma explicação mais completa das diferenças entre os dois, veja AI Writing Report e Similarity Report comparados.

Se foi o Similarity Report, referências que coincidem são o caso comum

Uma entrada de bibliografia é a sequência de texto mais repetível da escrita acadêmica. Autoria, título, periódico, volume, ano e a pontuação entre eles são todos fixados pelo manual de estilo, então dois trabalhos que citam a mesma fonte produzem a mesma linha, caractere por caractere. É exatamente para isso que serve um estilo de citação.

Uma bibliografia acendendo num Similarity Report costuma ser só esse mecanismo funcionando: as suas referências estão formatadas segundo o manual de estilo, e outras pessoas citam a mesma obra. O que vale examinar é onde mais aparece a cor. Texto coincidente dentro dos seus próprios parágrafos é outra conversa, e é essa que precisa de resposta. Quais coincidências entram no número que mostraram para você depende dos filtros ativos naquele relatório, o que a comparação entre os relatórios aborda.

Se foi o AI Writing Report, a sua bibliografia não entrou na conta

Uma nota de atualização de 9 de agosto de 2023 na página do Turnitin sobre o modelo de detecção de escrita por IA afirma que bibliografias passaram a ser excluídas no processamento do relatório de escrita por IA. Não é um filtro que alguém esqueceu de ligar. Faz parte de como o relatório é produzido.

O modelo também só examina o que o Turnitin chama de texto qualificado, ou seja, prosa longa feita de frases gramaticais comuns. Estruturas curtas que não são frases, como listas e marcadores, ficam de fora da análise, e uma entrada de bibliografia não é uma frase de qualquer maneira. Duas consequências confundem as pessoas: a porcentagem é uma fração da prosa qualificada, e não do documento inteiro, e a quantidade de destaque que você vê não vai bater com o número que deram a você. As duas coisas são detalhadas em como ler um relatório de escrita por IA do Turnitin.

Se o seu percentual de IA voltou mais alto do que você esperava, ele veio do corpo do seu texto. A lista de referências não foi a origem disso.

Então por que a frase que contém a minha citação está destacada?

Porque o que é avaliado não é a citação.

O Turnitin descreve o mecanismo assim: o envio é dividido em segmentos sobrepostos, cada segmento recebe uma pontuação entre 0 e 1, cada frase herda por agrupamento a pontuação dos segmentos em que se encontra, e tudo isso é agregado num número do nível do documento (perguntas frequentes sobre detecção de escrita por IA). Em nenhum ponto dessa descrição existe uma etapa que reconheça uma remissão, uma citação direta ou uma fonte.

Uma frase que por acaso contém (Smith, 2019) é avaliada como prosa, do mesmo modo que foi a frase anterior. O que foi marcado é a frase. A citação dentro dela é algo acessório.

Isso elimina uma família inteira de tentativas de conserto. Mudar o estilo de citação, passar uma remissão entre parênteses para uma nota de rodapé ou reformular a atribuição não toca nada daquilo a que o modelo reagiu.

A explicação mais popular é justamente a que o Turnitin nega

Em quase todos os fios sobre esse assunto, alguém explica que detectores de IA medem burstiness e perplexity, e que a prosa acadêmica vai mal nas duas porque é densa e tem ritmo uniforme. É uma explicação satisfatória. Também não é o que o Turnitin diz ter construído.

A mesma página de perguntas frequentes trata disso diretamente: o modelo é baseado em transformers e não é programado explicitamente para avaliar sinais específicos como burstiness ou perplexity, e o Turnitin acrescenta que uma previsão individual pode nem sempre ser explicável traço por traço.

Vale saber disso antes de seguir um conselho construído sobre o outro modelo. Variar de propósito o tamanho das suas frases para o texto parecer menos uniforme é uma teoria sobre um sistema cujo fornecedor diz que ele não é assim. De onde veio a história do burstiness e o que a substituiu está em o que os detectores de IA medem além de perplexity e burstiness.

Onde o Turnitin diz que se concentram os próprios falsos positivos

Falta uma peça, e ela é curiosamente específica. Uma nota de atualização de 24 de maio de 2023 na mesma página do modelo diz que o Turnitin observou uma incidência maior de falsos positivos nas primeiras e nas últimas frases de um documento, e observa que muitas vezes são frases de introdução ou conclusão escritas de forma genérica.

Agora pense onde fica a sua conclusão. É a última coisa antes da sua lista de referências.

Se você viu cor perto do fim de um relatório e leu isso como as suas referências tendo sido marcadas, verifique onde o destaque realmente termina. O parágrafo logo acima da sua bibliografia é exatamente o lugar que o Turnitin aponta como o próprio ponto fraco.

Uma observação relacionada, se o seu documento for curto. O Turnitin diz que previsões em documentos de apenas algumas centenas de palavras tendem ao tudo ou nada, porque existe um único segmento e nenhuma sobreposição para fazer média; então um conteúdo misturado num documento curto pode voltar pontuado inteiramente como IA.

O que verificar, em ordem

  1. Estabeleça qual relatório é. Se não há um número ao lado do indicador de IA, só um asterisco, esse é o relatório de IA. O Turnitin não mostra porcentagem para pontuações de IA entre 1 e 19, e diz que essa faixa carrega uma taxa maior de falsos positivos.
  2. Se for o Similarity Report, olhe as correspondências que ficam fora da lista de referências. São essas que significam alguma coisa.
  3. Se for o AI Writing Report, leia a prosa destacada e pare de tratar a porcentagem como uma proporção do documento.
  4. Verifique se os destaques estão nas suas primeiras ou últimas frases, a faixa que o Turnitin aponta como o próprio foco de falsos positivos.
  5. Lembre-se do que o fornecedor diz que esse número é. Em várias das próprias páginas, o Turnitin afirma que o indicador pode errar e não deve ser a única base para uma medida contra um estudante. Essa é uma frase razoável de levar para uma conversa com o seu orientador.

Se a conversa já começou e você mesmo escreveu o trabalho, marcado, mas foi você quem escreveu mostra quais evidências vale a pena reunir.

Se você decidir reescrever alguma coisa

Um aviso antes de colar qualquer coisa numa ferramenta de reescrita. Se a ferramenta reescreve o arquivo inteiro, a sua lista de referências fica dentro do alcance dela por padrão, e esse tipo de dano já foi registrado.

Tadhg Blommerde, professor na Northumbria University, que avalia essas ferramentas com acesso ao Turnitin pelo lado do professor e afirma não aceitar patrocínio nem usar links de afiliado, montou um ensaio de teste com citações no texto e uma lista de referências em APA e o passou pelo Walter Writes. Nessa avaliação de fevereiro de 2025, ele relata que a ferramenta "even humanized the reference list" (até a lista de referências ela humanizou), e aponta separadamente uma citação no resultado que não estava na entrada (vídeo da avaliação). Uma citação inventada é um problema pior do que a pontuação que você tentava corrigir.

A ferramenta HumanPen foi construída em torno dessa restrição. Entradas de bibliografia, marcadores de citação no texto, notas de rodapé, legendas, numeração de figuras, células de tabela e campos de referência cruzada ficam protegidos e não são reescritos. O alcance é algo que você define, e não algo que a ferramenta presume: selecione os trechos você mesmo, ou importe o AI Writing Report e deixe que os destaques dele os definam, e os parágrafos correspondentes são mostrados para você antes de qualquer coisa rodar. Um arquivo DOCX ou PPTX volta como o mesmo arquivo editável. Nada é artificialmente rebaixado com a inserção de erros de gramática ou ortografia. Resultados que cumprem os requisitos podem continuar reduzindo de graça a detecção de IA.

Nada disso é uma afirmação sobre o que o seu próximo relatório vai dizer. É uma descrição do que é mexido e do que não é.

Perguntas frequentes

A minha bibliografia aumenta a minha pontuação de IA no Turnitin? Não. As notas de atualização do Turnitin afirmam que bibliografias são excluídas quando o AI Writing Report é processado, e a análise cobre prosa qualificada em frases gramaticais comuns, o que as entradas de bibliografia não são. Um percentual alto de IA veio do corpo do seu texto.

Devo apagar as minhas referências antes de entregar para elas não serem marcadas? Não. Isso não muda o que o relatório de IA analisa, já que bibliografias ficam de fora desse processamento de qualquer forma, e entrega um trabalho incompleto para resolver um problema que você não tem. Se você quer saber a que o relatório reagiu, veja quais parágrafos de prosa estão destacados.

Por que a minha pontuação de similaridade é alta, mas a de IA é só um asterisco? São medições independentes de coisas diferentes. O Turnitin mostra um asterisco em vez de um número para pontuações de IA entre 1 e 19, e atribui isso a uma taxa maior de falsos positivos nessa faixa. Similaridade alta com um asterisco ao lado do indicador de IA costuma significar muito texto coincidente, muitas vezes incluindo a bibliografia, e muito pouca prosa que o modelo pontuou como IA.

Posso ver o AI Writing Report eu mesmo? Não diretamente. O Turnitin diz que os indicadores de escrita por IA são visíveis apenas para professores e administradores. Um professor pode baixar um PDF do relatório e compartilhar, e vale pedir isso antes de começar a raciocinar a partir da descrição que outra pessoa fez do que foi marcado.

Continue lendo