Por Que Diferentes Seções do Meu Artigo Recebem Porcentagens de IA Diferentes? Conheça o Pipeline de Detecção da Turnitin

Você abre o AI Writing Report e uma seção aparece com 60% enquanto outra mostra 0% — ou então as barras de destaque cobrem parte da página 3 e nada na página 5. O primeiro impulso é achar que o relatório está com defeito. Não está. A Turnitin avalia o documento frase por frase, agrupa essas pontuações e a porcentagem geral é um resultado agregado — o que significa que seções de comprimentos e densidades de frases diferentes naturalmente saem com valores distintos. Este artigo explica como o sistema funciona oficialmente, o que os destaques realmente significam e por que a porcentagem de IA nunca coincide com a pontuação de similaridade.

Equipe HumanPen

· 5 min de leitura

Resposta curta

Diferentes seções de um mesmo artigo recebem porcentagens de IA diferentes porque a Turnitin avalia cada frase individualmente e depois agrupa essas pontuações em uma porcentagem geral. O próprio guia da Turnitin descreve o pipeline: as frases são extraídas, cortadas em seções sobrepostas, cada seção recebe uma pontuação, cada frase herda essa pontuação e as pontuações das frases são agregadas no número final do documento. Uma seção curta e densa e outra longa e conversacional não vão parecer iguais no Submission Breakdown — esse é o mecanismo funcionando como deveria, não um erro no relatório.

Como o detector realmente lê o seu artigo

O guia oficial "Using the AI Writing Report" descreve como a detecção funciona:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis." (Quando um artigo é enviado à Turnitin, as frases da submissão são extraídas e segmentadas em seções sobrepostas para análise de predição.)
"Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated." (Cada segmento é classificado pelo modelo de detecção de IA e recebe um valor entre 0 e 1, indicando a probabilidade de o texto ser provavelmente humano ou gerado por IA.)

O próprio blog da Turnitin acrescenta o detalhe sobre a granularidade:

"The submission is first broken into segments of text that are roughly a few hundred words (about five to ten sentences). Those segments are then overlapped with each other to capture each sentence in context." (A submissão é primeiro dividida em segmentos de texto com algumas centenas de palavras [cerca de cinco a dez frases]. Esses segmentos são então sobrepostos uns aos outros para capturar cada frase em contexto.)

Então, o relatório que você está lendo foi construído a partir da menor unidade para cima: pontuações em nível de frase, depois agrupadas em visualizações por seção e, por fim, agregadas na porcentagem única que aparece no topo.

Por que as seções saem diferentes

O guia oficial continua:

"Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Cada frase qualificada dentro desses segmentos herda a pontuação do segmento. Como os segmentos se sobrepõem, algumas frases podem ter múltiplas pontuações, que são então agrupadas em uma única pontuação. Essas pontuações das frases são ainda mais agregadas e usadas para calcular a pontuação geral de escrita por IA do documento.)

Três consequências decorrem desse mecanismo:

  • As seções são pontuadas de acordo com a aparência das frases que contêm — uma seção cheia de frases curtas e parecidas com modelos pontua de forma diferente de outra com prosa longa e variada.
  • O comprimento da seção importa: o Submission Breakdown sombreia cada área do seu documento de acordo com quanto do texto qualificável foi sinalizado. Uma seção de 5 páginas pode visivelmente carregar mais texto destacado do que uma de 1 página, mesmo quando o padrão por frase é similar.
  • O agrupamento por sobreposição significa que uma frase na fronteira entre duas seções pode carregar uma pontuação mista — então a borda exata de um destaque não é um limite de veredicto preciso.

Nada disso é um erro do relatório. É a agregação funcionando exatamente como a Turnitin documenta.

A porcentagem de IA e a porcentagem de similaridade são independentes

Uma das interpretações equivocadas mais comuns é comparar a "pontuação" de IA com a porcentagem de similaridade como se fossem duas leituras da mesma coisa. O guia da Turnitin afirma a separação explicitamente:

"The percentage generated by Turnitin's AI writing detection model is different from and independent of the similarity score." (A porcentagem gerada pelo modelo de detecção de escrita por IA da Turnitin é diferente e independente da pontuação de similaridade.)
"AI writing highlights are not visible in the Similarity Report." (Os destaques de escrita por IA não estão visíveis no Similarity Report.)

Uma seção com 40% de similaridade e uma pontuação de IA de 0% não é contraditória: um número conta texto correspondente, o outro reflete o julgamento por frase do modelo de detecção. Diferentes seções de um documento podem, portanto, diferir em porcentagem de IA pela mesma razão pela qual as porcentagens de IA e similaridade podem diferir entre si — elas estão respondendo a perguntas diferentes.

Lendo o Submission Breakdown e os destaques

O guia oficial descreve a barra interativa no topo do relatório:

"The overall percentage of text likely detected as AI is detailed in the Submission Breakdown." (A porcentagem geral de texto provavelmente detectado como IA é detalhada no Submission Breakdown.)
"The bar is interactive and allows you to select each highlight to bring the corresponding text and page of the submission into focus." (A barra é interativa e permite que você selecione cada destaque para trazer para o foco o texto e a página correspondentes da submissão.)

Duas observações práticas quando você lê o seu próprio relatório:

  • A cor do destaque mudou em agosto de 2026: a Turnitin unificou as categorias AI-generated e AI-paraphrased em uma única cor azul, então relatórios mais novos mostram uma cor onde relatórios mais antigos mostravam duas.
  • Apenas prosa qualificável participa do cálculo — listas, pontos de bala, tabelas, poesia, scripts e código não contam. O guia oficial diz: "The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, etc." (O modelo não detecta de forma confiável texto gerado por IA na forma de não-prosa, como poesia, scripts ou código, nem detecta escrita de formato curto/não convencional, como pontos de bala, tabelas, etc.)

Então, uma seção "vazia" às vezes não está vazia de texto — está vazia de prosa qualificável. O relatório não diz nada sobre pontos de bala ou tabelas porque simplesmente não os conta.

Três estados para saber antes de entrar em pânico ao ler uma seção

O guia da Turnitin sobre estados de indicador cobre as porcentagens que não se comportam como um número simples:

"To avoid potential incidence of false positives, no score or highlights are attributed for AI detection scores above 0% and below the 20% threshold in the report. When this occurs, it is now indicated with an asterisk (%) and no percentage is attributed." (Para evitar a incidência potencial de falsos positivos, nenhuma pontuação ou destaque é atribuído para pontuações de detecção de IA acima de 0% e abaixo do limiar de 20% no relatório. Quando isso ocorre, agora é indicado com um asterisco [%] e nenhuma porcentagem é atribuída.)
"0% detected as AI … our testing has found that there is a higher incidence of false positives when the percentage is between 0 and 19." (0% detectado como IA … nossos testes descobriram que há uma incidência maior de falsos positivos quando a porcentagem está entre 0 e 19.)

Isso muda como você lê uma diferença em nível de seção: uma seção que mostra 0% pode ser um zero verdadeiro ou uma pontuação abaixo de 20% que o relatório se recusa a mostrar — o próprio relatório não pode dizer qual dos dois é. Isso é por design, não por acidente.

Resumo final

Um relatório de IA da Turnitin que mostra porcentagens diferentes entre seções é o pipeline do detector fazendo exatamente o que a Turnitin documenta: frases são pontuadas individualmente, segmentos sobrepostos agrupam as pontuações e o número geral é um agregado — não um veredicto uniforme em todo o seu documento. As seções diferem porque o caráter e o comprimento de suas frases diferem. A porcentagem de IA é independente da pontuação de similaridade e os destaques cobrem apenas prosa qualificável, então pontos de bala, tabelas e código ficam completamente fora do cálculo. Ao ler seu próprio relatório: trate os destaques como uma pista para investigar, não como um rótulo fixo em cada parágrafo.

Continue lendo