Relatórios de ensaios randomizados e detecção de IA: o que o CONSORT 2025 já decidiu antes de você escrever
Um relatório de ensaio randomizado é escrito duas vezes antes de alguém ler: uma vez como protocolo, outra como artigo, ambos seguindo listas de verificação numeradas do mesmo grupo. A lista publicada desce ao nível de uma única palavra do seu título. Vale saber disso antes de decidir quais frases mudar porque um detector as destacou.
Equipe HumanPen
· 15 min de leitura
Por que um relatório de ensaio randomizado volta com uma pontuação de IA alta se os dados são meus?
Porque a maior parte de um relatório de ensaio é especificada de antemão e boa parte dele é uma segunda versão de algo que você já escreveu. O CONSORT 2025 lista trinta itens que o relatório precisa cobrir, manda você colocar uma palavra específica no título e empurra as contagens de participantes para um diagrama de fluxo e as características basais para uma tabela. O que sobra em prosa contínua é a narrativa de Métodos e a Discussão, e a narrativa de Métodos é uma versão condensada de um protocolo registrado. A Turnitin, em documentos que não mencionam ensaios clínicos em nenhum momento, diz que mede apenas frases de prosa e que seus próprios falsos positivos podem envolver texto com pouca variação estrutural ou texto parafraseado sem ideias novas. Uma marcação na seção de Métodos não é prova de nada sobre como aquela seção foi escrita, e cortar conteúdo da lista de verificação para deixá-la menos uniforme piora o relatório.
Nada do lado do fornecedor diz nada disso sobre ensaios. Lemos as três páginas que definem o AI Writing Report (Using the AI Writing Report, as AI writing detection capabilities FAQs e File requirements for an AI Writing Report) em 27 de agosto de 2026, 38.174 caracteres de texto renderizado somando as três, e buscamos: `CONSORT` 0 ocorrências, `clinical` 0, `trial` 0, `randomis` 0, `randomiz` 0, `protocol` 0, `checklist` 0, `registr` 0. O instrumento estava funcionando na mesma passada: `prose` 12 ocorrências, `qualifying` 12.
A outra direção é a que é mais fácil de errar, então também a contamos. Nas treze páginas de conteúdo listadas no mapa do site SPIRIT-CONSORT, mais a lista de verificação do CONSORT 2025 e a sua versão expandida de doze páginas, 61.768 caracteres no total: `detection` 0 ocorrências, `detector` 0, `Turnitin` 0, `generative` 0, `large language` 0, `ChatGPT` 0, `plagiarism` 0. Sensibilidade na mesma passada: `consort` 107, `trial` 167, `randomis` 36. `Artificial intelligence` retorna exatamente uma ocorrência, na página de extensões, onde nomeia uma extensão SPIRIT para ensaios cuja intervenção é um sistema de IA. Esse é um padrão para relatar um ensaio de uma ferramenta de IA, o que é um assunto diferente de um autor usar uma. Portanto, a conexão traçada abaixo é nossa, montada a partir de dois conjuntos de documentos que nunca se referiram um ao outro.
A diretriz escolhe uma palavra para o seu título
O item 1a da lista de verificação do CONSORT 2025 diz `Identification as a randomised trial`. A lista expandida, que é onde o grupo detalha cada item, coloca isso de forma direta:
`Use the word "randomised" in the title` (use a palavra "randomised" no título)
Isso é uma diretriz de relato chegando ao nível de uma única palavra de uma única linha. É uma boa regra e existe por um bom motivo: indexadores e revisores sistemáticos precisam encontrar o seu ensaio. Isso também significa que a primeira linha de todo relatório nesse gênero, no mundo inteiro, carrega o mesmo termo.
O item 1b então especifica o resumo. A lista de conteúdos obrigatórios tem sete tópicos, três dos quais se desdobram em mais dez, e entre eles nomeiam quatorze coisas que o resumo precisa carregar: objetivos, desenho e estrutura do ensaio, critérios de elegibilidade e locais, intervenções e comparadores, desfechos primários, como os participantes foram alocados, quem foi cegado, números randomizados por grupo, números analisados por grupo, um resultado por grupo com tamanho de efeito e precisão, danos importantes, uma interpretação geral, o nome e o número do registro, e as fontes de financiamento. Abaixo da lista há mais uma instrução, impressa em asteriscos na fonte:
`Do not report information that does not appear in the body of the paper` (não relate informações que não aparecem no corpo do artigo)
Lido como uma restrição de escrita, isso é incomum. Exige-se que o seu resumo seja uma compressão do seu próprio artigo e que não contenha nada de novo. Do lado do fornecedor existe uma frase para isso, no parágrafo em que a Turnitin descreve a aparência típica dos seus falsos positivos, e ela é `text that has been paraphrased without developing new ideas`. Ninguém está dizendo que esses dois documentos falam da mesma coisa. Não falam. Mas um resumo escrito segundo o item 1b se encaixa nessa descrição por construção e, tirando os rótulos de seção, é feito de frases de prosa da primeira à última palavra.
A seção de Métodos é a segunda vez que você a escreveu
Esta é a parte que não tem equivalente na maioria dos outros gêneros e é o motivo pelo qual um relatório de ensaio é um problema diferente de um artigo com uma lista de verificação grampeada nele.
Antes de o ensaio acontecer, existia um protocolo. O item 3 do CONSORT exige que você diga onde ele está: `Where the trial protocol and statistical analysis plan can be accessed`, com a lista expandida pedindo uma URL para a sua localização. O item 2 exige o nome do registro, o número identificador, a URL e a data de registro. O item 10 exige que você relate `Important changes to the trial after it commenced including any outcomes or analyses that were not prespecified, with reason`.
Junte esses três e eles descrevem uma situação específica. Seus critérios de elegibilidade, seu método de randomização, seu sigilo de alocação, seus procedimentos de cegamento e suas análises planejadas foram todos registrados em um documento para o qual o seu artigo aponta publicamente, e o artigo relata o mesmo conteúdo outra vez em forma mais curta. Isso não é um atalho. É justamente o propósito do registro prospectivo.
O lado do protocolo tem a sua própria diretriz do mesmo grupo, o SPIRIT 2025, uma lista de verificação de 34 itens publicada junto com o CONSORT e financiada pelo mesmo subsídio. Os dois documentos, portanto, compartilham mais do que o assunto. Foram escritos contra listas numeradas emparelhadas que são revisadas em conjunto.
Se você já teve a sensação de que a sua seção de Métodos parece um formulário, é por isso. Dois dos documentos mais especificados da publicação acadêmica descrevem os mesmos procedimentos, um depois do outro, seguindo duas listas de verificação alinhadas.
Os números foram tirados da prosa de propósito
O CONSORT vai além de dizer o que relatar. Para vários dos itens mais pesados, ele diz em que formato relatar.
| Item do CONSORT 2025 | Forma exigida | O que isso significa para uma medição que só lê prosa |
|---|---|---|
| 22a, participantes aleatoriamente alocados, que receberam a intervenção, analisados | `In a flow diagram, the number of participants:` seguido de uma lista com marcadores de contagens | Um diagrama de contagens não contém frases de prosa |
| 22b, perdas e exclusões após a randomização, com os motivos | Também `In a flow diagram` | O mesmo |
| 25, características demográficas e clínicas basais | `A table showing baseline demographic and clinical characteristics for each group` (ou seja, em formato de tabela) | Uma grade de médias, desvios-padrão e porcentagens |
| 27, todos os danos ou eventos não intencionais | `For each group preferably in a table with the number of participants at risk` (de preferência em tabela, por grupo) | Principalmente em tabela, com alguma prosa em volta |
| 2, registro do ensaio | Nome do registro, número, URL, data | Linhas curtas em vez de frases |
| 5a e 5b, financiamento e conflitos de interesse | Financiadores nomeados, papéis, interesses declarados | Geralmente um bloco de declarações com entradas curtas |
Agora coloque ao lado disso a definição da Turnitin sobre o que ela lê:
`This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures.` (Em outras palavras: só entram na medição os blocos escritos em frases gramaticais completas — listas, marcadores e outras estruturas que não formam frases ficam de fora.)
E a frase que vem logo depois, na mesma página:
`This percentage is not necessarily the percentage of the entire submission.` (Ou seja, a porcentagem se refere ao texto analisado, e não necessariamente ao trabalho inteiro.)
A lista de referências também fica de fora, segundo a própria nota de versão do fornecedor de agosto de 2023, que diz que foi corrigido um bug que marcava escrita de IA dentro de referências bibliográficas e que `Bibliographies are now excluded when processing the AI writing report.` A nota acrescenta que o trabalho precisa ser reenviado para que a mudança passe a valer para ele.
Portanto, subtraia o diagrama de fluxo, a tabela de características basais, a tabela de danos, a linha de registro e a lista de referências. O que sobra na medição é a introdução, a narrativa de Métodos, a narrativa de resultados em volta das tabelas e a Discussão. Em outras palavras, as partes que o CONSORT especifica com mais rigor, menos quase todas as partes que carregam os seus números de verdade. O que é "texto elegível" na detecção de IA da Turnitin? cobre a regra geral e A Turnitin lê o texto dentro de tabelas? cobre o caso das tabelas, incluindo a parte daquela nota de versão sobre prosa longa dentro de células de tabela.
Há uma segunda consequência que vale destacar. Um relatório curto cuja prosa analisada chega a apenas algumas centenas de palavras cai no comportamento que a Turnitin descreve como `mostly "all or nothing" because we're predicting on a single segment without the opportunity to overlap`, e a frase seguinte diz que `some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated`. Um relatório de ensaio com um diagrama grande, três tabelas e quarenta referências é mais curto, no sentido que está sendo medido, do que a sua contagem de páginas sugere. Documentos curtos e o problema do tudo ou nada na Turnitin examina isso a fundo.
Onde a lista de verificação decide sobre a sua redação, e não só sobre o conteúdo
Dois itens vão além de listar conteúdo, e ambos são fáceis de deixar passar porque aparecem como uma única linha dentro de uma tabela longa.
O item 22b, sobre perdas e exclusões após a randomização, acrescenta isto:
`The wording "protocol deviation" is not sufficiently explicit and exact reasons should be reported` (Ou seja, a expressão "protocol deviation" é vaga demais: é preciso relatar os motivos exatos.)
É raro uma diretriz de relato citar uma expressão para recusá-la. O motivo pelo qual isso importa aqui não tem nada a ver com detector nenhum. Se, durante uma revisão, você trocar um motivo específico por uma expressão resumida e arrumada, terá violado o item 22b. Essa falha é invisível para quem revisa o texto e óbvia para um parecerista que conhece a lista de verificação.
O item 29, sobre interpretação, é o outro:
`Avoid overinterpretation ('spin')` (Evite exagerar na interpretação dos resultados, o chamado "spin".)
A Discussão costuma ser descrita como a parte livre de um artigo. Nesse gênero, ela vem com uma instrução sobre até onde as suas afirmações podem ir, ao lado de exigências de relacionar os resultados às evidências existentes e de equilibrar benefícios e danos. O item 30 então nomeia as quatro coisas que o seu parágrafo de limitações precisa abordar: limitações metodológicas, imprecisão, generalizabilidade e multiplicidade de análises, quando for o caso.
O que a lista de verificação nunca toca
Esta é a distinção que decide o que você faz a seguir, e não é a que a maioria dos conselhos de revisão oferece.
O CONSORT especifica o que deve aparecer, em vários lugares a forma em que deve aparecer e em dois lugares uma expressão a evitar. Ele não escreve as suas frases. Nada na lista de verificação diz como você deve formular por que a pergunta importava.
Fixo, e rastreável até um número. O útil aqui não é um aviso geral sobre o que não mexer. É que cada um desses elementos tem um número de item que você pode apontar. As contagens no diagrama de fluxo são 22a e 22b. O nome, número, URL e data do registro são o item 2. A elegibilidade como foi aplicada de fato é 12a. Quem gerou a sequência de alocação e por qual método é 17a. Quem foi cegado e como o cegamento foi feito são 20a e 20b. Resultado por grupo com tamanho de efeito e precisão, e efeitos absolutos e relativos para desfechos binários, é o item 26. Isso muda a forma da conversa, porque "não posso cortar isso" soa diferente quando vem com uma citação anexada. Para a disciplina geral de separar expressão de estado científico, em CONSORT, STROBE e PRISMA juntos, veja Métodos e resultados: o que você pode reformular e o que precisa ficar exato.
Seu, e geralmente subaproveitado. O item 6 pede `Importance of the research question` e `Why a new trial is needed in the context of available evidence`, com subitens cobrindo como a intervenção pode funcionar e por que você escolheu aquele comparador. O item 29 pergunta como os seus resultados se relacionam com as evidências existentes. São argumentos, e argumentos variam de forma porque o pensamento neles varia. Se a sua introdução pudesse ser trocada pela introdução de qualquer outro ensaio da sua área, isso é hábito, não diretriz, e é o único lugar do relatório onde variar não custa nada.
A própria lista de verificação também não finge cobrir todo tipo de desenho. A sua página de extensões lista vinte e duas extensões do CONSORT construídas sobre a lista de 2010 e uma construída sobre a de 2025, e diz com as próprias palavras que a lista `is by no means exhaustive`. Cluster, crossover, stepped-wedge, piloto, pragmático, de não inferioridade, danos, desfechos relatados pelo paciente, cada um com os seus itens adicionais. Se o seu ensaio for um deles, a fração especificada do seu artigo é maior, não menor.
Se os Métodos ou o resumo voltaram marcados
- Olhe onde a marcação está antes de olhar o número. Uma seção de Métodos que volta como um bloco contínuo tem uma explicação mecânica que vale entender primeiro: A Turnitin marcou toda a minha seção de metodologia.
- Conte a prosa analisada, não as páginas. Retire o diagrama de fluxo, as tabelas e a lista de referências e veja quanto de prosa contínua sobra. É esse número, e não a contagem de páginas, que o comportamento de tudo ou nada afeta.
- Marque o conteúdo da lista de verificação antes de mexer em qualquer redação. Abra a lista expandida ao lado do seu manuscrito e marque cada frase que existe porque um item a exigiu. Decida isso primeiro, a frio, e não durante a reescrita.
- Leve a posição do próprio fornecedor para a conversa. O FAQ dele diz que a porcentagem `should not be used as the sole basis for action or a definitive grading measure by instructors`, e o parágrafo sobre falsos positivos termina recomendando que o leitor leve em conta a natureza do texto ao ler a porcentagem. O que o seu professor é instruído a fazer quando a sua porcentagem de IA está alta reúne essas orientações.
- Se alguém lhe citar um limite, 20% de IA é alto demais? explica por que nenhum número publicado funciona como nota de corte.
- Verifique a sua declaração separadamente. Se você precisa declarar uma revisão assistida por IA é uma pergunta de revista, não de detector, e Políticas de divulgação de IA das editoras, comparadas coloca as principais lado a lado.
Se a redação vai mudar de qualquer forma
Revisar um relatório de ensaio tem um custo específico que tem pouco a ver com escrita. Qualquer parágrafo que você abra precisa ser relido depois contra outros três documentos: a lista de verificação preenchida, o protocolo registrado e o plano de análise estatística cuja localização o item 3 contou ao mundo. Abra o manuscrito inteiro e você se comprometeu a verificar o manuscrito inteiro de novo. Uma checagem perdida aqui não é um erro de digitação. É uma afirmação publicada sobre o que aconteceu com pessoas que concordaram em participar de um estudo.
É por isso que o escopo importa. A ferramenta HumanPen é nossa, então trate as próximas frases como uma descrição de primeira mão de como o limite funciona, e não como uma recomendação. O escopo é traçado antes de qualquer coisa rodar: ou você adiciona os trechos você mesmo, ou importa um relatório de detecção e deixa que os trechos marcados os definam. O site coloca a regra assim: o parágrafo é a menor unidade que o motor reescreve. Marque metade de um parágrafo e o limite cresce até a borda do parágrafo, e é a versão já expandida que você vê para aprovar. Nada além dela é aberto. A cobrança segue o mesmo limite, contando apenas as palavras efetivamente reescritas. O que volta é um documento editável, com sentido, estrutura, terminologia, citações, layout e estilos entre as coisas que a reescrita busca preservar, e a própria recomendação do site é revisar documentos complexos depois do download. Quando um trecho atende às condições e continua marcado, ele pode ser reprocessado sem custo. Reescrevendo apenas os parágrafos que um relatório da Turnitin marcou mostra o passo a passo da versão guiada pelo relatório.
Qual será a pontuação depois não é algo que alguém possa prometer de antemão, nós incluídos. O que quer que você use, coloque os parágrafos de Métodos devolvidos ao lado do protocolo e os tamanhos de efeito devolvidos ao lado da saída da sua análise antes de reenviar. Um intervalo de confiança que perdeu um dígito é um problema pior do que uma frase marcada.
Perguntas frequentes
Seguir o CONSORT aumenta a minha pontuação de IA? Nada do que o fornecedor publica diz isso, e na leitura descrita acima as três páginas do relatório não mencionam ensaios, protocolos ou diretrizes de relato em nenhum momento. O que ele publica é que os seus falsos positivos podem envolver conteúdo com pouca variação estrutural, e o CONSORT remove variação estrutural de partes de um relatório de ensaio de propósito.
A minha seção de Métodos repete o meu protocolo registrado. Isso é um problema? Para o relato, não. O protocolo é o que torna o ensaio prospectivo, o item 3 exige que você diga onde ele está e o item 10 exige que você relate qualquer desvio em relação a ele. É um problema apenas no sentido estrito de que uma segunda versão do seu próprio documento é prosa densa e uniforme, que é a forma mais exposta à medição.
O diagrama de fluxo e a tabela de características basais entram na porcentagem? Só são analisadas as frases de prosa elegível, e um diagrama de contagens e uma grade de médias não são frases de prosa. Uma nota de versão de agosto de 2023 diz que prosa longa dentro de células de tabela é processada, e que submissões existentes precisam ser reenviadas para serem reprocessadas, então uma tabela cheia de frases completas é um caso diferente de uma tabela de números.
Posso reformular a narrativa do fluxo de participantes para baixar a pontuação? Você pode mover frases, mas o item 22b exige motivos exatos para as exclusões e recusa explicitamente `protocol deviation` como redação suficiente. Se uma revisão trocar um motivo por uma expressão resumida, o relatório passa a estar menos em conformidade do que aquele que você enviou, e nenhuma pontuação compensa isso.
O meu resumo inteiro está marcado. Um resumo escrito segundo o item 1b tem quatorze conteúdos obrigatórios, uma instrução para não incluir nada que não esteja no corpo do artigo e nenhuma tabela, lista ou referência para quebrá-lo. É o texto elegível mais denso do documento. A orientação do fornecedor é que a porcentagem não é base única para uma decisão, e o parágrafo sobre falsos positivos é o que se deve colocar na frente de quem estiver perguntando.
Isso vale para artigos do CONSORT 2010 ou para estudos observacionais? Os itens citados acima são do CONSORT 2025, publicado em 2025 com uma lista de verificação de 30 itens. Estudos observacionais seguem uma diretriz totalmente diferente. A jogada geral vale de qualquer forma: descubra quais das suas frases uma norma de relato especificou antes de decidir quais mudar.
Continue lendo
O que o histórico de versões do Google Docs registra de fato
17 min de leitura
Detectores de IAPersonal Statement sinalizado como IA: foi o tema que escolheu a forma primeiro
13 min de leitura
Relatórios de detecçãoPost no fórum marcado como IA: descubra primeiro o que o marcou
12 min de leitura