Rapporti di sperimentazioni randomizzate e rilevamento dell’IA: ciò che CONSORT 2025 ha deciso prima che scrivessi
Un rapporto di sperimentazione randomizzata viene scritto due volte prima che qualcuno lo legga: una volta come protocollo, una volta come articolo, entrambe seguendo liste di controllo numerate dello stesso gruppo. La lista pubblicata arriva fino a una singola parola del tuo titolo. Vale la pena saperlo prima di decidere quali frasi cambiare perché un rilevatore le ha evidenziate.
Team HumanPen
· 15 min di lettura
Perché un rapporto di sperimentazione randomizzata torna con un punteggio IA alto quando i dati sono miei?
Perché gran parte di un rapporto di sperimentazione è specificata in anticipo e molto di esso è un secondo resoconto di qualcosa che hai già scritto. CONSORT 2025 elenca trenta elementi che un rapporto deve coprire, ti dice di mettere una parola precisa nel titolo e sposta i conteggi dei partecipanti in un diagramma di flusso e le caratteristiche al basale in una tabella. Ciò che resta in prosa continua sono la narrazione dei Metodi e la Discussione, e la narrazione dei Metodi è un resoconto condensato di un protocollo registrato. Turnitin, in documenti che non menzionano affatto le sperimentazioni cliniche, dice di misurare solo frasi in prosa e dice che i suoi stessi falsi positivi possono riguardare testi con scarsa variabilità strutturale o testi riformulati senza idee nuove. Un contrassegno su una sezione Metodi non è la prova di nulla sul modo in cui quella sezione è stata scritta, e tagliare contenuti della lista di controllo per farla sembrare meno uniforme peggiora il rapporto.
Nulla, da parte del fornitore, dice qualcosa di tutto questo sulle sperimentazioni. Abbiamo letto le tre pagine che definiscono l’AI Writing Report (Using the AI Writing Report, le AI writing detection capabilities FAQs e File requirements for an AI Writing Report) il 27 agosto 2026, 38.174 caratteri di testo d’articolo renderizzato in totale, e abbiamo cercato: `CONSORT` 0 occorrenze, `clinical` 0, `trial` 0, `randomis` 0, `randomiz` 0, `protocol` 0, `checklist` 0, `registr` 0. Lo strumento funzionava nella stessa passata: `prose` 12 occorrenze, `qualifying` 12.
L’altra direzione è quella in cui è facile sbagliare, quindi l’abbiamo contata anche noi. Sulle tredici pagine di contenuto elencate nella mappa del sito SPIRIT-CONSORT, più la lista di controllo CONSORT 2025 e la sua versione estesa di dodici pagine, 61.768 caratteri in tutto: `detection` 0 occorrenze, `detector` 0, `Turnitin` 0, `generative` 0, `large language` 0, `ChatGPT` 0, `plagiarism` 0. Prova di sensibilità sulla stessa passata: `consort` 107, `trial` 167, `randomis` 36. `Artificial intelligence` restituisce esattamente un’occorrenza, nella pagina delle estensioni, dove nomina un’estensione SPIRIT per sperimentazioni il cui intervento è un sistema di IA. Quello è uno standard per riportare una sperimentazione di uno strumento di IA, che è un argomento diverso da un autore che ne usa uno. Il collegamento tracciato qui sotto è quindi nostro, costruito a partire da due gruppi di documenti che non si sono mai richiamati a vicenda.
La linea guida impone una parola nel tuo titolo
L’elemento 1a della lista di controllo CONSORT 2025 recita `Identification as a randomised trial` (Identificazione come sperimentazione randomizzata). La lista estesa, che è il punto in cui il gruppo esplicita ogni elemento, lo dice senza giri di parole:
`Use the word "randomised" in the title` (Usa la parola «randomizzato» nel titolo)
È una linea guida di reporting che arriva fino a una singola parola di una singola riga. È una buona regola ed esiste per una buona ragione: chi indicizza e chi fa revisioni sistematiche deve poter trovare la tua sperimentazione. Significa anche che la prima riga di ogni rapporto di questo genere, in tutto il mondo, porta lo stesso termine.
L’elemento 1b specifica poi l’abstract. Il suo elenco di contenuti obbligatori è fatto di sette punti, tre dei quali si aprono in altri dieci, e tra tutti indicano quattordici cose che l’abstract deve portare: obiettivi, disegno e cornice della sperimentazione, criteri di eleggibilità e contesti, interventi e comparatori, esiti primari, come i partecipanti sono stati allocati, chi è stato accecato, numeri randomizzati per gruppo, numeri analizzati per gruppo, un risultato per gruppo con dimensione dell’effetto e precisione, danni importanti, un’interpretazione generale, nome e numero del registro e le fonti di finanziamento. Sotto l’elenco c’è un’altra istruzione, stampata in asterischi nella fonte:
`Do not report information that does not appear in the body of the paper` (Non riportare informazioni che non compaiono nel corpo dell’articolo)
Letta come un vincolo di scrittura, è insolita: il tuo abstract deve essere una compressione del tuo stesso articolo e non deve contenere nulla di nuovo. Da parte del fornitore esiste una frase per questo, nel paragrafo in cui Turnitin descrive come tendono a presentarsi i suoi falsi positivi, ed è `text that has been paraphrased without developing new ideas` (testo che è stato riformulato senza sviluppare idee nuove). Nessuno sostiene che quei due documenti stiano parlando della stessa cosa. Non lo stanno facendo. Ma un abstract scritto secondo l’elemento 1b rientra in quella descrizione per costruzione e, a parte le sue etichette di sezione, è fatto di frasi in prosa dalla prima all’ultima parola.
La sezione Metodi è la seconda volta che l’hai scritta
Questa è la parte che non ha equivalente nella maggior parte degli altri generi, ed è la ragione per cui un rapporto di sperimentazione è un problema diverso da un articolo con una lista di controllo allegata.
Prima che la sperimentazione partisse, c’era un protocollo. L’elemento 3 di CONSORT richiede che tu dica dove si trova: `Where the trial protocol and statistical analysis plan can be accessed` (Dove è possibile accedere al protocollo della sperimentazione e al piano di analisi statistica), con la lista estesa che chiede un URL della sua collocazione. L’elemento 2 richiede il nome del registro, il numero identificativo, l’URL e la data di registrazione. L’elemento 10 richiede che tu riporti `Important changes to the trial after it commenced including any outcomes or analyses that were not prespecified, with reason` (modifiche importanti alla sperimentazione dopo il suo avvio, inclusi esiti o analisi non pre-specificati, con la ragione).
Metti questi tre in fila e descrivono una situazione precisa: i tuoi criteri di eleggibilità, il tuo metodo di randomizzazione, l’occultamento dell’allocazione, le tue procedure di accecamento e le analisi pianificate erano tutti scritti in un documento verso cui il tuo articolo punta pubblicamente, e l’articolo riporta lo stesso contenuto una seconda volta, in forma più breve. Non è una scorciatoia. È il senso della registrazione prospettica.
Il versante protocollo ha una sua linea guida dello stesso gruppo, SPIRIT 2025, una lista di controllo di 34 elementi pubblicata accanto a CONSORT e finanziata dallo stesso grant. I due documenti condividono quindi più del loro argomento. Sono stati scritti sulla base di liste numerate appaiate, che vengono riviste insieme.
Se hai mai avuto la sensazione che la tua sezione Metodi sembri un modulo, ecco perché. Due dei documenti più pesantemente specificati dell’editoria accademica descrivono le stesse procedure, una dopo l’altra, secondo due liste di controllo allineate.
I numeri sono stati tolti dalla prosa di proposito
CONSORT non si limita a dire cosa riportare. Per diversi degli elementi più pesanti dice anche in che forma riportarlo.
| Elemento CONSORT 2025 | Forma richiesta | Cosa ne consegue per una misurazione che legge solo la prosa |
|---|---|---|
| 22a, partecipanti assegnati casualmente, che hanno ricevuto l’intervento, analizzati | `In a flow diagram, the number of participants:` (In un diagramma di flusso, il numero dei partecipanti) seguito da un elenco puntato di conteggi | Un diagramma di conteggi non contiene frasi in prosa |
| 22b, perdite ed esclusioni dopo la randomizzazione con le ragioni | Anch’esso `In a flow diagram` (In un diagramma di flusso) | Uguale |
| 25, caratteristiche demografiche e cliniche al basale | `A table showing baseline demographic and clinical characteristics for each group` (Una tabella con le caratteristiche demografiche e cliniche al basale per ogni gruppo) | Una griglia di medie, deviazioni standard e percentuali |
| 27, tutti i danni o gli eventi non intenzionali | `For each group preferably in a table with the number of participants at risk` (Per ogni gruppo preferibilmente in una tabella con il numero dei partecipanti a rischio) | Soprattutto tabellare, con un po’ di prosa intorno |
| 2, registrazione della sperimentazione | Nome del registro, numero, URL, data | Righe brevi più che frasi |
| 5a e 5b, finanziamenti e conflitti | Finanziatori nominati, ruoli, interessi dichiarati | Spesso un blocco di dichiarazioni fatto di voci brevi |
Ora metti accanto a questo la definizione che Turnitin dà di ciò che legge:
`This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures.` (Questo testo idoneo comprende solo frasi in prosa, il che significa che analizziamo unicamente blocchi di testo scritti in frasi grammaticali standard e non includiamo altri tipi di scrittura come elenchi, punti elenco (strutture brevi che non sono frasi) o altre strutture che non sono frasi.)
E la frase che la segue nella stessa pagina:
`This percentage is not necessarily the percentage of the entire submission.` (Questa percentuale non è necessariamente la percentuale dell’intera sottomissione.)
Anche l’elenco delle referenze è fuori, secondo la nota di rilascio dello stesso fornitore dell’agosto 2023, che dice di aver corretto un bug che evidenziava scrittura IA all’interno dei riferimenti bibliografici e che `Bibliographies are now excluded when processing the AI writing report.` (Le bibliografie sono ora escluse durante l’elaborazione del report di scrittura IA). Quella nota aggiunge che una sottomissione deve essere inviata di nuovo prima che la modifica le venga applicata.
Quindi sottrai il diagramma di flusso, la tabella al basale, la tabella dei danni, la riga di registrazione e l’elenco delle referenze. Ciò che resta nella misurazione sono l’introduzione, la narrazione dei Metodi, la narrazione dei risultati intorno alle tabelle e la Discussione. In altre parole: le parti che CONSORT specifica più strettamente, meno quasi tutte le parti che portano i tuoi numeri reali. Che cos’è il «testo idoneo» nel rilevamento IA di Turnitin tratta la regola generale e Turnitin legge il testo dentro le tabelle? tratta il caso delle tabelle, inclusa la parte di quella nota di rilascio sulla prosa lunga dentro le celle delle tabelle.
C’è una seconda conseguenza che vale la pena segnalare. Un rapporto breve la cui prosa analizzata arriva solo a poche centinaia di parole rientra nel comportamento che Turnitin descrive come `mostly "all or nothing" because we're predicting on a single segment without the opportunity to overlap` (soprattutto «tutto o niente», perché facciamo la previsione su un singolo segmento senza possibilità di sovrapposizione), e la frase successiva dice `some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated` (che un testo che è un misto di contenuto generato dall’IA e contenuto originale potrebbe essere contrassegnato come interamente generato dall’IA). Un rapporto di sperimentazione con un grande diagramma, tre tabelle e quaranta referenze è più breve, nel senso in cui si misura, di quanto suggerisca il suo numero di pagine. Documenti brevi e il problema del tutto o niente in Turnitin approfondisce la questione.
Dove la lista di controllo decide anche sulla tua formulazione, non solo sul contenuto
Due elementi vanno oltre il semplice elencare contenuti, ed entrambi sono facili da mancare perché stanno come una singola riga dentro una tabella lunga.
L’elemento 22b, su perdite ed esclusioni dopo la randomizzazione, aggiunge questo:
`The wording "protocol deviation" is not sufficiently explicit and exact reasons should be reported` (La formulazione «deviazione dal protocollo» non è sufficientemente esplicita e vanno riportate ragioni esatte)
Che una linea guida di reporting nomini una formulazione e la rifiuti è raro. La ragione per cui conta qui non ha a che fare con alcun rilevatore. Se durante una revisione sostituisci una ragione specifica con una frase riassuntiva ordinata, hai violato l’elemento 22b. Questo errore è invisibile a chi corregge le bozze ed evidente per un revisore che conosce la lista.
L’elemento 29, sull’interpretazione, è l’altro:
`Avoid overinterpretation ('spin')` (Evita la sovrainterpretazione, lo «spin»)
La Discussione viene normalmente descritta come la parte libera di un articolo. In questo genere arriva con un’istruzione su quanto possono spingersi le tue affermazioni, accanto ai requisiti di collegare i risultati alle prove esistenti e di bilanciare benefici e danni. L’elemento 30 indica poi le quattro cose che il tuo paragrafo sui limiti deve affrontare: limiti metodologici, imprecisione, generalizzabilità e molteplicità delle analisi dove pertinente.
Ciò che la lista di controllo non tocca mai
Ecco la distinzione che decide cosa farai dopo, e non è quella che offre la maggior parte dei consigli di revisione.
CONSORT specifica cosa deve comparire, in diversi punti la forma in cui deve comparire e in due punti una formulazione da evitare. Non scrive le tue frasi. Nulla nella lista ti dice come formulare il motivo per cui la domanda contava.
Fissato, e riconducibile a un numero. La cosa utile qui non è un avvertimento generale su cosa non toccare. È che ognuno di questi elementi ha un numero su cui puoi puntare il dito. I conteggi nel diagramma di flusso sono 22a e 22b. Nome del registro, numero, URL e data sono l’elemento 2. L’eleggibilità come è stata effettivamente applicata è 12a. Chi ha generato la sequenza di allocazione e con quale metodo è 17a. Chi è stato accecato e come è stato ottenuto l’accecamento sono 20a e 20b. Il risultato per gruppo con dimensione dell’effetto e precisione, e sia gli effetti assoluti sia quelli relativi per esiti binari, è l’elemento 26. Questo cambia la forma di una conversazione, perché «questo non posso tagliarlo» suona diversamente quando ci è allegata una citazione. Per la disciplina generale di separare l’espressione dallo stato scientifico, attraverso CONSORT, STROBE e PRISMA insieme, vedi Metodi e risultati: cosa puoi riformulare e cosa deve restare esatto.
Tuo, e di solito poco sfruttato. L’elemento 6 chiede `Importance of the research question` (Importanza della domanda di ricerca) e `Why a new trial is needed in the context of available evidence` (Perché serve una nuova sperimentazione nel contesto delle prove disponibili), con sotto-elementi su come l’intervento potrebbe funzionare e perché hai scelto quel comparatore. L’elemento 29 chiede come i tuoi risultati si collegano alle prove esistenti. Quelli sono argomenti, e gli argomenti variano in forma perché varia il pensiero che contengono. Se la tua introduzione potesse essere scambiata con l’introduzione di qualsiasi altra sperimentazione nel tuo campo, quella è abitudine e non la linea guida, ed è l’unico punto del rapporto in cui la variazione non ti costa nulla.
Nemmeno la lista stessa finge di coprire ogni disegno. La sua pagina delle estensioni elenca ventidue estensioni CONSORT costruite sulla lista del 2010 e una costruita su quella del 2025, e dice con parole proprie che l’elenco `is by no means exhaustive` (non è in alcun modo esaustivo). Cluster, crossover, stepped-wedge, pilota, pragmatico, di non inferiorità, danni, esiti riferiti dai pazienti, ciascuna con i propri elementi aggiuntivi. Se la tua sperimentazione è una di quelle, la quota specificata del tuo articolo è più grande, non più piccola.
Se i Metodi o l’abstract sono tornati evidenziati
- Guarda dove si trova l’evidenziazione prima di guardare il numero. Che una sezione Metodi arrivi come un blocco continuo ha una spiegazione meccanica che vale la pena capire prima: Turnitin ha contrassegnato tutta la mia sezione di metodologia.
- Conta la prosa analizzata, non le pagine. Togli il diagramma di flusso, le tabelle e l’elenco delle referenze, poi guarda quanta prosa continua resta. È quel numero, non il numero di pagine, a cui si applica il comportamento tutto o niente.
- Segna il contenuto della lista di controllo prima di toccare qualsiasi formulazione. Apri la lista estesa accanto al tuo manoscritto e segna ogni frase che esiste perché un elemento l’ha richiesta. Decidi questo prima, a mente fredda, e non mentre riscrivi.
- Porta nella conversazione la posizione dello stesso fornitore. Le sue FAQ dicono che la percentuale `should not be used as the sole basis for action or a definitive grading measure by instructors` (non dovrebbe essere usata come unica base per agire né come misura di valutazione definitiva da parte dei docenti), e il paragrafo sui falsi positivi finisce consigliando al lettore di tenere conto della natura del testo quando legge la percentuale. Cosa si dice al tuo docente di fare quando la tua percentuale IA è alta raccoglie quelle indicazioni.
- Se qualcuno ti cita una soglia, Il 20% di IA è troppo alto? spiega perché nessun numero pubblicato funziona come soglia di superamento.
- Controlla la tua dichiarazione separatamente. Se devi dichiarare una revisione assistita dall’IA è una questione della rivista, non del rilevatore, e Le politiche di dichiarazione sull’IA degli editori, a confronto mette le principali una accanto all’altra.
Se la formulazione cambierà comunque
Rivedere un rapporto di sperimentazione ha un costo specifico che ha poco a che fare con lo scrivere. Ogni paragrafo che apri deve essere riletto dopo, a confronto con altri tre documenti: la lista di controllo compilata, il protocollo registrato e il piano di analisi statistica di cui l’elemento 3 ha detto al mondo dove trovarlo. Apri tutto il manoscritto e ti sei impegnato a riverificare tutto il manoscritto. Un controllo mancato qui non è un refuso. È un’affermazione pubblicata su ciò che è accaduto a persone che hanno accettato di partecipare a uno studio.
Che è la ragione per cui il perimetro conta. HumanPen è nostro, quindi considera le prossime frasi come una descrizione di prima mano di come funziona il confine, più che come una raccomandazione. Il perimetro viene tracciato prima che parta qualsiasi cosa: o aggiungi tu i passaggi, o importi un report di rilevamento e lasci che siano i passaggi contrassegnati a definirli. Il sito formula la regola così: un paragrafo è l’unità più piccola che il motore riscrive. Ne contrassegni la metà e il confine cresce fino al bordo del paragrafo, ed è la versione cresciuta a esserti mostrata per l’approvazione. Nulla oltre quel punto viene aperto. La fatturazione segue lo stesso confine e conta solo le parole effettivamente riscritte. Ciò che torna è un documento modificabile, con il significato, la struttura, la terminologia, le citazioni, l’impaginazione e gli stili tra le cose che la riscrittura mira a preservare, e il consiglio dello stesso sito è di rivedere i documenti complessi dopo il download. Quando un passaggio soddisfa i requisiti e resta comunque contrassegnato, può essere riavviato gratuitamente. Riscrivere solo i paragrafi che un report Turnitin ha contrassegnato accompagna la versione di questo guidata dal report.
Come sarà un punteggio dopo non è qualcosa che nessuno può promettere in anticipo, noi compresi. Qualunque cosa tu usi, metti i paragrafi dei Metodi restituiti accanto al protocollo e le dimensioni dell’effetto restituite accanto all’output della tua analisi prima di inviare di nuovo. Un intervallo di confidenza che ha perso una cifra è un problema peggiore di una frase evidenziata.
Domande frequenti
Seguire CONSORT alza il mio punteggio IA? Nulla di ciò che il fornitore pubblica lo dice, e nella lettura descritta sopra le sue tre pagine del report non menzionano affatto sperimentazioni, protocolli o linee guida di reporting. Ciò che pubblica è che i suoi falsi positivi possono riguardare contenuti senza molta variabilità strutturale, e CONSORT rimuove deliberatamente la variabilità strutturale da parti di un rapporto di sperimentazione.
La mia sezione Metodi ripete il mio protocollo registrato. È un problema? Per il reporting no. Il protocollo è ciò che rende prospettica la sperimentazione, l’elemento 3 richiede che tu dica dove si trova e l’elemento 10 richiede che tu riporti ogni scostamento da esso. È un problema solo nel senso ristretto che un secondo resoconto del tuo stesso documento è prosa densa e uniforme, che è la forma più esposta alla misurazione.
Il diagramma di flusso e la tabella al basale contano nella percentuale? Viene analizzato solo il testo idoneo in forma di frasi in prosa, e un diagramma di conteggi e una griglia di medie non sono frasi in prosa. Una nota di rilascio dell’agosto 2023 dice però che la prosa lunga dentro le celle di una tabella viene elaborata, e che le sottomissioni esistenti devono essere inviate di nuovo per essere rielaborate, quindi una tabella piena di frasi complete è un caso diverso da una tabella di numeri.
Posso riformulare la narrazione del flusso dei partecipanti per abbassare il punteggio? Puoi spostare le frasi, ma l’elemento 22b richiede ragioni esatte per le esclusioni e rifiuta esplicitamente `protocol deviation` come formulazione sufficiente. Se una revisione sostituisce una ragione con una frase riassuntiva, il rapporto è ora meno conforme di quello che hai inviato, e nessun punteggio compensa questo.
Tutto il mio abstract è evidenziato. Un abstract scritto secondo l’elemento 1b ha quattordici contenuti obbligatori, l’istruzione di non includere nulla che sia assente dal corpo dell’articolo e nessuna tabella, elenco o referenza a spezzarlo. È il testo idoneo più denso del documento. L’indicazione del fornitore è che la percentuale non è un’unica base per agire, e il suo paragrafo sui falsi positivi è la cosa da mettere davanti a chi sta chiedendo.
Questo vale anche per gli articoli CONSORT 2010 o per gli studi osservazionali? Gli elementi citati sopra sono quelli di CONSORT 2025, pubblicato nel 2025 con una lista di 30 elementi. Gli studi osservazionali seguono una linea guida del tutto diversa. La mossa generale regge in entrambi i casi: scopri quali delle tue frasi uno standard di reporting ha specificato prima di decidere quali cambiare.
CONTINUA A LEGGERE
Cosa registra davvero la cronologia delle versioni di Google Docs
17 min di lettura
Rilevatori AIPersonal statement segnalato come IA: è la traccia a scegliere prima la forma
13 min di lettura
Report TurnitinPost del forum segnalato come IA: scopri prima cosa lo ha fatto segnalare
12 min di lettura