Se riscrivo una frase segnalata, il punteggio scende di quanto varrebbe quella frase?
Le varie spiegazioni su come Turnitin calcoli la percentuale AI sembrano tutte basate su una somma. Ognuna rimanda a un documento, ma in ogni caso il documento dice meno di quanto dica il consiglio che ci costruiscono sopra.
Team HumanPen
· 9 min di lettura
La risposta breve
No. Il punteggio che una frase porta non l'ha guadagnato da sola, quindi non esiste un tasso di cambio fisso tra frasi corrette e punti percentuali tolti. Secondo il resoconto pubblicato da Turnitin, le frasi vengono estratte e raggruppate in segmenti sovrapposti, ogni segmento riceve un punteggio da 0 a 1, e una frase eredita il punteggio di tutti i segmenti in cui si trova — il che significa che una frase vicina a un confine porta più di un punteggio, combinato. Quella descrizione nomina tre operazioni — ereditare, combinare, aggregare — ma non ne pubblica nessuna, quindi non c'è modo di leggerne il contributo di una singola frase. Tre spiegazioni specifiche di quel calcolo circolano e tutte e tre sono additive. Ognuna rimanda a un documento, e in ogni caso il documento dice meno della spiegazione che ci costruiscono sopra.
Quelle tre sono qui sotto, ciascuna accanto al proprio documento. Il meccanismo stesso, e le modifiche manuali che ne derivano, le abbiamo trattate separatamente in come rendere più umano un testo AI senza strumenti.
"The report is binary at the sentence level" (Il report è binario a livello di frase)
Dalla guida di un'azienda di revisione bozze su come ridurre un punteggio AI, recuperata il 18 agosto 2026 e citata testualmente:
"There is no colour scale like the similarity report. The AI report is binary at the sentence level: each sentence is either flagged or not flagged. The overall percentage is simply the proportion of flagged text across the whole document." (Non esiste una scala cromatica come nel report di similarità. Il report AI è binario a livello di frase: ogni frase è segnalata oppure no. La percentuale complessiva è semplicemente la proporzione di testo segnalato nell'intero documento.)
Come descrizione del report che hai davanti, la prima metà è corretta. Una frase è evidenziata oppure no; non c'è una gradazione nella visualizzazione. Ciò che sbaglia è ciò che c'è dietro l'evidenziazione. Il resoconto di Turnitin:
"Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score." (Ogni frase qualificata all'interno di questi segmenti eredita il punteggio del segmento. Poiché i segmenti si sovrappongono, alcune frasi possono avere più punteggi, che vengono poi combinati in un unico punteggio.)
Quindi la frase non ha guadagnato un verdetto. Ha ereditato una probabilità, forse due, da blocchi di testo che includono i suoi vicini. L'evidenziazione è la visualizzazione di una soglia, non la quantità da cui si costruisce il numero.
L'ultima frase di quella citazione ha un problema a parte. "The proportion of flagged text across the whole document" (la proporzione di testo segnalato nell'intero documento) non è ciò di cui Turnitin dice che la percentuale è proporzione. L'analisi copre solo quello che chiama testo qualificato — blocchi scritti come frasi grammaticali standard, il che lascia fuori elenchi e punti — e la conseguenza che Turnitin ne trae è che "this percentage is not necessarily the percentage of the entire submission" (questa percentuale non è necessariamente la percentuale dell'intera consegna). Se un terzo del tuo file sono tabelle, punti elenco e una bibliografia, il denominatore non è il tuo documento. Abbiamo smontato questo in come leggere un report di scrittura AI di Turnitin.
Cosa sembra il consiglio che ci costruiscono sopra: conta le frasi evidenziate, dividi, calcola quante ne devi sistemare. Sotto la descrizione pubblicata, quell'aritmetica non ha un referente, perché il conteggio delle evidenziazioni e la percentuale non sono due viste della stessa quantità.
"The average of all segment scores" (La media di tutti i punteggi dei segmenti)
Dalla guida di un fornitore di umanizzatori, che cita il centro assistenza di Turnitin come fonte per il meccanismo. Recuperata il 18 agosto 2026, citata testualmente:
"The model calculates an overall prediction based on the average of all segment scores, producing the percentage displayed in the AI writing indicator." (Il modello calcola una previsione complessiva basata sulla media di tutti i punteggi dei segmenti, producendo la percentuale visualizzata nell'indicatore di scrittura AI.)
Questa è più vicina, e il divario è abbastanza stretto da valere la pena di dirlo con precisione. La frase pubblicata è:
"These sentence scores are further aggregated and used to compute the overall document AI writing score." (Questi punteggi delle frasi vengono ulteriormente aggregati e usati per calcolare il punteggio complessivo di scrittura AI del documento.)
Punteggi delle frasi, non punteggi dei segmenti. Il punteggio del segmento è un valore intermedio che una frase eredita, a volte due volte; ciò che viene aggregato è ciò che esce dalla combinazione.
Se i due arrivino a numeri diversi non possiamo dirtelo, perché Turnitin non ha pubblicato né la funzione di combinazione né l'aggregazione. Ciò che è diverso è ciò su cui opera l'operazione, e quella è la metà da cui dipende un piano di revisione. Sotto una media sui segmenti, ogni segmento conta uguale indipendentemente da quante frasi contiene, e ogni frase si trova esattamente in uno di essi. Nessuna di queste cose è ciò che dice la descrizione pubblicata.
"Rewrite the first and last sentence of every paragraph" (Riscrivi la prima e l'ultima frase di ogni paragrafo)
La terza spiegazione salta il meccanismo e arriva come un'istruzione: riscrivi la frase di apertura e di chiusura di ogni paragrafo, perché aperture e chiusure sono quelle segnalate più spesso.
C'è un documento vero dietro. In una nota di rilascio datata 24 maggio 2023, sotto il titolo "Improvements in detection at the start and end of documents" (Miglioramenti nel rilevamento all'inizio e alla fine dei documenti), Turnitin ha scritto:
"Since launch, we have observed a higher incidence of false positive detection in the first few or last few sentences of a document. Many times these sentences consist of introduction or conclusion content written in a generic way. As a result, we have changed our detection logic to help reduce these false positives." (Dal lancio, abbiamo osservato un'incidenza maggiore di falsi positivi nelle prime o ultime frasi di un documento. Molte volte queste frasi consistono in contenuti di introduzione o conclusione scritti in modo generico. Di conseguenza, abbiamo modificato la nostra logica di rilevamento per aiutare a ridurre questi falsi positivi.)
Tre cose da prendere da questo, nell'ordine in cui spesso vengono omesse.
Dice l'inizio e la fine di un documento, non di ogni paragrafo. Il consiglio è migrato giù di due livelli di struttura.
È un annuncio di correzione. La terza frase è l'annuncio. Citare le prime due come descrizione di come si comporta il rilevatore ora significa citare un report di bug come se fosse una specifica.
E la nota prosegue: "We also worked on making our segment boundaries detection more precise which could lead in some rare cases to change of boundaries compared with a previous version." (Abbiamo anche lavorato per rendere più preciso il rilevamento dei confini dei segmenti, il che potrebbe portare in alcuni rari casi a un cambiamento dei confini rispetto a una versione precedente.) I confini si sono mossi. Quale frase si trovi in quale segmento è un dettaglio implementativo versionato, non qualcosa su cui pianificare.
Se ti stai preparando per un colloquio su una violazione, non portarti dietro questa nota di rilascio. La persona di fronte a te può leggere anche lei la terza frase. Quello che puoi ragionevolmente dire è più ristretto e regge meglio: il fornitore ha rivisto il modello in risposta ai falsi positivi, il che non è il comportamento di qualcosa da trattare come prova consolidata.
Cosa cambia questo su come passi la serata
- Prima di seguire una regola su quali frasi riscrivere, trova il documento da cui viene. Tutte e tre quelle sopra ne hanno uno. In tutte e tre il documento dice meno della regola, e il divario è visibile in circa cinque minuti di lettura.
- Lavora dalle evidenziazioni che hai davvero. Se un report ha segnato passaggi specifici, quelli sono quelli con evidenza allegata. L'evidenza dietro una regola sulla posizione è una nota di rilascio del 2023.
- Conta i paragrafi che dovrai riverificare, non quelli che cambierai. Ogni paragrafo che tocchi è un paragrafo che rileggi per una citazione rotta, un'affermazione spostata, o un numero che si è mosso. Un piano che tocca ogni paragrafo in una tesi ha tranquillamente creato un lavoro di revisione bozze delle dimensioni della tesi.
- Tieni il file da cui sei partito. L'originale e le bozze intermedie sono la parte di tutto questo con valore probatorio, e lo mantengono qualunque cosa faccia il numero. I meccanismi sono in la cronologia delle versioni come prova.
Lo strumento che costruiamo, e il numero che non possiamo darti
HumanPen prende l'AI Writing Report come PDF e lavora dai passaggi che segna. Una delle sue regole è rilevante qui: un paragrafo è l'unità più piccola che riscriverà, quindi una selezione che copre parte di uno viene allargata all'intero paragrafo prima che il processo abbia luogo.
Questa regola non è un'affermazione sul punteggio. C'è perché un'evidenziazione può liberamente iniziare a metà clausola, e riscrivere esattamente i caratteri evidenziati ti consegna un paragrafo scritto da due persone — metà in un registro, con la seconda metà che si appoggia a termini introdotti nella metà che nessuno ha toccato. Turnitin non ha pubblicato quale unità dovrebbe coprire una riscrittura per spostare un punteggio, e non siamo in grado di capirlo dall'esterno.
Quello che non possiamo darti è il tasso di cambio, e nemmeno può farlo nient'altro. Uno strumento che ti offre una percentuale prevista ti sta offrendo un numero che non ha.
Domande frequenti
Se una frase è evidenziata, rimuoverla rimuove la sua parte di punteggio? Non in modo prevedibile. L'evidenziazione riflette un punteggio che la frase ha ereditato dai segmenti intorno a sé, e rimuovere il testo cambia i segmenti. Il numero del documento è un aggregato di punteggi di frase combinati, non una somma di frasi evidenziate.
Il punteggio scende della stessa quantità se riscrivo un intero paragrafo? Non c'è una quantità pubblicata, per un paragrafo più di quanto ce ne sia per una frase. Ciò che è pubblicato è che i segmenti si sovrappongono, quindi ciò che accade a un singolo passaggio dipende dal testo su entrambi i lati.
Perché le evidenziazioni e la percentuale non concordano? Perché la percentuale viene calcolata solo sulla prosa qualificata, e Turnitin dice che un documento che mescola diversi tipi di scrittura "would result in a disparity between the percentage and the highlights" (risulterebbe in una disparità tra la percentuale e le evidenziazioni).
La prima e l'ultima frase di ogni paragrafo sono davvero segnalate più spesso? Il documento che ha dato origine a questo parlava delle prime e ultime frasi di un documento, lo ha detto nel 2023, e nella stessa nota ha annunciato una modifica alla logica di rilevamento per ridurlo. Non è una descrizione attuale del comportamento e non è utilizzabile come difesa.
Posso testare le mie modifiche da solo? Di solito no. Qualunque cosa sotto il 20% appare come un asterisco senza numero e senza evidenziazioni, e nella maggior parte delle configurazioni l'indicatore è visibile a istruttori e amministratori piuttosto che a te.
---
CONTINUA A LEGGERE