La percentuale AI del tuo saggio in inglese è troppo alta? Inizia leggendo il rapporto

Quando Turnitin segnala una percentuale AI elevata nel tuo saggio in inglese, il primo passo non è abbassarla. È capire che numero è, quale regola di visualizzazione l'ha prodotto e da quale lato della probabilità del modello sono finite le tue scelte lessicali. La soluzione non è una manopola chiamata "perplessità". La soluzione è riportare la probabilità delle tue parole verso il tuo pattern umano personale.

Team HumanPen

· 13 min di lettura

La risposta breve

Il rapporto di scrittura AI di Turnitin non mostra alcun numero tra l'1% e il 19%: visualizza un asterisco e non fornisce evidenziazioni. Solo dal 20% in su appare una percentuale precisa, con passaggi evidenziati che puoi effettivamente consultare. Quindi quando dici "la mia percentuale AI è troppo alta", la prima cosa da fare non è abbassarla. È capire se stai guardando un numero o una stella, perché solo il numero arriva con qualcosa su cui puoi intervenire.

Il secondo passo è chiedersi perché è alta. Il modello di Turnitin divide il tuo testo in segmenti sovrapposti, assegna a ciascuno una probabilità tra 0 e 1, raggruppa quei punteggi e li aggrega in una percentuale del documento. Se le tue scelte lessicali cadono dal lato AI-generated della distribuzione di probabilità del modello, il tuo punteggio sale. Scrivere in inglese come madrelingua cinese ha tre tendenze statistiche che spingono la tua probabilità verso il lato AI. Analizziamo ciascuna in dettaglio più sotto.

Il terzo passo è la revisione. La direzione non è abbassare una metrica chiamata perplessità, perché Turnitin non ne calcola una esplicitamente. La direzione è riportare la probabilità delle tue parole verso il tuo pattern umano personale: usa le parole che effettivamente ti vengono in mente, usa strutture sintattiche che non produci normalmente e rivedi i passaggi segnalati uno alla volta invece di fare un'unica spazzata su tutto il file.

Cosa significa davvero "troppo alta"

Il rapporto di scrittura AI di Turnitin ha una regola di visualizzazione speciale per i punteggi bassi. Le FAQ sulle capacità di rilevamento lo spiegano così:

"To avoid potential incidence of false positives, no score or highlights are attributed for AI detection scores in the 1% to 19% range. When AI is detected below the 20% threshold in the report, it is now indicated with an asterisk (%) and no percentage is attributed." (Per evitare possibili falsi positivi, non viene assegnato alcun punteggio o evidenziazione per i punteggi di rilevamento AI compresi tra l'1% e il 19%. Quando viene rilevata la presenza di AI al di sotto della soglia del 20% nel report, questa viene indicata con un asterisco (%) senza attribuire una percentuale.)

Quindi se la "percentuale AI" che hai in mano è un numero con il segno percentuale, è almeno 20. Se stai guardando un asterisco, sei da qualche parte tra 1 e 19, e il rapporto non ti dice dove. Zero è l'unica cifra esatta visualizzata sotto venti.

Questa distinzione sembra pedante ma decide cosa puoi fare dopo. Un asterisco significa nessun passaggio evidenziato, nessun modo per localizzare cosa ha attivato il segnale e niente su cui lavorare per la revisione. Un numero a 20 o sopra arriva con evidenziazioni, e le evidenziazioni sono l'unica cosa che ti permette di localizzare e modificare il testo segnalato. Quindi "la mia percentuale AI è troppo alta, cosa faccio" ha una risposta operativa solo quando il tuo rapporto mostra il 20% o più e puoi vedere le evidenziazioni. Abbiamo analizzato il rapporto stesso in come leggere un rapporto di scrittura AI di Turnitin.

Un'altra cosa da confermare per prima. Turnitin dichiara che "only instructors and administrators are able to see the indicator" e che "The AI writing detection indicator and report are not visible to students. However, with the PDF download feature, instructors can download and share the AI report with students." Se hai un rapporto tra le mani, è perché qualcuno ha deciso di scaricarlo e dartelo. Conferma di avere il PDF completo, non uno screenshot.

Perché è alta: la probabilità delle tue parole è dal lato AI

Turnitin descrive la catena di calcolo nelle sue FAQ:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Quando un documento viene inviato a Turnitin, le frasi del sottomesso vengono estratte e suddivise in sezioni sovrapposte per l'analisi predittiva. Ogni sezione viene classificata dal modello di rilevamento AI e riceve un valore tra 0 e 1, che indica la probabilità che il testo sia probabilmente umano o generato da AI. Ogni frase qualificata all'interno di queste sezioni eredita il punteggio della sezione. Poiché le sezioni si sovrappongono, alcune frasi possono avere più punteggi, che vengono poi combinati in un unico punteggio. Questi punteggi delle frasi vengono ulteriormente aggregati e utilizzati per calcolare il punteggio complessivo di scrittura AI del documento.)

Questa è una catena di probabilità. Ogni tua frase riceve un punteggio tra 0 e 1 dal modello; più vicino a 1, più simile all'AI. Quei punteggi si aggregano nella percentuale che vedi.

Quindi il significato meccanico di "percentuale AI alta" è specifico: la tua scrittura, nello spazio di probabilità del modello, cade dal lato generato da AI. Non perché hai usato l'AI, ma perché le caratteristiche statistiche delle tue scelte lessicali e dei tuoi schemi sintattici risultano più vicine allo schema medio del testo generato da AI.

Qui va corretta un'affermazione diffusa. Molte risposte descrivono il meccanismo di Turnitin come "misurazione di perplessità e burstiness" e poi ti dicono come abbassare quei due valori. Turnitin nega esplicitamente questo nelle sue FAQ:

"Our model is not explicitly programmed to evaluate specific signals such as 'burstiness,' 'perplexity,' or other individual metrics sometimes referenced in public discussions." (Il nostro modello non è programmato esplicitamente per valutare segnali specifici come "burstiness", "perplexity" o altre metriche individuali talvolta menzionate nelle discussioni pubbliche.)

La frase immediatamente successiva:

"Instead, it learns statistical patterns from our training data." (Al contrario, apprende pattern statistici dai nostri dati di addestramento.)

Ma questo non significa che Turnitin ignori la probabilità lessicale. La stessa pagina FAQ dice altrove:

"Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers." (I nostri classificatori sono addestrati a rilevare queste differenze nella probabilità delle parole e sono abili nel riconoscere le sequenze di probabilità delle parole tipiche degli scrittori umani.)

Queste due affermazioni vanno lette insieme. Turnitin non calcola esplicitamente un punteggio chiamato perplessità, ma il suo classificatore sta facendo un giudizio a livello di probabilità lessicale, perché la perplessità è essa stessa una misura di probabilità lessicale. L'affermazione corretta è: non puoi sintonizzare una manopola chiamata perplessità, perché quella manopola non esiste come input esplicito. Quello che puoi cambiare è la tua distribuzione di probabilità lessicale, in modo che il modello la collochi di nuovo dal lato umano.

Perché i madrelingua cinesi che scrivono in inglese vengono segnalati di più

Questa sezione riguarda tre tendenze statistiche. Ciascuna spinge la tua probabilità lessicale verso il lato AI. Non sono difetti dei madrelingua cinesi. Sono schemi che emergono quando scrivi in una seconda lingua gestendo allo stesso tempo grammatica, vocabolario e argomentazione.

Primo, la tendenza a cercare parole "sicure" ad alta frequenza. Quando si scrive in inglese come seconda lingua, l'istinto naturale è scegliere parole con significati stabili e basso rischio di errore. Quelle parole sono parole ad alta frequenza. Sono anche le parole che il testo generato da AI cerca più spesso, perché i modelli linguistici selezionano per probabilità e le parole ad alta frequenza hanno alta probabilità. Più la tua distribuzione lessicale si concentra in cima alla tabella delle frequenze, più si avvicina alla distribuzione media generata da AI. La frase che abbiamo già citato, "Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers", riguarda esattamente questo: il classificatore legge sequenze di probabilità lessicale, e gli scrittori umani hanno le loro sequenze caratteristiche. La concentrazione su alta frequenza non è una di quelle.

Secondo, bassa variazione strutturale. Turnitin stesso elenca le caratteristiche che tendono a produrre falsi positivi:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (Talvolta i falsi positivi (che segnalano erroneamente testo scritto da umani come generato da AI) possono comprendere contenuti con scarsa variazione strutturale, testo che si ripete letteralmente o testo che è stato parafrasato senza sviluppare nuove idee.)

La frase successiva:

"If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Se il nostro indicatore rileva una quantità significativa di scrittura AI in questo tipo di testo, ti consigliamo di tenerne conto quando esamini la percentuale indicata.)

Quando scrivi in inglese come seconda lingua, il budget cognitivo rimasto per la struttura delle frasi è stretto. Il risultato è coerenza strutturale: soggetto-verbo-oggetto, soggetto-verbo-oggetto, soggetto-verbo-oggetto. La bassa variazione strutturale è esattamente il primo elemento nella lista di Turnitin delle caratteristiche soggette a falsi positivi. Il consiglio ufficiale agli educatori è di scontare i punteggi alti su tali testi, e quella frase deve viaggiare con la prima.

Terzo, possibile uso di traduzione automatica o Grammarly. L'output della traduzione automatica è esso stesso prodotto da un modello linguistico, quindi la sua distribuzione di probabilità lessicale cade naturalmente dal lato AI. La situazione di Grammarly è più specifica. Le FAQ di Turnitin hanno una dichiarazione dedicata: le modifiche di ortografia, grammatica e punteggiatura non vengono segnalate "nella maggior parte dei casi", ma le funzionalità generative di Grammarly, inclusa la generazione di bozze, la parafrasi e il riassunto, non sono coperte da quell'esenzione. La formulazione ufficiale è che i contenuti prodotti utilizzando queste funzionalità "will likely be flagged as AI-generated". Quindi se hai usato la riscrittura di frasi di Grammarly, è normale che quei passaggi vengano segnalati, non sorprendente.

Perché i rilevatori AI sono prevenuti contro gli scrittori non madrelingua inglesi inquadra questa famiglia di domande in una cornice più ampia.

Come abbassarla: cambia la probabilità lessicale, non la perplessità

Prima, cosa non fare.

Non cercare di abbassare la perplessità. Abbiamo già citato Turnitin che dice che il suo modello non è esplicitamente programmato per valutare la perplessità come singola metrica. Qualsiasi consiglio che ti dice di "abbassare la perplessità" parte da una premessa falsa. Non puoi abbassare un valore che Turnitin non calcola esplicitamente. Molto del copy marketing degli humanizer è costruito su quella premessa falsa.

Non fermarti a una singola frase. Turnitin valuta segmenti sovrapposti di più frasi, quindi una modifica confinata a una frase compete contro il paragrafo che la circonda. Un passaggio segnalato lo è per la forma della sua intera distribuzione: cosa mette per primo, dove gira, quanto corre prima di fermarsi. L'unità su cui lavorare è il passaggio, non la frase.

Non riscrivere l'intero documento. I documenti brevi hanno un comportamento estremo documentato:

"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (Nei documenti più brevi con solo alcune centinaia di parole, la previsione sarà prevalentemente di tipo "tutto o niente", poiché analizziamo un unico segmento senza possibilità di sovrapposizione.)

La frase successiva:

"This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (Ciò significa che alcuni testi che combinano contenuto generato da AI e contenuto originale potrebbero essere segnalati come interamente generati da AI.)

Quindi un documento breve riscritto a metà è particolarmente rischioso. Hai riscritto la metà, l'altra metà viene chiamata AI, e il tutto torna alto.

Ora, cosa fare.

Ottieni prima il rapporto. Abbiamo già citato questo: gli studenti non possono vedere l'indicatore, ma gli istruttori possono scaricare il PDF e condividerlo. Hai il diritto di chiedere quel PDF. Una volta che ce l'hai, trova i passaggi evidenziati. Solo i rapporti al 20% e oltre hanno evidenziazioni. Sapere quali passaggi sono segnalati è il prerequisito per revisionarli.

Rivedi i passaggi segnalati uno per uno. La direzione è cambiare la forma della frase. Prendi lo schema soggetto-verbo-oggetto a cui ricorri abitualmente e sostituiscilo con una struttura che non produci normalmente: una subordinata, un'inversione, un inciso, un riferimento transfrastico. Queste strutture cambiano la tua sequenza di probabilità lessicale, che è ciò che il modello legge. Il punteggio di una frase è anche influenzato dai suoi vicini, perché i segmenti si sovrappongono, quindi rivedere un passaggio sposta i punteggi delle frasi intorno.

Usa le parole che effettivamente ti vengono in mente. Resistere alla spinta verso il vocabolario sicuro ad alta frequenza. Usa la parola che vuoi davvero, anche se è meno comune. La parte distintiva della sequenza di probabilità lessicale di uno scrittore umano sta spesso nelle scelte che deviano dalla cima della tabella delle frequenze.

Fai attenzione al confine del testo qualificante. Turnitin analizza solo frasi grammaticali standard:

"This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures." (Questo testo qualificante include solo frasi in prosa, il che significa che analizziamo unicamente blocchi di testo scritti in frasi grammaticali standard, escludendo altri tipi di scrittura come elenchi, punti elenco (strutture brevi non frasali) o altre strutture non frasali.)

La frase successiva:

"This percentage is not necessarily the percentage of the entire submission." (Questa percentuale non corrisponde necessariamente alla percentuale dell'intero documento inviato.)

Quindi il numero che vedi è una percentuale sul testo qualificante, non sull'intero file. Quando revisioni, mira al testo qualificante. Modificare un elenco puntato non muove quel numeratore.

Il compromesso progettuale: il modello preferisce i mancati rilevamenti ai falsi allarmi

Un'ultima cosa, perché influisce su come leggi il tuo punteggio. Turnitin rivela il compromesso progettuale nelle sue FAQ:

"In order to maintain this low rate of 1% for false positives, there is a chance that we might miss some AI written text in a document. We're comfortable with that since we do not want to incorrectly highlight human-written text as AI-written. For example, if we identify that 50% of a document is likely written by an AI tool, it could contain as much as 65% AI writing." (Per mantenere questo basso tasso dell'1% di falsi positivi, c'è la possibilità che alcuni testi scritti da AI possano sfuggire all'identificazione. Accettiamo questo compromesso poiché vogliamo evitare di evidenziare erroneamente testi scritti da umani come se fossero AI. Ad esempio, se identifichiamo che il 50% di un documento è probabilmente scritto da uno strumento AI, potrebbe contenere fino al 65% di scrittura AI.)

La direzione è esplicita: il modello preferirebbe non rilevare testo AI piuttosto che segnalare testo umano. Questo significa che il rapporto ha una tendenza intrinseca a sottostimare, non a sovrastimare. Se stai guardando un punteggio alto, quel punteggio è dal lato conservativo del progetto del modello, non da quello aggressivo. Questo non prova che il punteggio sia corretto. Significa che non dovresti trattarlo come un tetto.

Come appare "cambiare la struttura" nella pratica

"Cambiare la struttura" sembra astratto. Un esempio lo rende concreto.

  • Originale: "The results show that the method is effective."
  • Ricostruita: "What the results show is not that the method works in general, but that it works under the specific condition we tested." La frase passa da un semplice soggetto-verbo-oggetto a una costruzione enfatica con una svolta. La sequenza di probabilità lessicale è diversa. Il modello vede una distribuzione differente.

Cambiare la struttura non significa scrivere frasi elaborate. Significa scrivere le strutture sintattiche che non produci normalmente, perché le strutture che non produci normalmente sono esattamente dove vive la tua firma di probabilità da scrittore umano.

Cinque minuti con il rapporto

  1. Conferma di avere il PDF, non uno screenshot. Uno screenshot non ha data, non ha posizioni di evidenziazione e non c'è modo di dire di quale rapporto si tratti.
  2. Controlla se la cifra è una percentuale o un asterisco. Una percentuale significa 20% o più, con evidenziazioni su cui lavorare. Un asterisco significa dall'1% al 19%, nessuna evidenziazione e niente da localizzare.
  3. Trova i passaggi evidenziati specifici. Quelli sono da rivedere. Lascia stare il resto. Cambiare testo che non è stato segnalato è sforzo sprecato.
  4. Leggi ogni passaggio segnalato e diagnostica quale tendenza l'ha prodotto. Struttura delle frasi uniforme? Vocabolario ad alta frequenza? Una riscrittura di Grammarly? Cause diverse richiedono correzioni diverse.
  5. Ricostruisci la struttura della frase. Riscrivi le frasi segnalate in strutture che non usi normalmente.
  6. Ricontrolla dopo la revisione. I rilevatori cambiano e Turnitin dice che il suo modello itera, quindi nessun esito fisso può essere promesso. Quello che puoi fare è eseguire un altro rapporto dopo la revisione e vedere se le evidenziazioni sono diminuite. Perché diversi rilevatori AI danno risultati discordanti spiega perché i risultati di rilevatori diversi non possono validarsi a vicenda.

Domande frequenti

Una percentuale AI alta significa che ho usato l'AI? No. Il modello di Turnitin legge distribuzioni di probabilità lessicale, non registri d'uso. Puoi essere segnalato senza usare l'AI, se il tuo vocabolario è ad alta frequenza, la struttura delle tue frasi è uniforme o hai usato traduzione automatica. Turnitin stesso elenca le caratteristiche che tendono a produrre falsi positivi e consiglia agli educatori di scontare i punteggi alti su tali testi.

Posso controllare la mia percentuale AI? Non attraverso l'indicatore di Turnitin. La dichiarazione ufficiale è che l'indicatore e il rapporto non sono visibili agli studenti e che gli istruttori possono scaricare il rapporto come PDF e condividerlo. Ogni rapporto che vedi, lo vedi perché qualcuno ha scelto di mostrartelo.

Quali passaggi dovrei rivedere per primi? Quelli che il rapporto effettivamente segna. Turnitin riporta a livello di passaggio, quindi i passaggi segnati sono l'unico posto da cui hai evidenza su cui lavorare; rivedere un passaggio non segnato cambia il tuo saggio senza cambiare nulla a cui il rapporto sta rispondendo.

Verrò segnalato per aver usato Grammarly? Le modifiche di ortografia, grammatica e punteggiatura non vengono segnalate nella maggior parte dei casi. Ma le funzionalità generative di Grammarly, inclusa la generazione di bozze, la parafrasi e il riassunto, verranno probabilmente segnalate come generate da AI. Distingui tra le due.

I documenti brevi hanno più probabilità di essere segnalati? I documenti di poche centinaia di parole hanno previsioni che sono per lo più tutto-o-niente, e contenuti misti possono essere segnalati interamente come AI. Fai molta attenzione alle riscritture parziali su documenti brevi.

Uno strumento humanizer può abbassare il mio punteggio? Questo articolo non fa alcuna affermazione di efficacia. La direzione progettuale di Turnitin è preferire i mancati rilevamenti ai falsi allarmi, il modello itera e qualsiasi promessa su un risultato di rilevamento futuro non è una che uno strumento possa fare onestamente. Quello che possiamo dire è che rivedere con il rapporto in mano ti dice quali passaggi si sono mossi, e rivedere alla cieca no.

CONTINUA A LEGGERE