Turnitin addestra la sua IA sul tuo elaborato? Cosa dice la FAQ ufficiale
Una preoccupazione diffusa tra gli studenti: Turnitin ha il mio elaborato, ci stanno addestrando la loro IA? Posso chiedere che lo rimuovano? La FAQ ufficiale non risponde a nessuna delle due domande con un semplice sì o no. Dice che il modello è addestrato su un campione rappresentativo di scrittura accademica generata dall'IA e autentica, più un vastissimo corpus interno, senza mai affermare che gli elaborati degli studenti ne siano esclusi. Sulla cancellazione, dice che i clienti possono richiedere la cancellazione completa dei propri invii, ma non cancellazioni parziali. Questa pagina ripercorre il testo esatto, cosa promette e cosa no, e cosa significa per uno studente che vuole togliere il proprio lavoro dal sistema.
Team HumanPen
· 4 min di lettura
La risposta breve
La FAQ di Turnitin non dice che il tuo elaborato venga usato per addestrare il modello di rilevamento dell'IA, ma non dice nemmeno che ne sia escluso. Il testo ufficiale dice che il modello è addestrato su «a representative sample» (un campione rappresentativo) di scrittura accademica generata dall'IA e autentica, e che i modelli di Turnitin sono anche «trained on our vast inhouse corpus of academic data.» (addestrati sul nostro vastissimo corpus interno di dati accademici).
Su cui puoi agire è la cancellazione: la FAQ dice che gli atenei possono richiedere la cancellazione completa dei propri invii e che le cancellazioni parziali non sono supportate. La FAQ inquadra la cosa come una richiesta a livello di istituzione e non descrive alcun percorso individuale perché uno studente possa rimuovere il proprio elaborato. Se tu abbia un autonomo diritto alla cancellazione ai sensi della normativa sulla protezione dei dati, come il GDPR, è una questione giuridica che questa FAQ non affronta.
Il testo ufficiale sull'addestramento
La FAQ di Turnitin sul rilevamento dell'IA risponde a «How was Turnitin's model trained?» (Come è stato addestrato il modello di Turnitin?) così:
«Our model is trained on a representative sample of data spread over a period of time, that includes both AI generated and authentic academic writing across geographies and subject areas.» (Il nostro modello è addestrato su un campione rappresentativo di dati distribuiti nell'arco di un periodo di tempo, che comprende sia scrittura accademica generata dall'IA sia autentica, provenienti da diverse aree geografiche e discipline.)
Una seconda risposta della FAQ, su quale modello usi il rilevamento, va oltre:
«More importantly, our models are also trained on our vast inhouse corpus of academic data.» (Ancora più importante: i nostri modelli sono addestrati anche sul nostro vastissimo corpus interno di dati accademici.)
Nessuna delle due frasi indica gli elaborati degli studenti come parte dei dati di addestramento, e nessuna delle due li esclude. «Authentic academic writing» (scrittura accademica autentica) e «inhouse corpus of academic data» (corpus interno di dati accademici) sono il punto più vicino a cui arriva il testo ufficiale nel descrivere da dove vengano le parole, ed entrambe le formulazioni lasciano aperta la questione del tuo elaborato.
Questo è tutto, per la parte sull'«addestramento»: la FAQ non nega che i lavori inviati possano rientrare nei dati di addestramento, ma non lo conferma nemmeno.
Il testo ufficiale sulla cancellazione
La domanda della FAQ sulla cancellazione dei dati è formulata dal punto di vista del cliente, cioè dell'istituzione:
«Yes, customers can request a full deletion of their submissions; we cannot support partial data deletion requests to delete only the AI writing component of the submission data.» (Sì, i clienti possono richiedere la cancellazione completa dei propri invii; non possiamo supportare richieste di cancellazione parziale dei dati volte a rimuovere solo la componente di scrittura IA dei dati dell'invio.)
Ne derivano due conseguenze.
Primo: la cancellazione è possibile in linea di principio, ma a chiederla è l'istituzione. Un'università che voglia ripulire i propri invii può chiedere la cancellazione completa dei dati che le appartengono. Secondo: non puoi cancellare solo la componente IA: non esiste l'opzione «togliere il punteggio IA e tenere l'elaborato», e la FAQ non descrive alcun percorso di cancellazione individuale per lo studente.
Quindi la domanda «posso chiedere che il mio lavoro venga rimosso?», sulla base di ciò che questa FAQ descrive, ha una risposta diretta: non tramite questa FAQ, che prevedono solo un percorso istituzionale. Qualsiasi diritto tu abbia direttamente è questione di diritto della protezione dei dati della tua giurisdizione, non di questo documento.
Cosa dice la FAQ sul repository
La stessa FAQ contiene la frase che in realtà la maggior parte degli studenti cerca, su una preoccupazione molto vicina:
«No, it does not. There is no separate repository for AI writing detection, and customers retain the ability to choose whether to add their student papers into the repository or not.» (No, non lo fa. Non esiste un repository separato per il rilevamento della scrittura IA, e i clienti conservano la possibilità di scegliere se aggiungere o meno gli elaborati dei propri studenti al repository.)
Questo riguarda il «repository per il rilevamento dell'IA»: l'idea che Turnitin archivi il tuo elaborato in un database speciale per i controlli sull'IA. La FAQ dice che non esiste un repository separato per il rilevamento della scrittura IA, e che la decisione di aggiungere gli elaborati al repository di similarità spetta all'istituzione.
La parola «addestrare» non compare in questa risposta. Un repository per il rilevamento dell'IA e i dati di addestramento sono due cose diverse, e la FAQ le tiene separate: nessun repository separato per il rilevamento, nessuna dichiarazione sull'addestramento.
Cosa significa per te
Se sei uno studente che ha consegnato un elaborato e ora teme per il suo utilizzo, il riassunto onesto è questo:
- La FAQ ufficiale non conferma che il tuo elaborato addestri il modello, e non promette nemmeno il contrario.
- Le affermazioni ufficiali più vicine descrivono i dati di addestramento come «authentic academic writing» (scrittura accademica autentica) e un «inhouse corpus» (corpus interno), e nessuna delle due esclude gli elaborati degli studenti.
- La cancellazione esiste, ma è una cancellazione completa a livello di istituzione, non una rimozione a livello di studente, e le cancellazioni parziali non sono supportate.
- La risposta «nessun repository separato» riguarda la conservazione ai fini del rilevamento dell'IA, non l'addestramento.
Cosa puoi farci: se a preoccuparti sono i risultati del rilevamento IA sul tuo elaborato, le questioni pratiche sono come leggere il punteggio e farlo ricontrollare, non la proprietà dei dati. Se la preoccupazione è istituzionale, il canale è l'amministratore Turnitin della tua università: è il «cliente» di cui parla la FAQ quando cita le richieste di cancellazione.
In sintesi
La FAQ di Turnitin non conferma né nega che gli elaborati consegnati addestrino i suoi modelli di IA. Il testo ufficiale descrive i dati di addestramento come un campione rappresentativo di scrittura accademica autentica più un vastissimo corpus interno, e non dice nulla che escluda il lavoro degli studenti. Quanto alla rimozione, l'unica via ufficiale è una richiesta a livello di istituzione per la cancellazione completa: non è descritta alcuna cancellazione individuale da parte dello studente. Se vuoi sapere a cosa si è impegnato il tuo ateneo, la persona a cui chiedere è l'amministratore Turnitin della tua università, non direttamente l'assistenza di Turnitin.