¿Por qué Turnitin marca mis referencias?

Las bibliografías están excluidas explícitamente de la detección de escritura con IA de Turnitin. Repasamos qué cambió, qué no cambió y qué revisar cuando tus referencias siguen apareciendo marcadas.

Equipo de HumanPen

· 7 min de lectura

La respuesta corta

En los informes actuales de Turnitin, las listas de referencias y las bibliografías no deberían recibir ninguna marca de escritura con IA. El modelo de detección de escritura con IA excluye las bibliografías de su análisis. Si tus referencias aparecen marcadas en un informe que estás viendo ahora mismo, hay tres explicaciones realistas y ninguna de ellas es «Turnitin detectó IA en tu lista de referencias». Las tres son: el informe está desactualizado (es anterior a agosto de 2023), las marcas son coincidencias de similitud y no marcas de IA, o el texto marcado en realidad es prosa junto a tus referencias y el modelo lo analiza como prosa.

Vamos a ver las tres. Pero el punto de partida es el cambio que hizo Turnitin y la frase que te pidió que siguieras.

Por qué antes se marcaban las referencias y el arreglo que llegó en agosto de 2023

Durante los primeros meses después de que Turnitin lanzara la detección de escritura con IA, en abril de 2023, las bibliografías no estaban excluidas del análisis. Un error marcaba de vez en cuando escritura con IA dentro de las referencias incluidas en una bibliografía. Lo sabemos porque Turnitin lo documentó en sus notas de la versión del modelo de detección de escritura con IA:

«We have fixed a bug that was occasionally highlighting AI writing within references listed in a bibliography. Bibliographies are now excluded when processing the AI writing report.» (Hemos corregido un error que a veces marcaba escritura con IA dentro de las referencias incluidas en una bibliografía. Las bibliografías ahora se excluyen al procesar el informe de escritura con IA.)

La frase siguiente, en la misma línea de las notas de la versión, es:

«Resubmit to reprocess existing submissions that contain highlighted reference sections.» (Vuelve a enviar los trabajos ya entregados que contengan secciones de referencias marcadas para que se procesen de nuevo.)

Esa segunda frase es la que más estudiantes pasan por alto. El arreglo no se aplica a los informes ya generados. Si tu profesor generó un informe antes del lanzamiento de agosto de 2023 y nunca volvió a enviar el trabajo, el informe que sigue en su bandeja de entrada, con marcas sobre tu bibliografía, es el antiguo. El informe no se actualiza solo.

Las mismas notas de la versión incluyen además un cambio relacionado con las tablas. Antes de agosto de 2023 no se procesaba la prosa larga dentro de las tablas. Las notas de la versión de Turnitin dicen: «We are now able to process long-form prose text in tables.» (Ahora podemos procesar prosa larga dentro de tablas.) Y otra vez, la frase siguiente es: «Resubmit to reprocess existing submissions that contain tables.» (Vuelve a enviar los trabajos ya entregados que contengan tablas para que se procesen de nuevo.)

Si tu trabajo tiene tablas y tu informe es anterior a agosto de 2023, se aplica el mismo consejo. El arreglo ya se lanzó, pero solo surte efecto en los informes generados después del arreglo.

El puntaje de IA y el puntaje de similitud son completamente independientes

Hay una segunda confusión que produce quejas del tipo «Turnitin marcó mis referencias». Es la más común que vemos.

Turnitin genera dos informes distintos. Uno es el AI Writing Report. El otro es el Similarity Report. Son independientes, y leer los dos puntajes como si fueran lo mismo es el error que está detrás de la mayoría de esas quejas. El Similarity Report muestra dónde coincide tu texto con el de otras fuentes. El AI Writing Report muestra dónde cree el modelo que el texto está generado por IA. Esto es de las preguntas frecuentes sobre las capacidades de detección de escritura con IA de Turnitin:

«The Similarity score and the AI writing detection percentage are completely independent and do not influence each other.» (El puntaje de similitud y el porcentaje de detección de escritura con IA son completamente independientes y no se influyen entre sí.)

Y de las mismas preguntas frecuentes, una línea más abajo:

«AI writing highlights are not visible in the Similarity Report.» (Las marcas de escritura con IA no son visibles en el Similarity Report.)

Lo contrario también es cierto. Las marcas de similitud no son visibles en el AI Writing Report.

Las listas de referencias son una de las cosas que más coincidencias de similitud generan. Citaste artículos publicados. Otros estudiantes citaron los mismos artículos publicados. Los títulos, los nombres de los autores, los nombres de las revistas y los DOI son cadenas idénticas. Cuando tus referencias aparecen con texto marcado, lo primero que hay que comprobar es qué informe estás mirando. Por qué tu texto entre comillas y citado sigue apareciendo en el Similarity Report cubre el mismo efecto en las citas textuales. Si es el Similarity Report, las marcas no son marcas de IA: son texto que coincide. La fuente similar puede ser otro trabajo de un estudiante, un artículo publicado o un sitio web. Nada de eso tiene que ver con la detección de escritura con IA.

Qué analiza Turnitin y qué no en un documento cargado de referencias

Hay un tercer mecanismo que conviene entender. El modelo de IA de Turnitin no analiza cada palabra de tu entrega. Analiza lo que las preguntas frecuentes llaman «qualifying text» (texto calificable):

«This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures.» (Este texto calificable incluye únicamente frases de prosa, es decir, solo analizamos bloques de texto escritos en oraciones gramaticales estándar y que no incluyen otros tipos de escritura como listas, viñetas (estructuras cortas que no son oraciones) u otras estructuras que no son oraciones.)

La frase siguiente en esa página es:

«This percentage is not necessarily the percentage of the entire submission.» (Este porcentaje no es necesariamente el porcentaje de toda la entrega.)

Lo que esto significa en la práctica para una sección de referencias es que una lista de entradas bibliográficas, aunque esté formateada como prosa, puede no ser tratada en absoluto como texto calificable por el modelo. Las entradas son cortas. Muchas no son oraciones completas. El modelo está hecho para leer prosa. Una lista de referencias formateada se parece más a una lista estructurada que a un párrafo.

Esto también explica por qué el porcentaje que ves en el AI Writing Report y la cantidad de texto marcado pueden parecer que no cuadran. Un documento con una bibliografía larga, una lista de figuras y un índice tiene una parte grande de texto no calificable. El porcentaje se calcula sobre la prosa que el modelo sí lee. Las marcas se colocan en los segmentos de prosa que superaron el umbral del modelo. Si tu bibliografía tiene 40 entradas y solo se marcan dos párrafos tuyos, el «2 %» del informe es el 2 % de la prosa calificable, no el 2 % del documento completo.

Si tu informe muestra marcas de IA en las referencias, revisa estas tres cosas

Si estás mirando un informe ahora mismo y tus referencias parecen marcadas, esto es lo que hay que revisar, en orden.

Primero, revisa la fecha en que se generó tu informe. Si el informe es anterior a agosto de 2023, se produjo antes de que se lanzara el arreglo de las bibliografías. No le pasa nada al modelo actual: el informe está desactualizado. La solución es pedirle a tu profesor que vuelva a enviar el trabajo. Basta con citar la nota de la versión. La nota está en la página de documentación del propio Turnitin y dice «resubmit to reprocess existing submissions that contain highlighted reference sections.» (vuelve a enviar los trabajos ya entregados que contengan secciones de referencias marcadas para que se procesen de nuevo).

Segundo, revisa qué informe estás mirando. Si las marcas están en el Similarity Report y no en el AI Writing Report, son coincidencias de similitud, no marcas de IA. Que tu lista de referencias coincida con la lista de referencias de otro trabajo es el comportamiento esperado de la comprobación de similitud. No dice nada sobre la autoría de IA. Las marcas de escritura con IA «are not visible in the Similarity Report,» (no son visibles en el Similarity Report), y las marcas de similitud no son visibles en el AI Writing Report. Las dos cosas están separadas.

Tercero, revisa el texto justo alrededor de tus referencias. Si el texto marcado es una o dos frases de prosa inmediatamente antes o después de tu bibliografía (un agradecimiento, una nota metodológica, una introducción a la sección de referencias), puede que el modelo lo esté leyendo como prosa. Eso es justo lo que el modelo debe hacer. La marca no está en tus referencias, sino en la prosa que las rodea. Lee el texto marcado en sí, no la sección en la que cae. Si después decides revisar, esa prosa marcada es todo el trabajo: reescribir solo los párrafos que marcó un informe de Turnitin.

Un problema anterior que ya no lo es

Para que esté completo: Turnitin también observó en 2023 que los falsos positivos eran más frecuentes en las primeras y últimas frases de un documento. Se trataba de ese contenido de introducción o conclusión que suena genérico. De las notas de la versión del 24 de mayo de 2023:

«Since launch, we have observed a higher incidence of false positive detection in the first few or last few sentences of a document. Many times these sentences consist of introduction or conclusion content written in a generic way. As a result, we have changed our detection logic to help reduce these false positives.» (Desde el lanzamiento, hemos observado una mayor incidencia de detecciones de falsos positivos en las primeras o últimas frases de un documento. Muchas veces esas frases son contenido de introducción o conclusión escrito de forma genérica. Por eso hemos cambiado nuestra lógica de detección para ayudar a reducir estos falsos positivos.)

Esto importa porque a veces los estudiantes encuentran en internet consejos antiguos que dicen «Turnitin marca introducciones y conclusiones». Ese fue un problema conocido, y fue una mejora de 2023, no algo actual. Si ves ese consejo en una entrada de foro de 2023, el arreglo ya se lanzó. La nota de la versión lo dice en su propia frase siguiente. Para los informes actuales no es un problema abierto que deba preocuparte.

Lo que realmente tienes que hacer

El resumen para cualquiera que esté mirando ahora mismo una lista de referencias marcada:

  1. Revisa la fecha de generación del informe. Los informes anteriores a agosto de 2023 hay que volver a enviarlos.
  2. Revisa si estás mirando el AI Writing Report o el Similarity Report. Las marcas de similitud en las referencias son normales. Las marcas de IA en bibliografías no lo son.
  3. Si el informe es actual y las marcas están en el AI Writing Report, lee el texto marcado de verdad. Probablemente sea prosa cerca de las referencias, no las referencias en sí.

El arreglo de agosto de 2023 está documentado en la página que enlazamos. Si un profesor necesita volver a enviar el trabajo, las notas de la versión contienen la instrucción. «Resubmit to reprocess existing submissions that contain highlighted reference sections.» (Vuelve a enviar los trabajos ya entregados que contengan secciones de referencias marcadas para que se procesen de nuevo.)

Seguir leyendo