¿Turnitin ha marcado como IA las respuestas que citaste de una entrevista o encuesta? Esto es lo que ocurre en realidad
Citas textualmente la respuesta de un participante en tu apartado de entrevistas o encuestas, y Turnitin la marca como escrita por IA. Esa respuesta la escribió una persona real: ¿cómo puede el detector considerarla IA? Según la descripción oficial de Turnitin, el detector de IA analiza las frases con un modelo de lenguaje, y en la documentación no hay nada que exima al texto citado. Las citas directas se analizan igual que cualquier otra frase, y por eso una respuesta de participante bien redactada puede acabar marcada. En esta página explicamos el mecanismo oficial, qué forma de texto queda excluida y qué opciones concretas tienes.
Equipo de HumanPen
· 4 min de lectura
La respuesta breve
La detección de IA de Turnitin no se salta el texto citado. La documentación oficial describe un detector que extrae las frases del trabajo enviado y las analiza con un modelo de lenguaje: en ninguna de las páginas oficiales las comillas figuran como motivo de exclusión.
Una respuesta de participante citada que se lee como prosa fluida se analiza como cualquier otra frase de tu trabajo. Por eso las palabras de una persona real pueden aparecer como IA: el detector se fija en la estructura de la frase y en la probabilidad de las palabras, no en quién escribió el original.
El mecanismo oficial: frases, no citas
Las preguntas frecuentes de Turnitin sobre cómo funciona la detección son explícitas en cuanto a la unidad de análisis:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1." (Cuando se envía un trabajo a Turnitin, se extraen las frases del envío y se dividen en secciones superpuestas para el análisis de predicción. El modelo de detección de IA clasifica cada sección y le asigna un valor entre 0 y 1.)
La unidad es la frase. La página oficial del AI Writing Report plantea lo mismo desde el otro lado: el porcentaje se basa en frases de prosa dentro de un formato de escritura extenso, y "the model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, or annotated bibliographies." (el modelo no detecta de forma fiable el texto generado por IA en forma de texto no narrativo, como poesía, guiones o código, y tampoco detecta la escritura breve o no convencional, como viñetas, tablas o bibliografías anotadas).
En ninguna de estas descripciones aparece una categoría de «texto citado». Para el detector, una frase entre comillas sigue siendo una frase.
Por qué las respuestas citadas pueden acabar marcadas
Dos características de los datos citados de los participantes los vuelven vulnerables:
La respuesta se dio de forma oral, no como prosa escrita. Las respuestas habladas, al transcribirse, suelen ser breves, repetitivas o conversacionales. Si las dejas con esa forma, es posible que se traten como texto breve o no narrativo, que es justo lo que el detector excluye. Pero en la mayoría de los trabajos de investigación las citas se integran en una prosa fluida: presentas al participante, citas la respuesta y la comentas. En ese momento la cita ya es una frase dentro de un párrafo, y se analiza como tal.
Las respuestas de una entrevista pueden ser demasiado uniformes. Un participante que contesta un cuestionario estructurado tiende a producir frases completas y de estructura homogénea. La redacción oficial describe el detector como un modelo entrenado para distinguir las "word probability sequences" (secuencias de probabilidad de palabras) de los autores humanos y de la IA, y las frases muy regulares son exactamente la forma que suele adoptar el texto generado por IA. La cita se parece a aquello que el modelo aprendió a buscar.
El resultado es un desajuste: las palabras son de una persona real, pero su forma estadística se parece a la del texto generado.
Lo que la documentación excluye, y lo que no
La lista de exclusiones del texto oficial tiene que ver con la forma del texto, no con su origen:
"The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, or annotated bibliographies." (El modelo no detecta de forma fiable el texto generado por IA en forma de texto no narrativo, como poesía, guiones o código, y tampoco detecta la escritura breve o no convencional, como viñetas, tablas o bibliografías anotadas.)
Una respuesta breve de un participante, mantenida como viñeta o como elemento de una lista de una sola línea, puede quedar fuera del análisis. Esa misma respuesta, reescrita como una frase fluida dentro de tu párrafo, queda dentro. Las comillas por sí solas no cambian nada: lo que importa es si la frase se lee como prosa extensa.
No hay ninguna forma documentada de «proteger» una cita del análisis que no pase por cambiar su forma: mantenerla como texto breve o no incluirla en absoluto.
Qué hacer si tu informe marca una cita
Si tu informe de similitud o de IA marca la respuesta citada de un participante, la orientación oficial es la misma que para cualquier frase marcada: trata el indicador como una señal, no como un veredicto. Las preguntas frecuentes de Turnitin afirman que el porcentaje "should not be used as the sole basis for action or a definitive grading measure." (no debe utilizarse como única base para adoptar medidas ni como criterio de calificación definitivo).
Tus opciones, por orden:
- Comprueba la frase resaltada en sí. Abre el informe de IA y lee el texto marcado. Si es la cita de tu participante, puedes cotejarla con tu grabación o tu transcripción: eso es tu prueba.
- Decide si la cita necesita conservar su forma actual. Solo el texto genuinamente breve —una respuesta de una línea mantenida como elemento de lista— queda fuera del análisis; una frase completa sigue dentro, con o sin sangría de cita en bloque, porque el modelo lee frases de prosa al margen del formato. Así que esto solo sirve para las respuestas que ya eran breves y tenían forma de lista desde el principio.
- Guarda tus registros. Las transcripciones, las grabaciones y los consentimientos informados firmados son la prueba de que esas palabras no están generadas. La cita marcada, junto con tus registros, es en lo que debería apoyarse una conversación con tu profesor.
- Ajusta solo el texto que rodea la cita, no la cita. Reescribir las palabras del participante para cambiar su forma altera los datos. Lo defendible es conservar la cita tal cual y replantear su presentación, no su contenido.
En resumen
El detector de IA de Turnitin analiza las frases con un modelo de lenguaje, y en la documentación oficial no existe ninguna exención para el texto citado. La respuesta de un participante, cuando se integra como prosa, se analiza como cualquier otra frase, y las respuestas muy regulares pueden parecerse estadísticamente al texto generado. Las exclusiones que sí existen se refieren a la forma del texto (texto breve, listas, texto no narrativo), no a las comillas. Si marcan una cita, el indicador es una señal, no un veredicto: comprueba las palabras con tus registros, replantea la presentación y mantén intacto el contenido de la cita.