Turnitin hat Ihre zitierten Interview- oder Umfrageantworten als KI markiert? Was wirklich dahintersteckt

Sie zitieren in Ihrem Interview- oder Umfrageteil die Antwort eines Teilnehmers, und Turnitin stuft sie als KI-geschrieben ein. Die Antwort stammt von einem echten Menschen — wie kann der Detektor sie da für KI halten? In der offiziellen Beschreibung von Turnitin heißt es, der KI-Detektor analysiere Sätze mit einem Sprachmodell; in der Dokumentation steht an keiner Stelle, dass zitierter Text ausgenommen wäre. Direkte Zitate werden wie jeder andere Satz analysiert, und deshalb kann eine flüssig formulierte Antwort eines Teilnehmers auffallen. Auf dieser Seite geht es um den offiziellen Mechanismus, darum, welche Textform ausgenommen wird, und um die konkreten Möglichkeiten, die Ihnen bleiben.

HumanPen-Team

· 4 Min. Lesezeit

Die kurze Antwort

Die KI-Erkennung von Turnitin überspringt zitierten Text nicht. Die offizielle Dokumentation beschreibt einen Detektor, der Sätze aus der Einreichung extrahiert und mit einem Sprachmodell analysiert — Anführungszeichen sind auf keiner der offiziellen Seiten ein Ausschlussgrund.

Eine zitierte Teilnehmerantwort, die sich wie flüssige Prosa liest, wird wie jeder andere Satz Ihrer Arbeit analysiert. Genau deshalb können die Worte eines echten Menschen als KI erscheinen: Der Detektor betrachtet Satzbau und Wortwahrscheinlichkeit, nicht die Frage, wer den Text ursprünglich verfasst hat.

Der offizielle Mechanismus: Sätze, keine Zitate

In den FAQ von Turnitin zur Funktionsweise der Erkennung wird die Analyseeinheit ausdrücklich benannt:

When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1. (Wird bei Turnitin eine Arbeit eingereicht, werden die Sätze der Einreichung extrahiert und für die Vorhersageanalyse in überlappende Abschnitte unterteilt. Jeder Abschnitt wird vom KI-Erkennungsmodell klassifiziert und erhält einen Wert zwischen 0 und 1.)

Die Einheit ist der Satz. Die offizielle Seite zum AI Writing Report ergänzt denselben Punkt von der anderen Seite her: Der Prozentwert beruht auf Prosa-Sätzen in einem längeren Schreibformat, und „the model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, or annotated bibliographies." (Das Modell erkennt KI-generierten Text in Form von Nicht-Prosa, etwa Gedichten, Skripten oder Code, nicht zuverlässig; ebenso wenig erkennt es Kurzformen oder unkonventionelles Schreiben wie Aufzählungspunkte, Tabellen oder kommentierte Bibliografien.)

In keiner dieser Beschreibungen taucht eine Kategorie „zitierter Text" auf. Ein Satz in Anführungszeichen bleibt für den Detektor ein Satz.

Warum zitierte Antworten auffallen können

Zwei Eigenschaften zitierter Teilnehmerdaten machen sie anfällig:

Die Antwort wurde gesprochen, nicht als Prosa geschrieben. Gesprochene Antworten sind in der Transkription oft kurz, voller Wiederholungen oder umgangssprachlich. Lassen Sie sie in dieser Form, werden sie womöglich als Kurzform oder Nicht-Prosa behandelt — und genau das nimmt der Detektor aus. Die meisten Forschungsarbeiten betten Zitate aber in fließende Prosa ein: Sie führen den Teilnehmer ein, zitieren die Antwort und kommentieren sie. Damit ist das Zitat ein Satz innerhalb eines Absatzes und wird auch als solcher analysiert.

Interviewantworten können ungewöhnlich gleichförmig sein. Wer einen strukturierten Fragebogen beantwortet, produziert tendenziell vollständige, gleichmäßig gebaute Sätze. In der offiziellen Formulierung heißt es, der Detektor sei darauf trainiert, zwischen den „word probability sequences" (Wortwahrscheinlichkeitsfolgen) menschlicher und KI-gestützter Schreibender zu unterscheiden — und sehr regelmäßige Sätze haben genau die Form, die KI-generierter Text für gewöhnlich annimmt. Das Zitat sieht also aus wie das, worauf das Modell trainiert wurde.

Das Ergebnis ist ein Missverhältnis: Die Worte stammen von einem echten Menschen, ihre statistische Form ähnelt aber erzeugtem Text.

Was die Dokumentation ausschließt — und was nicht

Die Ausschlussliste im offiziellen Text betrifft die Form des Textes, nicht seine Herkunft:

The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, or annotated bibliographies. (Das Modell erkennt KI-generierten Text in Form von Nicht-Prosa, etwa Gedichten, Skripten oder Code, nicht zuverlässig; ebenso wenig erkennt es Kurzformen oder unkonventionelles Schreiben wie Aufzählungspunkte, Tabellen oder kommentierte Bibliografien.)

Eine kurze Teilnehmerantwort, die als Aufzählungspunkt oder einzeiliger Listeneintrag stehen bleibt, kann aus der Analyse herausfallen. Dieselbe Antwort, zu einem fließenden Satz in Ihrem Absatz umgeformt, fällt hinein. Anführungszeichen allein ändern nichts — entscheidend ist, ob der Satz sich als längere Prosa liest.

Es gibt keinen dokumentierten Weg, ein Zitat vor der Analyse zu „schützen", außer seine Form zu ändern: es als Kurztext stehen zu lassen oder es gar nicht aufzunehmen.

Was zu tun ist, wenn Ihr Bericht ein Zitat markiert

Wenn Ihr Similarity- oder KI-Bericht eine zitierte Teilnehmerantwort markiert, lautet die offizielle Empfehlung wie bei jedem markierten Satz: Verstehen Sie den Wert als Hinweis, nicht als Urteil. In den FAQ von Turnitin heißt es, der Prozentwert „should not be used as the sole basis for action or a definitive grading measure." (sollte nicht als alleinige Grundlage für eine Maßnahme oder als endgültige Bewertungsgröße verwendet werden.)

Ihre Möglichkeiten, der Reihe nach:

  • Sehen Sie sich den markierten Satz selbst an. Öffnen Sie den KI-Bericht und lesen Sie die markierte Stelle. Handelt es sich um das Zitat Ihres Teilnehmers, können Sie sie mit Ihrer Aufnahme oder Ihrem Transkript abgleichen — das ist Ihr Beleg.
  • Entscheiden Sie, ob das Zitat in seiner jetzigen Form nötig ist. Nur echte Kurzformen — eine einzeilige Antwort, die als Listeneintrag steht — fallen aus der Analyse heraus; ein vollständiger Satz bleibt darin, ob Sie ihn nun als Blockzitat einrücken oder nicht, denn das Modell liest Prosa-Sätze unabhängig von der Formatierung. Das hilft also nur bei Antworten, die schon von sich aus kurz und listenförmig waren.
  • Heben Sie Ihre Unterlagen auf. Transkripte, Aufnahmen und unterschriebene Einverständniserklärungen sind der Beleg dafür, dass die Worte nicht erzeugt wurden. Das markierte Zitat zusammen mit Ihren Unterlagen — darauf sollte ein Gespräch mit Ihrer Lehrkraft fußen.
  • Passen Sie nur den Text darum herum an, nicht das Zitat. Die Worte des Teilnehmens umzuschreiben, um ihre Form zu verändern, verfälscht die Daten. Vertretbar ist, das Zitat unverändert zu lassen und seine Darstellung zu überdenken, nicht seinen Inhalt.

Unterm Strich

Der KI-Detektor von Turnitin analysiert Sätze mit einem Sprachmodell, und in der offiziellen Dokumentation gibt es keine Ausnahme für zitierten Text. Die Antwort eines Teilnehmers wird, als Prosa eingebettet, wie jeder andere Satz analysiert — und sehr regelmäßige Antworten können statistisch erzeugtem Text ähneln. Die Ausnahmen, die es gibt, betreffen die Form des Textes (Kurzformen, Listen, Nicht-Prosa), nicht die Anführungszeichen. Wenn ein Zitat markiert wird, ist der Wert ein Hinweis und kein Urteil: Gleichen Sie die Worte mit Ihren Unterlagen ab, überdenken Sie die Darstellung und lassen Sie den Inhalt des Zitats unangetastet.