هل يدرّب Turnitin ذكاءه الاصطناعي على بحثك؟ ما تقوله الأسئلة الشائعة الرسمية
قلق شائع بين الطلاب: "Turnitin لديه بحثي — هل يدرّبون ذكاءهم الاصطناعي عليه؟ هل يمكنني أن أطلب منهم حذفه؟" لا تجيب الأسئلة الشائعة الرسمية عن أيّ من السؤالين بنعم أو لا بسيطة. تقول إنّ النموذج دُرّب على عيّنة تمثيلية من الكتابة الأكاديمية المولّدة بالذكاء الاصطناعي والكتابة الأكاديمية الأصيلة، إضافة إلى مجموعة نصوص داخلية ضخمة، من دون أن تنصّ على استبعاد أعمال الطلاب المقدَّمة. وفي ما يخصّ الحذف، تقول إنّ العملاء يمكنهم طلب حذف كامل لما قدّموه، من دون حذف جزئي. تستعرض هذه الصفحة الصياغة الدقيقة، وما تعد به وما لا تعد به، وما يعنيه ذلك لطالب يريد إخراج عمله من النظام.
فريق HumanPen
· مدة القراءة: 4 د
الجواب المختصر
لا تقول أسئلة Turnitin الشائعة إنّ البحث الذي تقدّمه يُستخدم لتدريب نموذج كشف الذكاء الاصطناعي — ولا تقول إنه مستبعد أيضاً. تقول الصياغة الرسمية إنّ النموذج دُرّب على "a representative sample" (عيّنة تمثيلية) من الكتابة الأكاديمية المولّدة بالذكاء الاصطناعي والأصيلة، وإنّ نماذج Turnitin أيضاً "trained on our vast inhouse corpus of academic data." (دُرّبت على مجموعتنا الداخلية الضخمة من البيانات الأكاديمية).
الشيء الذي يمكنك التحرّك بشأنه فعلاً هو الحذف: تقول الأسئلة الشائعة إنّ المؤسسات يمكنها طلب حذف كامل لما قدّمته، وإنّ الحذف الجزئي غير مدعوم. وتؤطّر الأسئلة الشائعة ذلك بوصفه طلباً مؤسسياً، ولا تصف أيّ مسار فردي يتيح للطالب إزالة بحثه بنفسه. أمّا ما إذا كان لك حقّ حذف مستقل بموجب قانون حماية البيانات مثل GDPR، فهذه مسألة قانونية لا تتناولها هذه الأسئلة الشائعة.
الصياغة الرسمية حول التدريب
تجيب الأسئلة الشائعة الخاصّة بكشف الذكاء الاصطناعي في Turnitin عن سؤال "How was Turnitin's model trained?" (كيف دُرّب نموذج Turnitin؟) بما يلي:
"Our model is trained on a representative sample of data spread over a period of time, that includes both AI generated and authentic academic writing across geographies and subject areas." (دُرّب نموذجنا على عيّنة تمثيلية من البيانات موزّعة على فترة زمنية، تشمل الكتابة الأكاديمية المولّدة بالذكاء الاصطناعي والكتابة الأكاديمية الأصيلة عبر مناطق جغرافية ومجالات دراسية مختلفة.)
وتذهب إجابة ثانية في الأسئلة الشائعة، حول النموذج الذي يستند إليه الكشف، إلى أبعد من ذلك:
"More importantly, our models are also trained on our vast inhouse corpus of academic data." (الأهمّ من ذلك أنّ نماذجنا دُرّبت أيضاً على مجموعتنا الداخلية الضخمة من البيانات الأكاديمية.)
لا تسمّي أيّ من الجملتين أعمال الطلاب المقدَّمة جزءاً من بيانات التدريب، ولا تستبعدها أيّ منهما. "Authentic academic writing" (الكتابة الأكاديمية الأصيلة) و"inhouse corpus of academic data" (مجموعة البيانات الأكاديمية الداخلية) هما أقرب ما يصل إليه النصّ الرسمي في وصف مصدر هذه الكلمات — وكلتا الصيغتين تبقي مسألة بحثك بالذات مفتوحة.
هذه هي القصة كاملة في ما يخصّ "التدريب": لا تنفي الأسئلة الشائعة أن يكون العمل المقدَّم ضمن خليط التدريب، ولا تؤكّد ذلك أيضاً.
الصياغة الرسمية حول الحذف
يُجاب سؤال حذف البيانات في الأسئلة الشائعة من وجهة نظر العميل — أي المؤسسة:
"Yes, customers can request a full deletion of their submissions; we cannot support partial data deletion requests to delete only the AI writing component of the submission data." (نعم، يمكن للعملاء طلب حذف كامل لما قدّموه؛ ولا يمكننا تلبية طلبات حذف جزئي للبيانات بحيث يُحذف مكوّن الكتابة بالذكاء الاصطناعي وحده من بيانات الإرسال.)
ينتج عن ذلك نتيجتان.
أولاً، الحذف ممكن من حيث المبدأ، لكنّ من يقدّم الطلب هو المؤسسة. فالجامعة التي تريد محو ما قدّمته يمكنها طلب حذف كامل للبيانات التي تملكها. ثانياً، لا يمكنك حذف مكوّن الذكاء الاصطناعي وحده — لا يوجد خيار "إزالة نتيجة الذكاء الاصطناعي مع الإبقاء على البحث"، ولا يوجد مسار لحذف يقوم به الطالب بنفسه في الأسئلة الشائعة.
لذا فإنّ سؤال "هل يمكنني أن أطلب إزالة عملي؟"، إذا أُجيب عنه بما تصفه هذه الأسئلة الشائعة، فله جواب مباشر: ليس عبر هذه الأسئلة الشائعة، فهي لا ترسم إلّا مساراً مؤسسياً. وأيّ حقّ قد يكون لك مباشرةً فهو مسألة تخصّ قانون حماية البيانات في نطاقك القضائي، لا هذه الوثيقة.
ما تقوله الأسئلة الشائعة فعلاً عن المستودع
وتحتوي الأسئلة الشائعة نفسها على الجملة التي يبحث عنها معظم الطلاب في الحقيقة، وهي عن قلق قريب جداً:
"No, it does not. There is no separate repository for AI writing detection, and customers retain the ability to choose whether to add their student papers into the repository or not." (لا، ليس كذلك. لا يوجد مستودع منفصل للكشف عن الكتابة بالذكاء الاصطناعي، ويحتفظ العملاء بالقدرة على الاختيار بين إضافة أوراق طلابهم إلى المستودع من عدمه.)
وهذا يغطّي "مستودع كشف الذكاء الاصطناعي" — أي فكرة أنّ Turnitin يضع بحثك في قاعدة بيانات خاصّة بفحص الذكاء الاصطناعي. تقول الأسئلة الشائعة إنّه لا يوجد مستودع منفصل للكشف عن الكتابة بالذكاء الاصطناعي، وإنّ قرار إضافة الأوراق إلى مستودع التشابه يعود إلى المؤسسة.
كلمة "تدريب" لا ترد في هذه الإجابة. فمستودع كشف الذكاء الاصطناعي وبيانات التدريب شيئان مختلفان، والأسئلة الشائعة تفصل بينهما: لا مستودع منفصل للكشف، ولا عبارة عن التدريب.
ما يعنيه ذلك لك
إذا كنت طالباً قدّمت بحثاً وتقلق الآن بشأن استخدامه، فالخلاصة الصادقة هي:
- الأسئلة الشائعة الرسمية لا تؤكّد أنّ بحثك يدرّب النموذج، ولا تعد بأنّه لا يدرّبه.
- أقرب العبارات الرسمية تصف بيانات التدريب بأنّها "authentic academic writing" (كتابة أكاديمية أصيلة) و"inhouse corpus" (مجموعة داخلية) — ولا تستبعد أيّ منهما أعمال الطلاب المقدَّمة.
- الحذف موجود، لكنّه حذف كامل على مستوى المؤسسة، لا إزالة على مستوى الطالب، والحذف الجزئي غير مدعوم.
- إجابة "لا مستودع منفصل" تتعلّق بتخزين بيانات كشف الذكاء الاصطناعي، لا بالتدريب.
ما يمكنك فعله بهذه المعلومات: إن كان قلقك من نتائج كشف الذكاء الاصطناعي على بحثك، فالمسائل العملية هي قراءة النتيجة وإعادة الفحص، لا ملكية البيانات. وإن كان القلق مؤسسياً، فالقناة هي مدير Turnitin في جامعتك — فهو "العميل" الذي تقصده الأسئلة الشائعة عندما تتحدّث عن طلبات الحذف.
الخلاصة
لا تؤكّد أسئلة Turnitin الشائعة ولا تنفي أنّ الأبحاث المقدَّمة تدرّب نماذج الذكاء الاصطناعي لديها. يصف النصّ الرسمي بيانات التدريب بأنّها عيّنة تمثيلية من الكتابة الأكاديمية الأصيلة إضافة إلى مجموعة داخلية ضخمة، ولا يقول شيئاً يستبعد عمل الطلاب. وفي ما يخصّ الإزالة، المسار الرسمي الوحيد هو طلب حذف كامل على مستوى المؤسسة — ولا يوجد حذف يقوم به الطالب بنفسه. وإذا أردت أن تعرف على ماذا وافقت مدرستك، فالشخص الذي تسأله هو مدير Turnitin في جامعتك، لا دعم Turnitin مباشرة.