كيف يتعامل Turnitin مع المعادلات الرياضية والمحتوى غير النثري
كثيرًا ما يتساءل طلاب الرياضيات والهندسة عما إذا كانت المعادلات والصيغ تؤثر على درجة الذكاء الاصطناعي. تقول الأسئلة الشائعة في Turnitin إن النموذج لا يحلل إلا الجمل النثرية المستوفية للشروط، وإنه لا يكتشف المحتوى غير النثري بشكل موثوق. وتضيف الأسئلة الشائعة أن Turnitin لا يعمل على اكتشاف الشيفرات البرمجية. إليك ما يُعد نصًا مؤهلًا وما لا يُعد كذلك.
فريق HumanPen
· مدة القراءة: 4 د
الإجابة المختصرة
المعادلات الرياضية والصيغ وكتل الشيفرات لا يحللها كاشف الذكاء الاصطناعي في Turnitin. تقول الأسئلة الشائعة: "This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures." (لا يتضمن هذا النص المؤهل سوى الجمل النثرية، أي أننا نحلل فقط كتل النص المكتوبة بجمل نحوية قياسية، ولا نُدخل أنواعًا أخرى من الكتابة مثل القوائم أو النقاط، وهي تراكيب قصيرة ليست جملًا، أو أي تراكيب أخرى ليست جملًا.) وعن النموذج تقول أيضًا إنه "does not reliably detect AI-generated text in the form of non-prose, or code." (لا يكتشف النص الناتج عن الذكاء الاصطناعي في شكل غير نثري أو في شكل شيفرة بشكل موثوق.) وتضيف الأسئلة الشائعة: "In addition, we are not pursuing ChatGPT code detection at this time." (بالإضافة إلى ذلك، لا نسعى حاليًا إلى اكتشاف شيفرات ChatGPT.) وهذا يعني أن معادلاتك وصيغك لا تدخل مباشرة في درجة الذكاء الاصطناعي. فالدرجة تعكس فقط أجزاء النص النثري في مستندك. وإذا كانت ورقتك معادلات في معظمها مع شرح موجز، فإن كاشف الذكاء الاصطناعي يُقيّم قدرًا ضئيلًا جدًا من النص، وهو ما يجعل الدرجة أقل دلالة.
ما الذي يُعد نصًا مؤهلًا
تحدد الأسئلة الشائعة ما يفحصه النموذج:
"This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures." (لا يتضمن هذا النص المؤهل سوى الجمل النثرية، أي أننا نحلل فقط كتل النص المكتوبة بجمل نحوية قياسية، ولا نُدخل أنواعًا أخرى من الكتابة مثل القوائم أو النقاط، وهي تراكيب قصيرة ليست جملًا، أو أي تراكيب أخرى ليست جملًا.)
الجملة التالية: "This means that a document containing several different writing types would result in a disparity between the percentage and the highlights." (هذا يعني أن المستند الذي يحتوي على عدة أنواع مختلفة من الكتابة سيؤدي إلى وجود تفاوت بين النسبة المئوية والتمييزات.)
بالنسبة لورقة بحثية في الرياضيات أو الهندسة، يعني هذا أن المعادلات نفسها لا تُقيّم. الذي يخضع لكشف الذكاء الاصطناعي هو الجمل النثرية المحيطة بها فقط: الشروح والمقدمات والمناقشات. إذا كان لديك صفحة ممتلئة بالمعادلات مع جملتين من الشرح، فهاتان الجملتان هما ما يُقيّمه الكاشف. وعند إعادة الكتابة يبرز السؤال المعاكس: كيف تتعامل أداة إضفاء الطابع البشري على النصوص مع الاقتباسات والجداول والمعادلات.
الشيفرات والمحتوى غير النثري
الأسئلة الشائعة واضحة تمامًا بشأن المحتوى غير النثري:
"The model does not reliably detect AI-generated text in the form of non-prose, or code, nor does it detect short-form/unconventional writing such as bullet points (short non-sentence structures)." (لا يكتشف النموذج النص الناتج عن الذكاء الاصطناعي في شكل غير نثري أو في شكل شيفرة بشكل موثوق، كما أنه لا يكتشف الكتابة القصيرة أو غير المعتادة مثل النقاط، وهي تراكيب قصيرة ليست جملًا.)
وتقول الأسئلة الشائعة أيضًا: "In addition, we are not pursuing ChatGPT code detection at this time." (بالإضافة إلى ذلك، لا نسعى حاليًا إلى اكتشاف شيفرات ChatGPT.)
لهذا أثر عملي على الأوراق البحثية العلمية والهندسية. فإذا كنت قد استخدمت أداة ذكاء اصطناعي لتوليد شيفرة أو معادلات، فإن كاشف الذكاء الاصطناعي لم يُصمم لرصد ذلك. الذي يُقيّمه الكاشف هو النص النثري المحيط، لا الشيفرة ولا الرياضيات نفسها.
كيف تعمل الآلية على النص النثري
يعالج نموذج الكشف النص المؤهل بتقسيمه إلى مقاطع متداخلة:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated." (عند إرسال ورقة بحثية إلى Turnitin، تُستخرج الجمل من الإرسال وتُقسَّم إلى أقسام متداخلة من أجل تحليل التنبؤ. ويصنّف نموذج كشف الذكاء الاصطناعي كل قسم ويمنحه قيمة بين 0 و1، تدل على احتمال أن يكون النص بشريًا أو ناتجًا عن الذكاء الاصطناعي.)
المقاطع تتداخل، وهذا يعني أن الجملة قد تحصل على أكثر من درجة تُجمع لاحقًا. وفي ورقة بحثية كثيفة المعادلات قليلة النص النثري، تتراجع ميزة هذا التداخل لأن الجمل النثرية القابلة للتقسيم أقل. وقد يجعل هذا الدرجة أقل استقرارًا، إذ تتوفر للنموذج نقاط بيانات أقل للعمل عليها.
وماذا عن الجداول والبيانات؟
تصف ملاحظة إصدار من أغسطس 2023 كيف يتعامل النموذج مع الجداول:
"We are now able to process long-form prose text in tables." (أصبحنا قادرين الآن على معالجة النص النثري الطويل داخل الجداول.)
الجملة التالية: "Resubmit to reprocess existing submissions that contain tables." (أعد الإرسال لإعادة معالجة الملفات المُرسَلة التي تحتوي على جداول.)
هذا يعني أن الجدول إذا احتوى على جمل نثرية طويلة، فإن هذه الجمل تُحلل الآن. أما البيانات الخام والأرقام والتسميات القصيرة في الجداول فليست جملًا نثرية، وبذلك تخرج من تعريف النص المؤهل. وقوائم المراجع مستبعدة أيضًا: إذ تقول ملاحظة الإصدار نفسها "Bibliographies are now excluded when processing the AI writing report." (تُستبعد قوائم المراجع الآن عند معالجة تقرير الكتابة بالذكاء الاصطناعي.) وتطلب الجملة التالية كذلك إعادة الإرسال بالنسبة للإرسالات القائمة، ولهذا السبب قد يبدو تقرير قديم وكأن Turnitin قد ميّز مراجعك.
درجة الذكاء الاصطناعي ودرجة التشابه أمران منفصلان
من أكثر أسباب الالتباس شيوعًا التساؤل عما إذا كان المحتوى الرياضي الذي تم تمييزه في فحص التشابه يؤثر أيضًا على درجة الذكاء الاصطناعي. لا يؤثر. وتقول الأسئلة الشائعة:
"The Similarity score and the AI writing detection percentage are completely independent and do not influence each other." (درجة التشابه ونسبة كشف الكتابة بالذكاء الاصطناعي مستقلتان تمامًا ولا تؤثر إحداهما على الأخرى.)
إذا طابقت معادلاتك مصدرًا في قاعدة بيانات التشابه، فإن ذلك يؤثر على درجة التشابه لديك، لا على درجة الذكاء الاصطناعي. فكاشف الذكاء الاصطناعي لا يُقيّم إلا النص النثري بحثًا عن أنماط الكتابة بالذكاء الاصطناعي، بصرف النظر عما يجده فحص التشابه. والخطأ الذي ينبغي تجنبه هنا هو قراءة الدرجتين كما لو كانتا شيئًا واحدًا.
ما يعنيه هذا لك
لتلخيص ما تناولناه:
- المعادلات والصيغ الرياضية لا يحللها كاشف الذكاء الاصطناعي. الجمل النثرية المستوفية للشروط وحدها هي ما يُحتسب.
- تقول الأسئلة الشائعة إن النموذج لا يكتشف المحتوى غير النثري أو الشيفرات بشكل موثوق، وإنه لا يعمل على اكتشاف الشيفرات.
- الجداول التي تحتوي على نص نثري طويل تُعالج الآن، أما البيانات الخام والتسميات القصيرة فلا.
- قوائم المراجع مستبعدة من معالجة كشف الذكاء الاصطناعي.
- درجة الذكاء الاصطناعي ودرجة التشابه مستقلتان تمامًا ولا تؤثر إحداهما على الأخرى.
- الأوراق البحثية الكثيفة المعادلات القليلة النص النثري تمنح النموذج نصًا أقل للتقييم، وهو ما قد يجعل الدرجة أقل استقرارًا.
إذا تلقيت تقريرًا من Turnitin عن ورقة بحثية علمية أو هندسية وأردت معالجة المقاطع النثرية التي تم تمييزها، استورد التقرير واعمل عليها. ويمكن إعادة تشغيل المقاطع المستوفية للشروط مجانًا.
تابع القراءة
هل وُضع على كتابتك وسم الذكاء الاصطناعي لأنك لست ناطقاً أصلياً بالإنجليزية؟ ما تقوله الوثائق
مدة القراءة: 4 د
تقارير الكشفلماذا تُعلَّم المقدمات والخواتم بأنها مكتوبة بالذكاء الاصطناعي (وماذا تفعل حيال ذلك)
مدة القراءة: 4 د
أدوات كشف الذكاء الاصطناعيلماذا يُصنَّف الإبداع الأدبي خطأً على أنه مكتوب بالذكاء الاصطناعي من قبل Turnitin
مدة القراءة: 4 د