لماذا تظهر نسب ذكاء اصطناعي مختلفة في أقسام ورقتي؟ إليك كيف يعمل نظام Turnitin للكشف

عندما تفتح تقرير الكتابة بالذكاء الاصطناعي، تجد قسمًا بنسبة 60% وقسمًا آخر بنسبة 0%، أو ترى تظليلًا يغطي جزءًا من الصفحة 3 ولا شيء في الصفحة 5. أول ما يخطر ببالك أن التقرير به خلل. لكن الواقع مختلف. Turnitin يقيّم النص جملةً جملة، ثم يجمع هذه التقييمات في نسبة إجمالية. وهذا يعني أن الأقسام المختلفة في الطول وكثافة الجمل تظهر بنسب مختلفة بطبيعة الحال. في هذا المقال نشرح آلية العمل الرسمية، وما تعنيه التظليلات فعليًا، ولماذا لا تتطابق نسبة الذكاء الاصطناعي مع نسبة التشابه.

فريق HumanPen

· مدة القراءة: 5 د

الإجابة المختصرة

تظهر أقسام الورقة نفسها بنسب ذكاء اصطناعي مختلفة لأن Turnitin يقيّم كل جملة على حدة، ثم يجمع تقييمات الجمل في النسبة الإجمالية. وفقًا لدليل Turnitin نفسه، تعمل الآلية هكذا: تُستخرج الجمل من النص، تُقسَّم إلى مقاطع متداخلة، يُقيَّم كل مقطع، ثم ترث كل جملة تقييمًا، وأخيرًا تُجمَّع تقييمات الجمل في الرقم الظاهر للوثيقة. لذا لن يبدو القسم القصير المكثف مثل القسم الطويل المحادث في تفصيل التسليم — وهذه ليست عيوبًا في التقرير، بل هكذا صُمّم النظام ليعمل.

كيف يقرأ الكاشف ورقتك فعليًا

يصف الدليل الرسمي "Using the AI Writing Report" طريقة الكشف على النحو التالي:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis." (عندما تُرسَل ورقة إلى Turnitin، تُستخرج جمل منها وتُقسَّم إلى مقاطع متداخلة لتحليل التنبؤ)
"Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated." (يُصنِّف نموذج كشف الذكاء الاصطناعي كل مقطع ويعطيه قيمة بين 0 و1، تدل على احتمال أن يكون النص بشريًا أو مولَّدًا بالذكاء الاصطناعي)

ويضيف مدوَّنة Turnitin تفصيل الدقة:

"The submission is first broken into segments of text that are roughly a few hundred words (about five to ten sentences). Those segments are then overlapped with each other to capture each sentence in context." (يُقسَّم النص أولًا إلى مقاطع من بضع مئات الكلمات تقريبًا — خمس إلى عشر جمل — ثم تُجعَل هذه المقاطع متداخلة لالتقاط كل جملة في سياقها)

إذًا التقرير الذي تقرأه بُني من الوحدة الصغرى إلى الكبرى: تقييمات على مستوى الجملة، ثم تُجمَع في عرض على مستوى القسم، ثم تُدمَج في النسبة المئوية الواحدة في الأعلى.

لماذا تخرج الأقسام بنسب مختلفة

يتابع الدليل الرسمي:

"Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (ترث كل جملة مؤهَّلة داخل هذه المقاطع تقييم المقطع. ولأن المقاطع متداخلة، قد يكون لبعض الجمل أكثر من تقييم، فتُدمَج في تقييم واحد. ثم تُجمَع تقييمات الجمل هذه أكثر ويُستفاد منها في حساب تقييم الذكاء الاصطناعي الإجمالي للوثيقة)

ينتج عن هذه الآلية ثلاث تبعات:

  • تُقيَّم الأقسام بناءً على شكل الجمل فيها — فالقسم المليء بجمل قصيرة نمطية يُقيَّم بشكل مختلف عن قسم آخر بجمل طويلة ومتنوعة.
  • طول القسم matters: يظلّل تفصيل التسليم كل منطقة من وثيقتك حسب كمية النص المؤهَّل المُعلَّم فيها. فقسم من 5 صفحات قد يحمل نصًا مُظلَّلًا أكثر وضوحًا من قسم من صفحة واحدة، حتى لو كان نمط الجمل متشابهًا.
  • الجمع بالتداخل يعني أن الجملة الواقعة على حدود قسمين قد تحمل تقييمًا مدمَجًا — لذا فإن الحدود الدقيقة للتظليل ليست حدود حكم دقيقة.

لا شيء من هذا خلل في التقرير، بل هو عمل الجمع كما يوثّقه Turnitin.

نسبة الذكاء الاصطناعي ونسبة التشابه مستقلة عن بعضها

من أكثر الأخطاء شيوعًا مقارنة "تقييم" الذكاء الاصطناعي بنسبة التشابه كأنهما قراءتان للشيء نفسه. ويصرّح دليل Turnitin بهذا الفصل بوضوح:

"The percentage generated by Turnitin's AI writing detection model is different from and independent of the similarity score." (النسبة المئوية التي يولّدها نموذج Turnitin لكشف الكتابة بالذكاء الاصطناعي مختلفة عن درجة التشابه ومستقلة عنها)
"AI writing highlights are not visible in the Similarity Report." (تظليلات الكتابة بالذكاء الاصطناعي غير ظاهرة في تقرير التشابه)

فقسم فيه نسبة تشابه 40% وتقييم ذكاء اصطناعي 0%ليس تناقضًا: الرقم الأول يحسب النص المطابق، والثاني يعكس حكم النموذج على كل جملة. لذا قد تختلف أقسام الوثيقة في نسبة الذكاء الاصطناعي للسبب نفسه الذي يجعل نسبتي الذكاء الاصطناعي والتشابه تختلفان عن بعض — لأن كلًا منهما يجيب عن سؤال مختلف.

قراءة تفصيل التسليم والتظليلات

يصف الدليل الرسمي الشريط التفاعلي في أعلى التقرير:

"The overall percentage of text likely detected as AI is detailed in the Submission Breakdown." (النسبة المئوية الإجمالية للنص الذي رُجّح كشفه كذكاء اصطناعي موضّحة في تفصيل التسليم)
"The bar is interactive and allows you to select each highlight to bring the corresponding text and page of the submission into focus." (الشريط تفاعلي ويسمح لك باختيار كل تظليل لإبراز النص والصفحة المقابلة من التسليم)

ملاحظتان عمليتان عند قراءة تقريرك:

  • تغيّر لون التظليل في أغسطس 2026: دمجت Turnitin فئتي "مولَّد بالذكاء الاصطناعي" و"أُعيدت صياغته بالذكاء الاصطناعي" في لون أزرق واحد، لذا تُظهر التقارير الحديثة لونًا واحدًا حيث كانت التقارير الأقدم تُظهر لونين.
  • النثر المؤهَّل فقط يدخل في الحساب — القوائم والنقاط والجدوال والشعر والنصوص البرمجية والأكواد لا تُحتسَب. يقول الدليل الرسمي: "The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, etc." (لا يكتشف النموذج بشكل موثوق النصوص المولَّدة بالذكاء الاصطناعي في شكل غير نثري كالشعر أو النصوص البرمجية أو الأكواد، ولا يكتشف الكتابة القصيرة/غير التقليدية كالنقاط والجدوال وما شابه)

إذًا القسم "الفارغ" قد لا يكون فارغًا من النص أصلًا — بل فارغًا من النثر المؤهَّل. فالتقرير لا يخبرك شيئًا عن النقاط أو الجدوال لأنه لم يحسبها أبدًا.

ثلاث حالات يجب معرفتها قبل أن تقرأ القسم وتفزع

يتناول دليل Turnitin المتعلّق بحالات المؤشر النسب التي لا تتصرّف كرقم عادي:

"To avoid potential incidence of false positives, no score or highlights are attributed for AI detection scores above 0% and below the 20% threshold in the report. When this occurs, it is now indicated with an asterisk (%) and no percentage is attributed." (لتجنّب احتمالية الإيجابيات الكاذبة، لا يُنسَب أي تقييم أو تظليلات لتقييمات كشف الذكاء الاصطناعي التي تكون أعلى من 0% وأقل من عتبة 20% في التقرير. وعند حدوث ذلك، يُشار إليها الآن بنجمة (%) دون إخراج أي نسبة)
"0% detected as AI … our testing has found that there is a higher incidence of false positives when the percentage is between 0 and 19." (0% مُكتشَفة كذكاء اصطناعي… وجدت اختباراتنا أن هناك معدلات أعلى للإيجابيات الكاذبة عندما تكون النسبة بين 0 و19)

هذا يغيّر طريقة قراءتك لفرق على مستوى القسم: فقسم يظهر 0% قد يكون صفرًا حقيقيًا أو تقييمًا أقل من 20% يرفض التقرير إظهاره — والتقرير نفسه لا يخبرك أي الحالتين. وهذا مقصود بالتصميم، وليس صدفة.

الخلاصة

تقرير Turnitin للذكاء الاصطناعي الذي يُظهر نسبًا مختلفة عبر الأقسام هو عمل قناة الكشف بالضبط كما يوثّقها Turnitin: الجمل تُقيَّم فرديًا، والمقاطع المتداخلة تجمع التقييمات، والرقم الإجمالي تجميع — وليس حكمًا موحدًا على وثيقتك. الأقسام تختلف لأن طبيعة جملها وأطوالها تختلف. ونسبة الذكاء الاصطناعي مستقلة عن درجة التشابه، والتظليلات تغطي النثر المؤهَّل فقط، لذا تظل النقاط والجدوال والأكواد خارج الحساب تمامًا. وعندما تقرأ تقريرك: تعامل مع التظليلات كإشارة للتحقيق، وليس كوسم ثابت على كل فقرة.

تابع القراءة