المفردات القوية تُعلَّم خطأً على أنها من الذكاء الاصطناعي؟ إليك السبب
كثير من الطلاب يلاحظون أن أفضل ما يكتبون - ذلك النص الغني بالمفردات والمنقح بعناية - هو ما يُعلَّم على أنه من الذكاء الاصطناعي. السبب ليس أن الكتابة الجيدة تشبه كتابة الآلة، بل إن الكاشف يقرأ أنماط احتمالية الكلمات، وبعض أساليب الكتابة الأكاديمية الرسمية تتشارك خصائص إحصائية مع النصوص المولَّدة بالذكاء الاصطناعي.
فريق HumanPen
· مدة القراءة: 4 د
الإجابة المختصرة
استخدام مفردات قوية لا يسبب علامات الذكاء الاصطناعي بحد ذاته. الكاشف لا يقيّم جودة اختياراتك للكلمات، بل يقيّم الاحتمال الإحصائي لتسلسلات الكلمات. النثر الأكاديمي الرسمي الذي يستخدم تراكيب جمل متسقة وعبارات انتقالية مألوفة وأنماط مفردات متوقعة يمكن أن ينتج ملفات احتمالية كلمات تتداخل مع ما تعلَّمه النموذج وربطه بالنصوص المولَّدة بالذكاء الاصطناعي. المشكلة ليست أن مفرداتك «جيدة أكثر من اللازم»، بل إن الملف الإحصائي لنصك - المشكَّل من بنية موحَّدة وأنماط كلمات رسمية - يمكن أن يشبه الكتابة المولَّدة آليًا. Turnitin تذكر في FAQ أن "content without a lot of structural variation" (المحتوى دون تنويع هيكلي كبير) من السمات المعرَّضة للإيجابيات الكاذبة. والمفردات المتطورة المقترنة ببنية موحَّدة تنطبق عليها هذه الصفة.
كيف يقرأ الكاشف كلماتك
تصف Turnitin عملية الكشف في FAQ:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (عندما تُرسَل ورقة إلى Turnitin، تُستخرَج جمل من المرسَل وتُقسَّم إلى أقسام متداخلة لتحليل التنبؤ. كل قسم يُصنَّف بواسطة نموذج كشف الذكاء الاصطناعي ويُعطى قيمة بين 0 و1، تدل على احتمالية أن يكون النص بشريًا أو مولَّدًا بالذكاء الاصطناعي. كل جملة مؤهلة ضمن هذه الأقسام ترث درجة القسم. ولأن الأقسام تتداخل، قد يكون لبعض الجمل درجات متعددة تُجمَّع في درجة واحدة. درجات الجمل هذه تُجمَّع أكثر وتُستخدَم لحساب درجة الذكاء الاصطناعي الكلية للوثيقة.)
النموذج لا يقرأ مفرداتك ويقرر أنها متطورة أكثر من أن تكون بشريًا، بل يصنِّف الأقسام حسب أنماط احتمالية الكلمات. عبارتان من FAQ توضِّحان ما يقيسه النموذج: "Our model is not explicitly programmed to evaluate specific signals such as 'burstiness,' 'perplexity,' or other individual metrics sometimes referenced in public discussions." (نموذجنا غير مبرمَج صراحةً لتقييم إشارات محددة مثل «التنوّيع» أو «الحيرة» أو غيرها من المقاييس الفردية التي تُذكَر أحيانًا في النقاشات العامة.) و"Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers." (مصنِّفاتنا مدرَّبة على كشف هذه الفروق في احتمالية الكلمات وماهرة في تسلسلات احتمالية الكلمات الخاصة بالكتّاب البشر.)
النموذج لا يحسب مقياسًا اسمه «الحيرة» perplexity، لكنه مدرَّب على بيانات احتمالية الكلمات. الكتابة الأكاديمية الرسمية التي تستخدم باستمرار كلمات انتقالية نفسها وبدايات جمل متشابهة وأنماط مفردات موحَّدة يمكن أن تنتج تسلسلات احتمالية كلمات تبدو أقرب للنصوص المولَّدة بالذكاء الاصطناعي منها للأنماط المتنوعة وغير المتوقعة في الكتابة البشرية الطبيعية. ما تقيسه كواشف الذكاء الاصطناعي Beyond perplexity وburstiness يروي القصة كاملةً.
لماذا الكتابة المنقَّحة تطابق ملف الإيجابيات الكاذبة
تذكر FAQ النصوص المعرَّضة للإيجابيات الكاذبة:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (أحيانًا الإيجابيات الكاذبة - أي تعلِيم نص مكتوب بشريًا خطأً على أنه مولَّد بالذكاء الاصطناعي - يمكن أن تشمل محتوى دون تنويع هيكلي كبير، أو نصًا يكرر نفسه حرفيًا، أو نصًا أُعيدت صياغته دون تطوير أفكار جديدة.)
الجملة التالية تقول: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (إذا أظهر مؤشرنا كمية أكبر من كتابة الذكاء الاصطناعي في مثل هذا النص، ننصحك بأخذ ذلك في الحسبان عند النظر إلى النسبة الموضَّحة.)
النثر الأكاديمي المنقَّح جيدًا يمكن أن ينطبق عليه البند الأول. فعندما تنقح كتابتك، قد توحد تراكيب الجمل وتستخدم انتقالات متسقة وتطبِّق مفردات رسمية في كل النص. هذا ينتج نصًا ذا «تنويع هيكلي كبير» منخفض. فالتنقيح الذي يجعل كتابتك أفضل أدبيًا قد يجعلها أكثر وحدة إحصائيًا، وهذه الوحدة هي ما تشير إليه صفة الإيجابيات الكاذبة. هذا هو جوهر الحجة في لماذا تُعلَّم المقالات المكتوبة جيدًا على أنها ذكاء اصطناعي.
الدرجة ليست حكمًا على الجودة
تذكر FAQ أيضًا:
"Hence, we must emphasize that the percentage on the AI writing indicator should not be used as the sole basis for action or a definitive grading measure by instructors." (لذلك يجب التأكيد على أن النسبة المئوية في مؤشر كتابة الذكاء الاصطناعي لا ينبغي استخدامها كأساس وحيد للإجراء أو كمقياس نهائي للدرجات من قبل المدرِّسين.)
درجة الذكاء الاصطناعي ليست تقييمًا للجودة. لا تعني أن كتابتك «جيدة أكثر من اللازم» أو «منقحة أكثر من اللازم» أو «رسمية أكثر من اللازم». بل تعني أن تصنيف النموذج لأنماط احتمالية كلماتك أنتج نسبة معينة. الدرجة العالية في نص جيد وغني بالمفردات لا تبطل جودة عملك، بل تعني أن الملف الإحصائي لنصك يتداخل مع الأنماط التي يربطها النموذج بالذكاء الاصطناعي. هل ينبغي أن تكتب بشكل مختلف بسبب هذا؟ سؤال منفصل: هل يجب أن تغيّر طريقة كتابتك لتجنُّب التعلِيم.
ماذا تفعل حيال ذلك
ملخّص ما غطّيناه:
- المفردات الجيدة لا تسبب علامات الذكاء الاصطناعي بحد ذاتها. الكاشف يقرأ أنماط احتمالية الكلمات، لا جودة المفردات.
- النثر الأكاديمي الرسمي ذو البنية الموحَّدة يمكن أن يتشارك خصائص إحصائية مع النصوص المولَّدة بالذكاء الاصطناعي.
- Turnitin تذكر أن «المحتوى دون تنويع هيكلي كبير» من السمات المعرَّضة للإيجابيات الكاذبة.
- التنقيح قد يقلل التنويع الهيكلي، ما يجعل النص أكثر وحدة من الناحية الإحصائية.
- الدرجة ليست حكمًا على جودة الكتابة ولا ينبغي أن تكون الأساس الوحيد للإجراء.
إذا كان لديك تقرير من Turnitin يوضّح أي الفقرات أُعلِّمت، استورد التقرير واعمل على تلك الفقرات المحددة. الفقرات المؤهَّلة يمكن إعادة تشغيلها دون تكلفة.
تابع القراءة