كاشف Turnitin للذكاء الاصطناعي مقابل فاحصات الانتحال: ما الذي يُرصد فعليًا
SUS IT
يقيس تقرير التشابه في Turnitin ومؤشر الكتابة بالذكاء الاصطناعي فيه أمرين مختلفين تمامًا. دليل لما يكشفه كل منهما، ولماذا لا تتنبأ فاحصات الانتحال المجانية بنتيجة Turnitin، وكيف تراجع عملك قبل التسليم.
الطلاب الذين يبحثون عن «كاشف Turnitin للذكاء الاصطناعي» يحاولون في الغالب الإجابة عن أحد سؤالين مختلفين، والخلط بينهما هو مصدر معظم الالتباس حول نتائج Turnitin. السؤال الأول هو «هل سيُرصد هذا كمنسوخ من مكان آخر؟» — هذا كشف انتحال، وتقوم به Turnitin منذ عام 2000. السؤال الثاني هو «هل سيُرصد هذا كمكتوب بواسطة ChatGPT؟» — هذه ميزة منفصلة تمامًا، أُضيفت عام 2023، وتستخدم تقنية مختلفة كليًا. يعرض تقرير Turnitin النتيجتين جنبًا إلى جنب، مما يجعلهما تبدوان كنسختين من قياس واحد. لكنهما ليستا كذلك.
ما الذي يفحصه تقرير التشابه فعليًا
الميزة الأصلية والأشهر لـ Turnitin هي تقرير التشابه، الذي يقارن النص المُسلَّم بقاعدة بيانات خاصة: مليارات صفحات الويب، والمحتوى الأكاديمي والمُنشَر الذي أبرمت Turnitin اتفاقيات ترخيص بشأنه، والأهم — مستودعها الخاص لأوراق الطلاب المُسلَّمة سابقًا الممتد لعقود. نتيجة التشابه هي نسبة الوثيقة التي تطابق نصًا موجودًا بالفعل في تلك القاعدة، مع ترميز لوني للتطابقات وربطها بمصادرها. النتيجة العالية للتشابه تعني أن مقاطع محددة وُجدت في مكان آخر، في وثائق محددة، يمكنك النقر عليها وقراءتها. إنها مشكلة مطابقة لا مشكلة إحصائية، ولهذا تُعد Turnitin فعّالة ضد الانتحال التقليدي: نسخ فقرة من مقال أكاديمي أو إعادة استخدام ورقة فصل دراسي سابق ينتج تطابقات نصية دقيقة أو شبه دقيقة مع فهرس Turnitin.
ما الذي يفحصه مؤشر الكتابة بالذكاء الاصطناعي فعليًا
مؤشر الكتابة بالذكاء الاصطناعي نتيجة منفصلة، أُضيفت بعد سنوات من محرك التشابه، ولا تقارن نصك بأي قاعدة بيانات من وثائق موجودة على الإطلاق. بدلًا من ذلك، تُطبِّق نمذجة لغوية إحصائية — عائلة الأساليب نفسها (الارتباك اللغوي، والتفاوت الإيقاعي، واحتمالية الرموز) التي تستخدمها GPTZero وCopyleaks ونهج الكشف الذي نتناوله في شرحنا لكاشف المقالات. تقدِّر مدى احتمال أن تكون كل جملة قد أنتجها نموذج لغوي كبير استنادًا إلى مدى قابلية التنبؤ باختيارات الكلمات وبنية الجملة، ثم تجمع ذلك في نسبة مئوية. لا يوجد «مصدر» لمقطع مُرصد بالذكاء الاصطناعي كما هو الحال في تطابق التشابه — لا يمكنك النقر لرؤية من أين أتى النص المزعوم أنه ذكاء اصطناعي، لأن النتيجة لا تقيس تطابقًا، بل تقيس نمطًا إحصائيًا. هذا أيضًا سبب كون نتيجة الذكاء الاصطناعي أقل موثوقية بطبيعتها من نتيجة التشابه: يمكن أن تحدث الأنماط الإحصائية في كتابة بشرية رسمية جدًا أو قابلة للتنبؤ جدًا أو مكتوبة من متحدث غير أصلي يتبع قواعد نحوية من كتاب مدرسي بدقة.
لماذا لا تتنبأ عبارة «فحصتُه بفاحص انتحال مجاني» بنتيجتك في Turnitin
الأدوات المجانية مثل DupliChecker وPlagium وQuetext مفيدة فعلًا في كشف الانتحال العرضي — استشهادات منسية، أو إعادة صياغة بقيت قريبة جدًا من مصدرها — لكنها تفحص مقابل فهرس أصغر بكثير من فهرس Turnitin، يقتصر عادة على ما يمكن زحفه علنًا على الويب المفتوح. ليس لديها وصول إلى أرشيف Turnitin المرخَّص من المجلات الأكاديمية، والأهم أنه ليس لديها وصول إلى مستودع Turnitin الخاص لأوراق الطلاب المُسلَّمة سابقًا، وهو بالضبط حيث يكمن الكثير من مخاطر الانتحال الحقيقية (ورقة شُوركت في محادثة جماعية، أو مقال مشترى سبق أن سلَّمه شخص آخر). نتيجة نظيفة من فاحص انتحال مجاني تخبرك أن نصك لا يطابق محتوى الويب العام. لا تخبرك شيئًا عمّا إذا كان يطابق أرشيف Turnitin المؤسسي، ولا تخبرك شيئًا إطلاقًا عن نتيجة الكتابة بالذكاء الاصطناعي، إذ إن معظم فاحصات الانتحال المجانية لا تحاول كشف الذكاء الاصطناعي أصلًا — والتي تُعلن عن «كشف ذكاء اصطناعي» كميزة إضافية تُشغِّل عادة نموذجًا أقل تطورًا بكثير من نموذج Turnitin أو كاشف مخصص.
كواشف الذكاء الاصطناعي وأوراق البحث: خطر إيجابية خاطئة محدد
«كاشف ذكاء اصطناعي لورقة بحثية» بحث شائع لسبب وجيه: الكتابة الأكاديمية والتقنية أكثر عرضة بشكل غير متناسب لإطلاق إيجابيات خاطئة على مؤشرات الكتابة بالذكاء الاصطناعي، بما فيها مؤشر Turnitin. تستخدم الأوراق البحثية سجلًا رسميًا، ومصطلحات مجالية متخصصة، وبنية موحدة (ملخص، منهجية، نتائج، مناقشة)، وجملًا كثيفة الاستشهاد — كلها خصائص تقلل «مفاجأة» النص إحصائيًا بنفس الطريقة التي يفعلها النص المولَّد بالذكاء الاصطناعي. قسم منهجية يصف بروتوكولًا تجريبيًا راسخًا بلغة تقنية دقيقة قد يُسجِّل درجة أعلى على مؤشر ذكاء اصطناعي من مقال شخصي غير رسمي، رغم كونه مكتوبًا بالكامل بواسطة إنسان. هذا ليس عيبًا خاصًا بـ Turnitin — إنه قيد بنيوي في الكشف الإحصائي للذكاء الاصطناعي عند تطبيقه على الكتابة الرسمية، ويستحق معرفته قبل أن تُصاب بالذعر بسبب مراجعة أدبيات مُرصودة.
الكاشف الذي يستخدمه المعلمون فعليًا
الكثير من اهتمام البحث حول «كاشف الذكاء الاصطناعي الذي يستخدمه المعلمون» يأتي من طلاب يحاولون مراجعة عملهم مسبقًا مقابل الأداة الصحيحة، والإجابة الصادقة هي: يعتمد ذلك على المؤسسة، لكنه غالبًا Turnitin، لأنه مدمج مباشرة في أنظمة إدارة التعلم (Canvas، Blackboard، Moodle) التي تُشغِّل من خلالها معظم المدارس تسليم الواجبات بالفعل. تستخدم بعض المؤسسات GPTZero أو Copyleaks بدلًا من ذلك أو إضافة إليه. عدد صغير لكنه ذو دلالة لا يستخدم أي كاشف آلي إطلاقًا ويعتمد على حكم المدرّس. الأثر العملي هو أن فاحص ذكاء اصطناعي مجاني ومستقل تُشغِّله بنفسك ليس مضمونًا أن يتفق مع الأداة التي تستخدمها مدرستك تحديدًا — فالكواشف المختلفة مُدرَّبة على بيانات مختلفة ومُعايَرة بشكل مختلف. إن كنتَ تعرف أن مدرستك تستخدم Turnitin تحديدًا، فإن فحصًا خاصًا بأداة مختلفة تحقق عقلاني معقول لكنه ليس ضمانًا.
كيف تراجع عملك قبل التسليم
لن يكون لديك وصول إلى قاعدة بيانات Turnitin نفسها للاختبار مقابلها قبل التسليم، لكن لا يزال بإمكانك رصد أكثر المشكلات شيوعًا. شغِّل مسودتك عبر فاحص كتابة بالذكاء الاصطناعي مثل تحليل الوثائق من SUS IT، الذي — على عكس نسبة مئوية مجردة — يُبرز المقاطع المحددة التي أسهمت أكثر في النتيجة، بحيث ترى ما إذا كان أسلوبك الرسمي في الاستشهاد أم صياغة أقرب فعليًا لأسلوب الذكاء الاصطناعي هو ما يقود الرقم. بخصوص مخاوف التشابه، تأكد من أن كل إعادة صياغة أُعيدت صياغتها جوهريًا (لا مجرد استبدال مرادفات) وأن كل اقتباس مباشر مُوثَّق بشكل صحيح — الإصلاح الآلي لمعظم إشارات التشابه. لشرح أعمق لاستراتيجية ما قبل التسليم، بما في ذلك كيفية بناء سجل نسخ يوثق عملية كتابتك، راجع دليلنا عن مراجعة المقالات قبل التسليم.
الخلاصة
تجيب نتيجة التشابه ونتيجة الكتابة بالذكاء الاصطناعي في Turnitin عن سؤالين مختلفين باستخدام تقنية مختلفة، ولا تتنبأ إحداهما بموثوقية بالأداة المجانية التي تفحص النوع الآخر فقط. إن كنتَ تراجع مسبقًا كتابة رسمية أو تقنية تحديدًا، اعلم أن قدرًا من خطر الإيجابية الخاطئة في نتيجة الذكاء الاصطناعي بنيوي، وليس علامة على أنك أخطأت — وأن عملية صياغة موثَّقة هي أفضل دفاع لك بغض النظر عن الكاشف الذي تستخدمه مؤسستك.