هل الشرطة الطويلة دليل على الكتابة بالذكاء الاصطناعي؟
الملاحظة التي يقوم عليها هذا النصح صحيحة. أما الاستنتاج المستخلص منها فليس كذلك، والحل الذي يلجأ إليه الناس هو البحث والاستبدال الشامل في نص لم يكن لديهم أي سبب آخر لتغييره.
فريق HumanPen
· مدة القراءة: 12 د
الجواب المختصر
لا شيء مما وجدناه في وثائق الشركة نفسها يدعم هذا الادعاء، والقسم التالي يوضح بالضبط أين بحثنا. بحثنا في ثلاث من صفحات مساعدة Turnitin في 18 أغسطس 2026 — دليل AI Writing Report، والأسئلة الشائعة حول كشف الكتابة بالذكاء الاصطناعي، وصفحة متطلبات الملفات. عبر هذه الصفحات الثلاث، تظهر السلسلة "dash" مرة واحدة بالضبط، وذلك داخل كلمة "dashboard". وتظهر كلمة "punctuation" مرة واحدة بالضبط، في إجابة تشرح أن الكاشف "is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content" (لم يُضبط لاستهداف تعديلات الإملاء والقواعد وعلامات الترقيم التي يولدها Grammarly في النص). والصفحة التي تجيب عن السؤال "what parameters or flags does Turnitin's model take into account when detecting AI writing?" (ما هي المعايير أو المؤشرات التي يأخذها نموذج Turnitin في الحسبان عند كشف الكتابة بالذكاء الاصطناعي؟) تجيب عنه كلياً من حيث تسلسل الكلمات. إذن، النصيحة الأكثر تداولاً بثقة حول علامة ترقيم واحدة لا تستند إلى أي شيء نجده صادراً عن الشركة التي بنت الكاشف.
هذا لا يعني أننا أثبتنا أن الشرطة لا يمكن أن يكون لها أي أثر. فالنموذج الذي يتعلم أنماطاً إحصائية ليس ملزماً بنشر ما تعلمه، ولا توجد مادة علنية تستبعد أن تسهم الشرطة بشيء. وما ينقص هو النصف الآخر: لا شيء مما وجدناه يدعم ترجيح هذا الاحتمال أيضاً. وفي الوقت نفسه، الحل الذي يلجأ إليه الناس — استبدال كل شرطة طويلة، في كل مكان — هو تغيير يمس كل فقرة تقريباً في المستند، يُجرى بضغطة واحدة، دون أن يقرأ أحد النتيجة.
ادعاءان مختلفان في عبارة واحدة
يُقال "الشرطة الطويلة دليل على الذكاء الاصطناعي" وكأنه أمر واحد. لكنه أمران، ولا شيء يربط بينهما:
- النص المولَّد يحتوي على كثير من الشرطات الطويلة. هذا قول عمّا يخرج من نماذج اللغة. ويمكن لأي شخص أن يتحقق منه بنفسه.
- الشرطة الطويلة ترفع درجة الكشف عن الكتابة بالذكاء الاصطناعي. هذا قول عمّا يرجّحه مصنِّف بعينه. ولا يمكن لأحد من خارج الشركة أن يطلع على ذلك.
يمكن أن يكون الأول صحيحاً تماماً بينما يكون الثاني خاطئاً، لأن كون سمة ما شائعة في مجموعة لا يقول شيئاً عن كيفية استخدام كاشف دُرِّب على المجموعتين لتلك السمة. والكتّاب الذين يكثرون من استخدام الشرطة هم المجموعة التي سيخطئ بحقها الادعاء الثاني، ولا شيء في الادعاء الأول يخبرك بما سيحدث لهم.
لسنا أول من يطرح هذه الفكرة العامة. فصفحتنا حول ما الذي تقيسه كواشف الذكاء الاصطناعي توضح أن المقطع لا يحصل على درجة مرتفعة بسبب عادة ظاهرة واحدة. وما يلي هنا أضيق نطاقاً: ذهبنا لنتحقق مما إذا كانت هذه العادة بعينها تظهر في أي موضع من وثائق الشركة نفسها، لأن ادعاءً بهذا الانتشار لا بد أن تكون وراءه وثيقة ما في مكان ما.
ما ذهبنا نبحث عنه، وما وجدناه هناك
ثلاث صفحات، جرى استرجاعها في 18 أغسطس 2026، وقراءتها كما تظهر في الصفحة، والبحث فيها دون تمييز بين الحروف الكبيرة والصغيرة: "Using the AI Writing Report"، و"Turnitin's AI writing detection capabilities FAQs" (الأسئلة الشائعة حول قدرات Turnitin في كشف الكتابة بالذكاء الاصطناعي)، و"File requirements for an AI Writing Report" (متطلبات الملفات للحصول على تقرير الكتابة بالذكاء الاصطناعي). هذه هي الصفحات التي تشرح الآلية وقواعد الملفات؛ ولم تدخل ملاحظات الإصدار وصفحات المشكلات المعروفة في هذا البحث. والأرقام هي عدد مرات الورود، لا عدد الأسطر.
| مصطلح البحث | استخدام تقرير AI Writing | الأسئلة الشائعة عن قدرات الكشف | متطلبات الملفات |
|---|---|---|---|
| dash | 0 | 1، داخل "dashboard" | 0 |
| em dash | 0 | 0 | 0 |
| hyphen | 0 | 0 | 0 |
| punctuation | 0 | 1 | 0 |
| character | 0 | 0 | 0 |
| comma | 0 | 0 | 0 |
| "300 words" (للتحقق) | 1 | 1 | 1 |
الصف الأخير موجود لأن البحث الذي لا يجد شيئاً والبحث الذي لم يصل إلى الصفحة أصلاً يبدوان متطابقين من الخارج. وأن يُرجع تعبير نعرف وجوده في الصفحات الثلاث نتيجة واحدة في كل منها، هو ما يمنح الأصفار أعلاه معناها.
يبقى إذن ورود حقيقي واحد. وإليك الإجابة الكاملة التي ورد فيها، عن سؤال ما إذا كان التدقيق النحوي من Grammarly يُعلَّم:
"No. Our detector is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content but rather, other AI content written by LLMs such as GPT-3.5. Based on tests we conducted on human-written documents with no AI-generated content in them, in most cases, changes made by Grammarly (free & premium) and/or other grammar-checking tools were not flagged as AI-written by our detector. Please note that this excludes content generated by Grammarly's generative AI-powered features, including draft generation, paraphrasing, summarizing, and other features. Content produced using these features will likely be flagged as AI-generated by our detector." (لا. لم يُضبط كاشفنا لاستهداف تعديلات الإملاء والقواعد وعلامات الترقيم التي يولدها Grammarly في النص، بل لاستهداف محتوى الذكاء الاصطناعي الآخر الذي تكتبه نماذج مثل GPT-3.5. وبناءً على اختبارات أجريناها على مستندات كتبها البشر ولا تحتوي على أي محتوى مولَّد بالذكاء الاصطناعي، فإن التعديلات التي أجراها Grammarly بنسختيه المجانية والمدفوعة و/أو أدوات التدقيق النحوي الأخرى لم تُعلَّم في معظم الحالات على أنها مكتوبة بالذكاء الاصطناعي من قِبل كاشفنا. يرجى ملاحظة أن هذا يستثني المحتوى الذي تولده ميزات الذكاء الاصطناعي التوليدي في Grammarly، بما في ذلك توليد المسودات وإعادة الصياغة والتلخيص وغيرها من الميزات. ومن المرجح أن يُعلَّم المحتوى المنتَج باستخدام هذه الميزات على أنه مولَّد بالذكاء الاصطناعي من قِبل كاشفنا.)
اقرأها على حقيقتها. إنها تتعلق بتعديلات مدقق نحوي، لا بشرطاتك، وتقول "in most cases" (في معظم الحالات) بدلاً من أن تقول أبداً، والجملتان الأخيرتان تدفعان بقوة في الاتجاه المعاكس لكل ما يولده Grammarly بدلاً من أن يصححه. والحد الفاصل بين النص المصحَّح والنص المولَّد موضوع قائم بذاته، وقد رسمنا حدوده في هل يكشف Turnitin استخدام Grammarly. والفائدة الوحيدة منها هنا هي: في الموضع الوحيد عبر تلك الصفحات الثلاث الذي تجتمع فيه علامات الترقيم والكشف في جملة واحدة، تتجه تلك الجملة بعيداً عن الضبط على مستوى علامات الترقيم لا نحوه.
ثم هناك السؤال الذي كان سيجيب عن سؤالنا مباشرة لو أن الإجابة كانت في ذلك الاتجاه. وتحت العنوان "What parameters or flags does Turnitin's model take into account when detecting AI writing?" (ما هي المعايير أو المؤشرات التي يأخذها نموذج Turnitin في الحسبان عند كشف الكتابة بالذكاء الاصطناعي؟)، يرد الجزء الجوهري:
"Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers." (دُرِّبت مصنِّفاتنا على كشف هذه الاختلافات في احتمال الكلمات، وهي بارعة في تسلسلات احتمال الكلمات المميزة للكتّاب البشر.)
احتمال الكلمات. تسلسل الكلمات. هذا هو المستوى الذي تصف الشركة عنده عمل مصنِّفاتها، وذلك في الإجابة التي تقدمها عندما تسألها أسئلتها الشائعة بصراحة عمّا يأخذه النموذج في الحسبان.
لا شيء منشور يسمّي وحدة أصغر من الكلمة
تتبَّع المصطلحات نزولاً عبر الوصف المنشور لكيفية إنتاج الدرجة، وستجدها تتوقف قبل أن تصل إلى الحرف:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1 … Each qualifying sentence within these segments inherits the segment's score." (عند إرسال ورقة بحثية إلى Turnitin، تُستخرج الجمل من الملف المرسَل وتُقسَّم إلى مقاطع متداخلة لأجل تحليل التنبؤ. ويُصنَّف كل مقطع بواسطة نموذج كشف الذكاء الاصطناعي ويُعطى قيمة بين 0 و1 … وترث كل جملة مؤهلة ضمن هذه المقاطع درجة المقطع.)
مقاطع. جمل. نص مؤهل، وهو ما تعرّفه الأسئلة الشائعة نفسها بأنه كتل مكتوبة على شكل جمل نحوية قياسية. تسلسلات احتمال الكلمات. كل وحدة يُذكر اسمها في هذه السلسلة هي كلمة أو أكبر، وأصغر شيء يحصل على رقم خاص به هو امتداد من عدة جمل، تستعير الجملة درجته منه.
تقع الشرطة داخل ذلك الامتداد. أزلها وسيظل المقطع يحتوي على الكلمات نفسها بالترتيب نفسه — وهذا بالتحديد هو ما لا يغيره تبديل علامات الترقيم، وترتيب الكلمات هو ما سمّته الشركة. أما ما إذا كان محلل الرموز يهتم بذلك فهو سؤال منفصل لا يستطيع أحد من خارج Turnitin الإجابة عنه، ولن نتظاهر بأننا نعرف. لكن النصيحة تُقدَّم عادةً كما لو أن الآلية مفهومة، والآلية كما نُشرت لا تحتوي على موضع لها.
ما تغيره الشرطة بشكل يمكن إثباته
لحذف الشرطة الطويلة نتيجة واحدة قابلة للقياس يمكنك أن تتحقق منها بنفسك في الثلاثين ثانية القادمة، ولا علاقة لها بالكشف على الإطلاق. فبرنامج Microsoft Word يعامل الشرطة الطويلة والشرطة المتوسطة بوصفهما حداً فاصلاً بين الكلمات، ولا يعامل الواصلة كذلك، لذا تُحسب "cost—benefit" كلمتين وتُحسب "well-known" كلمة واحدة. استبدل أربعين شرطة طويلة غير محاطة بمسافات بواصلات، وينقص عدد كلماتك بمقدار أربعين.
بالنسبة لمعظم المستندات، هذا مجرد فضول. أما بالنسبة لملف يقترب من حد صارم فليس كذلك — ومتطلبات الملفات الخاصة بـ Turnitin نفسها تضع سقفاً لما تتم معالجته أصلاً، ولهذا خصصنا قسماً للشرطات وعدادات الكلمات في هل يمكن لـ Turnitin فحص أطروحة كاملة. لاحظ شكل هذا الأمر: الأثر الذي نستطيع إثباته فعلياً يمر عبر عداد الكلمات، لا عبر المصنِّف.
ما تكلفه إزالتها
الشرطة الطويلة تؤدي وظيفة في الجملة. وأي شيء تضعه مكانها يؤدي وظيفة مختلفة، والاختيار ليس اختياراً شكلياً:
- الفاصلة تجعل الانقطاع أضعف. ففي الموضع الذي كانت الشرطة تحمل فيه انقطاعاً حقيقياً، إما أن تضيّع الفاصلة ذلك الانقطاع وإما أن تنتج وصلاً خاطئاً.
- الفاصلة المنقوطة ترفع مستوى الأسلوب وتشترط أن يصلح ما بعدها لأن يكون جملة قائمة بذاتها. وكثيراً ما لا يصلح.
- الأقواس تنزّل المحتوى إلى مرتبة الملاحظة الهامشية. وهذا يغيّر ما تقرره بشأن أهميته، وهو في قسم المناقشة حجة، وليس قراراً يتعلق بالتنسيق.
- النقطة تقسم الفكرة الواحدة إلى فكرتين. وأحياناً يكون ذلك تحسيناً. وأحياناً تقطع الرابط الذي كان هو مغزى الجملة.
- عدم وضع أي شيء ينجح أكثر مما يتوقع الناس، وهو الخيار الوحيد في هذه القائمة الذي لا يُدخل قراراً جديداً.
والآن اضرب ذلك في عدد الشرطات التي يحتويها المستند. فالبحث والاستبدال يتخذ كل واحد من تلك القرارات بالطريقة نفسها، في إجراء واحد، وفي نص لم يكن لديك سبب آخر لفتحه. هذه هي أكبر عملية تعديل يجريها معظم الناس على مخطوطة مكتملة، وهي أكثر ما يُنجز بأقل قدر من الانتباه.
وإذا كان هناك دليل أسلوب يحكم مستندك، فإن القاعدة المتعلقة بالشرطات التي تلزمك هي القاعدة الواردة في ذلك الدليل، لا الواردة في منشور على الإنترنت. وأما تمييز الشرطات الطويلة من المتوسطة في نصك فهو على الأقل سؤال له إجابة.
النسخة التي تصمد من هذا الادعاء
إذا أسقطت النظرية المتعلقة بالمصنِّفات سيبقى شيء قائماً، لكنه يشير إلى شخص لا إلى درجة.
كثير من القراء يصدقون هذه القاعدة. وإن كان مشرفك من بينهم، فإن شرطاتك تكلفك شيئاً حقيقياً — انطباعاً يتكوّن في الصفحة الأولى، قبل أن يتدخل أي كاشف. وهذا الخطر لا يعتمد على أي تفسير لكيفية عمل البرنامج، ولهذا تحديداً هو النصف الأكثر متانة في الادعاء. ونرى أنه النصف الجدير بالاهتمام، ونقدمه على أنه قراءتنا نحن، لا على أنه شيء منشور.
لكن لاحظ أن البحث والاستبدال إجابة سيئة عن ذلك. فالشخص الذي يكوّن انطباعاً عن كتابتك يتفاعل مع صفحة، ولا يحصي حروفاً، والفقرة نفسها التي بدت له كأنها من صنع آلة ستبدو له كذلك حتى بعد وضع فواصل مكان الشرطات. ما يؤثر في القارئ هو أن تكون الكتابة تعود إليك بما لا يقبل الشك، وأن تكون قادراً على الحديث عنها — وهذه هي الحجة للاحتفاظ بالمسودات، وقد شرحنا كيف يُستخدم هذا الدليل فعلياً في سجل الإصدارات بوصفه دليلاً.
انطباع القارئ عن أسلوبك ونتيجة كشف الذكاء الاصطناعي نوعان مختلفان من المعلومات. تقول Turnitin إن الطلاب لا يستطيعون الاطلاع مباشرة على مؤشر الكتابة بالذكاء الاصطناعي ولا على تقريره؛ إذ يتعين على المدرّس تنزيله ومشاركته. احصل على التقرير، وراجع المقاطع المُظلَّلة فعلياً، واستخدم مسوداتك وسجلات كتابتك لشرح طريقة عملك، بدلاً من تخمين النتيجة من علامات الترقيم.
القيام بذلك على نطاق يمكنك قراءته
مهما قررت بشأن الشرطات، فإن المبدأ المفيد هو المبدأ الذي ينتهكه الاستبدال الشامل: غيّر النص على نطاق تستطيع معه أن تقرأ ما تغيّر. فكل تغيير لم تتم مراجعته هو موضع يمكن أن يخطئ فيه المستند بصمت.
هذا القيد، وليس أي رأي حول علامات الترقيم، هو ما شكّل أداة HumanPen. أعطها الملف مع تقرير ذكاء اصطناعي من Turnitin أو iThenticate، فتصبح المقاطع المحددة هي النطاق؛ وكل ما خارجها يحتفظ بالصياغة التي كتبتها أنت. وتنص صفحتنا بصراحة على قاعدة مستوى التفصيل: "a paragraph is the smallest unit a rewrite can touch, so a selection is expanded to full paragraphs before it is counted." (الفقرة هي أصغر وحدة يمكن لإعادة الكتابة أن تمسها، لذلك يُوسَّع التحديد ليشمل فقرات كاملة قبل احتسابه.) والفقرة أعلى بعدة مستويات من الشيء الذي تتحدث عنه هذه المقالة.
يترتب على ذلك أمران، يجدر ذكرهما على أنهما حدود لا ميزات. فالفوترة تحسب الكلمات التي أُعيدت كتابتها فعلياً، لذا فإن العمل المحدد النطاق يكلّف بقدر نطاقه لا بقدر حجم الملف. ويمكن إعادة تشغيل المقاطع المستوفية للشروط مجاناً.
ما لا نستطيع فعله هو أن نعطيك رقماً. فموقف Turnitin نفسها من نموذجها هو أن التنبؤات الفردية "may not always be explainable in simple feature-by-feature terms" (قد لا تكون قابلة للتفسير دائماً بعبارات بسيطة تُفصّل ميزة تلو أخرى)، ولم تنشر شيئاً يربط أي تعديل بحركة في الدرجة، لذا فإن أي أداة تعرض لك نسبة مئوية ناتجة تعرض شيئاً لا تملكه. والأمر يزداد سوءاً تحت الخط، لأن الدرجات بين 1% و19% تظهر على شكل علامة نجمة دون نسبة مئوية ودون تمييز، مما يعني أن أي تحسن حقيقي داخل هذا النطاق غير مرئي للجميع بما فيهم أنت. وإن أردت أسباب اختلاف الأداتين في الإبلاغ عن رقمين مختلفين للفقرة نفسها، فذلك في لماذا تختلف الكواشف؛ وإن كان لديك تقرير الآن، فابدأ من كيفية قراءة تقرير الكتابة بالذكاء الاصطناعي من Turnitin.
الأسئلة الشائعة
هل يؤدي حذف كل شرطة طويلة إلى خفض درجتي؟ لا أحد يستطيع أن يخبرك، ومن يقول نعم قطعاً أو لا قطعاً فإنه يتجاوز ما نُشر. وما يمكننا الإبلاغ به هو أن صفحات المساعدة الثلاث من Turnitin التي بحثنا فيها لا تذكر الشرطات إطلاقاً، وأن الموضع الوحيد الذي تظهر فيه علامات الترقيم هو إجابة تقول إن الكاشف لم يُضبط لاستهداف تعديلات علامات الترقيم.
هل تستخدم نماذج الذكاء الاصطناعي شرطات طويلة أكثر من البشر فعلاً؟ من المحتمل جداً، وهذا ادعاء يمكنك أن تختبره بنفسك على نص مولَّد. وهو ادعاء مختلف عن القول بأن "الكاشف يرجّحها"، ولا يستلزمه.
هل هناك أي أثر قابل للقياس لإزالتها؟ نعم، أثر واحد يمكنك التحقق منه بنفسك، وهو لا علاقة له بالكشف. فبرنامج Word يحسب الشرطة الطويلة حداً فاصلاً بين الكلمات ولا يحسب الواصلة كذلك، لذا فإن استبدال الشرطات الطويلة غير المحاطة بمسافات بواصلات يقلل عدد كلماتك بمقدار كلمة واحدة مع كل استبدال.
قال لي مشرفي إن شرطاتي تبدو كأنها من ChatGPT. ماذا أفعل؟ تعامل مع ذلك على أنه انطباع قارئ لا نتيجة كاشف، لأنه كذلك فعلاً. والانطباع يُجاب عنه بالمسودات والملاحظات وبأن تكون قادراً على شرح حجتك بنفسك، لا بالبحث والاستبدال الذي لن يلاحظه أحد.
هل يجب أن أكتب بأسلوب مختلف لتجنب هذه المشكلة برمتها؟ الكتابة المتعمدة دون مستواك لها تكلفة محققة في الدرجات، ومقابلها فائدة غير مقيسة أمام درجة لا يُسمح لك عادةً برؤيتها. وقائمة الشركة المنشورة لشكل حالات الإيجابية الخاطئة — نص ذو تنوع بنيوي ضئيل، نص يكرر نفسه حرفياً — ليست قائمة علامات ترقيم، وقد استعرضنا التعديلات اليدوية التي تدعمها فعلاً في كيفية جعل النص المولَّد بالذكاء الاصطناعي يبدو بشرياً دون أداة.
تابع القراءة