AI Humanization

علامة الشرطة الطويلة: لماذا يفرط ChatGPT في استخدامها

ما الذي يسبب فعليًا عادة ChatGPT في الاعتماد على الشرطة الطويلة، وما الوظيفة التي تؤديها هذه العلامة في الجملة، وما الذي يلجأ إليه المحرر البشري بدلًا منها: فاصلة، أو نقطتان، أو نقطة.

5 min
Table showing what a human writer uses instead of the chatgpt em dash habit, by sentence function

أحيانًا، يرسل مدير التوظيف خطاب تقديم إلى زميل مع سطر مضاف: تحقّق من الشرطات. هذا النوع الطويل يظهر ثلاث مرات في جملتين، مرة بوصفه فاصلة، ومرة بوصفه نقطتين، ومرة بوصفه نقطة، وكل ذلك في الفقرة نفسها. العادة الصغيرة التي لدى chatgpt هي تلك التي ترى فيها الشرطة قبل أن تقرأ الفكرة. من المهم فهم هذه العادة على نحو صحيح قبل إصدار أي استنتاجات بشأن ما تعنيه فعليًا. تلك الاستجابة التلقائية، أي ملاحظة العلامة قبل قراءة الحجة، هي عادة الشرطة الطويلة لدى chatgpt في صورة مصغرة، ومن الجدير فهمها على نحو صحيح قبل تقرير ما الذي تثبته فعليًا.

الشرطة الطويلة هي الشرطة الممتدة، وهي أطول من الشرطة القصيرة وأطول من الشرطة المستخدمة في نطاق الأعداد، ويضعها الكاتب في منتصف الجملة لتؤدي وظيفة فاصلة أو نقطتين أو نقطة. يستخدم ChatGPT هذه العلامة أكثر مما تفعل النثرية المحررة في الغالب، مع أن مقدار الزيادة بالضبط يعتمد على أي نسخة من النموذج أنتجت الفقرة أمامك. يقتصر هذا النص على تلك العلامة وحدها: ما الذي يسبب هذه العادة، وما الوظيفة التي تؤديها فعليًا عندما تظهر، وما الذي يستبدله بها محرر بشري بدلًا منها.

ما الذي يسبب عادة الشرطة الطويلة لدى ChatGPT؟

لم ينشر أحد في OpenAI تفسيرًا تقنيًا، لكن كثيرًا مما نعرفه يعود إلى تحقيق مستقل، من دون حاجة إلى تدوينة من الشركة. ومن الأمثلة الجيدة على ذلك تحليل معمق كتبه مهندس البرمجيات Sean Goedecke في أكتوبر 2025. وبدلًا من التخمين، اختبر هو النظريات السهلة بنفسه. جرّب نموذجًا كان يوفر الرموز باستخدام علامة واحدة بدلًا من فاصلة. لكن الفاصلة قصيرة بالقدر نفسه تمامًا. كما جرّب تفضيلًا لهجيًا التقطه من العاملين في التغذية الراجعة البشرية، وفحص عينة كبيرة من نصوص الإنجليزية النيجيرية، وهي لهجة ترتبط عادةً بتلك القوة العاملة. وفي الواقع، ظهرت هذه العلامة هناك أقل مما ظهرت في الإنجليزية الحديثة العادية، لا أكثر.

تشير النظرية التي أبقى عليها اختبار Goedecke نفسه إلى حدوث تغير في بيانات التدريب بين إصدارات النموذج. فقد وجد أن هذه العادة كانت بالكاد موجودة في مخرجات GPT-3.5، ثم أصبحت أكثر تكرارًا بنحو 10 مرات بعد طرح GPT-4o، وهو ما يشير إلى ما تغير في مجموعة التدريب لا إلى بنية النموذج نفسها. وأفضل تقدير لديه هو الكتب المرقمنة من أواخر 1800s وأوائل 1900s، وهي فترة كان فيها هذا الرمز مرتفعًا على نحو غير معتاد في الإنجليزية المطبوعة، أي أعلى بكثير من موضعه في الكتابة المعاصرة. ولا يستطيع أحد خارج المختبرات التي دربت هذه النماذج تأكيد ذلك. إنها النظرية الأكثر اختبارًا بعناية المتاحة، لا حقيقة محسومة.

ويشير خط بحث منفصل نُشر في March 2026 إلى سبب ذي صلة يستحق التسمية: مقدار ما كان من نص تدريب النموذج منسقًا بصيغة markdown بدلًا من النثر العادي، على أساس أن التعرض الكثيف لذلك الأسلوب التنسيقي يترك بصمته الخاصة على اختيارات علامات الترقيم عمومًا. والخلاصة الصادقة هي أن عدة تفسيرات ممكنة، وأن أحدها خضع لاختبار معقول، وأن أيا منها لم يؤكده الطرف الوحيد القادر فعلا على تأكيده.

ما الوظيفة التي يؤديها الرمز في الجملة؟

قبل اختيار بديل، من المفيد تسمية الوظيفة التي يؤديها الرمز، لأن الفاصلة، والنقطتان، والنقطة ليست قابلة للتبادل، وكذلك بدائلها ذات الشرطتين الطويلتين. وتغطي أربع وظائف تقريبًا كل حالة قد يواجهها القارئ.

ما الذي تفعله العلامةما يستخدمه الكاتب البشري بدلًا منهامثال
فصل تعليق جانبي داخل جملةزوج من الفواصل، أو أقواسالنتيجة، التي أُعيدت مرتين، ظلت قائمة تحت كلا الشرطين.
الإشارة إلى انتقال مفاجئ أو انقطاع حادنقطة وجملة جديدةظلت النتيجة قائمة تحت كلا الشرطين. لكنها لم تصمد أمام ثالث.
ربط عبارتين مستقلتين وثيقتي الصلةنقطة، أو فاصلة منقوطة حيث تكون الصلة مهمةكانت العينة صغيرة. ولم يكن حجم الأثر كذلك.
إدخال قائمة أو خلاصة أو تفسيرنقطتانأشارت النتيجة إلى اتجاه واحد: فشلت إعادة الإنتاج.

كانت كل واحدة من تلك الجمل جملة كان يمكن أن تستخدم العلامة ولم تفعل. هذه القطعة نفسها حجة على أن العلامة دليل آلي، وهي تقدم تلك الحجة عبر عدم استخدام الحرف الذي تصفه مطلقًا، لا مرة واحدة، في أي جملة أعلاه أو أدناه.

أضف الطابع البشري إلى بحثك الخاص

حوّل نصك المدعوم بالذكاء الاصطناعي واجعله يبدو بشريًا، من دون المساس بالكلمات المهمة أو الاستشهادات.

ابدأ مجانًا

هل تكون عادة الشرطة الطويلة لدى كل روبوت محادثة هي نفسها؟

لا، والفجوة بين الأنظمة كبيرة. وقد وجد اختبار للنص نفسه عبر ستة روبوتات محادثة في منتصف 2025، أُشير إليه في الدليل الأوسع لـ TextPulse حول أنماط الكتابة بالذكاء الاصطناعي، أن ثلاثة أنظمة كانت تنتج العلامة مرة تقريبًا كل 70 كلمة، وأن نظامًا واحدًا كان ينتجها مرة تقريبًا كل 470 كلمة، بينما لم ينتجها نظامان آخران إطلاقًا في العينة. إن التواتر خاصية للنظام والإصدار اللذين ولّدا الفقرة أمامك، وليس سمة ثابتة لكتابة الذكاء الاصطناعي عمومًا.

أصدرت OpenAI إصلاحًا جزئيًا في نوفمبر 2025: إعدادًا للتعليمات المخصصة، وعندما يفعّله المستخدم، يخبر النموذج بالتوقف. وأعلن Sam Altman ذلك بنفسه، وقدم الأمر بوصفه أخيرًا استجابةً لشكوى قائمة منذ مدة طويلة. هذا الإعداد اختياري، وليس افتراضيًا، لذلك لم يمس قدرًا هائلًا من مخرجات ChatGPT اليومية، وتستمر العادة حيث لم يكلف أحد نفسه عناء تبديل المفتاح.

إن سمعة هذه العلامة بوصفها دليلا على الذكاء الاصطناعي حديثة نسبيا ومبالغ فيها إلى حد ما. وقد بدأ رد الفعل العكسي نحو فبراير 2025، وفقا للتعليقات التي تتبعت ذلك. وأشارت مادة شائعة عن هذا الاتجاه إلى أنه لم تكن هناك قط أدلة قوية على أن روبوتات الدردشة تستخدم هذه العلامة أكثر مما كان يفعله الكتاب البشريون الحذرون بالفعل. ويمكن أن يجتمع الأمران معا, فهذه العادة حقيقية وقابلة للقياس في الناتج الخام، لكن ثقة الإنترنت في اكتشافها من جملة واحدة تسبق الأدلة الفعلية بكثير.

كيفية فحص مسودتك الخاصة بحثا عن هذه العادة

اقرأ فقرة بصوت عال وضع علامة عند كل موضع يظهر فيه شرطة طويلة. إن ظهورها مرة واحدة في صفحة هو خيار أسلوبي، من النوع الذي استخدمه الكتاب البشريون قرونا. أما ظهورها عدة مرات في فقرة واحدة، ولا سيما إذا كانت تؤدي وظائف مختلفة عن تلك الواردة في الجدول أعلاه، فيستحق نظرة ثانية. وهذه الكثافة غير مألوفة خارج ناتج الذكاء الاصطناعي وخارج عدد قليل من أصحاب الأساليب النثرية الذين يكثرون عمدا من استخدام الشرطة.

يتحقق مزيل الشرطة الطويلة المجاني من TextPulse من هذه الكثافة تلقائيا ويقترح الفاصلة أو النقطتين أو النقطة أو إعادة الصياغة التي تتطلبها كل حالة، وهو أسرع من العد اليدوي عبر مستند طويل. وتغطي مجموعة الأدوات المجانية نفسها المستويات الأخرى التي تميل الفقرة المصاغة آليا إلى الإشارة إليها دفعة واحدة، اختيار الكلمات، وإيقاع الجمل، والبنية، من أجل فحص يتجاوز علامات الترقيم وحدها.

تؤدي العبارات الحشو العمل نفسه على مستوى الجملة، وهناك قائمة بما يستحق الحذف أولا منها. كما أن إزالة هذه المفردات من مسودة سبق أن كتبتها تتبع نهجا مختلفا أيضا.

لم يتطلب أي من ذلك برمجيات خاصة للفحص، بل مجرد الانتباه والاستعداد لقراءة الجملة مرة أخرى. وقد اتخذ هذا المقال الخيار نفسه طوال صياغته: أن يلجأ إلى فاصلة أو نقطتين أو نقطة، وألا يلجأ مرة واحدة إلى العلامة التي أمضى ألفا وخمسمائة كلمة في وصفها.

XLinkedInFacebook

الأسئلة الشائعة

تنشأ عادة الشرطة الطويلة لدى ChatGPT في الغالب من التغير الذي طرأ على بيانات التدريب بين إصدارات النموذج، لا من خيار تصميمي مقصود. وقد وجدت اختبارات مستقلة أن هذه العلامة أكثر شيوعًا بكثير في مخرجات GPT-4o منها في GPT-3.5، وتشير النظرية الأرجح إلى التعرض الكثيف لكتب مطبوعة أقدم من فترة كانت فيها هذه العلامة شائعة على نحو غير معتاد. ولم تنشر OpenAI تفسيرها الخاص، لذا تبقى هذه أفضل نظرية مدعومة بالأدلة، لا حقيقة مؤكدة.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.