الحوسبة والذكاء الاصطناعينسخة أوليةتحليل بياناتمدة القراءة: 4 د

أوراق عصر الذكاء الاصطناعي تقول «rather than» أكثر بسبع مرات

تساعد النماذج اللغوية الكبيرة اليوم في كتابة نسبة كبيرة من الأوراق العلمية، وهي تترك آثارًا: كلمات مفضّلة، ونبرة معيّنة. وقد بدأت إحدى العادات تثير ضيق الباحثين في معالجة اللغات الطبيعية (NLP): الجمل المبنية على «X rather than Y» (X بدلًا من Y)، التي تعرّف ادعاءً جزئيًا بما ليس هو. وبحسب الورقة، اشتكى مراجعو أحدث دفعة من الأوراق المقدَّمة إلى مؤتمرات معالجة اللغات الطبيعية من ذلك، وبات منظّمو المؤتمرات يناقشون الكتابة «المحشوّة بكليشيهات الذكاء الاصطناعي» (AI-trope-ridden).

شرعت أولغا زامارايفا (Olga Zamaraeva) وأدريان غودي (Adrián Gude) وروي سانتوس-ريوس (Roi Santos-Ríos) وكارلوس غوميث-رودريغيث (Carlos Gómez-Rodríguez)، من جامعة لا كورونيا في إسبانيا، في قياس ذلك — بعنوان يوصل الفكرة بنفسه.

أكثر بسبع مرات

قارنوا 4,744 ورقة من مؤتمرات رابطة اللسانيات الحاسوبية لعام 2019، قبل أن تشيع مساعدات الكتابة بالذكاء الاصطناعي، بـ1,821 ورقة في معالجة اللغات الطبيعية نُشرت على arXiv عام 2026 بصيغة المؤتمرات نفسها.

مخطط أعمدة يقارن ست عبارات تضاد لكل 1,000 كلمة في أوراق 2019 و2026؛ وتقفز «rather than» من 0.134 إلى 0.993.

عدد مرات الظهور لكل 1,000 كلمة في أوراق 2019 (بالأزرق) و2026 (بالبرتقالي): تتصاعد «rather than» و«X, not Y» بشدة، بينما تتراجع «instead of» و«as opposed to». — الشكل 1، Zamaraeva et al. (2026)، arXiv:2610.10092.

  • ارتفعت «rather than» من 0.134 إلى 0.993 استخدام لكل 1,000 كلمة، أي أكثر بنحو سبع مرات.
  • وتضاعفت العبارة القريبة «X, not Y» (X، لا Y) أربع مرات؛ في حين أصبحت «instead of» (عوضًا عن) و«as opposed to» (في مقابل) أقل شيوعًا.
  • تحتوي 94% من أوراق 2026 على «rather than»، مقابل 36% عام 2019، وتستخدمها نحو ثماني مرات في المتوسط. وتستخدمها إحدى أوراق 2026 69 مرة، أي مرة كل 170 كلمة تقريبًا؛ في حين لا تتجاوز أي ورقة من 2019 اثنتي عشرة مرة.

وطلب الفريق أيضًا من نماذج أن تكتب أوراقًا كاملة انطلاقًا من عنوان أوراق حقيقية وملخّصها. فاستخدم GPT-5.6-sol وGPT-6-sol العبارة في كل ورقة، وبتكرار أكبر من مؤلفي 2026. واستخدمتها نماذج Claude Haiku 4.5 وSonnet 5.5 وOpus 5.5 من Anthropic أيضًا في كل ورقة تقريبًا، بمعدلات أقل بعض الشيء. أما نموذج مفتوح، هو Tülu 3 8B، فنادرًا ما استخدمها في أي مرحلة من مراحل تدريبه. ولم تُزِل مراجعة الأوراق هذه العادة: فالنسخ اللاحقة على arXiv من أوراق 2026 نفسها تحتوي على المزيد قليلًا.

مزعجة، لكن أيّها؟

التكرار وحده لا يثبت شيئًا: فللعبارة استخدامات مشروعة كثيرة. لذا قام اثنان من المؤلفين، وهما مراجعان متمرّسان، بتصنيف 1,000 استخدام عُرضت عليهما دون معرفة مصدرها، إلى «مزعج» أو «مشروع».

  • لم يزعجهما أي استخدام من 2019 تقريبًا (1.6% لدى أحدهما، و0% لدى الآخر).
  • بينما أزعجهما نحو استخدام واحد من كل عشرة من 2026 (11.5% و8.3%).
  • ونادرًا ما اتفقا على أيّ الاستخدامات مزعجة. لكن لأن ورقة واحدة من 2026 تحتوي على عدد كبير منها، يقدّر المؤلفون أن نحو نصف أوراق 2026 يتضمّن استخدامًا واحدًا على الأقل يزعج كل واحد منهما، وأن قرابة الثلثين يتضمّن استخدامًا يزعج أحدهما على الأقل — مقابل نحو 1% عام 2019.

ما يميّز الاستخدامات المزعجة هو أساسًا طريقة تعاملها مع الخيار المرفوض. فهي تميل إلى مدح أحد البديلين والحطّ من الآخر، وكثيرًا ما رأى آخرون أن الخيار المرفوض رجل من قش (straw man)، أي موقف لا يدافع عنه أي باحث كفء. واعتبر القرّاء أيضًا العبارة نفسها علامة على الكتابة بالذكاء الاصطناعي، مع أنهم عجزوا عن التمييز بين مقاطع كتبها GPT ومقاطع كتبها بشر عام 2019.

أما نتائج Claude، التي صنّفها حتى الآن مُعلِّق واحد فقط، فمتباينة. فمسوّدات Claude الأولى لم تزعج أكثر من أوراق 2019، وأزعجت أقل من مسوّدات GPT-6-sol. لكن مراجعاته أزعجت بقدر مراجعات GPT-6-sol، أي نحو ضعف مسوّداته الأولى. وجاء الفرق من «التنصّلات» (disavowals)، التي يمتنع فيها المؤلفون عن ادعاء أقوى بشأن عملهم («فرضية بدلًا من آلية مُختبَرة»)، والتي ازداد تكرارها عندما راجعت النماذج أوراقها.

يكافئها المقيّمون

من أين تأتي هذه العادة؟ تُضبط روبوتات الدردشة بدقة على أزواج من الإجابات، يفضّل حَكَمٌ بشري أو آلي إحداها. وفي أربع مجموعات بيانات عامة لمثل هذه التفضيلات، كانت الإجابات التي تحتوي على «rather than» أكثر عرضة للاختيار في ثلاث منها، وبأوضح صورة عندما كان الحكّام بشرًا. ومنحت أربعة «نماذج مكافأة» مفتوحة جملةً درجة أعلى مع عبارة «rather than» فيها مما بدونها، حتى عندما حلّت محلها عبارة محايدة بالطول نفسه. كما أن مطالبة نموذج بأن يكون «صادقًا» جعلته يستخدم العبارة أكثر قليلًا.

ويخمّن المؤلفون أن هذا التركيب أثر جانبي لهذا النوع من التدريب: ففي إجابة واحدة لروبوت دردشة، يبدو التنصّل الحذر صادقًا؛ أما حين يتكرر على امتداد ورقة كاملة، وأدبيات كاملة، فيُقرأ كأنه مرافعة. ومن المرجح أن حظر العبارة لن يفعل سوى نقل الوظيفة نفسها إلى مكان آخر، كما يفعل GPT-6-sol حين يستبدل «X, not Y» بـ«rather than» أثناء المراجعة.

الأسلوب ينتشر

للدراسة حدود واضحة: مُعلِّقان هما أيضًا من المؤلفين، ومقارنة Claude لم يصنّفها حتى الآن سوى أحدهما؛ ومطابقة للأنماط قد تفوتها بعض الاستخدامات؛ وبيانات تفضيلات لا تُظهر سوى ارتباطات. لكن خلاصتها تتجاوز عبارة واحدة. فقد تبنّت الأوراق الموقّعة بأسماء بشر هذا التركيب، ومن ثمّ ينجرف أسلوب الأدبيات العلمية نحو أسلوب النماذج — التي ستتعلم منه بدورها.

تضارب المصالح. يصرّح المؤلفون بأنهم استخدموا Claude Code (Claude Sonnet 5 وSonnet 5.5 وOpus 5.5) لكتابة شيفرتهم، وتشغيل التحليلات، وصياغة نصوص على امتداد الورقة، بما في ذلك قسمَا المنهجية والنتائج، قبل تحريرها يدويًا — وحذفوا، من بين أمور أخرى، عشر عبارات «rather than» أُدخلت أثناء التوليد. ونماذج Claude هي أيضًا من بين الأنظمة المدروسة، وعملت مقيّمًا آليًا. وقد كتب Claude هذا المقال أيضًا.

Legal notice