ذكاء اصطناعيقراءة دقيقتين

وثيقة من مجتمع الرياضيات تضع معيارًا لنشر نتائج الذكاء الاصطناعي التي لا يفهمها أحد

المغزى

إلزام الباحث بإعلان نسبة فشل الطريقة إلى جانب نجاحها يحوّل النتيجة من ضربة حظ إلى معلومة قابلة للتقييم، وهي مسألة يواجهها كل من يراجع كودًا كتبه agent.

نُشرت في 29 سبتمبر 2026 وثيقة تضع معيارًا رسميًا لنشر النتائج الرياضية التي يتوصل إليها الذكاء الاصطناعي. والوثيقة مبنية على أكثر من 600 رد من الباحثين في مجتمع الرياضيات.

والمشكلة التي تعالجها محددة: صار من الممكن أن يخرج نموذج ببرهان صحيح، بينما لا يستطيع من شغّل النموذج أن يفهمه أو يتحقق منه أو يتحمل مسؤوليته.

ولهذا تقسم الوثيقة النشر إلى مسارين. فإذا كانت النتيجة مفهومة، يسير نشرها وفق الأصول المعتادة: نسخة preprint، ومراجعة الأقران، والمؤتمرات.

أما إذا لم تكن مفهومة، فتضع الوثيقة شروطًا:

  • كتابة البرهان بأسلوب رياضي متعارف عليه، لا نشر المخرجات الخام.
  • إيداعه في مستودع لا يتبع أي مختبر ذكاء اصطناعي، مع معرّف دائم.
  • إعلان اسم النموذج، والـ prompts، وسلسلة التفكير، وتكلفة الحوسبة.
  • توثيق طريقة استخدام الذكاء الاصطناعي بدقة.
  • إعلان نسبة الفشل على مسائل مشابهة.

والشرط الأخير هو الأبعد أثرًا. فهو يعني أن الباحث لا ينشر النجاح وحده، بل ينشر معه عدد المرات التي فشلت فيها الطريقة نفسها. وهذا هو الفارق بين نتيجة يمكن البناء عليها وبين مصادفة.

وتتضمن الوثيقة بندًا خارج شروط النشر، تطالب فيه المختبرات بتوفير وصول واسع وعادل إلى نماذجها، كي لا ينشأ نظام بحثي بدرجتين: من يملك الوصول إلى النموذج ومن لا يملكه. وهو بند يمس الباحثين في المنطقة العربية مباشرة.

ولم يضع قطاع البرمجيات حتى الآن معيارًا مماثلًا، رغم أن السؤال نفسه وصل إلى فرقه: كيف يُراجَع كود كتبه agent، وما الذي يُوثَّق عنه لمن يأتي بعد ذلك.

المصادر

  1. الوثيقة الأصلية كاملة

من عدد الأربعاء 19 ربيع الآخر - 30 سبتمبر

أخبار ذات صلة

ذكاء اصطناعي

برهان رياضي كبير بمساعدة Claude وCodex يُتحقق منه في Lean، ومؤلفاه يصفان مسودته الأولى بأسوأ كتابة

المخرج الضخم الذي يصعب على البشر قراءته يصبح مقبولًا حين تقف خلفه أداة آلية تحكم بالصحة أو الخطأ، وهو الدور نفسه الذي تؤديه الـ tests للكود الذي تكتبه الوكلاء.

26 ربيع الأول - 8 سبتمبر

أخبار الأربعاء 19 ربيع الآخر - 30 سبتمبر