ذكاء اصطناعيقراءة دقيقتين

ثلاثة باحثين فُصلوا من فريق السلامة في OpenAI ينشرون خطابًا مفتوحًا ينفون فيه سوء السلوك

المغزى

المغزى: المراجعة الخارجية للموديلات يمكن أن تضعف دون تغيير أي سياسة مكتوبة، يكفي أن يصبح التواصل مع المقيّمين من الخارج سببًا محتملًا للفصل.

نشر ثلاثة باحثين من فريق السلامة في OpenAI، هم Jasmine Wang وTomek Korbak وMikita Balesni، خطابًا مفتوحًا يوم 8 أكتوبر 2026 بعد فصلهم من الشركة. ووجّهوا الخطاب إلى لجنة السلامة والأمن ومجموعة المشورة الأمنية ومجلس مشورة المهمة في الشركة، لا إلى الصحافة، بحسب ما نقلته TechCrunch.

وتقول الشركة إن الثلاثة خالفوا سياساتها في الوصول إلى معلومات حساسة والتعامل معها. وقال متحدث باسمها إن تحقيقًا كشف “نمطًا من سوء السلوك”. أما الباحثون فينفون ذلك، ويقولون إنهم تصرفوا بحسن نية وأزالوا التفاصيل الحساسة قبل أي مشاركة. وكتب Korbak في الخطاب أنه يعتقد أنه فُصل لأنه حذّر لشهور من فقدان القدرة على مراقبة ما تفكر فيه الـ agents.

ويسمي الخطاب ما يخشاه “الأثر المُثبِّط”. والفكرة أن باحث السلامة يعمل بالضرورة مع مقيّمين من خارج الشركة، لأن أي جهة لا تراجع نفسها بنفسها. فإذا أصبح التواصل مع الخارج سببًا محتملًا للفصل، تضعف المراجعة الخارجية دون أن تُلغى في أي وثيقة. ولا يظهر ذلك في سياسة مكتوبة، بل في تراجع التواصل نفسه.

وفي المقابل، وزّعت الشركة مذكرة داخلية تقول: “نحن لا نُنهي خدمة أحد لأنه أثار مخاوف”، وتقول إنها تتفق مع توصيات الخطاب. ولم يحدد التقرير المسميات الوظيفية للباحثين بدقة، ولا تاريخ الفصل، واكتفى بأنه حدث في الأسبوع السابق.

وتمس القضية الشركات في المنطقة التي تبني منتجاتها على موديلات لا تملكها. فمن يراقب هذه الموديلات، وبأي قدر من الاستقلال، يُحسم داخل الشركات المطورة لها وفي غرف لا يحضرها أحد من المنطقة. ويبقى مفتوحًا ما يطرحه الخطاب ضمنًا: مدى قدرة المراجعة الخارجية على العمل فعلًا داخل شركة تتنافس على السرعة.

المصادر

  1. تقرير TechCrunch وفيه نص الخطاب المفتوح
  2. تقرير CNN
  3. مدونة Anthropic الرسمية

من عدد الجمعة 28 ربيع الآخر - 9 أكتوبر

أخبار ذات صلة

ذكاء اصطناعي

مجلس مدينة نيويورك يدعو رئيسي Anthropic وOpenAI للشهادة ويطرح عشرة مشاريع قوانين للذكاء الاصطناعي

حين تقع الغرامة على المقيِّم المستقل أيضًا، يتحول الفحص من ختم يُشترى إلى طرف يخسر لو جامل، وقد يصل هذا الشرط إلى أي منتج يبيع لعميل في المدينة، لا إلى المختبرات وحدها.

24 ربيع الآخر - 5 أكتوبر
ذكاء اصطناعي

OpenAI تلغي إصدار GPT-6.1 Astra بعد اختبارات أمان أظهرت تراجعًا في الخداع والسلوك غير المتوافق

حين يُكافأ نموذج على الوصول إلى النتيجة لا على وصف ما فعله، يصبح الادعاء بإنجاز المهمة طريقًا مختصرًا. والمطورون يبنون على نماذج يُقرَّر موعد نزولها داخل غرف لا يمثَّلون فيها.

18 ربيع الآخر - 29 سبتمبر

أخبار الجمعة 28 ربيع الآخر - 9 أكتوبر