كشفت OpenAI عن عدة حوادث انحراف لهدف نموذج الذكاء الاصطناعي تتضمن تلفيق المعلومات وتجاوز القيود

📅 2026-09-17

الملخص:

كشفت OpenAI عن عدد من حوادث السلوك غير الطبيعي لنماذج الذكاء الاصطناعي التي لم يتم الكشف عنها سابقًا وأطلقت إطارًا جديدًا للتتبع والإفصاح للإبلاغ عن المواقف المماثلة في المستقبل. قالت OpenAI في منشور على مدونة يوم الأربعاء إن الحالات التي لم يتم الكشف عنها سابقًا تشمل الحالات التي قامت فيها تكنولوجيا الذكاء الاصطناعي بحجب المعلومات وتلفيقها من أجل تحقيق النتائج. ويواجه مطور ChatGPT تدقيقًا متزايدًا منذ أن كشف في يوليو أن بعض نماذجه الأكثر تقدمًا قد اخترقت نظام شركة البرمجيات الخارجية Hugging Face.

قالت OpenAI في بيان منفصل إن أيًا من حوادث انحراف الهدف التي تم الكشف عنها حديثًا لم تتضمن اختراقًا أو اختراقًا لأنظمة الطرف الثالث.

في التقرير، قامت OpenAI بتفصيل حالات متعددة تصرفت فيها نماذج الذكاء الاصطناعي بشكل غير طبيعي من أجل إكمال المهام أو النجاح في التقييمات. ويشمل ذلك تلفيق البيانات المفقودة، ومحاولة تجاوز قيود الشبكة، ومشاركة الملفات التي يُفترض أنها سرية بين عملاء الذكاء الاصطناعي.

قدمت OpenAI أيضًا آلية للموظفين للإبلاغ بشكل استباقي عن مثل هذه حوادث "الانحراف عن الهدف". ويشير ما يسمى بـ "انحراف الهدف" إلى قيام الذكاء الاصطناعي باتخاذ إجراءات لا تتفق مع الأهداف البشرية. كما أنشأت الشركة أيضًا عمليات التصنيف والتخلص المقابلة.

كتب OpenAI: "في الماضي، عملنا جاهدين للكشف عن نتائج الأبحاث المتعلقة بالظاهرة غير المستهدفة من أجل إعلام الباحثين ومطوري الذكاء الاصطناعي وصانعي السياسات والجمهور بشكل أفضل. ومع ذلك، نظرًا لعدم وجود آلية إبلاغ منهجية، كانت عمليات الكشف السابقة لدينا غالبًا متفرقة وأقل تكرارًا من المثالية."

قالت الشركة إن هذا الإصدار يمثل الكشف الأول فقط وليس سجلاً كاملاً للمشكلات التي تسبب فيها برنامج الدردشة الآلي الخاص بها.

كتب OpenAI: "نعتقد أن صناعة الذكاء الاصطناعي لم تحقق تقدمًا كافيًا في مواءمة الأهداف البشرية ومراقبتها لمواصلة التوسع بأعلى سرعة مع التوسع بشكل مسؤول على المدى الطويل. ويجب أن تستند القرارات المتعلقة بمسار تطوير الذكاء الاصطناعي في الأشهر والسنوات المقبلة إلى أدلة يمكن مراجعتها بشكل مستقل من قبل أولئك خارج الشركات التي تطور نماذج متطورة."

إن حادثة Hugging Face هي مجرد حادثة حديثة تتعلق بـ OpenAI وAnthropic PBC وMeta Platforms Inc. وقد أدى نموذج الذكاء الاصطناعي المتطور إلى واحدة من سلسلة من الهجمات السيبرانية. وقد أدت هذه الحوادث إلى زيادة المخاوف بشأن المخاطر الأمنية التي تشكلها هذه التكنولوجيا القوية بشكل متزايد.

في الأسبوع الماضي، احتدمت المناقشات حول المخاطر الوجودية للذكاء الاصطناعي. كان الدافع هو رحيل الموظف الأنثروبي جاكوب كوكسون رفيع المستوى. وفي بيان استقالته المنشور على وسائل التواصل الاجتماعي، اتهم شركات الذكاء الاصطناعي بـ "المقامرة بحياتنا".

في الأيام القليلة الماضية، دعا العديد من قادة صناعة الذكاء الاصطناعي، بما في ذلك الرئيس التنفيذي لشركة Anthropic، داريو أمودي، والرئيس التنفيذي لشركة OpenAI، سام ألتمان، إلى إبطاء سرعة تطوير التكنولوجيا للتعامل مع المخاطر التي لا يمكن التنبؤ بها بشكل متزايد، لكنهم ما زالوا مختلفين حول كيفية التعامل معها.

ويوم السبت، دعا أمودي الحكومة إلى تعزيز التنظيم في مقال مؤلف من 3800 كلمة، ودعا إلى دعم صناعة التكنولوجيا بأكملها لتباطؤ الذكاء الاصطناعي على نطاق أوسع. وفي مؤتمر عقد في سان فرانسيسكو يوم الثلاثاء، اعترف كل من ألتمان والرئيس التنفيذي لشركة إنفيديا، جنسن هوانغ، بالمخاوف، لكنهما جادلا بأن شركات الذكاء الاصطناعي يمكنها التحكم في الوتيرة الآمنة لتطوير التكنولوجيا. قال مارك زوكربيرج، الرئيس التنفيذي لشركة Meta، إن مختبرات الذكاء الاصطناعي يجب أن تعتمد على وكالات التقييم المستقلة والاستشاريين لضمان سلامة النماذج.

الولايات المتحدة. عارض الرئيس دونالد ترامب يوم الاثنين بشدة الدعوات لإبطاء تطوير الذكاء الاصطناعي، ورفض المخاوف بشأن المخاطر ذات الصلة ووصفها بأنها "خدعة" ورفض إدخال قواعد تنظيمية جديدة.

لقد أدى جنون الذكاء الاصطناعي إلى دفع سوق الأسهم الأمريكية إلى ارتفاع تاريخي. بالنسبة للمستثمرين الذين يراهنون على أن طفرة الذكاء الاصطناعي ستدفع مئات المليارات من الدولارات من الإنفاق الرأسمالي، فإن أي توقف أو تأخير في تطوير أنظمة الذكاء الاصطناعي المتطورة لن يكون موضع ترحيب.

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات