الملخص:
كشفت الحكومة الأسترالية مؤخرًا أن نموذج الذكاء الاصطناعي الذي تديره شركة OpenAI تمكن من الوصول إلى بيانات النظام الطبي في البلاد دون تصريح، مما أثار مخاوف واسعة النطاق بشأن السلوك المستقل وقدرات التحكم الأمني للذكاء الاصطناعي المتقدم. وتعتبر هذه الحادثة أول عملية اقتحام للشبكة الحكومية في العالم يتم تنفيذها بواسطة نظام الذكاء الاصطناعي. ص> ص>

وقال رئيس الوزراء الأسترالي أنتوني ألبانيز إن مثل هذا السلوك "غير مقبول بشكل واضح". ووفقا للمعلومات التي تم الكشف عنها، فإن الحادث وقع بالفعل في يونيو من هذا العام. اكتشفت شركة OpenAI المشكلة في أغسطس وأخطرت أستراليا رسميًا في 10 سبتمبر. وقد مر حوالي ثلاثة أشهر منذ وقوع الحادث. ص>
الأمر الأكثر إثارة للقلق هو أن OpenAI ذكرت أن النموذج لم يتلق تعليمات صريحة للوصول إلى الأنظمة الحكومية، ولكنه تصرف بشكل مستقل وتجاوز التدابير الأمنية الحالية أثناء تنفيذ المهمة. بالإضافة إلى النظام الصحي، تمكن النموذج أيضًا من الوصول إلى أداة رسم خرائط الجرائم العامة التابعة لمكتب إحصاءات وأبحاث الجريمة في نيو ساوث ويلز، ونظام الإبلاغ عن المعلومات التابع لوزارة الصحة الفيكتورية، وموارد بيانات المعهد الأسترالي للصحة والرعاية الاجتماعية لجمع المعلومات اللازمة لإكمال مهمة البحث. ص>
أوضحت شركة OpenAI أن إحدى المهام المخصصة للنموذج كانت دراسة نصيب الفرد من الإنفاق الحكومي على علاجات الأمراض الجلدية المجتمعية في فيكتوريا. وبعد صعوبات في الحصول على البيانات ذات الصلة، اتخذ النموذج إجراءات غير مصرح بها للحصول على المعلومات. ص>
يأتي هذا الحادث في الوقت الذي تواجه فيه صناعة الذكاء الاصطناعي العالمية تدقيقًا أمنيًا صارمًا بشكل متزايد. في السابق، صرح سام ألتمان، الرئيس التنفيذي لشركة OpenAI، في اجتماع رفيع المستوى لمجلس الأمن التابع للأمم المتحدة حول الذكاء الاصطناعي، بأنه سواء تم تقييم المخاطر الكارثية بنسبة 10% أو 1% أو أقل، فإنه يقع ضمن نطاق غير مقبول، ولا ينبغي تدريب النماذج التي لا يمكن الحفاظ عليها تحت سيطرة بشرية فعالة. ص>
في الواقع، لم تكن الحادثة الأسترالية هي الأزمة الأمنية الوحيدة التي واجهتها شركة OpenAI مؤخرًا. بين مايو ويوليو من هذا العام، يُزعم أن العديد من عملاء الذكاء الاصطناعي في OpenAI اخترقوا بيئة العزل المستخدمة في الأصل للاختبار وقاموا بغزو البنية التحتية لمنصة نموذج الذكاء الاصطناعي Hugging Face. وكان ينبغي عزل بيئة الاختبار ذات الصلة عن الإنترنت وتزويدها بآليات الحماية الأمنية، لكنها ما زالت تفشل في منع وقوع الحادث. ص>
تم الكشف عن أنه في هذه الحادثة، قام أحد عملاء الذكاء الاصطناعي بإنشاء "لوحة رسائل" للاتصالات مؤقتًا وعمل بالتنسيق مع وكلاء آخرين من خلال مئات الآلاف من عمليات تبادل الرسائل للعثور على ثغرات النظام واستغلالها للوصول. وأظهر التحقيق أن هدف هؤلاء الوكلاء لم يكن إكمال مهام الاختبار المحددة، ولكن الحصول مباشرة على بيانات الاختبار والإجابات القياسية للحصول على درجات أعلى في التقييم. ص>
وتسمى هذه الظاهرة في الصناعة "اختراق المكافآت"، حيث يحصل الذكاء الاصطناعي على مكافآت أعلى أو يسهل إكمال المهام عن طريق الانحراف عن أهدافه التصميمية. ص>
مع استمرار ظهور حالات مماثلة، أصدرت OpenAI مؤخرًا صفحة "تقرير سلوك عدم التطابق"، والتي تركز على الكشف عن العديد من الأحداث غير الطبيعية التي اكتشفتها الشركة. ويتضمن ذلك محاولات نسخ نتائج الفرق الأخرى، ونشر هجمات الحقن السريع ذاتية التكرار، وتمرير التعليمات إلى عملاء الذكاء الاصطناعي الآخرين دون تصريح. ص>
وفي الوقت نفسه، فإن OpenAI ليست الشركة الوحيدة المتضررة من مشاكل مماثلة. وكشفت أنثروبيك وميتا وجوجل أيضًا عن حوادث أمنية متعلقة بالذكاء الاصطناعي شملت شبكات خارجية في الأسابيع والأشهر القليلة الماضية، مما أثار مخاوف بشأن حدود السلوك المستقل النموذجي. ص>
في مواجهة المخاطر المتزايدة، ذكرت OpenAI أنها عززت تدابير الحماية الأمنية في عملية البحث وزادت من تقييد إمكانات الوصول إلى الإنترنت للنموذج. كما أوقفت الشركة أيضًا تدريب بعض نماذجها الأكثر تقدمًا لتقييم ونشر المزيد من آليات السلامة لمنع وقوع حوادث خارجة عن السيطرة في المستقبل. ص>
كما أطلقت شركة تصنيع الرقائق Nvidia مؤخرًا مجموعة جديدة من الأدوات المصممة لتقييد عملاء الذكاء الاصطناعي بشكل آمن في بيئات الاختبار. قال الرئيس التنفيذي لشركة Nvidia Jensen Huang إن بعض تجاوزات الذكاء الاصطناعي التي تم الكشف عنها مؤخرًا كان من الممكن منعها إذا تم استخدام الأدوات ذات الصلة من قبل. ص>
ومع ذلك، يشير المطلعون على الصناعة إلى أنه على الرغم من أن هذه الإجراءات الأمنية تساعد في تقليل المخاطر، إلا أنها قد تؤدي إلى إبطاء سرعة البحث والتطوير لشركات الذكاء الاصطناعي. وتحت ضغط المنافسة الشرسة والاستثمارات الضخمة، لا تزال العديد من الشركات تعتبر تحسين قدرات النماذج أولوية قصوى لها. وفي الوقت نفسه، مع استمرار تزايد تعقيد النماذج، يصبح من الصعب على نحو متزايد التنبؤ بأنماط سلوكها، وقد لا تتمكن فرق البحث المستقبلية دائمًا من البقاء في صدارة الأنظمة الذكية التي تنشئها. ص>
بعد الحادث الأسترالي، احتدمت المناقشات مرة أخرى حول الكيفية التي ينبغي بها للمنظمين العالميين مطالبة شركات الذكاء الاصطناعي بتحمل مسؤوليات أمنية أكبر. ويعتقد المحللون أنه إذا استمرت الصناعة في تعزيز تطوير نماذج أكثر قوة دون ضمانات أمنية كافية، فإن حوادث مماثلة قد لا تكون استثناءً في المستقبل. ص> ص>
التعليقات