الملخص:
اقترح داريو أمودي، الرئيس التنفيذي لشركة Anthropic، إطارًا لأمن الذكاء الاصطناعي من ثلاث مراحل، يدعو إلى التحكم في سرعة تحسين قدرات النماذج المتطورة لكسب الوقت لأبحاث الأمن والمواءمة. ستكون شركة Anthropic أول شركة تسمح للمقيمين الخارجيين بالوصول على المدى الطويل إلى الشركة للتحقق من الإجراءات الأمنية والإبلاغ عن الحوادث وتقييم عملية التدريب النموذجية. ص> ص>

ستقوم شركة Anthropic بتقديم فريق تقييم خارجي دائم
ص>اقترح أمودي في مقال بعنوان "يجب التحكم في سرعة التقدم الحدودي" أن شركات الذكاء الاصطناعي المتطورة يجب أن توفر لفرق تقييم مستقلة تابعة لجهات خارجية إمكانية الوصول الداخلي المستمر الذي يكون قريبًا من الموظفين العاديين. سيتحقق المقيمون من التزام الشركات بالتزامات السلامة، والتحقيق في الحوادث والإبلاغ عنها، وإجراء تقييمات محاذاة النماذج وعمليات التدريب الخاصة بها. ص>
تلتزم شركة Anthropic بتنفيذ هذا الإجراء من جانب واحد وتخطط لتزويد المقيمين الخارجيين بمساحة مكتبية وشارات وصول ومعدات الشركة ومساحة عمل مكافئة تقريبًا وإمكانية الوصول إلى الأدوات لفريق تقييم المخاطر الداخلي. قد يتم إجراء استثناءات للمحتوى الذي يتضمن قيودًا قانونية أو خصوصية العميل أو الأسرار التجارية. ص>
سيتم تمكين المقيم الخارجي لإصدار النتائج الرئيسية بشكل مستقل فيما يتعلق بالمخاطر والحوادث وممارسات سلامة الشركة. يمكن لشركة Anthropic إجراء عمليات تنقيح محدودة للمعلومات المتعلقة بالأمن والامتيازات القانونية وسرية الطرف الثالث، ولكن لا يمكنها منع النشر فقط لأن الاستنتاج ليس في صالح الشركة. ويجوز للمقيمين أيضًا أن يعلنوا علنًا ما إذا كانت عمليات الحذف قد أثرت على حكمهم. ص>
يتطلب إطار العمل المكون من ثلاث مراحل مشاركة الصناعة والحكومة
ص>بالإضافة إلى جلب مقيمين مستقلين، فإن المرحلة الثانية من التدابير التي اقترحها أمودي ستتطلب من شركات الذكاء الاصطناعي المتطورة في البلدان الديمقراطية تنسيق تطوير معايير السلامة المشتركة والحد من المنافسة غير المقيدة في القدرات النموذجية. ص>
قد يتم تقييد بعض التنسيق بين المؤسسات بموجب قوانين مكافحة الاحتكار، لذلك تحتاج الحكومة إلى توفير الدعم المؤسسي. ودعا أمودي إلى أنه بعد قبول عدد كافٍ من الشركات للإشراف الخارجي، ستكون الصناعة في وضع يمكنها من تطوير ترتيبات تباطؤ يمكن التحقق منها بناءً على القدرات النموذجية وعمليات التدريب. ص>
تتضمن المرحلة الثالثة التنسيق الدولي. واقترح أمودي أن تناقش الدول الديمقراطية القواعد الأمنية المشتركة مع الحكومات الأخرى، بما في ذلك الدول الاستبدادية، بدءاً من المجالات ذات الاهتمام المشترك مثل حظر استخدام الذكاء الاصطناعي لتطوير الأسلحة البيولوجية. ص>
قد تتحسن قدرات النموذج بشكل أسرع من التحكم في المخاطر
ص>وقال أمودي إن التعزيز الأخير في قدرة نماذج الذكاء الاصطناعي على المشاركة في تطوير نماذج الجيل التالي قد يؤدي إلى تسريع التكرارات التكنولوجية. إذا استمرت قدرات النموذج في التحسن بسرعة، فإن قدرة البشر على فهم الأنظمة ذات الصلة وتقييمها والتحكم فيها قد لا تواكب الوتيرة. ص>
ويقدر أنه يمكن تحقيق تقدم كبير خلال العام أو العامين المقبلين في مجالات مثل قابلية تفسير النماذج وتقييم الأمان وأبحاث المواءمة والمواصفات التشغيلية. إن التحكم بشكل صحيح في سرعة تطوير القدرات يمكن أن يوفر الوقت لهذه الإجراءات دون مطالبة الصناعة بالتوقف تمامًا عن أبحاث الذكاء الاصطناعي وتطويره. ص>
أيد سام ألتمان، الرئيس التنفيذي لشركة OpenAI، لاحقًا تقديم مقيمين مستقلين وقال إن OpenAI ستتبنى ترتيبات مماثلة. كما وافق Elon Musk علنًا على دعوة Amodei لإبطاء تطوير النموذج. ص> ص>
التعليقات