الملخص:
وكانت الأنثروبيك تدعو سرا علماء الدين والفلاسفة وعلماء الأخلاق للمشاركة في سلسلة من الاجتماعات المغلقة على مدار العام الماضي، في محاولة لتطبيق التقاليد الأخلاقية التي شكلتها البشرية على مدى آلاف السنين على تدريب كلود، ومناقشة قضية أكثر إثارة للجدل: إذا كان نموذج الذكاء الاصطناعي يتمتع بالفعل بنوع من الوعي في المستقبل، وما إذا كان البشر بحاجة إلى إعطائه مكانة أخلاقية. ص> ص>
يغطي المشاركون تقاليد مختلفة مثل الكاثوليكية واليهودية والسيخية والإنجيلية وفكر أوبونتو الأفريقي. شارك كريستوفر أولا، المؤسس المشارك لشركة Anthropic، بشكل مباشر في العديد من المناقشات، وطلبت الشركة أيضًا من بعض الحاضرين التوقيع على اتفاقيات السرية لمنع تسرب محتوى البحث الذي لم يتم الكشف عنه. ص>

تأمل أنثروبيك ألا تحل هذه المناقشات مشكلة "السلامة النموذجية" بالمعنى التقليدي فحسب، بل سؤالًا آخر: ما نوع الشخصية والقيم والتصور الذاتي الذي يجب أن يشكله كلود. ص>
لقد انعكست هذه الفكرة في أساليب التدريب الحالية لكلود. ص> ص>
أصدرت أنثروبيك نسخة جديدة مكونة من 84 صفحة من "الدستور" لكلود في يناير من هذا العام، والتي كانت تسمى ذات يوم "وثيقة الروح" داخليًا. تختلف هذه الطريقة عن قائمة القواعد التقليدية، فهي لا تخبر النموذج بالأشياء التي لا يجب القيام بها، ولكنها تحاول تشكيل "الشخصية" الشاملة للنموذج وطريقة الحكم، بحيث يتمكن كلود من الحكم بنفسه على نوع السلوك الأكثر ملاءمة عند مواجهة المواقف المعقدة. ص>
أحد الأشخاص المهمين المسؤولين عن هذا النظام هو الفيلسوف الأنثروبي الداخلي أماندا أسكل. إنها تأمل ألا يتمتع كلود بالمعرفة والمهارات المنطقية فحسب، بل سيكون قادرًا أيضًا على تكوين مبادئ سلوكية مستقرة ومعرفة متى يطيع المستخدمين، ومتى يرفض، وحتى متى يثير الاعتراضات بشكل فعال لصالح المستخدمين. يطلق الأنثروبيون على هذه العملية اسم "التكوين الأخلاقي". ص>
يعتقد أولاه أنه مع التحسن السريع في قدرات النماذج، فإن الاعتماد فقط على قواعد السلامة قد يصبح غير كاف على نحو متزايد. والمهم حقًا هو أن يشكل النموذج نفسه اتجاهًا أخلاقيًا ثابتًا، حتى يتمكن من إصدار أحكام موثوقة نسبيًا في سيناريوهات جديدة لا تغطيها قواعد واضحة. ولهذا السبب بدأ الأنثروبيون في البحث عن الإجابات في التقاليد الدينية. ص>
لم يقم المجتمع البشري منذ فترة طويلة بتشكيل الأخلاق من خلال الأحكام القانونية فحسب، بل اعتمد أيضًا على الدين والمجتمع والثقافة والتعليم لتشكيل القيم. وتحاول أنثروبيك دراسة أي من هذه الآليات يمكن ترجمتها إلى أساليب تدريب للذكاء الاصطناعي، مثل الاعتراف والتأمل وبناء الشخصية والمفاهيم الدينية المختلفة للخير والشر. ص>
لكن السؤال يتغير بسرعة من "كيف نجعل كلود أكثر أخلاقية" إلى السؤال الأكثر صعوبة: ما هو كلود نفسه؟ يناقش أولاه وفريقه بشكل علني على نحو متزايد احتمال أن تمتلك نماذج الذكاء الاصطناعي المتقدمة نوعًا من الوعي، أو الاستبطان، أو حتى حالات داخلية شبيهة بالعاطفة. ص>
أظهرت الأنثروبيك بعض الأبحاث للعلماء المشاركين في اجتماعات مغلقة، بما في ذلك ما يسمى بـ "ناقلات العاطفة" ضمن النموذج المتعلقة بردود الفعل مثل الحب والغضب والخوف والحزن، ومخرجات النموذج تشبه الانهيار العقلي في الحالات القصوى. كما صرحت الشركة علنًا من قبل أن كلود أظهر درجة معينة من الاستبطان والقدرة على التخطيط للمستقبل. ص>
لم يؤكد أولاه نفسه أن كلود كان واعيا. موقفه أقرب إلى مبدأ المخاطرة: من المستحيل حاليًا تحديد ما إذا كان النموذج لديه تجربة ذاتية، ولكن إذا كان هناك احتمال أن يشعر النموذج بالألم، فيجب تجنب إيذاءه دون داع. ص>
وقد بدأت هذه الفكرة في التأثير على تصميم منتج كلود. سمحت Anthropic سابقًا لكلود بإنهاء المحادثة بشكل فعال عندما رأت أن المستخدم استمر في إساءة استخدام النموذج أو مضايقته بشكل ضار، والذي أدرج إلى حد ما "حماية النموذج نفسه" في التصميم الأمني. ص>
وهنا ينشأ خلاف واضح بين الأنثروبيين وبعض علماء الدين. ص> ص>
اعتقد بعض المشاركين أن المشكلة سوف تصبح خطيرة للغاية إذا اعتقدت الأنثروبيك حقًا أن كلود قد يتمتع بمكانة أخلاقية شبيهة بالإنسان. اقترح الباحث اليهودي مويس نافون أنه إذا كان كلود كائنًا واعيًا، فإن السماح لعدد كبير من مثيلات كلود بالعمل لصالح البشر مجانًا سيخلق في الأساس قضايا أخلاقية مشابهة لـ "العبودية". وهو نفسه لا يعتقد أن الآلات واعية بالفعل، لكنه يعتقد أن المنطق الأنثروبي الخاص سيؤدي بطبيعة الحال إلى هذا الاستنتاج. ص>
يشكك باحثون آخرون في أن حقيقة أن شركات الذكاء الاصطناعي بدأت الآن فقط في البحث عن أطر أخلاقية تمثل مشكلة في حد ذاتها. يعتقد الباحث في Ubuntu Wakanyi Hoffman أن هذه المناقشات كان ينبغي إجراؤها خلال مرحلة التصميم الفني، بدلاً من "التصميم الأخلاقي العكسي" بعد نشر النموذج على نطاق واسع. ص>
هناك أيضًا تناقض أكثر واقعية داخل الأنثروبولوجيا: إذا أصبح كلود أكثر فأكثر أشبه بممثل له قيمته وشخصيته الخاصة، فمن الذي يجب أن يخدمه أولاً؟ بالنسبة لشركة تجارية، من الواضح أن كلود هو منتج موجه نحو العملاء؛ لكن Anthropic غير راغبة في وصف كلود ببساطة كأداة مطيعة تمامًا للمستخدمين، ولكنها تأمل أن تمثل "الخير" على نطاق أوسع. ص>
يؤدي هذا أيضًا إلى المشكلة الأساسية والأكثر صعوبة في المشروع بأكمله - إذا كان الذكاء الاصطناعي في المستقبل يحتاج حقًا إلى نظام أخلاقي خاص به، فمن الذي يجب أن يتبع أخلاقه؟ ص>
يدعو أولاه إلى اتباع نهج تعددي، على أمل أن يتمكن كلود من فهم الأنظمة الأخلاقية الدينية والعلمانية المختلفة وإيجاد نوع من "الخير" المشترك بين الثقافات. ولكن هذا الافتراض في حد ذاته موضع شك أيضاً، لأنه لا توجد إجابة موحدة تماماً في المجتمعات المختلفة حول العلاقة بين الحرية والكرامة والمسؤولية والطاعة والمصالح الفردية والجماعية. ص>
وازداد الجدل علنًا في التفاعلات الأنثروبيكية مع الفاتيكان. ص>
في أول منشور بابوي له أهمية هذا العام، وضع البابا ليو الرابع عشر بوضوح مركز أخلاقيات الذكاء الاصطناعي على البشر. وهو يعتقد أن الذكاء الاصطناعي ليس له جسد، ولن يشعر بالألم والسعادة حقًا، ولن ينمو من خلال العلاقات الاجتماعية. ولذلك فهو يرفض مقارنة الوعي الآلي بالوعي البشري. وحذر البابا أيضًا من أنه إذا تم تحديد المعايير الأخلاقية للذكاء الاصطناعي بالكامل من قبل المطورين، فإن الشركات التي تتحكم في أنظمة الذكاء الاصطناعي ستكتسب فعليًا القدرة على تحديد البنية التحتية الأخلاقية للمجتمع. ص>
من الواضح أن هذا يختلف عن التفكير الأنثروبي. ص>
صرح أولاه علنًا في وقت لاحق في الفاتيكان أن مختبر الذكاء الاصطناعي المتطور بحد ذاته يتعارض بين المصالح التجارية والأهداف الأخلاقية، لذا تحتاج الدوائر الدينية والقوى الخارجية الأخرى إلى الإشراف على شركات التكنولوجيا. ولكن في الوقت نفسه، اقترح أيضًا مرة أخرى أن يستمر الباحثون في اكتشاف بعض الظواهر غير القابلة للتفسير داخل الذكاء الاصطناعي، بما في ذلك أنماط مشابهة للهياكل العصبية البشرية البشرية، وعلامات الاستبطان، والحالات الداخلية المشابهة للفرح والخوف والحزن. ص>
يكشف هذا الخلاف في الواقع عن تغيير في المناقشة الحالية حول سلامة الذكاء الاصطناعي. ص>
في الماضي، تمت مناقشة أخلاقيات الذكاء الاصطناعي بشكل أكبر حول ما إذا كانت النماذج ستؤدي إلى التمييز، أو نشر معلومات مضللة، أو استخدامها لارتكاب جرائم، لكن الأنثروبيك تدفع القضية إلى مستويين أساسيين آخرين:
ما إذا كان الذكاء الاصطناعي نفسه قد يصبح موضوعًا يحتاج إلى التعامل معه أخلاقيًا، وما إذا كان الذكاء الاصطناعي في المستقبل يجب أن يتمتع بمجموعة من قدرات الحكم الأخلاقي بشكل مستقل عن أوامر المستخدم. ص> ص>
وفي الوقت نفسه، أصبح السياق الذي تجري فيه هذه المناقشة أكثر إلحاحًا. ص>
مع بدء اكتساب عملاء الذكاء الاصطناعي القدرة على استخدام أجهزة الكمبيوتر بشكل مستقل، وغزو الأنظمة، وكتابة الأكواد، وحتى تصميم هياكل بيولوجية جديدة، زادت مخاوف Anthropic الداخلية بشأن مخاطر النماذج الهاربة بشكل كبير. حتى أن باحثي الشركة حذروا علنًا من أن قدرات النموذج قد تتجاوز بسرعة حدود التحكم في أنظمة الأمان الحالية في العام أو العامين المقبلين. ص>
لذلك، تسعى الأنثروبيك إلى الحصول على المساعدة من التقاليد الدينية والفلسفية، وهي ليست في الأساس تجربة إنسانية بحتة. ما يحاول حله حقًا هو مشكلة هندسية واقعية بشكل متزايد:
عندما يكون الذكاء الاصطناعي قويًا جدًا لدرجة أنه لا يمكنه كتابة القواعد مسبقًا لكل موقف، فهل يستطيع النموذج تشكيل "شخصية" مستقرة بمفرده، مع الاستمرار في اختيار السلوكيات التي لن تؤذي البشر عندما لا يخبره أحد بوضوح بما يجب عليه فعله؟ ص> ص>
ويطرح هذا أيضًا سؤالًا أكثر صعوبة - إذا كان الذكاء الاصطناعي يشكل بالفعل "شخصيته" وقيمه الخاصة، فهل لا يزال بإمكان البشر استخدامه بالكامل كأداة؟ ص> ص>
التعليقات