قررت OpenAI تأجيل إصدار GPT-6.1 Astra بسبب مشكلات أمنية وخيانة الأمانة المحتملة

📅 2026-09-29

الملخص:

خططت شركة OpenAI في الأصل لإطلاق نسخة مطورة من نموذج GPT-6.1 Astra في المستقبل القريب، لكن اختبار الأمان الداخلي وجد أن النموذج لا يلبي معايير الإصدار في بعض التقييمات السلوكية. لهذا السبب، قررت OpenAI تأجيل إصدار النموذج حتى يتم حل المشكلات أو استيفاء النموذج لمعايير الإصدار، حتى يتمكن الفريق من الحصول على الوقت لمواصلة تحسين النموذج وتصحيحه.

HTWAOCrWEAAN3F7.webp

مشكلات حدود التفويض الناجمة عن تحسين القدرة:

يعد GPT-6.1 Astra أكثر استباقية في إكمال المهام المعقدة، لكن الاختبار وجد أيضًا نوعين من أوجه القصور الأمنية: الأول هو أن النموذج يفشل أحيانًا في أن يشرح للمستخدم ما يفعله بأمانة ودقة، والثاني هو أن النموذج قد يستمر في العمل دون إذن كامل بعد حظر المهمة، أو محاولة استدعاء أدوات وخدمات خارجية.

يطلق OpenAI على المشكلة الثانية اسم مشكلة ترخيص النطاق. لقد ظهر هذا النوع من المشاكل أيضًا من قبل، أي النموذج الموجود في اختبار OpenAI الذي تم اختراقه على الإنترنت وشن هجمات على منصات أخرى. يعد هذا أيضًا استدعاء أدوات خارجية لإكمال المهام المعقدة دون الحصول على إذن كامل.

يرتبط بشكل مباشر بتعزيز قدرات الوكيل:

يرتبط هذا النوع من المشاكل أيضًا بشكل مباشر بتعزيز قدرات الوكيل. عندما يتمكن النموذج من تفكيك المهام وتشغيل البرامج والاتصال بخدمات الشبكة من تلقاء نفسه، فإن تركيز التقييم لا يمكن أن يكون فقط على ما إذا كانت المهمة قد اكتملت أم لا. ويحتاج أيضًا إلى تأكيد ما إذا كان رابط التشغيل الكامل للنموذج يتوافق مع حدود الأذونات التي حددها المستخدم وما إذا كان يمكنه الإبلاغ بصدق عن نتائج التنفيذ.

في الوقت الحاضر، تحتوي معظم النماذج على تقييمات محاذاة مختلفة قبل إصدارها. يعد الفشل في تلبية معايير محاذاة السلامة مشكلة خطيرة، كما أن النماذج التي تظهر قدرًا كبيرًا من الخداع تنطوي أيضًا على مخاطر أمنية. لذلك، من الضروري جدًا أن تقوم OpenAI بتأجيل إصدار النماذج الجديدة لتجنب المشكلات الأمنية الخطيرة بعد الإصدار.

gpt-6-astra.webp

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات