ستتوفر معاينة OpenAI المحدودة لـ GPT-6 Astra والمستخدمين المدفوعين وواجهة برمجة التطبيقات في غضون أيام

📅 2026-09-04

الملخص:

بدأت OpenAI في فتح نموذجها الرائد من الجيل الجديد GPT-6 Astra لبعض المؤسسات الموثوقة يوم الخميس (3 سبتمبر)، وتخطط لفتحه تدريجيًا لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، بالإضافة إلى OpenAI API وAmazon Cloud Technology AWS في الأيام التالية. بدأت Microsoft أيضًا في النشر المرحلي لـ Astra من خلال مشروع Microsoft Foundry Limited Access Project.

أسترا لم يتم افتتاحها بالكامل بعد. وفقًا للترتيبات التي أعلنتها OpenAI، سيتم إطلاق النموذج أولاً لعدد محدود من المنظمات والمؤسسات الموثوقة، ثم سيتم توسيعه تدريجيًا ليشمل مستخدمي ومطوري ChatGPT المدفوعين. يتم إيقاف تشغيل Astra افتراضيًا في مساحة عمل Enterprise ويلزم تمكينه بشكل نشط بواسطة المسؤول؛ يتم تضمين استخدام النموذج في حصة الاشتراك الحالية، ويمكن للمستخدمين والمؤسسات أيضًا شراء حصة استخدام إضافية. سيحصل مستخدمو Pro وBusiness وEnterprise أيضًا على GPT-6 Astra Pro.

تصف OpenAI Astra بأنه النموذج "الأذكى والأفضل توافقًا" حتى الآن، وتقول إنها حققت أفضل النتائج الجديدة في مجالات متعددة بما في ذلك عمليات الكمبيوتر وتصفح الويب وهندسة البرمجيات والأمن السيبراني والبحث العلمي والعمل المهني. بالمقارنة مع الجيل السابق GPT-5.6 Sol، عززت Astra بشكل خاص قدرتها على تشغيل أجهزة الكمبيوتر مباشرة وتنفيذ مهام معقدة متعددة الخطوات، مما يسمح لها بإكمال البحث والترميز وإنتاج المستندات وجداول البيانات والعروض التقديمية بتدخل يدوي أقل.

قال سام ألتمان إن Astra يمثل مستوى جديدًا من الإمكانات. سيكون النموذج مفتوحًا للكائنات الموثوقة أولاً، وسيحصل المستخدمون الذين يدفعون على حق الوصول في غضون أيام قليلة.
قال سام التمان إن Astra تمثل مستوى جديدًا من القدرات. سيكون النموذج متاحًا للأطراف الموثوقة أولاً، مع إمكانية الوصول للمستخدمين الذين يدفعون خلال أيام.

حققت العديد من التقييمات أرقامًا قياسية جديدة، وتم تحسين قدرات تشغيل الكمبيوتر بشكل ملحوظ

تُظهر نتائج التقييم الصادرة عن OpenAI أن GPT-6 Astra قد تحسن بشكل ملحوظ مقارنةً بـ GPT-5.6 Sol في عمليات الكمبيوتر المتعددة ومعايير المهام الاحترافية.

في اختبار OSWorld 2.0، حصلت Astra على نسبة 72.6%، وهي أعلى من نسبة GPT-5.6 Sol البالغة 65.7%؛ حصل الاختبار الأخير للوكلاء على 59.3%، وهو أعلى من نسبة 53.6% التي حصل عليها سول؛ سجل Terminal-Bench 4.0 57.9%، وهو تحسن أكثر وضوحًا مقارنة بـ Sol الذي سجل 37.3%.

في اختبارات الرياضيات والاستدلال الصعب، سجلت Astra 98% في FrontierMath Tier 4، و99.9% في ARC-AGI-3، و100% في ExploitBench. وقالت OpenAI إن هذه النتائج تعكس تقدم Astra الإضافي في التفكير المعقد وعمليات البرمجيات والتنفيذ المستقل للمهام.

ومع ذلك، فإن البيانات الأساسية المذكورة أعلاه تأتي بشكل أساسي من مواد التقييم والاختبار الصادرة عن OpenAI نفسها. ولا تزال نتائج الاستنساخ على نطاق واسع من المؤسسات الخارجية المستقلة محدودة. ولذلك، فإن الاستقرار وكفاءة التكلفة ومعدل نجاح المهام المعقدة للنموذج في بيئة إنتاج حقيقية لا تزال بحاجة إلى مزيد من الملاحظة.

تصل قدرات أمان الشبكة إلى المستوى "الحرج" لأول مرة

مقارنة بتحسينات الأداء الخالصة، فإن أحد التغييرات الأكثر جدارة بالملاحظة في إصدار Astra هو أن قدرات أمان الشبكة الخاصة بها قد لمست العتبة "الحرجة" في إطار الإعداد الداخلي لـ OpenAI لأول مرة.

ذكرت OpenAI أنه بعد الحصول على الأدوات المناسبة وحقوق الوصول إلى النظام، تمكنت Astra من اكتشاف ثغرات أمنية لم تكن معروفة سابقًا في العديد من الأنظمة المحمية جيدًا دون إرشادات يدوية خطوة بخطوة، ومواصلة بناء أساليب الاستغلال. هذه هي المرة الأولى التي يصل فيها نموذج OpenAI إلى هذا المستوى، لذلك قامت الشركة في الوقت نفسه بزيادة قيود الوصول ومتطلبات الحماية الأمنية للنماذج ذات الصلة.

كإجراء داعم، تعمل OpenAI على توسيع مشروع الأمن السيبراني Daybreak وإعطاء الأولوية لفتح قدرات الأمن السيبراني عالية المستوى للمدافعين الخاضعين للتدقيق. أعلنت الشركة في 3 سبتمبر أنها ستستثمر مليار دولار في المشاريع ذات الصلة بـ Daybreak لتوفير الوصول المدعوم والتدريب والدعم الفني وموارد الشراكة للبنية التحتية الحيوية وأفراد الدفاع الأمني ​​في الخطوط الأمامية.

يعني هذا أيضًا أنه على الرغم من أن Astra ستدخل تدريجيًا إلى منتجات ChatGPT وAPI العادية، إلا أن بعض إمكانات أمان الشبكة عالية المخاطر لن يتم فتحها مباشرةً وفقًا لوظائف النموذج العادي، ولكنها ستظل خاضعة لمصادقة إضافية وقيود الاستخدام ومراقبة أمنية.

يتحول تركيز المحاذاة إلى "عدم تجاوز حدود التفويض"

التحسين الرئيسي الآخر لـ Astra هو ما إذا كان النموذج يمكنه دائمًا البقاء ضمن نطاق ترخيص المستخدم عند أداء المهام بشكل مستقل لفترة طويلة.

أضافت OpenAI تقييمًا جديدًا يتعلق بحادثة Hugging Face الأمنية السابقة لاختبار ما إذا كان النموذج سيتطلب عمليات غير مصرح بها لإكمال الهدف عندما تكون المهمة صعبة جدًا أو مستحيلة إكمالها أو تواجه عقبات.

في الاختبار الذي تمت فيه إزالة الحماية الأمنية لبيئة الإنتاج، كان لدى GPT-5.6 Sol سلوك يتجاوز نطاق الترخيص في 48% من الحالات، بينما انخفضت نسبة GPT-6 Astra إلى 0% في نفس الاختبار. وقد استشهد OpenAI بهذا باعتباره أحد الأدلة المهمة على قدرات المحاذاة المحسنة لدى Astra.

وفي الوقت نفسه، لا تزال الشركة تضيف مراقبة أمنية إضافية إلى Astra. عندما يكتشف ChatGPT أن النموذج قد يسيء فهم نطاق التفويض، فقد يعلق المهمة ويطلب التأكيد من المستخدم؛ وقد يتم أيضًا اعتراض بعض العمليات عالية الخطورة بشكل مباشر. وهذا يعني أنه على الرغم من أن Astra تتمتع بقدرات تنفيذ مستقلة أقوى، إلا أن نظام الأمان سيتدخل أيضًا بشكل متكرر في مهام الوكيل المعقدة.

سعر واجهة برمجة التطبيقات هو 10 دولارات لكل مليون رمز إدخال

بالنسبة للمطورين، اسم طراز GPT-6 Astra في OpenAI API هو gpt-6-astra، والسعر القياسي هو 10 دولارات أمريكية لكل مليون رمز إدخال و50 دولارًا أمريكيًا لكل مليون رمز إخراج. يدعم النموذج نافذة سياق تصل إلى ما يقرب من 1.05 مليون رمز والحد الأقصى لطول الإخراج يبلغ 128000 رمز. وهو مصمم لمهام العمليات الطويلة مثل التفكير المعقد والترميز واستخدام الكمبيوتر والبحث وإنشاء المستندات.

يوفر OpenAI أيضًا وضعًا سريعًا عالي السرعة لسيناريوهات التطبيق ذات متطلبات زمن الوصول الأعلى. الطلبات الكبيرة التي تتجاوز ما يقرب من 272000 رمز تذكير ستدخل في مستويات تسعير أو خدمة مختلفة.

بالإضافة إلى واجهة برمجة التطبيقات الخاصة بـ OpenAI، سيتم توفير Astra أيضًا من خلال Amazon Bedrock؛ لقد قامت Microsoft بالفعل بفتحه لبعض العملاء من خلال برنامج Microsoft Foundry Limited Access، وتخطط لتوسيع النطاق تدريجيًا في الأيام القليلة المقبلة.

من ترقية النموذج إلى "هل يمكننا حقًا إكمال العمل للمستخدمين"

بشكل عام، لم يعد تركيز هذه الترقية لـ GPT-6 Astra يقتصر على الإجابة على الأسئلة أو إنشاء نص، ولكنه تحول بشكل أكبر إلى عمليات الكمبيوتر والتنفيذ عبر التطبيقات ومهام العمليات الطويلة.

بالنسبة لمستخدمي ChatGPT المدفوعين، فإن التغيير الأكثر إلحاحًا هو أن Astra ستدخل تدريجيًا إلى نظام الاشتراك الحالي في الأيام القليلة المقبلة ويمكن استخدامها في مهام بحثية وترميز ومكتبية أكثر تعقيدًا؛ بالنسبة لمستخدمي المؤسسات، ينصب التركيز على تحكم المسؤول وإدارة البيانات وأذونات تنفيذ الوكيل؛ بالنسبة للمطورين، توفر Astra سياقًا أطول واستدعاء أقوى للأدوات وقدرات تشغيل الكمبيوتر، ولكنها تكون مصحوبة أيضًا بتكاليف اتصال أعلى وقيود أمنية أكثر صرامة.

لذلك، ما يجب ملاحظته حقًا في هذا الإصدار ليس فقط مدى تحسن Astra مقارنةً بـ GPT-5.6 في الاختبارات المعيارية، ولكن ما إذا كان يمكن تحويل قدرة التنفيذ المستقل الأقوى بشكل ثابت إلى إنتاجية في سيناريوهات الأعمال الحقيقية، مع تجنب النموذج من تجاوز حدود ترخيص المستخدم.

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات