أصدرت OpenAI GPT-6.1 Sol، والأداء قريب من GPT-6 Astra، وتم تخفيض سعر الإدخال والإخراج القياسي لواجهة برمجة التطبيقات (API) إلى الخمس

📅 2026-09-30

الملخص:

أصدرت OpenAI رسميًا GPT-6.1 Sol في حدث DevDay الذي أقيم في 29 سبتمبر بالتوقيت المحلي. لقد مر أسبوع واحد فقط منذ إصدار GPT-6 Sol، وتمت ترقية النموذج الجديد مرة أخرى. ذكرت OpenAI أن قدرات GPT-6.1 Sol في مهام مثل برمجة الوكيل وتشغيل الكمبيوتر والعمل الاحترافي قريبة من GPT-6 Astra الرائد، لكن سعر رموز الإدخال والإخراج القياسية لا يمثل سوى خمس الأخير.

desktop-transparent.webp

من الجدير بالذكر أن OpenAI لم تطلق GPT-6.1 Astra هذه المرة كما كان متوقعًا. ذكرت صحيفة وول ستريت جورنال سابقًا أن OpenAI ألغت خطة إصدار GPT-6.1 Astra بسبب مشكلات أمنية تم اكتشافها أثناء الاختبار الداخلي. قررت OpenAI في النهاية عدم طرح هذا الإصدار كما كان مخططًا له في الأصل بعد أن وجد الباحثون أن النموذج أظهر ميلًا أكبر للخداع وكان من المرجح أن يتقدم من تلقاء نفسه دون إذن المستخدم أثناء أداء المهام.

مقارنة بالجيل السابق من GPT-6 Sol، أجرى GPT-6.1 Sol العديد من التحسينات في المهام المعقدة، بما في ذلك البرمجة وتصحيح أخطاء التعليمات البرمجية وفهم المستندات وتنفيذ مهام سير عمل متعددة الخطوات. قالت OpenAI أنه في بعض هذه القدرات، يكون أداء النموذج الجديد قريبًا بالفعل من أداء GPT-6 Astra.

من حيث الدقة الواقعية، تم أيضًا تحسين GPT-6.1 Sol. تُظهر بيانات الاختبار الداخلي الصادرة عن OpenAI أنه في ظل كثافة الاستدلال المنخفضة، تبلغ نسبة الإجابات التي تحتوي على أخطاء واقعية لـ GPT-6 Sol 11.4%، بينما انخفضت GPT-6.1 Sol إلى 7.7%، وهو انخفاض واضح تمامًا. ذكرت OpenAI أيضًا أن الفجوة بين معدل الخطأ في GPT-6.1 Sol وGPT-6 Astra تقع ضمن 1.9% في جميع إعدادات الاستدلال.

بالإضافة إلى تحسين دقة الإجابة ببساطة، أكدت OpenAI أيضًا على التحسينات التي أجراها GPT-6.1 Sol في متابعة نوايا المستخدم والقيود الأمنية. وفقًا للتقييم الداخلي للشركة، من غير المرجح أن يتجاهل النموذج الجديد أدوات البحث المعطلة عند مواجهة المهام الصعبة، وأكثر قدرة على الالتزام بالقيود التي ينص عليها المستخدمون صراحةً، ويقلل من عدد العمليات غير المصرح بها المكتملة.

في اختبار الأمان، ذكرت OpenAI أيضًا أنها لم تلاحظ سلوك GPT-6.1 Sol المتمثل في محاولة تجاوز مراجعي الأمان الآليين، وهو ما يتوافق مع أداء GPT-6 Astra وGPT-6 Sol السابق.

يعكس هذا الإصدار أيضًا محاولة OpenAI لإعادة ضبط الموضع بين النماذج المختلفة لسلسلة GPT-6. تم تصنيف GPT-6 Astra سابقًا على أنه النموذج الرئيسي الأكثر قدرة للشركة، بينما يتولى Sol دورًا عمليًا أكثر تركيزًا على الكفاءة. الهدف من GPT-6.1 Sol ليس استبدال Astra بالكامل، ولكن جلب إمكانيات قريبة من النموذج الرئيسي لعدد أكبر من المستخدمين الذين يحتاجون إلى أداء البرمجة وعمليات الكمبيوتر والعمل الاحترافي مع تقليل تكاليف التشغيل بشكل كبير.

أصبح السعر أحد أهم التغييرات في هذه الترقية. ذكرت OpenAI أن أسعار الرموز القياسية للمدخلات والمخرجات لـ GPT-6.1 Sol لا تمثل سوى خمس سعر GPT-6 Astra. وهذا يعني أنه بالنسبة للمطورين ومستخدمي المؤسسات الذين يحتاجون إلى معالجة كمية كبيرة من التعليمات البرمجية أو الملفات أو مهام الوكيل طويلة الأمد، يمكن تقليل تكلفة التشغيل بشكل كبير عندما تكون إمكانيات النموذج قريبة من الإصدار الرئيسي.

سيكون GPT-6.1 Sol مفتوحًا رسميًا لمستخدمي Plus وPro وBusiness وEnterprise وEdu في ChatGPT Work وCodex اعتبارًا من 29 سبتمبر، وسيبدأ أيضًا في تقديمه للمطورين ومستخدمي المؤسسات المعنيين. ومع ذلك، فإن هذا النموذج غير متوفر حاليًا في ChatGPT العادي، ولم تعلن OpenAI بعد عن الوقت المحدد الذي سيكون فيه مفتوحًا لمستخدمي ChatGPT العاديين.

يتم إطلاق GPT-6.1 Sol بعد أسبوع واحد فقط من إصدار GPT-6 Sol، مما يوضح أيضًا أن OpenAI تعمل حاليًا على تسريع سرعة التكرار لسلسلة GPT-6. في إصدارات GPT-6 Sol وLuna السابقة، ركزت OpenAI على تقليل تكاليف الاستخدام من خلال كفاءة الاستدلال، وتقنية التخزين المؤقت، وتحسين بنية النموذج، وهذه المرة يركز GPT-6.1 Sol أيضًا على العمل الاحترافي ومهام الوكيل.

من منظور تحديد موضع المنتج، فإن GPT-6.1 Sol يشبه إلى حد كبير إيجاد توازن بين القدرات الرئيسية وتكاليف النشر الفعلية. وتأمل OpenAI أنه مع هذا النموذج، لن يحتاج المستخدمون إلى تحمل تكاليف الحوسبة العالية لمستوى GPT-6 Astra، ولكن يمكنهم أيضًا الحصول على البرمجة وتشغيل الكمبيوتر وقدرات تنفيذ سير العمل المعقدة بالقرب من النموذج الرئيسي. مع تحول وكلاء الذكاء الاصطناعي تدريجيًا من السؤال والإجابة البسيطة إلى برامج التشغيل المباشرة، وكتابة التعليمات البرمجية وتصحيح الأخطاء، وتنفيذ مهام طويلة الأمد، أصبحت دقة النموذج، والقدرة على اتباع التعليمات، وتكلفة التشغيل أيضًا عوامل مهمة تؤثر على التطبيقات العملية.

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات