الملخص:
أصدرت شركة xAI، شركة الذكاء الاصطناعي التابعة لـ Musk، رسميًا Grok 4.7، وهو جيل جديد من النماذج الكبيرة، ووضعته كأقوى نموذج عمل برمجي ومعرفي حاليًا. وذكرت الشركة أن النموذج الجديد لا يعمل على تحسين قدرات المعالجة للمهام المعقدة فحسب، بل يحافظ أيضًا على نفس سرعة التشغيل ونظام الأسعار مثل منتجات الجيل السابق، وينافس في السوق بتكلفة أقل. ص> ص>

وفقًا للمعلومات الصادرة عن xAI، يتبنى Grok 4.7 نموذجًا أساسيًا جديدًا واسع النطاق وينفذ تحسينًا أطول للتعلم المعزز أثناء عملية التدريب. بالمقارنة مع الإصدارات السابقة، يتعرض النموذج الجديد لمهام تدريبية أكثر تعقيدًا، مع عدد كبير من المهام المصممة لتستمر عدة ساعات لإكمالها. يتيح ذلك للنموذج تحقيق تحسينات كبيرة في التفكير طويل المدى والتحقق الذاتي وإدارة المهام المعقدة. ص>
قالت xAI أن أحد أكبر التغييرات في Grok 4.7 هو "قدرتها على الاختبار الذاتي" الأقوى. يمكن للنماذج التحقق بشكل استباقي من مخرجاتها عند الإجابة على الأسئلة وكتابة التعليمات البرمجية وتنفيذ المهام المعرفية المعقدة، وبالتالي تقليل معدلات الخطأ وتحسين موثوقية النتائج النهائية. ص>
وفي الوقت نفسه، تم أيضًا تحسين قدرة النموذج الجديد على التعامل مع السياقات الطويلة للغاية. عند مواجهة مستندات كبيرة، وجولات متعددة من المهام، وأعمال المشروع طويلة الأمد، يمكن لـ Grok 4.7 الحفاظ على قدرات إدارة معلومات أكثر استقرارًا دون تدهور واضح في الأداء مع نمو السياق مثل بعض النماذج التقليدية. ص>
من أجل تحسين تجربة العمل الفعلية بشكل أكبر، تقوم xAI أيضًا بتدريب Grok 4.7 خصيصًا لفهم إطار تشغيل Grok Bot بشكل أصلي. وهذا يعني أنه ليس مناسبًا فقط لسيناريوهات الأسئلة والأجوبة لمرة واحدة، ولكنه أيضًا أكثر ملاءمة للمشاركة في سير العمل كعامل ذكي طويل الأمد. تعتقد الشركة أن هذا سيؤدي إلى تحسين أداء النموذج في أعمال المعرفة العامة والمحادثات المستمرة والمهام على مستوى المؤسسة. ص>
بالإضافة إلى إمكانيات البرمجة، يتمتع Grok 4.7 أيضًا بقدرات أقوى لإنشاء المستندات والعروض التقديمية. وذكر المسؤولون أن النموذج أصبح الآن أكثر قدرة على إنشاء تقارير احترافية ووثائق أعمال ومواد عرض تقديمي، ويأملون في توسيع نطاق تطبيقه بشكل أكبر في مجال التشغيل الآلي للمكاتب. ص>
في ما يتعلق بالأداء، أعلنت شركة xAI عن سلسلة من نتائج الاختبارات الداخلية. ص>
في اختبار CursorBench 4.0، والذي يُستخدم لتقييم قدرات هندسة البرمجيات على المدى الطويل، حقق Grok 4.7 درجة 46.3%، والتي تم تحسينها بشكل ملحوظ مقارنة بـ Grok 4.6 التي حصلت على 40.4%. وفي اختبار هندسة البرمجيات DeepSWE، حقق النموذج الجديد درجة 71%، مع الاستمرار في الحفاظ على مستوى تنافسي قريب من المنتجات الرائدة في الصناعة. ص>
وفي اختبار EBench في مجال الهندسة الإلكترونية، حقق Grok 4.7 درجة 64%، أي بزيادة أكثر من عشر نقاط مئوية مقارنة بالجيل السابق. بالنسبة للمهام المكتبية التي تتضمن قدرًا كبيرًا من المعرفة المهنية وسير العمل المعقد، فقد تحسن أيضًا أداء النموذج في اختبار حقيبة الملفات AA. ص>
فيما يتعلق بالتحليل القانوني، سجل Grok 4.7 19.6% في اختبار Harvey Legal Agent Benchmark، وهو ما يعد تحسنًا إضافيًا مقارنة بمنتج الجيل السابق. وفي مجال التفكير الطبي، تحسنت أيضًا نتائج HealthBench Professional من 48.5% إلى 56.7%. ص>
في مجال عمل المعرفة العامة، ركزت xAI بشكل خاص على نتيجتي التقييم الخاصة بـGDDval وحقيبة AA. وتعتقد الشركة أن هذه الاختبارات أقرب إلى محتوى العمل الحقيقي للمحترفين مثل المحامين والممرضين والمحللين الماليين، وقد وصل Grok 4.7 إلى المستوى التنافسي للنماذج المتطورة الحالية في هذه السيناريوهات. ص>



يعد السعر نقطة بيع مهمة أخرى لهذا الإصدار. ص>

وفقًا للبيانات الرسمية، يظل سعر إدخال Grok 4.7 عند 2 دولارًا أمريكيًا لكل مليون رمز، وسعر الإخراج هو 6 دولارات أمريكية لكل مليون رمز، بما يتوافق مع Grok 4.6. بالمقارنة مع بعض النماذج المتطورة التي غالبًا ما تكلف عدة مرات أو حتى عشر مرات أكثر، تؤكد xAI أن Grok 4.7 يمكنه إكمال المهام ذات المستوى المماثل بتكلفة أقل. ص>
تصف الشركة ذلك بأنه حل "يوفر أداءً تنافسيًا بحوالي نصف سعر الطرازات من نفس المستوى"، على أمل زيادة حصتها في السوق مع ميزة التكلفة. ص>
فيما يتعلق بالأمان، قالت xAI أن Grok 4.7 يعتمد نظام حماية أمني أعيد بناؤه حديثًا. ووفقاً لنتائج الاختبارات الداخلية، فقد وصل النموذج الجديد إلى أفضل مستوى في سلسلة Grok من حيث رفض الطلبات الخطيرة، ومقاومة هجمات كسر الحماية، وتحديد المحتوى عالي الخطورة. ص>
لا سيما في المجالات الحساسة مثل الأمن السيبراني والأمن البيولوجي، تم تصميم النماذج للمساعدة في معالجة المهام الدفاعية المشروعة مع رفض الاستخدامات الخطيرة أو الضارة. تظهر البيانات الرسمية أن Grok 4.7 حقق أداءً رائدًا في بعض اختبارات مخاطر أمن الشبكات وتقييمات الأمن الحيوي. ص>
في الوقت الحالي، أصبح Grok 4.7 مفتوحًا للمستخدمين من خلال واجهة برمجة التطبيقات (API) ومنصة Grok. يمكن للمطورين تسمية هذا النموذج بالبرمجة والأسئلة والأجوبة المعرفية وكتابة المستندات وتطوير تطبيقات الوكيل الذكي. ص>
مع الإطلاق الرسمي لـ Grok 4.7، قامت xAI بتسريع وتيرة تكرار المنتج. منذ إصدار Grok 4.5 في يوليو من هذا العام، إلى إطلاق Grok 4.6 في أغسطس، والآن Grok 4.7، أكملت xAI ثلاث ترقيات رئيسية في أقل من ثلاثة أشهر. بالنسبة لسوق الذكاء الاصطناعي شديد التنافسية، لا يعد Grok 4.7 تحديثًا منتظمًا فحسب، بل يُظهر أيضًا النية الإستراتيجية لشركة xAI لتحدي قادة الصناعة من خلال تكرارات أسرع وأسعار أقل وقدرات عمل أقوى. ص> ص>
التعليقات