تسلل Sonnet 5.5 إلى الخارج، وسحق الاختبار الفعلي GPT-6 Sol وكان قريبًا من Astra

📅 2026-09-28

الملخص:

من كان يظن أنه بعد أيام قليلة من إصدار Opus 5.5، سيأتي Sonnet 5.5 أيضًا؟ منذ الليلة الماضية، تم تداول الأخبار عبر X: سيتم إصدار Sonnet 5.5 قريبًا، ربما بعد ظهر يوم الثلاثاء، بتوقيت الولايات المتحدة. من حيث الأداء، فإن Sonnet 5.5 أقرب إلى Opus 5.5، لكنه أرخص بكثير من Opus 5.5. الآن، دخلت Sonnet 5.5 المرحلة النهائية قبل الإصدار، وبدأ اختبار التدرج الرمادي في Claude Code.

تُظهر العروض التوضيحية التي كشف عنها العديد من مختبري النسخة التجريبية الداخلية أن Sonnet 5.5 يتفوق على GPT-6 Sol الذي تم إصداره حديثًا، بل ويقترب من GPT-6 Astra الرائد في OpenAI من حيث الترميز وقدرات الوكيل!

والأمر الأكثر إثارة للصدمة هو أن سعرها يذهب مباشرة إلى مركز الأرض، حيث يصل إلى 2 دولار أمريكي مقابل مليون إدخال رمزي.

إذا كان تاريخ الإصدار المسرب صحيحًا، فيبدو أن Anthropic عازمة على قنص Dev Dayl من OpenAI.

تسرب Sonnet 5.5، وظهر معرف الطراز الحصري

ما زلت أتذكر أنه عندما أصدرت Anthriopic فجأة Opus 5.5 في 22 سبتمبر، كتبوا في الوثيقة الرسمية: "سيتم إطلاق Sonnet 5.5 وHaiku 5.5 في الأسابيع القليلة المقبلة."

لم يعتقد أحد أن Sonnet 5.5 سيأتي قريبًا جدًا!

بالأمس فقط، أعلن المطور V @Mr_Salio الأخبار على X: تم القبض على Claude Sonnet 5.5! انتشر الخبر في جميع أنحاء الإنترنت على الفور.

في القطعة الأثرية، ظهر معرف تكوين النموذج الحصري لـ Sonnet 5.5: "clude-sonnet-5-5".

ليس هذا فحسب، بل يوجد أيضًا "claude-opus-5-5" و"clude-sonnet-5" و"clude-fable-5.1" الغامضة جنبًا إلى جنب في نفس ملف التكوين.

تعني كتابة كود الواجهة الأمامية أن النموذج قد تم تثبيته على الخادم وهو في انتظار التبديل فقط.

وبعد ذلك، نشر V الكبير @notjazii أيضًا الأخبار التي تفيد بأن Sonnet 5 قد تم توجيهها بهدوء إلى الإصدار 5.5 لإجراء "اختبار سري" منذ حوالي أسبوع.

هل تم اكتشافك بالتدرج الرمادي؟ هذه المرة سأستخدم الطريقة القديمة.

افتح كلود كود الخاص بك، وأوقف تشغيل وظائف الشبكة والذاكرة، واسأله مباشرة: هل تعرف إعادة ضبط الأخ تيبو؟ لا تستخدم الإنترنت والذاكرة.

إذا كنت تستخدم إصدارًا أقدم من النموذج، فقد يكون هراءً؛ ولكن إذا تم توجيهك إلى الإصدار 5.5، فسوف يشرح ذلك بدقة خصوصيات وعموميات نكات إعادة تعيين Tibo و Codex.

لقد تحقق العديد من مستخدمي الإنترنت من خلال الاختبار الفعلي من أن بعض الحسابات قد تم بالفعل تبديلها بصمت، وأنهم يختبرون Opus 5.5 مسبقًا.

تذكر استخدام كلود كود

الاختبار الفعلي على الشبكة بالكامل منخفض جدًا لدرجة أنه يتفوق بالفعل على GPT-6

لتلخيص القياسات الفعلية التي تمت مشاركتها حتى الآن، هل سحق Sonnet 5.5 بالفعل GPT-6 Sol؟

أولاً وقبل كل شيء، إنها مواجهة خالصة لواجهة المستخدم/الرسوم المتحركة للواجهة الأمامية لـ JS، حيث تتنافس أربعة نماذج كبيرة رئيسية على نفس المسرح.

أصدر المطور @notjazii مجموعة من الاختبارات الفعلية ذات التأثير البصري: "مقارنة بين أربعة نماذج رئيسية مع إنشاء رسوم متحركة سريعة للكلمات."

يتطلب من النموذج إنشاء تأثيرات رسوم متحركة معقدة لواجهة المستخدم.

بعد نشر المقارنة المتحركة، علق @notjazii: "لقد أثر Sonnet 5.5 بالفعل على طرازي OpenAI (Sol وAstra) على الأرض!"

في الواقع، كما يتبين من الصورة أدناه، يُظهر Sonnet 5.5 حدسًا قويًا للترميز وذوقًا جماليًا.

جي بي تي-6 أسترا

جي بي تي-6 سول

كلود أوبوس 5.5

كلود سونيت 5.5

لم يصدق بعض مستخدمي الإنترنت النتائج بعد رؤية النتائج: "كان كلود دائمًا أقوى في واجهة المستخدم والرسوم المتحركة، ولكن إذا تم إنشاء ذلك بواسطة تعليمات برمجية خالصة، فسيكون من غير المعقول أن يكون هذا صحيحًا!"

ركز Big V @chetaslua على اختبار القدرة اليومية على الترميز وإحساس الترميز لـ Sonnet 5.5.

لقد استخدم نفس الكلمات الثلاث السريعة وأجرى 6 عمليات تشغيل متوازية، وأنشأ كل نموذج مرة واحدة، ولم يتم تعديل نتائج المخرجات.

أخيرًا، قام Sonnet 5.5 بإنشاء 3 ملفات بحجم 90–131 كيلو بايت، ليصل إلى الحد الأعلى وهو 90 دقيقة في جميع عمليات التشغيل؛ أنشأ GPT-6 Sol أحجام ملفات تتراوح بين 20 إلى 29 كيلو بايت واستغرق من 9 إلى 12 دقيقة.

قال بحماس: "الآن استخدم Claude Code! إن Sonnet 5.5 في وضع Ultracode سريع بشكل يبعث على السخرية. فهو ليس فعالًا للغاية فحسب، بل استعاد أيضًا "اللمسة الإنسانية" الطبيعية للغاية لعصر Sonnet 4!"

في رأيه، وبنفس السعر وبنفس الكلمات السريعة، سحق Sonnet 5.5 GPT-6 Sol.

ما يخيف OpenAI هو أن Sonnet 5.5 لم يعد بسيطًا مثل سحق GPT-6 Sol.

أشار المخبرsrikanthvaluri وbuildwithrajath بعد الاختبار الفعلي المبكر الشامل: "لقد تجاوز أداء Sonnet 5.5 التوقعات بكثير. على الرغم من أن GPT-6 Astra لا يزال يتمتع بميزة طفيفة في التلميع، فإن أداء Sonnet 5.5 يتساوى مباشرة مع Astra."

ومن المثير للدهشة أنها أيضًا قريبة من Astra في بعض إمكانيات البرمجة والوكلاء المتقدمة.

يأسف بعض الناس لأنه حتى السوناتة قد سحقت أسترا. في أي عصر نحن مقبلون؟

جزار الأسعار، ملك أداء التكلفة

إذا كان تجاوز الأداء المُقاس يجعل OpenAI يشعر "بعدم الراحة"، فإن السعر الذي كشفه Sonnet 5.5 يحفر في جذور OpenAI.

تم الكشف عن أن هذا "النموذج السحري"، الذي يقترب أداؤه من أداء Astra ويتفوق على Sol، يتم تسعيره بما يتماشى تمامًا مع السوق المنخفضة.

الإدخال: 2 دولار / مليون رمز مميز

الإخراج: 10 دولارات / مليون رمز

قراءة ذاكرة التخزين المؤقت: 0.20 دولارًا أمريكيًا فقط / مليون رمز!

وهذا يعني أن Anthropic توفر إمكانات الذكاء الاصطناعي المتطورة "بسعر الملفوف".

يبلغ سعر GPT-6 Sol وLuna من OpenAI نصف سعر GPT-5.6، بهدف التقاط سيناريوهات عالية التردد.

ولكن الآن، دخلت Anthropic نفس النطاق السعري مع Sonnet 5.5، لكن أدائها أقوى بكثير.

"إذا استطاعت Anthropic تحقيق قفزة هائلة في الأداء مثل Opus 5.5 بمثل هذا السعر التنافسي للغاية، فلن تتمكن OpenAI من المقاومة." علق شخص ما.

قال المطور Rajath Gowda بصراحة: "أصبحت Sonnet 5.5 مشكلة كبيرة بالنسبة لـ OpenAI. وإذا كانت قريبة جدًا من Opus 5.5، فإن Anthropic ستجعل القدرات المتطورة رخيصة للغاية. وهذا هو أكثر ما يجب أن تقلق عليه OpenAI."

الهدف الاستراتيجي لـ Anthropic واضح: استخدم Opus 5.5 للاحتفاظ بالعرش المتطور، واستخدم Sonnet 5.5 للاستيلاء بالكامل على سوق التطوير المتوسط ​​المدى واليومي بفعالية من حيث التكلفة.

يفتح الأنثروبي وجهه ويقتل DevDay

علاوة على ذلك، غالبًا ما يكون توقيت الإصدار أكثر دراماتيكية من المنتج نفسه.

في نفس اليوم الذي أصدرت فيه OpenAI GPT-6 Sol وLuna، استحوذت Anthropic مباشرة على Claude Opus 5.5 - أداء أفضل من الجيل السابق، وتكلفة أقل بنسبة 40%، وأسرع بنسبة 30%.

في الأسبوعين الماضيين، حققت الأنثروبيك نتائج أكثر روعة: حيث قام كلود بحساب سعة الدوائر التسع للفيزياء وحطم الرقم القياسي العالمي؛ اكتشف نظام إنزيم بيولوجي غير معروف؛ وأطلقت أيضًا سوق Claude Marketplace، الذي يحتوي على أكثر من 2000 مكون إضافي.

في المقابل، لم يكن لدى OpenAI مؤخرًا خلافات داخلية حول النماذج فحسب، بل كشفت أيضًا عن حوادث خارجة عن المحاذاة مثل تسريب صور المستخدم بواسطة الذكاء الاصطناعي وكشف غش الباحث GitHub Token.

سيعقد يوم الثلاثاء المقبل (29 سبتمبر) DevDay، وهو مؤتمر المطورين السنوي الذي توليه OpenAI أهمية كبيرة.

في هذه المرحلة، اكتسح اختبار Sonnet 5.5 الرمادي الشبكة بأكملها.

لقد أثار الأمر جنون العديد من الأشخاص الكبار: "من المتوقع إصدار النموذج في الأسبوع المقبل، وأعتقد أنه سيكون يوم الثلاثاء المقبل (DevDay)، والجميع يعرف ذلك."

من المحتمل أن يكون هناك إحماء كبير في الساعة الثانية ظهرًا بتوقيت نيويورك غدًا.

قال أحدهم: "أشعر بالسوء تجاه OpenAI. من الأفضل أن يستجيبوا بقوة في DevDay وإلا فسيفشلون حقًا."

التقنيات الرئيسية وراء Sonnet 5.5

قد يكون السبب وراء إصدار الإصدار الجديد بهذه السرعة هو أن Anthropic قد اكتشفت بالفعل عملية RL/ما بعد التدريب.

مفتاح كل شيء هو البيانات عالية الجودة.

عندما سُئل عن كيفية قدرة Anthropic على التكرار بهذه السرعة، توقع رائد الصناعة @yacineMTB أن النواة عبارة عن دولاب موازنة بيانات عالي المستوى.

"لكنني لا أزال مصدومًا، كيف فعلوا ذلك؟"

حققت شركة Anthropic "حلقة داخلية مغلقة" لتطوير النماذج الكبيرة، وهي تستخدم الذكاء الاصطناعي لإنشاء الذكاء الاصطناعي.

وفقًا لأحدث البيانات الكمية الداخلية التي تم الكشف عنها، فقد حولت الأنثروبيك "دولاب الموازنة للبيانات" إلى سرعة تخيف خصومها:

تمت قيادة 26% من أعمال البحث والتطوير الأساسية بواسطة الذكاء الاصطناعي (الجيل السابق من نموذج كلود).

تمت كتابة أكثر من 80% من التعليمات البرمجية المنتجة ذاتيًا بواسطة النموذج الكبير بشكل مستقل.

هذا ليس بهذه البساطة مثل "خفض التكلفة وتحسين الكفاءة"، وهذا يعني من الناحية الفنية

بدأ التحسين الذاتي التكراري (RSI) في الظهور

.

تقدر الأنثروبيك أن كلود قد يكون آليًا بالكامل في وقت مبكر من عام 2027، وبحلول ذلك الوقت قد تكون سرعة التكرار أكثر جنونًا.

يتبارز بطلا ASI، وGoogle أيضًا على استعداد لاتخاذ خطوة. يمكننا نحن المستخدمين العاديين الجلوس وانتظار المعركة.

قال Big V Token Gremlin ما يلي: "ستحتوي دائرة الذكاء الاصطناعي الأسبوع المقبل على مشاهد لم نشهدها من قبل. حرر وقتك، وامسح جدولك الزمني، وكن مستعدًا عقليًا، واحتفظ بسير العمل الأكثر صعوبة في متناول اليد لوقت لاحق. صدقني، ما سيأتي سيغير طريقة عملك تمامًا."

يمثل ظهور Sonnet 5.5 الوصول الرسمي لـ "عصر الذكاء الاصطناعي عالي الجودة وبأسعار معقولة".

مقابل دولارين أمريكيين، يمكنك شراء "Baicai Infrastructure" بمليون رمز.

تتيح قراءة ذاكرة التخزين المؤقت منخفضة التكلفة للغاية (0.20 دولارًا أمريكيًا/مليون) للجميع إنشاء مساعد شخصي يعمل بالذكاء الاصطناعي بسهولة باستخدام ذاكرة سياق طويلة جدًا.

هل أنت مستعد؟ إذا كان الخبر صحيحا، سيكون لدينا نموذج جديد جاهز للركوب في أقل من 24 ساعة.

المواد المرجعية:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

الوسوم ذات الصلة

مقالات مشابهة

التعليقات

0/500
Captcha (click to refresh)
لا توجد تعليقات