أعلنت شركة Intel عن أحدث الأداء والتوقعات الداخلية للجيل الخامس القادم من وحدات المعالجة المركزية Emerald Rapids والجيل التالي من وحدات المعالجة المركزية Granite Rapids Xeon. خلال مؤتمر SC23، كشفت إنتل عن مقاييس أداء جديدة لوحدات المعالجة المركزية Xeon الخاصة بها، بما في ذلك النتائج الفعلية للجيل الخامس القادم من Emerald Rapids والنتائج المتوقعة للجيل التالي من وحدات المعالجة المركزية Granite Ridge Xeon. قارنت شركة تصنيع الرقائق هذه النتائج برقائق الجيل السابق، وأظهرت أيضًا مقاييس HPC تقارن وحدات المعالجة المركزية Xeon Max برقائق AMD's PYC Genoa ذات 96 نواة.

إن وحدة المعالجة المركزية Emerald Rapids من الجيل الخامس من Intel متوافقة تمامًا مع وحدة المعالجة المركزية Sapphire Rapids على منصة EagleStream. إنهم يستخدمون نفس مقبس LGA-4677 ويقدمون في المقام الأول تصميمًا محسنًا مع عدد أقل من النوى/الخيوط، ومجموعات ذاكرة تخزين مؤقت أكبر، والتركيز على الأداء الأعلى لكل واط.

وأكدت الشركة أن وحدات المعالجة المركزية Emerald Rapids Xeon ستوفر أداءً محسنًا لأعباء العمل وحوسبة موفرة للطاقة. وفي الوقت نفسه، ستؤدي إضافة ذاكرة DDR5-5600 الأسرع إلى توفير نطاق ترددي أعلى وسرعات نقل أعلى. وسيوفر الجيل الخامس من Xeon أيضًا دعم CXL1.0 و2.0، بالإضافة إلى 80 مسارًا PCIeGen5.0. تدعي شركة Intel أن الأداء سيزيد بنسبة 40٪. التفاصيل هي كما يلي:

مقارنة بين Intel Emerald Rapids (Xeon 8592+64 مركزًا) وSapphire Rapids (Xeon 8480+56 مركزًا):

التعرف على الكلام بالذكاء الاصطناعي: تحسن بمقدار 1.4 مرة

HPCLAMMPS (النحاس): تحسن بمقدار 1.4 مرة

تحويل ترميز الوسائط (FFMPEG): تحسين بمقدار 1.2 مرة

تتضمن بعض ميزات وحدة المعالجة المركزية Xeon "EmeraldRapids" من الجيل الخامس ما يلي:

ذاكرة تخزين مؤقت ذات مسؤولية محدودة أسرع 3 مرات

أسرع سرعة الذاكرة

المزيد من مراكز وحدة المعالجة المركزية (ما يصل إلى 64 مركزًا)

واجهة عرض النطاق الترددي العالي من النوع 3 من CXL

تحسين عبء العمل (Intel AE)

وضع الطاقة الأمثل

تحسن الأداء العام/استهلاك الطاقة بنسبة تصل إلى 17%

استخدم Intel Accelerator Engine لتفريغ أنوية وحدة المعالجة المركزية وتحسين كفاءة استخدام الطاقة

تحسين الاستدلال وأداء التدريب بشكل كبير

Intel AMX لتسريع الذكاء الاصطناعي المدمج

النشر الأمثل لمكدس البرامج خارج الصندوق


أعلنت Intel أيضًا عن توقعات الأداء الداخلي لوحدات المعالجة المركزية Granite Rapids Xeon القادمة. ستحتوي هذه السلسلة من المعالجات على أنوية P فقط، بينما ستضيف Sierra Forest أنوية E وستوفر ما يصل إلى 288 نواة. ستكون الرقائق متوافقة مع الجيل التالي من منصة BirchStream، والتي تحتوي على مقبسين مختلفين: LGA4710 وLGA7529. وأكدت الشركة أن وحدات المعالجة المركزية Granite Rapids Xeon ستوفر عددًا أكبر من النواة والترددات وأحدث Intel AMX (امتدادات Matrix المتقدمة). ستضيف GraniteRapids أيضًا FP16 لتوسيع دعم الدقة للمطورين المعتمدين على الذكاء الاصطناعي. ستوفر المنصة دعم MCRDIMM ذو 12 قناة للتعامل مع نماذج LLM الكبيرة ذات الذاكرة المحدودة.

من حيث الأداء، وفقًا للتقديرات الداخلية مقارنة بالجيل الرابع الحالي من وحدة المعالجة المركزية Sapphire Rapids، ستزيد شريحة Granite Rapids Xeon بمقدار 2.9 مرة في استدلال الذكاء الاصطناعي (DeepMD+LAAMPS)، و2.8 مرة في عرض النطاق الترددي للذاكرة، و3 مرات في أحمال عمل الذكاء الاصطناعي. هذه تقديرات تقريبية فقط وقد يختلف الأداء النهائي.

أخيرًا، أظهرت Intel أيضًا بعض معايير أداء HPC لوحدة المعالجة المركزية Xeon Max 9480، والتي تأتي مع 56 نواة وذاكرة HBM بسعة 64 جيجابايت، والتي يمكن مقارنتها بـ AMD PYC9654 مع 96 نواة. يمكن تحسين أداء وحدة المعالجة المركزية XeonMax بنسبة تصل إلى 30%. يبلغ سعر EPYC9645 11,805 دولارًا أمريكيًا، بينما يبلغ سعر XeonMax9480 12,980 دولارًا أمريكيًا.

تم تصنيف كلا وحدتي المعالجة المركزية على 360/350 واط، لكن SapphireRapids تستهلك المزيد من الطاقة، لذلك من المرجح أن تكون التكلفة الإجمالية للملكية أقل من حل AMD. بالإضافة إلى ذلك، توفر AMD أيضًا سلسلة Genoa-X من المنتجات المحسنة 3DV-Cache التي يمكن أن توفر أداءً تنافسيًا في سيناريوهات أحمال العمل ذات النطاق الترددي المحدود.

ستطلق إنتل سلسلة وحدات المعالجة المركزية Xeon من الجيل الخامس في 14 ديسمبر، بينما ستتوفر وحدات المعالجة المركزية Granite Ridge في النصف الثاني من عام 2024، بعد وقت قصير من إطلاق Sierra Forest.