پردازندههای EPYC Venice AMD در بنچمارکها انویدیا Vera را شکست دادند
پس از عرضه پردازندههای EPYC ‘Venice’ شرکت AMD در ماه جولای، AMD روز جمعه ادعاهای عملکردی خود را برای نسل آتی تراشههای سرور خود گسترش داد. ادعای سطح بالا تغییری نکرده است. AMD همچنان میگوید یک تراشه ۹۶ هستهای و با فرکانس بالا از سری Venice، حدود ۲۰ درصد سریعتر از Vera 88 هستهای انویدیا در تست Integer Rate بنچمارک SPEC CPU 2026 است. با این حال، این شرکت در یک وایتپیپر جدید جزئیات بسیار بیشتری در مورد بنچمارکها ارائه کرده است.
در وایتپیپر AMD، چندین تفاوت پیکربندی بسته به بنچمارک وجود دارد و اگرچه ما تمام تلاش خود را میکنیم تا این تفاوتها را در اینجا بیان کنیم، اما همه جزئیات را در اختیار نداریم. به ویژه برای مقایسه با Vera، AMD دادهها را از منابع مختلف ترکیب کرده و در برخی موارد، از نسخههای اصلی متفاوتی از مجموعه کامپایلر GNU (GCC) استفاده کرده است. این میتواند تأثیر قابل توجهی بر عملکرد داشته باشد، بنابراین با احتیاط به نتایج نگاه کنید.
اولین نتایج مربوط به SPEC CPU 2026 با تست intrate است که به توان عملیاتی کلی میپردازد. اینها اعداد قدیمیتری هستند که در ماه جولای با GCC 15.2 جمعآوری شدهاند. تست intrate چندین کپی از یک برنامه را روی یک CPU اجرا میکند و روش استاندارد این است که یک کپی به ازای هر ترد اجرا شود. احتمالاً AMD نیز همین کار را کرده است، اما وایتپیپر حتی در پاورقیها نیز این موضوع را روشن نمیکند.
طبق اسلاید، مدل ۲۵۶ هستهای ۹۹۹۶، ۲.۳۷ برابر سریعتر از Intel Xeon 6980P و ۲.۲۴ برابر سریعتر از Vera است. وایتپیپر روشن میکند که CPU مرموز ۹۰۰۶ همان پرچمدار ۲۵۶ هستهای است. شاید چشمگیرترین بخش، مقایسه نسل به نسل AMD باشد. طبق این نتایج، ۹۹۹۶ حدود ۷۸ درصد سریعتر از EPYC 9965 192 هستهای نسل قبلی است.
اگرچه نتایج سطح بالا شامل دادههایی از اینتل و AWS است، اما بخش عمدهای از وایتپیپر به طور مستقیم بر مقایسه بین Venice و Vera متمرکز شده است. AMD زیرتستهای جداگانه SPEC CPU 2026 intrate را در وایتپیپر تشریح کرده است که میتوانید در ادامه مشاهده کنید.
این مقایسه به طور طبیعی برای AMD خوب به نظر میرسد، اگرچه چند نکته در پیکربندی وجود دارد. AMD در حال آزمایش یک EPYC 9996 با هستههای کاهشیافته است که از ۲۵۶ هسته به ۹۶ هسته کاهش یافته است. اشارهای به بودجه توان نشده است، اما زمانی که AMD در ابتدا اعداد SPEC را به اشتراک گذاشت، مدل ۹۶ هستهای به همان ۶۰۰ وات مدل ۲۵۶ هستهای دسترسی داشت — در حالی که SKU 96 هستهای و با فرکانس بالای Venice شرکت AMD حداکثر ۵۰۰ وات مصرف میکند. با این حال، مهمتر از آن کامپایلر است. AMD از GCC 16.1 استفاده میکند و نتایج را با نتایجی که انویدیا در وایتپیپر Vera خود به اشتراک گذاشته بود، مقایسه میکند. انویدیا از GCC 15.2 استفاده کرده بود.
مایکل لارابل در Phoronix یک مقاله خوب در مورد تفاوت بین GCC 15 و 16 دارد، اما خلاصه داستان این است که تفاوتهای عملکردی وجود دارد که همیشه هم به نفع نیستند. GCC 16 به دلیل بهینهسازیهای بهتر، زمان بیشتری برای کامپایل نیاز دارد، از این رو امتیازات پایینتر در کامپایلهای GCC و LLVM در بالا مشاهده میشود. با این حال، این منجر به باینریهای سریعتر میشود. میزان آن به پرچمها، نرمافزار و مجموعهای از عوامل دیگر بستگی دارد. صرف نظر از این، مقایسه بنچمارکها با استفاده از دو نسخه کامپایلر متفاوت، بهترین روش نیست.
در مورد Phoronix، AMD برخی دادهها را برای آزمایش اولیه و کنترلشده Vera توسط این نشریه جمعآوری کرده است. در بالا، میتوانید Stream را مشاهده کنید، یک بنچمارک استاندارد صنعتی برای اندازهگیری پهنای باند حافظه. باز هم، AMD از یک ۹۹۹۶ با هستههای کاهشیافته از ۲۵۶ به ۹۶ استفاده میکند و بودجه توان ۶۰۰ واتی را برای آن در نظر گرفته است. با این حال، این یک نمایش چشمگیر است، زیرا Vera در نتایج اصلی Stream این نشریه، رقبا را کاملاً شکست داده بود. در اینجا، AMD حدود ۱۸ درصد جلوتر است و عملکرد به ازای هر هسته حدود ۸ درصد بیشتر است.
فراتر از Vera، AMD همچنین عملکرد را در بارهای کاری ابری، از جمله پایگاه داده، جاوا و رمزنگاری نشان داد. بار دیگر، مقایسه نسل به نسل برجسته است، زیرا AMD با تراشههای نسل قبلی خود نیز در این بارهای کاری پیشتاز بود. AMD این آزمایشها را خود انجام داده است، نه اینکه به دادههای شخص ثالث تکیه کند، اگرچه نتایج Graviton5 از یک نمونه ابری AWS به دست آمده است.
به طور مشابه، در بارهای کاری HPC، AMD برتری خود را نسبت به محصول پرچمدار Granite Rapids-AP اینتل افزایش میدهد. پردازندههای مرکز داده نسل بعدی اینتل، با اسم رمز Diamond Rapids، قرار است سال آینده عرضه شوند.
در نهایت، ما “عملکرد بار کاری هوش مصنوعی عاملمحور” را داریم که با وجود آنچه نامها در نمودار بالا نشان میدهند، از بنچمارکهای واقعی برای مقایسه استفاده میکند. از چپ به راست، AMD از NGINX، کیت TPCx-AI، FAISS، TPC-H و TPC-C و بازپخش یک عامل چندشخصیتی استفاده کرده است. برای TPC-H و TPC-C، AMD میگوید بارهای کاری را از آن بنچمارکها استخراج کرده است، بنابراین نتایج در اینجا با نتایج منتشر شده قابل مقایسه نیستند.
اگرچه نگاه کردن به نتایج بنچمارک همیشه جالب است، اما در زمینه استقرار سرور، حداقل در مقیاسی که AMD هدف قرار داده است، چیز زیادی نمیگوید. عملکرد اوج تنها یکی از عوامل اصلی است که در استقرار سرور نقش دارد و حتی در آن صورت، عملکرد میتواند بسته به نرمافزاری که اجرا میکنید و نحوه ساخت آن، به شدت متفاوت باشد.
با این حال، Venice چشمگیر به نظر میرسد، شاید بیشتر در مقایسه نسل به نسل تا هر مقایسه رقابتی دیگر. امیدواریم این برای عرضه آینده Zen 6 AMD در دسکتاپهای مصرفکننده نویدبخش باشد، اما باید منتظر بمانیم تا تیم قرمز اطلاعات بیشتری به اشتراک بگذارد تا بتوانیم در این زمینه نتیجهگیری کنیم.
- کولبات
- شهریور 28, 1405
- 8 بازدید






