AMD shares first official benchmarks for EPYC 'Venice' CPUs, targets Nvidia — company claims 256-core chip is more than twice as fast as Nvidia Vera, 96-core model 20% faster per-core | Tom's HardwareTom's Hardware

پردازنده‌های EPYC Venice AMD در بنچمارک‌ها انویدیا Vera را شکست دادند

پس از عرضه پردازنده‌های EPYC ‘Venice’ شرکت AMD در ماه جولای، AMD روز جمعه ادعاهای عملکردی خود را برای نسل آتی تراشه‌های سرور خود گسترش داد. ادعای سطح بالا تغییری نکرده است. AMD همچنان می‌گوید یک تراشه ۹۶ هسته‌ای و با فرکانس بالا از سری Venice، حدود ۲۰ درصد سریع‌تر از Vera 88 هسته‌ای انویدیا در تست Integer Rate بنچمارک SPEC CPU 2026 است. با این حال، این شرکت در یک وایت‌پیپر جدید جزئیات بسیار بیشتری در مورد بنچمارک‌ها ارائه کرده است.

a snippet from the HBM roadmap article

در وایت‌پیپر AMD، چندین تفاوت پیکربندی بسته به بنچمارک وجود دارد و اگرچه ما تمام تلاش خود را می‌کنیم تا این تفاوت‌ها را در اینجا بیان کنیم، اما همه جزئیات را در اختیار نداریم. به ویژه برای مقایسه با Vera، AMD داده‌ها را از منابع مختلف ترکیب کرده و در برخی موارد، از نسخه‌های اصلی متفاوتی از مجموعه کامپایلر GNU (GCC) استفاده کرده است. این می‌تواند تأثیر قابل توجهی بر عملکرد داشته باشد، بنابراین با احتیاط به نتایج نگاه کنید.

Venice benchmarks

اولین نتایج مربوط به SPEC CPU 2026 با تست intrate است که به توان عملیاتی کلی می‌پردازد. اینها اعداد قدیمی‌تری هستند که در ماه جولای با GCC 15.2 جمع‌آوری شده‌اند. تست intrate چندین کپی از یک برنامه را روی یک CPU اجرا می‌کند و روش استاندارد این است که یک کپی به ازای هر ترد اجرا شود. احتمالاً AMD نیز همین کار را کرده است، اما وایت‌پیپر حتی در پاورقی‌ها نیز این موضوع را روشن نمی‌کند.

طبق اسلاید، مدل ۲۵۶ هسته‌ای ۹۹۹۶، ۲.۳۷ برابر سریع‌تر از Intel Xeon 6980P و ۲.۲۴ برابر سریع‌تر از Vera است. وایت‌پیپر روشن می‌کند که CPU مرموز ۹۰۰۶ همان پرچمدار ۲۵۶ هسته‌ای است. شاید چشمگیرترین بخش، مقایسه نسل به نسل AMD باشد. طبق این نتایج، ۹۹۹۶ حدود ۷۸ درصد سریع‌تر از EPYC 9965 192 هسته‌ای نسل قبلی است.

اگرچه نتایج سطح بالا شامل داده‌هایی از اینتل و AWS است، اما بخش عمده‌ای از وایت‌پیپر به طور مستقیم بر مقایسه بین Venice و Vera متمرکز شده است. AMD زیرتست‌های جداگانه SPEC CPU 2026 intrate را در وایت‌پیپر تشریح کرده است که می‌توانید در ادامه مشاهده کنید.

Venice benchmarks

این مقایسه به طور طبیعی برای AMD خوب به نظر می‌رسد، اگرچه چند نکته در پیکربندی وجود دارد. AMD در حال آزمایش یک EPYC 9996 با هسته‌های کاهش‌یافته است که از ۲۵۶ هسته به ۹۶ هسته کاهش یافته است. اشاره‌ای به بودجه توان نشده است، اما زمانی که AMD در ابتدا اعداد SPEC را به اشتراک گذاشت، مدل ۹۶ هسته‌ای به همان ۶۰۰ وات مدل ۲۵۶ هسته‌ای دسترسی داشت — در حالی که SKU 96 هسته‌ای و با فرکانس بالای Venice شرکت AMD حداکثر ۵۰۰ وات مصرف می‌کند. با این حال، مهم‌تر از آن کامپایلر است. AMD از GCC 16.1 استفاده می‌کند و نتایج را با نتایجی که انویدیا در وایت‌پیپر Vera خود به اشتراک گذاشته بود، مقایسه می‌کند. انویدیا از GCC 15.2 استفاده کرده بود.

مایکل لارابل در Phoronix یک مقاله خوب در مورد تفاوت بین GCC 15 و 16 دارد، اما خلاصه داستان این است که تفاوت‌های عملکردی وجود دارد که همیشه هم به نفع نیستند. GCC 16 به دلیل بهینه‌سازی‌های بهتر، زمان بیشتری برای کامپایل نیاز دارد، از این رو امتیازات پایین‌تر در کامپایل‌های GCC و LLVM در بالا مشاهده می‌شود. با این حال، این منجر به باینری‌های سریع‌تر می‌شود. میزان آن به پرچم‌ها، نرم‌افزار و مجموعه‌ای از عوامل دیگر بستگی دارد. صرف نظر از این، مقایسه بنچمارک‌ها با استفاده از دو نسخه کامپایلر متفاوت، بهترین روش نیست.

Venice benchmarks

در مورد Phoronix، AMD برخی داده‌ها را برای آزمایش اولیه و کنترل‌شده Vera توسط این نشریه جمع‌آوری کرده است. در بالا، می‌توانید Stream را مشاهده کنید، یک بنچمارک استاندارد صنعتی برای اندازه‌گیری پهنای باند حافظه. باز هم، AMD از یک ۹۹۹۶ با هسته‌های کاهش‌یافته از ۲۵۶ به ۹۶ استفاده می‌کند و بودجه توان ۶۰۰ واتی را برای آن در نظر گرفته است. با این حال، این یک نمایش چشمگیر است، زیرا Vera در نتایج اصلی Stream این نشریه، رقبا را کاملاً شکست داده بود. در اینجا، AMD حدود ۱۸ درصد جلوتر است و عملکرد به ازای هر هسته حدود ۸ درصد بیشتر است.

Venice benchmarks

فراتر از Vera، AMD همچنین عملکرد را در بارهای کاری ابری، از جمله پایگاه داده، جاوا و رمزنگاری نشان داد. بار دیگر، مقایسه نسل به نسل برجسته است، زیرا AMD با تراشه‌های نسل قبلی خود نیز در این بارهای کاری پیشتاز بود. AMD این آزمایش‌ها را خود انجام داده است، نه اینکه به داده‌های شخص ثالث تکیه کند، اگرچه نتایج Graviton5 از یک نمونه ابری AWS به دست آمده است.

Venice benchmarks.

به طور مشابه، در بارهای کاری HPC، AMD برتری خود را نسبت به محصول پرچمدار Granite Rapids-AP اینتل افزایش می‌دهد. پردازنده‌های مرکز داده نسل بعدی اینتل، با اسم رمز Diamond Rapids، قرار است سال آینده عرضه شوند.

Nvidia Vera CPU Nvidia Vera CPU amd Venice benchmarks

در نهایت، ما “عملکرد بار کاری هوش مصنوعی عامل‌محور” را داریم که با وجود آنچه نام‌ها در نمودار بالا نشان می‌دهند، از بنچمارک‌های واقعی برای مقایسه استفاده می‌کند. از چپ به راست، AMD از NGINX، کیت TPCx-AI، FAISS، TPC-H و TPC-C و بازپخش یک عامل چندشخصیتی استفاده کرده است. برای TPC-H و TPC-C، AMD می‌گوید بارهای کاری را از آن بنچمارک‌ها استخراج کرده است، بنابراین نتایج در اینجا با نتایج منتشر شده قابل مقایسه نیستند.

اگرچه نگاه کردن به نتایج بنچمارک همیشه جالب است، اما در زمینه استقرار سرور، حداقل در مقیاسی که AMD هدف قرار داده است، چیز زیادی نمی‌گوید. عملکرد اوج تنها یکی از عوامل اصلی است که در استقرار سرور نقش دارد و حتی در آن صورت، عملکرد می‌تواند بسته به نرم‌افزاری که اجرا می‌کنید و نحوه ساخت آن، به شدت متفاوت باشد.

با این حال، Venice چشمگیر به نظر می‌رسد، شاید بیشتر در مقایسه نسل به نسل تا هر مقایسه رقابتی دیگر. امیدواریم این برای عرضه آینده Zen 6 AMD در دسکتاپ‌های مصرف‌کننده نویدبخش باشد، اما باید منتظر بمانیم تا تیم قرمز اطلاعات بیشتری به اشتراک بگذارد تا بتوانیم در این زمینه نتیجه‌گیری کنیم.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!