هواوی عرضه جهانی تراشههای هوش مصنوعی Ascend را به چین محدود کرد
هواوی این هفته اعلام کرد که شتابدهندههای هوش مصنوعی نسل بعدی و چشمگیر سری Ascend 900 این شرکت، تنها در چین و نه در سطح بینالمللی عرضه خواهند شد، زیرا این شرکت در تلاش است تا تقاضای داخلی را در بحبوحه محدودیتهای ظرفیت تولید برآورده کند. در حالی که واحدهای پردازش عصبی (NPU) سری Ascend 960 آینده میتوانند با برخی از پردازندههای گرافیکی هوش مصنوعی موجود AMD و Nvidia رقابت کنند، تقاضا برای این واحدها در خارج از چین به هر حال تضمین شده نبود.
اریک شو، رئیس دورهای هواوی، در حاشیه کنفرانس Huawei Connect این شرکت، به گزارش رویترز، گفت: «از آنجایی که ما ظرفیت کافی برای برآورده کردن تقاضا حتی در چین را نداریم، برنامهای برای گسترش کامل به بازار بینالمللی نداریم.» او افزود که هواوی حجم محدودی را به «برخی کشورهایی که تقاضا در آنها به ویژه قوی است» عرضه میکند، اگرچه جزئیات بیشتری ارائه نکرد.
هواوی این هفته جدیدترین نقشه راه شتابدهندههای هوش مصنوعی خود را رونمایی کرد که نشاندهنده افزایش قابل توجه عملکرد آموزش و استنتاج برای NPUهای نسل بعدی Ascend 960، 970 و 980 نسبت به سریهای موجود Ascend 910C و Ascend 950 است. Ascend 960DT و 960PR قرار است عملکرد آموزش FP8 خود را به 2 PFLOPS و عملکرد استنتاج FP4 خود را به ترتیب به 4 PFLOPS و 8 PFLOPS در سال 2027 افزایش دهند. در همین حال، جانشینان آنها، Ascend 970 و Ascend 980، پیشبینی میشود که عملکرد FP4 خود را به ترتیب به 14 PFLOPS و 28 PFLOPS در سالهای آینده افزایش دهند.
پردازندههای هوش مصنوعی هواوی Ascend در برابر Nvidia
*دادههای اولیه
S/D – پراکنده و متراکم (Sparse and Dense)
T/I – آموزش و استنتاج (Training and Inference)
اما در حالی که NPUهای Ascend آینده به طور قابل توجهی سریعتر از نسلهای قبلی خود خواهند بود، به ویژه برای استنتاج، آنها حداقل از نظر عملکرد محاسباتی خام، همچنان بسیار عقبتر از شتابدهندههای نسل قبلی و فعلی Nvidia باقی خواهند ماند. Ascend 960DT هواوی برای سال 2027، پیشبینی میشود 2 FP8 TFLOPS برای آموزش ارائه دهد، در مقایسه با 4 FP8 TFLOPS Nvidia برای H200 که در سال 2023 عرضه شد. Ascend 960PR انتظار میرود 8 FP4 PFLOPS برای آموزش ارائه کند که بسیار عقبتر از B300 Nvidia است که 15 تا 20 NVFP4 PFLOPS ارائه میدهد. حتی Ascend 980 که برای سال 2029 هدفگذاری شده، پیشبینی میشود به 7.2 FP8 PFLOPS و 28 FP4 PFLOPS برسد که بسیار کمتر از R200 Nvidia است که قرار است امسال 17.5 FP8 PFLOPS و 35/50 FP4 PFLOPS ارائه دهد.
چنین تفاوت عملکرد عظیمی با سختافزارهای پیشرو هوش مصنوعی، اتکای هواوی را به مقیاسپذیری عظیم در سطح سیستم به جای عملکرد تراشه به تراشه برای رقابت با Nvidia تقویت خواهد کرد. اما مقیاسپذیری عظیم در سطح سیستم با مصرف برق بسیار زیاد همراه است که باعث میشود SuperPoDها و SuperClusterهای نسل بعدی Atlas هواوی در بازارهایی که میتوانند به سختافزار AMD یا Nvidia دسترسی داشته باشند، به طور قابل توجهی کمتر رقابتی باشند.
هواوی در یک وضعیت متناقض جالب قرار دارد. از یک سو، تلاشهای یکپارچهسازی آن مانند اپتیک نزدیک به بسته (NPO) به وضوح ظرفیت را در گرههای «قدیمیتر» آزاد میکند که میتوانند برای سایر اجزای پلتفرمهای هوش مصنوعی استفاده شوند. اما از سوی دیگر، ناتوانی SMIC در افزایش تولید در گرههای 7 نانومتری و 6 نانومتری، توانایی هواوی را برای تامین سختافزار هوش مصنوعی خود محدود میکند، به همین دلیل است که به سختی میتواند تقاضا را برآورده کند.
با این حال، در حالی که SuperPoDهای Atlas هواوی با حداکثر 15,488 NPU Ascend 960 میتوانند تا 30 FP8 EFLOPS و 120 FP4 EFLOPS عملکرد ارائه دهند و بسیار فراتر از قابلیتهای خوشههای NVL72 Nvidia با مقیاس 72 پردازنده گرافیکی هستند، عملکرد آنها به ازای هر وات در مقایسه با معماریهای Nvidia به طور چشمگیری پایینتر خواهد بود، به این معنی که تقاضا برای چنین سختافزاری در خارج از چین در بهترین حالت محدود خواهد بود. با این اوصاف، تلاش برای عرضه جهانی سختافزار هوش مصنوعی در حال حاضر برای هواوی منطقی نیست. آنچه شاید منطقی باشد، ارائه دسترسی ابری به سختافزار خود به مشتریان دانشگاهی و پژوهشی مختلف برای محبوبیت بخشیدن به پشته نرمافزاری CANN آن است.
- کولبات
- شهریور 30, 1405
- 8 بازدید






