AMD در رویداد Advancing AI خود، شتابدهنده هوش مصنوعی Instinct MI455X و معماری مقیاس رک Helios را معرفی کرد. این محصول برای رقابت مستقیم با طراحیهای NVL72 انویدیا در نسلهای Blackwell و Rubin طراحی شده است. MI455X، پیشرفتهترین شتابدهنده هوش مصنوعی AMD، تراشهای عظیم با ۳۲۰ میلیارد ترانزیستور است که از بستهبندی پیشرفته و معماری CDNA 5 بهره میبرد. این شتابدهنده بهبودهای چشمگیری در عملکرد محاسباتی، به ویژه برای استنتاج هوش مصنوعی، ارائه میدهد و FLOPS اوج را تا چهار برابر افزایش میدهد.
مزیت کلیدی MI455X، حافظه HBM4 با ظرفیت ۴۳۲ گیگابایت به ازای هر پردازنده گرافیکی است که از Rubin انویدیا بیشتر است. در مقیاس رک، این ظرفیت به ۳۱.۱ ترابایت در ۷۲ پردازنده گرافیکی میرسد. AMD کش و حافظه را بازنگری کرده و قابلیتهای انتقال داده کارآمدتری مانند Tensor Data Mover و multicast را اضافه کرده است. با قراردادهای اخیر با مایکروسافت و Anthropic، رقابت برای برتری در محاسبات هوش مصنوعی در نیمه دوم سال جاری میلادی به شدت افزایش خواهد یافت.
متا در حال استفاده از شتابدهندههای هوش مصنوعی سفارشی AMD Instinct MI450-series است که با 144 گیگابایت حافظه HBM4 (به جای 432 گیگابایت نسخه کامل) برای سیستمهای توصیهگر بهینهسازی شدهاند. این رویکرد به متا امکان میدهد تا هزینههای مواد اولیه و مصرف انرژی را به طور چشمگیری کاهش دهد، در حالی که عملکرد کافی برای بارهای کاری توصیهگر را حفظ میکند. این طراحی سفارشی، نسبت پهنای باند به دلار رقابتیتری را ارائه میدهد و میتواند به صرفهجویی دهها میلیون دلاری برای متا منجر شود.
با این حال، این کاهش ظرفیت و قدرت محاسباتی، به قیمت از دست دادن تطبیقپذیری تمام میشود. این شتابدهندهها برای آموزش مدلهای زبان بزرگ (LLM) و استنتاج در مقیاس وسیع کمتر جذاب هستند و ممکن است متا را مجبور کند تا برای نیازهای هوش مصنوعی پیشرفتهتر خود، همچنان به شتابدهندههای عمومیتر، احتمالاً از انویدیا، متکی باشد. این وضعیت طنزآمیز است، زیرا متا برای کاهش هزینهها به AMD روی آورده، اما تخصصگرایی ممکن است در نهایت به نفع رقیبش انویدیا تمام شود.
سامسونگ گواهینامه انویدیا را برای تراشههای ۱۲ لایه HBM3E خود، که برای شتابدهندههای هوش مصنوعی پیشرفته حیاتی هستند، با موفقیت کسب کرد. این خبر باعث جهش بیش از ۵ درصدی سهام سامسونگ شد و نشاندهنده رسیدن این شرکت به رقبای اصلی خود، SK hynix و Micron، در بازار حافظههای HBM3E است. فروش انبوه HBM3E سامسونگ به انویدیا تا سال ۲۰۲۶ آغاز نخواهد شد، اما حافظه HBM3 آن در کارتهای Nvidia DGX B300 و AMD Instinct MI350 استفاده میشود.
صنعت به سرعت به سمت نسل بعدی، HBM4، حرکت میکند که پهنای باند ۲ ترابایت بر ثانیه، ظرفیت ۶۴ گیگابایت و کاهش مصرف انرژی را نوید میدهد. سامسونگ برای دریافت گواهینامه زودهنگام HBM4 و آغاز تولید انبوه در نیمه اول ۲۰۲۶ تلاش میکند. اگرچه SK hynix در توسعه HBM4 پیشتاز است، اما جهش سهام سامسونگ نشاندهنده اعتماد سرمایهگذاران به توانایی این شرکت برای رقابت است.
انویدیا تامینکنندگان حافظه را برای HBM4 با سرعت 10 گیگابیت بر ثانیه (پلتفرم Vera Rubin 2026) تحت فشار قرار میدهد. این سرعت، فراتر از استاندارد JEDEC (8 گیگابیت بر ثانیه) بوده و هدفش افزایش پهنای باند GPU برای رقابت با MI450 ایامدی. پهنای باند GPU را تا 15 ترابایت بر ثانیه میرساند، اما چالشهایی چون مصرف توان بالا و پیچیدگی فنی دارد. TrendForce به تقسیمبندی SKUهای Rubin بر اساس رده HBM اشاره دارد.
SK hynix توسعه HBM4 را تکمیل کرده؛ سامسونگ با نود 4 نانومتری FinFET رویکردی تهاجمی دارد. ایامدی با MI450 (تا 432 گیگابایت HBM4 در هر GPU) در حال رقابت است. تکیه انویدیا بر HBM4 10Gbps، آن را در معرض خطرات تامین، بازدهی و محدودیتهای توان قرار میدهد، که رقابت فشرده و چالشهای فنی توسعه حافظههای پیشرفته را نشان میدهد.