AMD در رویداد Advancing AI خود، شتابدهنده هوش مصنوعی Instinct MI455X و معماری مقیاس رک Helios را معرفی کرد. این محصول برای رقابت مستقیم با طراحیهای NVL72 انویدیا در نسلهای Blackwell و Rubin طراحی شده است. MI455X، پیشرفتهترین شتابدهنده هوش مصنوعی AMD، تراشهای عظیم با ۳۲۰ میلیارد ترانزیستور است که از بستهبندی پیشرفته و معماری CDNA 5 بهره میبرد. این شتابدهنده بهبودهای چشمگیری در عملکرد محاسباتی، به ویژه برای استنتاج هوش مصنوعی، ارائه میدهد و FLOPS اوج را تا چهار برابر افزایش میدهد.
مزیت کلیدی MI455X، حافظه HBM4 با ظرفیت ۴۳۲ گیگابایت به ازای هر پردازنده گرافیکی است که از Rubin انویدیا بیشتر است. در مقیاس رک، این ظرفیت به ۳۱.۱ ترابایت در ۷۲ پردازنده گرافیکی میرسد. AMD کش و حافظه را بازنگری کرده و قابلیتهای انتقال داده کارآمدتری مانند Tensor Data Mover و multicast را اضافه کرده است. با قراردادهای اخیر با مایکروسافت و Anthropic، رقابت برای برتری در محاسبات هوش مصنوعی در نیمه دوم سال جاری میلادی به شدت افزایش خواهد یافت.
تراشه هوش مصنوعی AI5 تسلا، که توسط ایلان ماسک معرفی شده بود، اکنون در آستانه تولید انبوه در سامسونگ فاندری با فناوری پیشرفته 2 نانومتری قرار گرفته است. این خبر توسط یک مهندس ارشد سامسونگ در لینکدین فاش شد و نشان میدهد که این تراشه اخیراً به مرحله “تیپاوت” رسیده است. تسلا برای تولید این پردازنده قدرتمند، استراتژی دو فاندری را در پیش گرفته و پیش از این، نسخه پیادهسازی شده با فناوری TSMC نیز به مرحله تیپاوت رسیده بود. این رویکرد دوگانه، تامین پایدار و حجم بالای تولید را تضمین میکند.
ماژول پردازنده AI5 شامل یک دای شتابدهنده فشرده و 12 بسته حافظه SK Hynix (GDDR6/GDDR7) است که به یک باس حافظه 384 بیتی با پهنای باند بالا (تا 1.536 ترابایت بر ثانیه) مجهز است. ماسک ادعا کرده که AI5 میتواند تا 40 برابر بهبود عملکرد نسبت به نسل قبلی خود داشته باشد. این تراشه قرار است در خودروها، رباتها و مراکز داده تسلا به کار گرفته شود و انتظار میرود یکی از پرتیراژترین تراشههای تاریخ باشد.
OpenAI با همکاری Arm و Broadcom در حال توسعه یک CPU سفارشی و شتابدهنده هوش مصنوعی داخلی است. Arm یک CPU سرور-کلاس طراحی میکند که زیربنای رکهای هوش مصنوعی نسل بعدی OpenAI خواهد بود و گام بزرگی برای Arm در بازار مراکز داده است. شتابدهنده هوش مصنوعی داخلی OpenAI، تخصصی برای بارهای کاری استنتاجی، قرار است در اواخر سال ۲۰۲۶ وارد تولید شود و تا سال ۲۰۲۹ ظرفیت محاسباتی ۱۰ گیگاوات را فراهم کند. این پروژه به OpenAI کمک میکند تا وابستگی خود به GPUهای Nvidia را کاهش داده و اهرم بیشتری در مذاکرات قیمتگذاری یابد.
سافتبانک، مالک Arm، میلیاردها دلار سرمایهگذاری کرده. برنامههای تراشه OpenAI، شامل توافقات با Nvidia و AMD، مجموعاً ۲۶ گیگاوات ظرفیت مرکز داده برنامهریزی شده دارد. تحلیلگران تخمین میزنند که استقرار این تراشههای سفارشی میتواند بیش از ۱ تریلیون دلار هزینه ساخت و تجهیزات ببرد. این توسعه نشاندهنده تلاش OpenAI برای کنترل بیشتر بر زیرساختهای هوش مصنوعی خود و مقابله با محدودیتهای عرضه GPU.
OpenAI و Broadcom قراردادی برای توسعه و استقرار ۱۰ گیگاوات شتابدهنده هوش مصنوعی سفارشی امضا کردهاند. این همکاری که استقرار آن از نیمه دوم سال ۲۰۲۶ آغاز و تا پایان ۲۰۲۹ تکمیل میشود، نشاندهنده تلاش OpenAI برای کاهش وابستگی به پردازندههای گرافیکی Nvidia و استفاده از سختافزار داخلی با IP شبکه Broadcom است. این معامله چند میلیارد دلاری، به تعهدات سختافزاری قبلی OpenAI با Nvidia و AMD اضافه کرده و مجموع تعهدات این شرکت را به ۲۶ گیگاوات میرساند.
این روند توسعه سیلیکونهای سفارشی در میان شرکتهای بزرگ هوش مصنوعی مانند آمازون، گوگل، متا و مایکروسافت مشاهده میشود که چالشهایی را برای اکوسیستم CUDA Nvidia ایجاد میکند. جزئیات فنی کمی منتشر شده، اما استفاده از شبکه مبتنی بر اترنت تأیید شده است. این همکاری، OpenAI را در طراحی ASIC و بلوغ زنجیره تأمین Broadcom تقویت کرده و مسیری برای سختافزار متمایز بدون نیاز به ایجاد تیم سیلیکون از ابتدا فراهم میآورد.