AMD and Cerebras partner on low-latency, high-throughput AI inference — EPYC processors in Helios rack-scale infrastructure paired with Cerebras' Wafer-Scale Engine (WSE) solutions | Tom's HardwareTom's Hardware

AMD و Cerebras پلتفرم استنتاج هوش مصنوعی با EPYC و WSE را توسعه می‌دهند

AMD و Cerebras Systems روز پنجشنبه از برنامه‌های خود برای توسعه پلتفرمی خبر دادند که پردازنده‌های EPYC شرکت AMD را در زیرساخت‌های مقیاس رک Helios با راه‌حل‌های موتور مقیاس ویفر (WSE) Cerebras ترکیب می‌کند. این سیستم‌های جدید نوید می‌دهند که تأخیر کم CPUها و GPUهای Instinct شرکت AMD را با توان عملیاتی بالای پردازنده‌های موتور مقیاس ویفر (WSE) Cerebras ترکیب کنند.

AMD و Cerebras انتظار دارند که پلتفرم جدید بین‌رک‌مقیاس — مبتنی بر رک Helios شرکت AMD با CPUهای EPYC و شتاب‌دهنده‌های سری MI400 Instinct — مسئول پردازش سریع و پنجره‌های متنی بزرگ باشد، در حالی که WSE شرکت Cerebras مرحله تولید توکن با پهنای باند حافظه بالا را بر عهده خواهد گرفت.

AMD و Cerebras انتظار دارند که پلتفرم استنتاج تفکیک‌شده آن‌ها با اختصاص بخش‌های مختلف یک بار کاری استنتاج به معماری‌های بهینه شده برای آن‌ها، تا 5 برابر توکن در ثانیه به ازای هر وات (T/s/W) بالاتری ارائه دهد. بنابراین، AMD Helios ظرفیت محاسباتی در مقیاس رک و حجم زیادی از درخواست‌های پیچیده را فراهم می‌کند، در حالی که WSE شرکت Cerebras تولید توکن حساس به تأخیر را مدیریت می‌کند. این دو پلتفرم محاسباتی در یک جریان کاری استنتاج واحد عمل خواهند کرد، اگرچه شرکت‌ها داده‌های عملکرد اضافی را فاش نکرده‌اند یا توضیح نداده‌اند که سیستم‌ها چگونه به هم متصل خواهند شد.

ایده اصلی پلتفرم AMD + Cerebras اساساً همان مفهوم CPX انویدیا است، اما AMD و Cerebras سخت‌افزار تخصصی را به مرحله استنتاج متفاوتی اختصاص می‌دهند.

طراحی تفکیک‌شده انویدیا استنتاج را به دو بخش زمینه/پیش‌پر کردن (context/prefill) و تولید/رمزگشایی (generation/decode) تقسیم می‌کند. GPU لغو شده Rubin CPX با GDDR7 به طور خاص برای مرحله زمینه/پیش‌پر کردن که محاسبات سنگینی دارد، بهینه شده بود، در حالی که GPUهای معمولی Rubin مجهز به HBM مرحله تولید را که محدود به پهنای باند حافظه است، مدیریت می‌کنند.

در مقابل، پلتفرم AMD و Cerebras از همان اصل تفکیک پیروی می‌کند، اما تخصص معکوس است: پلتفرم Helios شرکت AMD با GPUهای Instinct مرحله پیش‌پر کردن را مدیریت کرده و درخواست‌ها و پنجره‌های متنی بزرگ را پردازش می‌کند، در حالی که WSE شرکت Cerebras مرحله رمزگشایی را بر عهده گرفته و تولید توکن حساس به تأخیر را مدیریت می‌کند.

Cerebras قصد دارد سیستم‌های AMD Helios را در مراکز داده خود نصب کرده و آن‌ها را با رک‌های WSE خود یکپارچه کند. طبق گفته دو شرکت، این پیشنهاد ترکیبی قرار است در نیمه دوم سال 2026 ابتدا از طریق Cerebras Cloud در دسترس قرار گیرد.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!