Arm پلتفرم Neoverse CSS N4 با ۱۲۸ هسته و فناوری TSMC N3P را معرفی کرد
Arm پلتفرمهای نسل بعدی Neoverse CSS N4 خود را به فضای ابری میآورد که تا ۱۲۸ هسته در هر دای را پشتیبانی میکنند و بر پایه فرآیند N3P شرکت TSMC ساخته شدهاند. زیرسیستم محاسباتی Arm یا CSS، یک برنامه نیمهسفارشی است که به مشتریان امکان میدهد تا یک تراشه را بر اساس IP شرکت Arm طراحی کنند و مؤلفههایی مانند تعداد هسته، اندازه کش، ورودی/خروجی و اتصالپذیری را متناسب با نیازهای خاص خود پیکربندی کنند. این همان پلتفرمی است که در همه جا از پردازندههای مرکزی در Azure و Google Cloud گرفته تا DPUs در Nvidia و Intel شاهد بودهایم.
Arm میگوید Neoverse CSS N4 بین ۸ تا ۱۲۸ هسته Neoverse N4 را پشتیبانی میکند که با فرکانس حداکثر ۳.۸ گیگاهرتز کار میکنند. احتمالاً با افزایش تعداد هستهها، فرکانسها کاهش مییابند؛ Arm حداکثر فرکانسها را برای هر پیکربندی ممکن مشخص نکرده است. در سطح سیستمی، Neoverse CSS N4 میتواند فراتر از ۱۲۸ هسته مقیاسپذیر باشد، با پشتیبانی از طراحیهای چند-چیپلت و چند-سوکت، و با پشتیبانی از UCIe از طریق اتصالات چیپ به چیپ، و همچنین “PNYهای خاص شرکا”.
این پلتفرم از DDR5 یا LPDDR6 پشتیبانی میکند و دارای حداکثر ۲۵۶ مگابایت کش L3 در هر دای است. برای کش محلی، Arm تا ۲ مگابایت کش L2 در هر هسته، و همچنین ۶۴ کیلوبایت کش دستورالعمل L1 و ۶۴ کیلوبایت کش داده L1 در هر هسته را شامل میشود. برای ورودی/خروجی، Arm تا ۱۲۸ خط PCIe 7/6 و CXL 4.0 را پشتیبانی میکند.
این یک ارتقاء قابل توجه نسبت به پلتفرم Neoverse CSS N2 است که حداکثر ۶۴ هسته، ۱ مگابایت کش L2 در هر هسته، و ۶۴ مگابایت کش L3 را پشتیبانی میکرد، همراه با DDR5 یا LPDDR5 و ۶۴ خط PCIe 5.0/CXL.
Arm میگوید با ۱۲۸ هسته که با فرکانس ۳ گیگاهرتز و ۲ مگابایت کش L2 در هر هسته کار میکنند، Neoverse CSS N4 دو برابر عملکرد سوکت Neoverse N3، ۱.۲۵ برابر عملکرد به ازای هر وات، و ۱.۷۵ برابر پهنای باند حافظه را ارائه میدهد.
هستههای سری N شرکت Arm برای عملکرد به ازای هر وات بهینهسازی شدهاند، در حالی که هستههای سری V آن حداکثر عملکرد را هدف قرار میدهند. به عنوان مثال، Arm از بلوکهای ساختمانی Neoverse CSS V3 برای CPU AGI خود استفاده کرده است، و Nvidia از Neoverse V2 برای CPU Grace نسل قبلی خود استفاده کرده است ( CPU Vera از یک هسته سفارشی استفاده میکند). AWS نیز از هستههای سری V Neoverse برای تراشههای Graviton خود استفاده کرده است، همانطور که Google Cloud برای Axion استفاده میکند.
هستههای سری N معمولاً در پردازندههای مرکزی با عملکرد بالا مستقر نمیشوند. بلکه، آنها در شتابدهندههای با عملکرد کمتر، مانند آداپتور IPU E2100 اینتل، که بر پایه هستههای Neoverse N1 ساخته شده است، جای میگیرند. ما همچنین شاهد استقرار آن در بارهای کاری مبتنی بر ابر با نیاز کمتر بودهایم، مانند Microsoft Azure Cobalt 100، که بر پایه Neoverse N2 ساخته شده است. Cobalt 200 به Neoverse V3 منتقل شد.
ما اطلاعات زیادی در مورد هستههای Neoverse N4 با اسم رمز Dionysus نداریم. نقشه راه ۲۰۲۴ شرکت Arm نشان میدهد که Arm Neoverse CSS V4 نیز با اسم رمز Vega را خواهیم دید.
برخلاف یک اعلامیه سنتی از اینتل، AMD، یا شرکای مختلفی که بر پایه Arm میسازند، هستههای Neoverse N4 را تا مدتی در بازار نخواهیم دید. اعلامیهای که Arm منتشر میکند برای کسانی است که بر روی پلتفرم CSS کار میکنند و از بلوکهای ساختمانی تأیید شده Arm برای ایجاد سریع سیلیکون نیمهسفارشی استفاده میکنند. Arm هنوز هیچ شریکی را اعلام نکرده است، اگرچه به طور سنتی، تنها چند قرارداد بزرگ CSS مورد نیاز است.
استقرارهای اضافی CPU Arm AGI
همراه با اعلام Neoverse CSS N4 شرکت Arm، این شرکت استقرارهای اضافی تراشه AGI خود را که با هستههای Neoverse V3 ساخته شده است، فاش کرد. این شرکت اعلام کرد که Oracle و ByteDance تراشههای AGI را مستقر خواهند کرد، در کنار استقرارهای قبلاً اعلام شده در Meta، Lenovo، SAP، OpenAI، Cloudflare و دیگران.
اگرچه Arm در مورد AGI زیاد صحبت کرده است، از جمله یک بررسی عمیق از معماری تراشه در Hot Chips، اما هنوز اعداد عملکرد واقعی را ندیدهایم. این غیرمعمول نیست، به خصوص در میان تراشههای مبتنی بر Arm جدیدتر. به عنوان مثال، ما فقط مقایسههای نسل به نسل برای Microsoft Azure Cobalt 200 و AWS Graviton5 را داریم. Arm به طور مبهم به عملکرد اشاره کرده و گفته است که AGI “بیش از ۲ برابر عملکرد در هر رک را در مقایسه با جدیدترین سیستمهای x86” ارائه میدهد، اگرچه این ادعاها بر اساس تخمینهای داخلی است، نه بنچمارکهای واقعی.
AGI یک CPU دو-دای با حداکثر ۱۳۶ هسته Neoverse V3 و حداکثر ۲۷۲ مگابایت کش L3 است که میتواند تا فرکانس ۳.۷ گیگاهرتز کار کند. این تراشه دارای مشخصاتی است که با هر طراحی x86 رده بالا در بازار فعلی مطابقت دارد، بر روی گره ۳ نانومتری ساخته شده و تا ۶ ترابایت ظرفیت حافظه در هر تراشه را پشتیبانی میکند که با سرعت DDR5-8800 کار میکند. شاید بزرگترین تفاوت در مقایسه با AMD و Intel، تصمیم Arm برای قرار دادن حافظه و ورودی/خروجی بر روی همان دای محاسباتی بود که به گفته این شرکت منجر به تأخیر حافظه کمتر از ۱۰۰ نانوثانیه میشود.
این اولین تلاش Arm برای سیلیکون تولیدی خود است، اگرچه تاکنون به عنوان وسیلهای برای کاربردهای گستردهتر Arm در مراکز داده نیز مطرح شده است. مایکروسافت، انویدیا، متا، گوگل کلود و دیگران تراشههای سفارشی را بر اساس IP شرکت Arm میسازند، که حتی با وجود AGI، همچنان هدف اصلی به نظر میرسد.
- کولبات
- شهریور 17, 1405
- 6 بازدید






