گوگل با AMD برای توسعه TPUهای هوش مصنوعی نسل بعدی همکاری میکند
گوگل طبق یادداشتی از SemiAnalysis (از طریق شان)، با AMD برای توسعه یکی از TPUهای نسل دهم خود همکاری کرده است. تحلیلگران SemiAnalysis معتقدند که گوگل ممکن است به هستههای CPU شرکت AMD برای بارهای کاری سنگین CPU علاقهمند باشد. اگر این موضوع دقیق باشد، این همکاری اولین مشارکت عمده AMD در یک پروژه ASIC سفارشی هوش مصنوعی خواهد بود و میتواند نشاندهنده این باشد که گوگل در حال بررسی نوع جدیدی از TPU است که فناوری شتابدهنده اختصاصی خود را با هستههای عمومی داخلی برای بارهای کاری سنگین CPU ترکیب میکند.
یادداشت SemiAnalysis برای مشتریان که توسط شان نقل شده، میگوید: «شایعات بازار حاکی از آن است که [گوگل] در حال کار با AMD بر روی یک پروژه TPU در نسل v10 است.» «مشارکت AMD اولین مشارکت واقعی در یک پروژه ASIC سفارشی هوش مصنوعی خواهد بود، با وجود اینکه تیم سیلیکون سفارشی دارد. AMD دارای IP قوی، به ویژه در بستهبندی پیشرفته و SoIC است. علاوه بر این، IP پردازنده نیز میتواند جذاب باشد، با توجه به اینکه گوگل و مشتریانش به دنبال TPUهایی با هستههای CPU روی بسته برای بارهای کاری RL هستند.»
گوگل با توسعه نه نسل از شتابدهندههای هوش مصنوعی اختصاصی خود (با برودکام به عنوان طراح واقعی سیلیکون) و داشتن تخصص گسترده در معماری شتابدهنده، به سختی به AMD برای طراحی یک TPU معمولی نیاز دارد. از این رو، احتمال اینکه AMD، TPU v10i گوگل را برای استنتاج یا V10t را برای آموزش پیادهسازی کند، کم است. بنابراین، گوگل ممکن است به چیزی نیاز داشته باشد که تنها یک سازنده CPU مانند AMD بتواند آن را فراهم کند، از جمله IP پردازنده، منطق قابل برنامهریزی، اتصالات داخلی، یا دانش خاصی در زمینه بستهبندی پیشرفته.
در این میان، جنبه CPU به ویژه قابل توجه است. SemiAnalysis ادعا میکند که گوگل و مشتریانش به دنبال TPUهایی با هستههای CPU روی بسته برای یادگیری تقویتی و احتمالاً سایر بارهای کاری سنگین CPU هستند. در حالی که آموزش مدلهای زبان بزرگ (LLM) به طور عمده به شتابدهندهها متکی است، یادگیری تقویتی برای استدلال و مدلهای عاملمحور میتواند به محاسبات عمومی بسیار بیشتری در اطراف عملیات شتابدهنده نیاز داشته باشد.
گوگل قبلاً شروع به افزایش منابع CPU در اطراف جدیدترین TPUهای خود که برای استنتاج طراحی شدهاند، کرده است. سیستمهای TPU 8i آن، که برای بارهای کاری استنتاج، استدلال و RL طراحی شدهاند، به ازای هر دو TPU، یک CPU Google Axion دارند. در مقابل، سرورهایی که TPUهای نسل هفتم گوگل را اجرا میکردند، به ازای هر چهار TPU، از یک پردازنده Xeon ‘Emerald Rapid’ استفاده میکردند. علاوه بر این، ما میشنویم که در برخی موارد نسبت 1:1 CPU به شتابدهندهها بهینه است، بنابراین آینده هوش مصنوعی ممکن است بسیار بیشتر از آنچه فکر میکنیم به CPU متکی باشد.
در همین حال، آوردن هستههای CPU مستقیماً به داخل بسته TPU میتواند گام منطقی بعدی باشد، زیرا کاهش فاصله بین محاسبات عمومی و تنسور میتواند عملکرد را بهبود بخشد و مصرف انرژی را کاهش دهد. اینجاست که AMD وارد عمل میشود، زیرا این شرکت قبلاً تجربه توسعه یک طراحی در سطح دیتاسنتر – Instinct MI300A – را دارد که هم چیپلتهای x86 و هم شتابدهنده را در خود جای داده است. بنابراین، یک طراحی فرضی گوگل میتواند چیپلتهای محاسباتی TPU توسعهیافته توسط گوگل را با CPU و HBM شرکت AMD در یک بسته یکپارچه و فشرده که توسط AMD ساخته شده، ترکیب کند. شاید اینتل نیز با توجه به همکاریهای استراتژیک متعدد گوگل و اینتل، به عنوان یک نامزد بالقوه دیگر ظاهر شود. با این حال، اینتل تجربهای در ساخت طراحیهای هیبریدی x86+شتابدهنده برای دیتاسنترها ندارد.
توجه داشته باشید که در حال حاضر ما در حال گمانهزنی هستیم و تحلیل ما ممکن است دقیق نباشد. در حال حاضر، ماهیت مشارکت ادعایی AMD نامشخص باقی مانده است. با این حال، اگر گزارش واقعاً دقیق باشد، توسعه مهم ممکن است این نباشد که AMD به گوگل در ساخت یک TPU دیگر کمک میکند. در عوض، آنچه مهم است این است که گوگل در حال بررسی یک عضو جدید و CPU-محور از خانواده TPU v10 خود است که به طور خاص برای بارهای کاری RL و عاملمحور بهینهسازی شده و از AMD به عنوان ارائهدهنده برخی از بلوکهای ساختمانی مورد نیاز برای ایجاد آن استفاده میکند.
- کولبات
- مرداد 25, 1405
- 39 بازدید






