برتری چشمگیر تراشه Jalapeño اوپنایآی بر GPUهای پرچمدار انویدیا
تنها کمی بیش از یک هفته پس از موافقت انویدیا با تامین مالی تا سقف ۱۰۵ میلیارد دلار برای مراکز داده خود، OpenAI روز سهشنبه در کنفرانس Hot Chips با بنچمارکهایی حاضر شد که ادعا میکرد اولین تراشه داخلیاش، GB300 انویدیا را شکست میدهد. تراشه Jalapeño، یک ASIC استنتاجی که OpenAI با همکاری Broadcom توسعه داده است، ۱.۵ تا ۱.۹ برابر توان عملیاتی بیشتر به ازای هر کیلووات و ۱.۷ تا ۳.۶ برابر تاخیر کمتر از سیستمهای رک GB200 و GB300 انویدیا در مجموعه عمومی InferenceX SemiAnalysis ارائه کرد، در حالی که یک قطعه ۷۰۰ واتی در برابر شتابدهندههایی با توان ۱۲۰۰ و ۱۴۰۰ وات قرار گرفت. OpenAI قصد دارد استقرار این تراشه را در مراکز داده خود از اواخر سال جاری آغاز کند.
این آزمایشها سه مدل باز را پوشش داد: GPT-OSS 120B، DeepSeek R1 670B، و Kimi K2.5 با یک تریلیون پارامتر از Moonshot AI. OpenAI گستردهترین برتریهای خود را در نقاط عملیاتی با تاخیر کم گزارش کرد، جایی که ادعا میکند ۸.۶ تا ۱۰۴.۳ برابر توان عملیاتی بیشتر به ازای هر کیلووات در سریعترین تنظیمات قبلی زمان بین توکنهای GB300 دارد.
OpenAI نتایج را نرمالسازی کرد بر اساس TDP پکیج منتشر شده هر شتابدهنده، اگرچه اعلام کرد که توان پایدار اندازهگیری شده Jalapeño در آزمایشها در ۵۵۰ وات یا کمتر باقی مانده است. مقایسهای در پیوست با استفاده از توان مصرفی کلی به ازای هر شتابدهنده، ۱.۱۸ کیلووات برای Jalapeño در برابر ۲.۵۵ کیلووات برای GB300، شکافهای کمتری را نشان میدهد، همانطور که مقایسه Jalapeño با GB300 در حال اجرای پیشبینی چند توکنی، که در آن برتری اوج کارایی تقریباً به ۱.۵ برابر کاهش مییابد.
Jalapeño در برابر Vera Rubin، پلتفرم انویدیا که قرار است اولین گیگاوات از سیستمهای انویدیا را که OpenAI با استقرار آن در نیمه دوم سال ۲۰۲۶ موافقت کرده است، تامین کند، آزمایش نشد. این تراشه همچنین مدلها را آموزش نمیدهد، کاری که سختافزار انویدیا در آن بیرقیب باقی مانده است. علاوه بر این، مقایسههای اصلی، پیشبینی تک توکنی Jalapeño را در برابر پیکربندیهای GB300 که همین کار را انجام میدهند، اجرا کردند، حتی با وجود اینکه استقرار انویدیا معمولاً از پیشبینی چند توکنی در تولید استفاده میکند. SemiAnalysis، که اعلام کرد InferenceX را با مهندسان OpenAI در آزمایشگاه این شرکت اجرا کرده است، این قطعه را به عنوان “شکست دادن هر تراشه انویدیا، AMD و گوگل که توانستهایم آزمایش کنیم” توصیف کرد.
هر پکیج Jalapeño، که در ماه ژوئن رونمایی شد پس از یک چرخه ۹ ماهه از RTL تا tapeout، هسته محاسباتی خود را با شش پشته HBM4 جفت میکند که مجموعاً ۲۱۶ گیبیبایت با سرعت ۱۵.۴ ترابایت بر ثانیه را ارائه میدهد. GB300 دارای ۲۸۸ گیگابایت HBM3E با توان ۱۴۰۰ وات است، بنابراین به ازای هر وات توان نامی، تراشه OpenAI تقریباً ۵۰ درصد حافظه بیشتری را در خود جای میدهد. ارائه Hot Chips این شرکت بیان میکند که گلوگاه اصلی که معماری آن هدف قرار داده است، نمایش پهنای باند کلی HBM است، نه افزودن بیشتر آن.
این حافظه البته کمیابترین کالا در صنعت نیمههادی است. سامسونگ، SK hynix و Micron ظرفیت HBM خود را تا سال ۲۰۲۷ فروختهاند، کمبودی آنقدر شدید که انویدیا طبق گزارشها پیکربندیهای کاهشیافته Rubin Ultra را آزمایش میکند با حداقل ۱۹۲ گیگابایت، و مدیرعامل SK hynix، کواک نو-جونگ، هشدار داده است که سال ۲۰۲۷ بدترین سال این بحران خواهد بود. Micron در همان کنفرانس Hot Chips در ۲۳ آگوست اعلام کرد که HBM تقریباً سه برابر مساحت ویفر DDR5 را مصرف میکند برای ظرفیت معادل، جریمهای که با هر نسل گسترش مییابد. گسترش Jalapeño در سراسر توافقنامه استقرار ۱۰ گیگاواتی که OpenAI در اکتبر گذشته با Broadcom امضا کرد، این شرکت را به یک مدعی جدید و قابل توجه برای تامین HBM4 تبدیل خواهد کرد، که انویدیا در حال حاضر از طریق قراردادهای تخصیص چند ساله با SK hynix بر آن مسلط است.
طبق گزارش بلومبرگ، تراشه نسل دوم در حال نزدیک شدن به tapeout است که ظرف چند ماه آینده انتظار میرود، و کار مفهومی روی نسل سوم در حال انجام است. گزارش شده است که اولین قطعه از فرآیند کلاس ۳ نانومتری TSMC استفاده میکند و OpenAI را در صفهای ویفر، حافظه و بستهبندی پیشرفته مشابه Blackwell و Rubin برای آینده قابل پیشبینی نگه میدارد.
OpenAI در حال تامین این ورودیها است در حالی که وابستگی مالی خود را به شرکتی که اخیراً بنچمارک کرده است، عمیقتر میکند. در ۱۷ آگوست، انویدیا موافقت کرد که تا ۱۰۵ میلیارد دلار برای تامین مالی یک پردیس مرکز داده اجارهای OpenAI در اوهایو فراهم کند. ریچارد هو، معاون سختافزار OpenAI، در مصاحبهای پس از این اعلام به بلومبرگ گفت: “انویدیا یک شریک واقعاً خوب است و ما همچنان به مقدار زیادی از انویدیا نیاز داریم.”
- کولبات
- شهریور 3, 1405
- 79 بازدید






