OpenAI’s 700W Jalapeño ASIC outpaces 1,400W Nvidia flagship GPU — claims up to 1.9x throughput per kilowatt and 3.6x lower latency, co-developed with Broadcom | Tom's HardwareTom's Hardware

برتری چشمگیر تراشه Jalapeño اوپن‌ای‌آی بر GPUهای پرچمدار انویدیا

تنها کمی بیش از یک هفته پس از موافقت انویدیا با تامین مالی تا سقف ۱۰۵ میلیارد دلار برای مراکز داده خود، OpenAI روز سه‌شنبه در کنفرانس Hot Chips با بنچمارک‌هایی حاضر شد که ادعا می‌کرد اولین تراشه داخلی‌اش، GB300 انویدیا را شکست می‌دهد. تراشه Jalapeño، یک ASIC استنتاجی که OpenAI با همکاری Broadcom توسعه داده است، ۱.۵ تا ۱.۹ برابر توان عملیاتی بیشتر به ازای هر کیلووات و ۱.۷ تا ۳.۶ برابر تاخیر کمتر از سیستم‌های رک GB200 و GB300 انویدیا در مجموعه عمومی InferenceX SemiAnalysis ارائه کرد، در حالی که یک قطعه ۷۰۰ واتی در برابر شتاب‌دهنده‌هایی با توان ۱۲۰۰ و ۱۴۰۰ وات قرار گرفت. OpenAI قصد دارد استقرار این تراشه را در مراکز داده خود از اواخر سال جاری آغاز کند.

این آزمایش‌ها سه مدل باز را پوشش داد: GPT-OSS 120B، DeepSeek R1 670B، و Kimi K2.5 با یک تریلیون پارامتر از Moonshot AI. OpenAI گسترده‌ترین برتری‌های خود را در نقاط عملیاتی با تاخیر کم گزارش کرد، جایی که ادعا می‌کند ۸.۶ تا ۱۰۴.۳ برابر توان عملیاتی بیشتر به ازای هر کیلووات در سریع‌ترین تنظیمات قبلی زمان بین توکن‌های GB300 دارد.

OpenAI می‌گوید تراشه Jalapeño آن در اولین بنچمارک‌های منتشر شده، GB300 انویدیا را شکست می‌دهد

OpenAI نتایج را نرمال‌سازی کرد بر اساس TDP پکیج منتشر شده هر شتاب‌دهنده، اگرچه اعلام کرد که توان پایدار اندازه‌گیری شده Jalapeño در آزمایش‌ها در ۵۵۰ وات یا کمتر باقی مانده است. مقایسه‌ای در پیوست با استفاده از توان مصرفی کلی به ازای هر شتاب‌دهنده، ۱.۱۸ کیلووات برای Jalapeño در برابر ۲.۵۵ کیلووات برای GB300، شکاف‌های کمتری را نشان می‌دهد، همانطور که مقایسه Jalapeño با GB300 در حال اجرای پیش‌بینی چند توکنی، که در آن برتری اوج کارایی تقریباً به ۱.۵ برابر کاهش می‌یابد.

Jalapeño در برابر Vera Rubin، پلتفرم انویدیا که قرار است اولین گیگاوات از سیستم‌های انویدیا را که OpenAI با استقرار آن در نیمه دوم سال ۲۰۲۶ موافقت کرده است، تامین کند، آزمایش نشد. این تراشه همچنین مدل‌ها را آموزش نمی‌دهد، کاری که سخت‌افزار انویدیا در آن بی‌رقیب باقی مانده است. علاوه بر این، مقایسه‌های اصلی، پیش‌بینی تک توکنی Jalapeño را در برابر پیکربندی‌های GB300 که همین کار را انجام می‌دهند، اجرا کردند، حتی با وجود اینکه استقرار انویدیا معمولاً از پیش‌بینی چند توکنی در تولید استفاده می‌کند. SemiAnalysis، که اعلام کرد InferenceX را با مهندسان OpenAI در آزمایشگاه این شرکت اجرا کرده است، این قطعه را به عنوان “شکست دادن هر تراشه انویدیا، AMD و گوگل که توانسته‌ایم آزمایش کنیم” توصیف کرد.

هر پکیج Jalapeño، که در ماه ژوئن رونمایی شد پس از یک چرخه ۹ ماهه از RTL تا tapeout، هسته محاسباتی خود را با شش پشته HBM4 جفت می‌کند که مجموعاً ۲۱۶ گیبی‌بایت با سرعت ۱۵.۴ ترابایت بر ثانیه را ارائه می‌دهد. GB300 دارای ۲۸۸ گیگابایت HBM3E با توان ۱۴۰۰ وات است، بنابراین به ازای هر وات توان نامی، تراشه OpenAI تقریباً ۵۰ درصد حافظه بیشتری را در خود جای می‌دهد. ارائه Hot Chips این شرکت بیان می‌کند که گلوگاه اصلی که معماری آن هدف قرار داده است، نمایش پهنای باند کلی HBM است، نه افزودن بیشتر آن.

این حافظه البته کمیاب‌ترین کالا در صنعت نیمه‌هادی است. سامسونگ، SK hynix و Micron ظرفیت HBM خود را تا سال ۲۰۲۷ فروخته‌اند، کمبودی آنقدر شدید که انویدیا طبق گزارش‌ها پیکربندی‌های کاهش‌یافته Rubin Ultra را آزمایش می‌کند با حداقل ۱۹۲ گیگابایت، و مدیرعامل SK hynix، کواک نو-جونگ، هشدار داده است که سال ۲۰۲۷ بدترین سال این بحران خواهد بود. Micron در همان کنفرانس Hot Chips در ۲۳ آگوست اعلام کرد که HBM تقریباً سه برابر مساحت ویفر DDR5 را مصرف می‌کند برای ظرفیت معادل، جریمه‌ای که با هر نسل گسترش می‌یابد. گسترش Jalapeño در سراسر توافقنامه استقرار ۱۰ گیگاواتی که OpenAI در اکتبر گذشته با Broadcom امضا کرد، این شرکت را به یک مدعی جدید و قابل توجه برای تامین HBM4 تبدیل خواهد کرد، که انویدیا در حال حاضر از طریق قراردادهای تخصیص چند ساله با SK hynix بر آن مسلط است.

طبق گزارش بلومبرگ، تراشه نسل دوم در حال نزدیک شدن به tapeout است که ظرف چند ماه آینده انتظار می‌رود، و کار مفهومی روی نسل سوم در حال انجام است. گزارش شده است که اولین قطعه از فرآیند کلاس ۳ نانومتری TSMC استفاده می‌کند و OpenAI را در صف‌های ویفر، حافظه و بسته‌بندی پیشرفته مشابه Blackwell و Rubin برای آینده قابل پیش‌بینی نگه می‌دارد.

OpenAI در حال تامین این ورودی‌ها است در حالی که وابستگی مالی خود را به شرکتی که اخیراً بنچمارک کرده است، عمیق‌تر می‌کند. در ۱۷ آگوست، انویدیا موافقت کرد که تا ۱۰۵ میلیارد دلار برای تامین مالی یک پردیس مرکز داده اجاره‌ای OpenAI در اوهایو فراهم کند. ریچارد هو، معاون سخت‌افزار OpenAI، در مصاحبه‌ای پس از این اعلام به بلومبرگ گفت: “انویدیا یک شریک واقعاً خوب است و ما همچنان به مقدار زیادی از انویدیا نیاز داریم.”

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!