OpenAI's custom Jalapeno AI inference ASIC is for OpenAI’s internal use, but company leaves the door open to broader rollout — firm says it will have its ‘hands full’ with Jalapeño for ‘a good long time’ | Tom's HardwareTom's Hardware

تراشه هوش مصنوعی Jalapeño اوپن‌ای‌آی: تمرکز بر استفاده داخلی با چشم‌انداز عرضه عمومی

پس از معرفی تراشه Jalapeño ASIC اوپن‌ای‌آی، یک سوال واضح مطرح شد: این تراشه برای چه کسی است؟ این بدان معنا نیست که این شتاب‌دهنده هدفی ندارد، بلکه اوپن‌ای‌آی به وضوح جاه‌طلبی‌های خود را در فضای سخت‌افزار تعریف نکرده بود. از یک سو، این شرکت پیشنهاد کرده بود که ASICs را می‌سازد برای اهداف خود هنگامی که اوپن‌ای‌آی و برادکام شراکت خود را فاش کردند سال گذشته. از سوی دیگر، اوپن‌ای‌آی بنچمارک‌هایی را ارائه کرد که Jalapeño را با شتاب‌دهنده‌های Blackwell انویدیا مقایسه می‌کرد و بر یک نقشه راه چند نسلی در Hot Chips 2026 تأکید کرد. ریچارد هو، رئیس بخش سخت‌افزار در اوپن‌ای‌آی، به *Premium* گفت که Jalapeño برای نیازهای محاسباتی اوپن‌ای‌آی ساخته شده است. با این حال، معاون رئیس می‌گوید «صادقانه بگویم، می‌توانید آن را برای هر کسی استفاده کنید» و در را برای عرضه گسترده‌تر باز گذاشت. می‌توانید متن کامل مصاحبه را اینجا بخوانید.

هو گفت: «ما تقاضای بسیار زیادی برای محاسبات در داخل شرکت داریم. زمان زیادی طول خواهد کشید تا حتی تقاضای خودمان را که همیشه در حال رشد است، برآورده کنیم. فکر می‌کنم ما برای مدت طولانی فقط مشغول تأمین محاسبات برای اوپن‌ای‌آی خواهیم بود. این بدان معنا نیست که نمی‌توان آن را در جای دیگری استفاده کرد. من معتقدم که می‌توان، اما فکر می‌کنم اولویت ما این است که ابتدا و مهم‌تر از همه، نیازهای محاسباتی اوپن‌ای‌آی برآورده شود.»

موقعیت رقابتی Jalapeño عمدتاً به بنچمارک‌هایی برمی‌گردد که اوپن‌ای‌آی در طول Hot Chips به اشتراک گذاشت، که بر روی بنچمارک InferenceX شرکت SemiAnalysis اجرا شده و Jalapeño را با GB200 و GB300 انویدیا مقایسه می‌کند. ASICs رایج هستند، اما عملکرد رقابتی برای آن‌ها رایج نیست و دلیل خوبی هم دارد. آن‌ها برای شتاب‌دهی به بارهای کاری خاص ساخته شده‌اند. با این حال، با Jalapeño، اوپن‌ای‌آی نشان داد که این تراشه مدل GPT-OSS با وزن باز خود، و همچنین DeepSeek R1 و Kimi K2.5 را شتاب می‌دهد.

هو به ما گفت که در ابتدا، اوپن‌ای‌آی برنامه‌ای برای نمایش بنچمارک‌ها در Hot Chips نداشت و شرکت مطمئن نبود که اصلاً در این رویداد حضور پیدا کند. این مدیر اجرایی داستانی را که اوپن‌ای‌آی در صحنه Hot Chips تعریف کرد، تکرار کرد، درباره اینکه چگونه تیمی از مهندسان در دو ماه بین نمونه A0 و ارائه Hot Chips، Kimi و DeepSeek را روی Jalapeño راه‌اندازی کردند.

OpenAI

اگرچه هو به وضوح بیان کرد که Jalapeño در حال حاضر به صورت داخلی مستقر می‌شود و داخلی باقی خواهد ماند، اما او قطعاً در را برای ورود گسترده‌تر به بازار سخت‌افزار باز گذاشت. هو در مورد بنچمارک‌های نمایش داده شده در Hot Chips گفت: «آنچه ما واقعاً می‌خواستیم نشان دهیم، برای از بین بردن تصور غلط در صنعت بود که تراشه سفارشی استنتاجی ما فقط برای مدل‌های اوپن‌ای‌آی است… این تراشه قابل برنامه‌ریزی، و عمومی است، و برای مدل‌های اوپن‌ای‌آی سخت‌کد نشده است.»

یکی از توضیحات احتمالی برای عدم تمایل به ورود به بازار سخت‌افزار خارجی، عرضه است. هو گفت «یک خط پایه جدید برای عرضه وجود دارد»، اشاره به دو سال گذشته که هو و سم آلتمن، مدیرعامل اوپن‌ای‌آی، از کارخانه‌های تولید بازدید کرده و ظرفیت بیشتری درخواست کرده‌اند. اگرچه هو می‌گوید «[اوپن‌ای‌آی] از نظر عرضه داخلی در وضعیت خوبی است»، اما عرضه برای تأمین مشتریان خارجی احتمالاً داستان متفاوتی است.

Jalapeño برای مدل‌های دیگر نیز کار می‌کند، اما عملکرد رقابتی خام هدف اصلی طراحی نبود. وقتی در مورد نیروی محرکه پشت طراحی Jalapeño پرسیدم، هو صریح بود: «کارایی بود.» این مدیر اجرایی به کارایی به عنوان خویشاوند محاسبات اشاره کرد و به مرکز داده هوش مصنوعی مدرن با محدودیت توان و اینکه چگونه یک موتور استنتاجی کارآمدتر، محاسبات مؤثرتری را نشان می‌دهد، اشاره کرد.

هو همچنین به همان تصمیم‌گیری عمل‌گرایانه به عنوان نیروی محرکه پشت طراحی Jalapeño اشاره کرد، به ویژه در مورد طراحی مشترک با مدل‌های داخلی اوپن‌ای‌آی. «[طراحی مشترک] چیزی است که نمی‌توانید با یک فروشنده سیلیکون شخص ثالث به خوبی انجام دهید زیرا IP تحقیقاتی زیادی در مدل‌ها وجود دارد، و بنابراین نمی‌توانید آن را به طور گسترده به اشتراک بگذارید زیرا فاش خواهد شد. بدون توجه به تعداد توافق‌نامه‌های عدم افشایی که امضا می‌کنید، به بیرون درز خواهد کرد.»

اگر Jalapeño قرار بود به صورت گسترده‌تر عرضه شود، با پلتفرم Grace Blackwell انویدیا رقابت نمی‌کرد، بلکه با پلتفرم جدیدتر Vera Rubin رقابت می‌کرد. هو گفت که مقایسه با Blackwell «به این دلیل بود که آن‌ها بهترین نتایج منتشر شده‌ای بودند که می‌توانستیم پیدا کنیم.» با این حال، این شرکت بنچمارک‌های بیشتری را به صورت داخلی، هم در برابر Vera Rubin و هم برای پنجره‌های متنی بزرگ‌تر اجرا کرده است.

بنچمارک‌های InferenceX فقط به بنچمارک‌های 8k1k نگاه کردند که نشان‌دهنده 8,000 توکن ورودی ثابت و 1,000 توکن خروجی است. هو گفت بنچمارک‌های داخلی اوپن‌ای‌آی نشان می‌دهد که ASIC «به نظر می‌رسد حتی بهتر از بنچمارک‌های موجود برخی از دستگاه‌های دیگر عمل می‌کند.» جالب‌تر از آن، مقایسه با Vera Rubin است که اوپن‌ای‌آی می‌گوید خوب به نظر می‌رسد.

هو گفت: «واضح است، اما زمانی که ما مستقر می‌شویم، [Vera Rubin] خواهد بود، شاید حتی VR Ultra در برخی از بخش‌های برنامه استقرار. ما کارهای داخلی خود را انجام داده‌ایم، اما واضح است که آن‌ها را منتشر نمی‌کنیم. آن‌ها باید از انویدیا و افراد دیگری که قادر به انجام آن هستند، بیایند… بله، ما در این زمینه واقعاً خوب عمل می‌کنیم.»

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!