اولین محموله‌های انویدیا H200 به چین رسید، اما هنگ‌کنگ زیرساخت ندارد

شرکت‌های ByteDance و Tencent اخیراً حدود ۱۰,۰۰۰ شتاب‌دهنده Nvidia H200 را تحویل گرفته‌اند که نشان‌دهنده اولین ورود معنادار این تراشه‌ها به چین پس از تأیید صادرات توسط ترامپ است. با این حال، پکن بیشتر این تراشه‌های دارای مجوز آمریکا را به هنگ‌کنگ هدایت می‌کند، در حالی که انویدیا حدود ۵۰۰,۰۰۰ واحد برای مشتریان چینی در اختیار دارد. این تحویل‌ها علی‌رغم محاصره قبلی چین و کاهش سهم بازار انویدیا در این کشور صورت می‌گیرد.

مشکل اصلی، عدم وجود زیرساخت کافی در هنگ‌کنگ برای پشتیبانی از این حجم عظیم تراشه است؛ مراکز داده موجود ظرفیت لازم برای مصرف برق بالای H200 را ندارند و پروژه‌های جدید تا سال ۲۰۲۹ تکمیل نمی‌شوند. کمیسیون ملی توسعه و اصلاحات چین (NDRC) همچنان هر سفارش را کنترل می‌کند و با هدایت تراشه‌ها به منطقه‌ای بدون زیرساخت، بازار سرزمین اصلی را برای تولیدکنندگان داخلی تراشه حفظ می‌کند. این وضعیت چالش‌های جدی برای استقرار فناوری‌های پیشرفته هوش مصنوعی در چین ایجاد کرده است.

جنسن هوانگ: مدل‌های هوش مصنوعی چینی برای شرکت‌های آمریکایی تهدید نیستند

مدیرعامل انویدیا، جنسن هوانگ، معتقد است شرکت‌های آمریکایی باید از مدل‌های هوش مصنوعی چینی استفاده کنند و نگرانی‌های امنیتی در مورد درهای پشتی را نادرست می‌داند. او تأکید می‌کند که کاربران می‌توانند مدل‌ها را دانلود، بهینه‌سازی و محافظت کنند. هوانگ همچنین محدودیت‌های ایالات متحده بر مدل‌های هوش مصنوعی آمریکایی را نقد کرده و می‌گوید شرکت‌ها باید مدل‌های خود را در دسترس قرار داده و از طریق آزمایش و رفع سریع مشکلات، آن‌ها را امن‌تر کنند.

هوانگ بر اهمیت مدل‌های باز برای امنیت هوش مصنوعی در صنایع مختلف تأکید دارد. او واکنش منفی بازار به مدل‌های ارزان‌تر و با وزن باز (مانند کیمی K3) را سوءتفاهم سرمایه‌گذاران می‌داند. به باور او، این مدل‌ها با کاهش هزینه اجرا، استفاده از هوش مصنوعی را گسترش داده و تقاضا برای مراکز داده و پردازنده‌های گرافیکی هوش مصنوعی را افزایش می‌دهند که در نهایت به نفع صنعت و انویدیا است.

آرم به اکوسیستم NVLink Fusion انویدیا می‌پیوندد

آرم و انویدیا در کنفرانس Supercomputing ’25 اعلام کردند که آرم به اکوسیستم NVLink Fusion پیوسته است. این همکاری مهم به مشتریان آرم امکان می‌دهد CPUهایی سازگار با شتاب‌دهنده‌های هوش مصنوعی انویدیا توسعه دهند. این اقدام، مجموعه CPUهای قابل استفاده در سیستم‌های هوش مصنوعی انویدیا را گسترش داده و پیچیدگی طراحی و هزینه‌های توسعه را برای هایپراسکیلرها کاهش می‌دهد. همچنین، آرم می‌تواند CPUهایی طراحی کند که مستقیماً با پردازنده‌های Grace/Vera انویدیا و Intel Xeon در سیستم‌های مجهز به پردازنده‌های گرافیکی انویدیا رقابت کنند و موقعیت آرم را به عنوان ارائه‌دهنده IP و مجوزدهنده ISA تقویت می‌کند.

این همکاری یک برد بزرگ برای آرم، انویدیا و شرکایشان است و مسیرهای جدیدی برای توسعه CPUهای سفارشی و ادغام نزدیک‌تر با پردازنده‌های گرافیکی هوش مصنوعی فراهم می‌آورد. اما، خطرات قابل توجهی برای رقبایی مانند AMD و اینتل دارد که فاقد پشتیبانی قوی از NVLink هستند یا با توسعه راه‌حل‌های سازگار فاصله دارند. این حرکت، جاذبه اکوسیستم انویدیا را افزایش داده و معماری آرم را در بازارهای حیاتی دیتاسنتر و هوش مصنوعی، آینده‌نگر می‌سازد.

بنچمارک هوش مصنوعی InferenceMax پشته‌های نرم‌افزاری، کارایی و TCO را آزمایش می‌کند

InferenceMax، بنچمارک متن‌باز جدید SemiAnalysis، رویکردی نوین در ارزیابی هوش مصنوعی ارائه می‌دهد. این ابزار به جای تمرکز بر سخت‌افزار، کارایی پشته‌های نرم‌افزاری هوش مصنوعی را در سناریوهای استنتاجی واقعی اندازه‌گیری می‌کند. نتایج روزانه منتشر شده و هدف آن ارائه معیارهای بی‌طرفانه و شبیه‌سازی کاربردهای دنیای واقعی است. تمرکز اصلی بر هزینه کل مالکیت (TCO) بر حسب دلار در هر میلیون توکن است، که به ارزیابی جامع‌تر و ردیابی تکامل نرم‌افزاری کمک می‌کند.
این بنچمارک تعادل توان عملیاتی و تعامل‌پذیری را بررسی کرده، نشان می‌دهد کارآمدترین GPU لزوماً سریع‌ترین نیست. InferenceMax رقابت MI335X AMD با B200 انویدیا را از نظر TCO برجسته می‌کند و به نیاز به بهبود در کرنل‌های FP4 AMD اشاره دارد. پروژه با همکاری فروشندگان، اشکالاتی را در تنظیمات هر دو شرکت کشف کرده است. InferenceMax از شتاب‌دهنده‌های اصلی AMD و Nvidia پشتیبانی کرده و قصد دارد پشتیبانی از Tensor گوگل و AWS Trainium را نیز اضافه کند.

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!