معماری روبین انویدیا: جهشی بی‌سابقه در عملکرد و کارایی استنتاج هوش مصنوعی

پلتفرم آتی ورا روبین انویدیا، که اواخر امسال عرضه می‌شود، با هدف بهبود عملکرد و کارایی استنتاج هوش مصنوعی در مقیاس وسیع، به ویژه برای بارهای کاری عامل‌محور و مدل‌های زبان بزرگ (LLM)، معرفی شده است. این معماری جدید، بهینه‌سازی‌های قابل توجهی را از سطح GPU تا سیستم‌های در مقیاس رک ارائه می‌دهد. انویدیا بر افزایش سرعت و کاهش هزینه واحد توکن‌های تولید شده در جریان‌های کاری هوش مصنوعی عامل‌محور تأکید دارد.
از جمله نوآوری‌های کلیدی روبین می‌توان به شتاب‌دهنده حافظه تنسور (TMA) بهبود یافته برای مدیریت کارآمد مدل‌های MoE، دو برابر شدن توان عملیاتی بعد K در هسته‌های تنسور، افزایش 4 برابری عملکرد سافت‌مکس نسبت به بلک‌ول، مدیریت وابستگی دقیق‌تر برای بهره‌وری بهتر GPU، و ارتباطات کارآمدتر بین GPUها از طریق NVLink اشاره کرد. این پیشرفت‌ها در مجموع به منظور افزایش عملکرد استنتاج و کاهش هزینه‌ها در کاربردهای هوش مصنوعی آینده طراحی شده‌اند و نویدبخش یک جهش بزرگ در این حوزه هستند.

پردازنده گرافیکی جدید CPX انویدیا با هدف تغییر بازی در استنتاج هوش مصنوعی

انویدیا پردازنده گرافیکی Rubin CPX را برای بهینه‌سازی استنتاج هوش مصنوعی با زمینه طولانی معرفی کرد. این GPU تخصصی، کنار پردازنده‌های Rubin و Vera CPUs کار می‌کند، برای پردازش میلیون‌ها توکن ورودی طراحی شده است. استفاده از حافظه GDDR7 به جای HBM، هزینه‌ها را به شدت کاهش داده و مصرف انرژی و نیاز به خنک‌سازی را کمتر می‌کند. این رویکرد، زیرساخت هوش مصنوعی را برای مدل‌های زبان بزرگ و بارهای کاری سنگین بهینه می‌سازد.

Rubin CPX با توان عملیاتی بالا و شتاب‌دهنده توجه سخت‌افزاری، عملکرد استنتاج با زمینه طولانی را تضمین می‌کند. این پلتفرم با اکوسیستم نرم‌افزاری انویدیا (CUDA و Dynamo) سازگار است و مدیریت هوشمندانه بارهای کاری را تسهیل می‌کند. شرکت‌هایی نظیر Cursor، Runway و Magic قصد دارند Rubin CPX را برای تولید کد، ویدئو و عوامل هوش مصنوعی به کار گیرند. این نوآوری هزینه‌ها را کاهش داده و توسعه برنامه‌های هوش مصنوعی پیچیده را ممکن می‌کند. پلتفرم Rubin CPX تا پایان 2026 عرضه خواهد شد.

انویدیا روبین CPX نیمی از معماری جدید و «تفکیک‌شده» استنتاج هوش مصنوعی را تشکیل می‌دهد

انویدیا از پردازنده گرافیکی جدید Rubin CPX رونمایی کرد که برای بارهای کاری هوش مصنوعی با زمینه طولانی طراحی شده و بخشی از معماری نوین «استنتاج تفکیک‌شده» این شرکت است. این رویکرد، وظایف پردازش هوش مصنوعی را بین دو نوع پردازنده گرافیکی تقسیم می‌کند: Rubin CPX برای فاز محاسباتی فشرده (فاز زمینه) و Rubin استاندارد برای فاز نیازمند پهنای باند حافظه بالا (فاز تولید). این تقسیم‌بندی بهینه‌سازی عملکرد برای مدل‌های پیچیده هوش مصنوعی را هدف قرار داده است.

Rubin CPX با 30 پتافلاپس NVFP4 و 128 گیگابایت GDDR7 عرضه می‌شود، در حالی که Rubin استاندارد 50 پتافلاپس FP4 و 288 گیگابایت HBM4 دارد. این پردازنده‌ها در رک Vera Rubin NVL144 CPX انویدیا (عرضه 2026) ادغام خواهند شد. این رک قادر به تولید 8 اگزافلاپس NVFP4 است که 7.5 برابر عملکرد نسل فعلی را بهبود می‌بخشد و انویدیا پتانسیل درآمدزایی بالایی برای آن پیش‌بینی می‌کند.

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!