پلتفرم آتی ورا روبین انویدیا، که اواخر امسال عرضه میشود، با هدف بهبود عملکرد و کارایی استنتاج هوش مصنوعی در مقیاس وسیع، به ویژه برای بارهای کاری عاملمحور و مدلهای زبان بزرگ (LLM)، معرفی شده است. این معماری جدید، بهینهسازیهای قابل توجهی را از سطح GPU تا سیستمهای در مقیاس رک ارائه میدهد. انویدیا بر افزایش سرعت و کاهش هزینه واحد توکنهای تولید شده در جریانهای کاری هوش مصنوعی عاملمحور تأکید دارد.
از جمله نوآوریهای کلیدی روبین میتوان به شتابدهنده حافظه تنسور (TMA) بهبود یافته برای مدیریت کارآمد مدلهای MoE، دو برابر شدن توان عملیاتی بعد K در هستههای تنسور، افزایش 4 برابری عملکرد سافتمکس نسبت به بلکول، مدیریت وابستگی دقیقتر برای بهرهوری بهتر GPU، و ارتباطات کارآمدتر بین GPUها از طریق NVLink اشاره کرد. این پیشرفتها در مجموع به منظور افزایش عملکرد استنتاج و کاهش هزینهها در کاربردهای هوش مصنوعی آینده طراحی شدهاند و نویدبخش یک جهش بزرگ در این حوزه هستند.
انویدیا پردازنده گرافیکی Rubin CPX را برای بهینهسازی استنتاج هوش مصنوعی با زمینه طولانی معرفی کرد. این GPU تخصصی، کنار پردازندههای Rubin و Vera CPUs کار میکند، برای پردازش میلیونها توکن ورودی طراحی شده است. استفاده از حافظه GDDR7 به جای HBM، هزینهها را به شدت کاهش داده و مصرف انرژی و نیاز به خنکسازی را کمتر میکند. این رویکرد، زیرساخت هوش مصنوعی را برای مدلهای زبان بزرگ و بارهای کاری سنگین بهینه میسازد.
Rubin CPX با توان عملیاتی بالا و شتابدهنده توجه سختافزاری، عملکرد استنتاج با زمینه طولانی را تضمین میکند. این پلتفرم با اکوسیستم نرمافزاری انویدیا (CUDA و Dynamo) سازگار است و مدیریت هوشمندانه بارهای کاری را تسهیل میکند. شرکتهایی نظیر Cursor، Runway و Magic قصد دارند Rubin CPX را برای تولید کد، ویدئو و عوامل هوش مصنوعی به کار گیرند. این نوآوری هزینهها را کاهش داده و توسعه برنامههای هوش مصنوعی پیچیده را ممکن میکند. پلتفرم Rubin CPX تا پایان 2026 عرضه خواهد شد.
انویدیا از پردازنده گرافیکی جدید Rubin CPX رونمایی کرد که برای بارهای کاری هوش مصنوعی با زمینه طولانی طراحی شده و بخشی از معماری نوین «استنتاج تفکیکشده» این شرکت است. این رویکرد، وظایف پردازش هوش مصنوعی را بین دو نوع پردازنده گرافیکی تقسیم میکند: Rubin CPX برای فاز محاسباتی فشرده (فاز زمینه) و Rubin استاندارد برای فاز نیازمند پهنای باند حافظه بالا (فاز تولید). این تقسیمبندی بهینهسازی عملکرد برای مدلهای پیچیده هوش مصنوعی را هدف قرار داده است.
Rubin CPX با 30 پتافلاپس NVFP4 و 128 گیگابایت GDDR7 عرضه میشود، در حالی که Rubin استاندارد 50 پتافلاپس FP4 و 288 گیگابایت HBM4 دارد. این پردازندهها در رک Vera Rubin NVL144 CPX انویدیا (عرضه 2026) ادغام خواهند شد. این رک قادر به تولید 8 اگزافلاپس NVFP4 است که 7.5 برابر عملکرد نسل فعلی را بهبود میبخشد و انویدیا پتانسیل درآمدزایی بالایی برای آن پیشبینی میکند.