Moonshot AI مدل Kimi K3 را با وزن‌های باز و هزینه کمتر منتشر کرد

شرکت چینی Moonshot AI مدل هوش مصنوعی Kimi K3 را با وزن‌های باز منتشر کرده است. این مدل در بنچمارک‌ها عملکردی نزدیک به مدل‌های پیشرفته‌ای چون Claude Fable و GPT-5.6 Sol از Anthropic و OpenAI نشان می‌دهد، اما با هزینه‌ای به مراتب کمتر (۲ تا ۳ برابر ارزان‌تر و تا ۱۰ برابر با کش) قابل اجراست. این عرضه، چالشی جدی برای بازیگران اصلی صنعت هوش مصنوعی محسوب می‌شود.

کارایی بالای Kimi K3 از بهینه‌سازی‌هایی چون استفاده از MXFP4/MXFP8 و Kimi Delta Attention ناشی می‌شود که مصرف VRAM و زمان اجرا را کاهش می‌دهد. این امکان اجرای مدل را حتی بر روی سخت‌افزارهای پایین‌رده فراهم می‌آورد. انتشار Kimi K3 با وزن‌های باز، رقابت‌پذیری نرم‌افزارهای “رایگان” را در برابر رقبای اختصاصی برجسته می‌کند، هرچند فرآیند آموزش و مجموعه داده آن محرمانه باقی می‌ماند.

معماری روبین انویدیا: جهشی بی‌سابقه در عملکرد و کارایی استنتاج هوش مصنوعی

پلتفرم آتی ورا روبین انویدیا، که اواخر امسال عرضه می‌شود، با هدف بهبود عملکرد و کارایی استنتاج هوش مصنوعی در مقیاس وسیع، به ویژه برای بارهای کاری عامل‌محور و مدل‌های زبان بزرگ (LLM)، معرفی شده است. این معماری جدید، بهینه‌سازی‌های قابل توجهی را از سطح GPU تا سیستم‌های در مقیاس رک ارائه می‌دهد. انویدیا بر افزایش سرعت و کاهش هزینه واحد توکن‌های تولید شده در جریان‌های کاری هوش مصنوعی عامل‌محور تأکید دارد.
از جمله نوآوری‌های کلیدی روبین می‌توان به شتاب‌دهنده حافظه تنسور (TMA) بهبود یافته برای مدیریت کارآمد مدل‌های MoE، دو برابر شدن توان عملیاتی بعد K در هسته‌های تنسور، افزایش 4 برابری عملکرد سافت‌مکس نسبت به بلک‌ول، مدیریت وابستگی دقیق‌تر برای بهره‌وری بهتر GPU، و ارتباطات کارآمدتر بین GPUها از طریق NVLink اشاره کرد. این پیشرفت‌ها در مجموع به منظور افزایش عملکرد استنتاج و کاهش هزینه‌ها در کاربردهای هوش مصنوعی آینده طراحی شده‌اند و نویدبخش یک جهش بزرگ در این حوزه هستند.

هواوی ابزار جدیدی را برای دور زدن لیست سیاه صادرات HBM توسط شرکت‌های چینی منتشر کرد

هواوی با معرفی نرم‌افزار Unified Cache Manager (UCM)، پاسخی استراتژیک به محدودیت‌های صادراتی ایالات متحده بر حافظه HBM (High-Bandwidth Memory) داده است. این ابزار برای تسریع آموزش و استنتاج مدل‌های زبان بزرگ (LLM) بدون اتکای کامل به HBM طراحی شده و داده‌های هوش مصنوعی را در سراسر HBM، DRAM و SSDها بهینه‌سازی و توزیع می‌کند. UCM نتایج چشمگیری از خود نشان داده: تا ۹۰ درصد کاهش تأخیر و ۲۲ برابر افزایش توان عملیاتی برای بارهای کاری استنتاج هوش مصنوعی. آزمایش‌های واقعی آن در بانک China UnionPay، کارایی‌اش را در کاربردهای تجاری تأیید کرده است. این دستاورد می‌تواند محرک بزرگی برای بازار هوش مصنوعی چین باشد و به این کشور در مسیر خودکفایی فناوری کمک کند.

این اقدام هواوی در زمانی صورت می‌گیرد که چین به طور فزاینده‌ای به سمت استقلال فناوری حرکت می‌کند. گزارش‌ها حاکی از آن است که دولت چین شرکت‌های داخلی را از خرید تراشه‌های H20 انویدیا، که نسخه‌های ساده‌شده‌ای برای بازار چین بودند، منع کرده است. این تصمیم ضربه دیگری به انویدیا وارد می‌کند که ماه‌ها برای فروش این تراشه‌ها در چین تلاش کرده بود.

تلاش‌های هواوی برای کاهش وابستگی به HBM و دستورالعمل‌های دولت چین برای دوری از تراشه‌های انویدیا، نشان‌دهنده عزم پکن برای کاهش اتکا به فناوری‌های غربی است. این تحولات، استراتژی ایالات متحده برای کند کردن پیشرفت فناوری چین را به چالش می‌کشد و می‌تواند پیامدهای گسترده‌ای برای آینده صنعت جهانی تراشه و هوش مصنوعی داشته باشد.

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!