Colibrì: گامی بلند برای هوش مصنوعی محلی؛ اجرای مدل ۱.۵ ترابایتی با تنها ۲۵ گیگابایت رم

با افزایش هزینه‌های اشتراک هوش مصنوعی و نگرانی‌های حریم خصوصی، اجرای مدل‌های زبان بزرگ (LLM) محبوبیت یافته، اما سخت‌افزارهای قدرتمند گران هستند. مهندس ایتالیایی وینچنزو (JustVugg) با پروژه Colibrì، راه حلی نوآورانه ارائه داده: اجرای مدل عظیم GLM-5.۲ با ۷۴۴ میلیارد پارامتر و حجم ۱.۵ ترابایت، تنها با ۲۵ گیگابایت رم و یک CPU معمولی. این دستاورد، گامی مهم برای دسترسی‌پذیری هوش مصنوعی پیشرفته در تنظیمات محلی است.

اگرچه سرعت فعلی Colibrì (حدود ۰.۰۵ تا ۰.۱ توکن بر ثانیه) برای مکالمات بلادرنگ عملی نیست، کیفیت پاسخ‌های مدل GLM-5.۲ (MoE) بالا است. Colibrì با بارگذاری و تخلیه هوشمندانه بخش‌های تخصصی مدل به ازای هر توکن، از معماری MoE بهره می‌برد و به سخت‌افزارهای ارزان‌تر اجرای مدل‌های بزرگ را ممکن می‌سازد. این پروژه یک اثبات مفهوم است و پتانسیل بالایی برای آینده هوش مصنوعی محلی و اجرای مدل‌های پیچیده روی سخت‌افزارهای مصرف‌کننده دارد.

AMD بی‌سروصدا کارت گرافیک RX 7700 غیر XT را با ۱۶ گیگابایت VRAM عرضه کرد

AMD بی‌سروصدا کارت گرافیک RX 7700 غیر XT را با ۱۶ گیگابایت VRAM معرفی کرده است. این کارت که از دای Navi 32 ضعیف‌شده استفاده می‌کند، در مقایسه با مدل ۷۷۰۰ XT، حدود ۲۰ درصد عملکرد کمتری در بازی‌ها ارائه می‌دهد و مصرف برق بالاتری (۲۶۳ وات) دارد. با این حال، وجود ۱۶ گیگابایت حافظه GDDR6 و ۸۰ شتاب‌دهنده هوش مصنوعی، آن را به گزینه‌ای بالقوه برای کاربردهای هوش مصنوعی محلی تبدیل می‌کند.

این محصول احتمالاً برای بازار OEM و سیستم‌های از پیش ساخته شده در نظر گرفته شده است، زیرا AMD هنوز اطلاعاتی درباره در دسترس بودن عمومی آن منتشر نکرده است. ASRock نیز طراحی سفارشی “Challenger” خود را برای این کارت رونمایی کرده است. با توجه به وجود کارت‌های قوی‌تر در خط تولید AMD، قیمت‌گذاری RX 7700 غیر XT بسیار حیاتی است؛ قیمتی بالاتر از ۳۵۰ دلار می‌تواند به شکست این محصول منجر شود.

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!