Amazon cracks down on 'CPU waste' among engineers as agentic AI crunch intensifies — CPU demand makes low-utilization EC2 instances a hot commodity | Tom's HardwareTom's Hardware

آمازون مصرف CPU مهندسان را به دلیل افزایش تقاضای هوش مصنوعی کاهش می‌دهد

آمازون وب سرویسز در حال محدود کردن استفاده داخلی مهندسان خود از نمونه‌های EC2 است. طبق گزارش The Information، در ماه می، این شرکت با مهندسان جلسه‌ای برگزار کرده و از آن‌ها خواسته تا مصرف CPU را کاهش دهند تا AWS ظرفیت کافی برای پاسخگویی به تقاضای مشتریان را داشته باشد. این پیام در حالی منتشر می‌شود که تقاضا برای CPU در مراکز داده به اوج خود رسیده است و نسبت سنتی هشت به یک یا چهار به یک GPU به CPU در حال نزدیک شدن به برابری است.

دستی که پردازنده Ryzen 7 9850X3D را نگه داشته است.

نمونه‌های EC2 بخش بزرگی از اینترنت مدرن را تشکیل می‌دهند و در استقرار‌های خصوصی نیز استفاده می‌شوند. به طور سنتی، مهندسان AWS می‌توانستند نمونه‌های خود را برای توسعه راه‌اندازی کنند و با بهره‌گیری از مصرف نسبتاً پایین CPU مورد نیاز برای زیرساخت وب، از ماشین‌های مجازی بیشتری استفاده کنند. اکنون، مهندسان می‌گویند که برای دسترسی به این نمونه‌ها روزها منتظر می‌مانند، در حالی که قبلاً می‌توانستند ظرف چند ساعت به آن‌ها دسترسی پیدا کنند. یک مهندس به The Information گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نشده به این مدت طولانی برای یک نمونه منتظر بماند.

آمازون انواع مختلفی از CPUها را در نمونه‌های EC2 مستقر می‌کند، از جمله گزینه‌های AMD و Intel و تراشه نسبتاً جدید Graviton5 خود. Graviton5 قدرتمندترین CPU آمازون تا به امروز است و از معماری مبتنی بر Arm مشابه CPU ورا (Vera) انویدیا و AGI خود Arm استفاده می‌کند.

افزایش تقاضا برای CPU به دلیل عوامل هوش مصنوعی (AI agents) است، یک پارادایم جدید در بهره‌وری که حتی شرکت‌های بزرگی مانند آمازون نیز در حال دست و پنجه نرم کردن با آن هستند. به عنوان مثال، ماه گذشته، یک عامل کدنویسی ۱.۸ میلیون دلار هزینه توکن در آمازون ایجاد کرد که بودجه توسعه را ۸۶۰٪ فراتر رفت.

بخش عمده‌ای از زیرساخت‌های هوش مصنوعی کنونی بر اساس استنتاج (inference) طراحی شده‌اند، یک بار کاری که توسط GPUها تسریع می‌شود. با نسبت چهار به یک، CPU به عنوان راهی برای تغذیه GPUها عمل می‌کرد و نه بیشتر. با این حال، بارهای کاری عامل‌محور (agentic workloads) بسیار پیچیده‌تر هستند. آن‌ها اغلب شامل فراخوانی ابزارها هستند که روی CPU اجرا می‌شوند، و همچنین هماهنگی پیچیده‌تر استنتاج روی GPUها. این همان چیزی است که CPUها را در عصر عامل‌محور به مرکز توجه آورده است. اینتل، AMD و دیگران آنچه را که در چند ماه گذشته از شرکت‌های حافظه و ذخیره‌سازی شنیده‌ایم تکرار کرده‌اند: تقاضا برای CPUها آنقدر بالاست که اکثر شرکت‌ها هر آنچه را که بتوانند به دست آورند، می‌پذیرند.

بازیگران اصلی در حال بهره‌برداری از این تقاضا هستند. AMD اخیراً مجموعه CPUهای Zen 6 ‘Venice’ خود را برای مراکز داده معرفی کرده است که برای اولین بار در دهه‌های اخیر، AMD یک معماری جدید را ابتدا در بازار مراکز داده و سپس در بازار مشتریان عرضه می‌کند. انویدیا نیز پیام‌رسانی خود را از شتاب‌دهنده‌ها دور کرده و به سمت CPU جدید Vera خود سوق داده است و تلاش می‌کند تا سهم خود را در بازار رو به رشد زیرساخت هوش مصنوعی عامل‌محور تثبیت کند.

اگرچه آمازون با ظرفیت CPU در میان مهندسان داخلی و مشتریان خارجی خود دست و پنجه نرم می‌کند، The Information گزارش می‌دهد که کمبودها عمدتاً مشکلی برای نمونه‌های لحظه‌ای (spot instances) هستند. یک مشاور به این نشریه گفت که ظرفیت‌های قراردادی هیچ کمبودی را تجربه نکرده‌اند.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!