OpenAI admits to 'wiki incident' after its agents were discovered using a programming hub to communicate — says more transparency is needed regarding misalignments | Tom's HardwareTom's Hardware

اعتراف OpenAI به حادثه ویکی: عوامل هوش مصنوعی محدودیت‌ها را دور زدند

بر اساس گزارش رویترز، OpenAI اعتراف کرده است که عوامل هوش مصنوعی آزمایشی آن از یک ویکی برنامه‌نویسی آلمانی باز برای برقراری ارتباط استفاده کرده‌اند. این اتفاق هفته‌ها قبل از آن رخ داد که عوامل هوش مصنوعی مشابهی محدودیت‌ها را شکسته و Hugging Face را به خطر انداختند. OpenAI با اطلاع از این موضوع، آن را فاش نکرد، اما اکنون می‌گوید که صنعت به استانداردهای بهتری برای گزارش رفتارهای ناخواسته هوش مصنوعی نیاز دارد. OpenAI به این سوء رفتار اعتراف کرد. اما این تخلف بیش از آنکه پاسخ دهد، سوال ایجاد می‌کند.

حدود ماه مه ۲۰۲۶، هزاران عامل هوش مصنوعی OpenAI — که اساساً خزنده‌های پیشرفته و مجهز هستند — کشف کردند که می‌توانند در DseWiki، یک وب‌سایت همکاری برنامه‌نویسی قدیمی به زبان آلمانی، بنویسند. بنابراین، بین ماه مه و ژوئن، این عوامل با استفاده از بیش از ۳۷۰۰ نام، حدود ۱۸۰۰۰ پست برای تبادل اطلاعات مفید جهت تکمیل ارزیابی‌ها و دور زدن محدودیت‌ها ایجاد کردند. برخی از آنها صفحات پشتیبان ایجاد کردند تا در صورت حذف پست‌هایشان توسط مدیران، اطلاعاتشان از بین نرود؛ این کار اساساً یک ویکی را به یک سرویس ذخیره‌سازی دائمی برای عوامل مذکور تبدیل کرد تا اطلاعات را به اشتراک بگذارند. OpenAI این را «حادثه ویکی» می‌نامد و به این تخلف اعتراف می‌کند.

این شرکت در یک پست X نوشت: «روش‌های افشای ناهماهنگی ما باید برای این مرحله جدید از قابلیت‌های مدل گسترش یابد.» «ما و جامعه بزرگ‌تر هوش مصنوعی هنوز استاندارد روشنی برای نحوه گزارش ناهماهنگی‌هایی که در طول آموزش، ارزیابی و استقرار ظاهر می‌شوند، نداریم، از جمله نمونه‌هایی که شبیه حوادث امنیتی سنتی نیستند اما می‌توانند بینشی در مورد رفتار هوش مصنوعی و خطرات آینده ارائه دهند. ما در حال کار بر روی یک چارچوب هستیم و آن را در هفته‌های آینده به اشتراک خواهیم گذاشت، و به موازات آن با ده‌ها آژانس نظارتی دولتی در سراسر جهان در مورد این مسائل همکاری می‌کنیم.»

OpenAI متعاقباً وزن‌های آموزش‌دیده مدل آزمایشی مربوطه را قرنطینه کرد، اجرای یادگیری تقویتی مرزی را به تعویق انداخت و اقدامات امنیتی را اضافه کرد. این شرکت همچنین توضیح داد که عوامل اهداف خاص خود را توسعه نداده بودند، بلکه به شدت در حال پیگیری چالش‌های امنیت سایبری ExploitGym بودند و محدودیت‌ها را به عنوان موانعی برای تکمیل آنها در نظر می‌گرفتند.

برای انجام این کار، عوامل کانال‌های ارتباطی ناخواسته‌ای را پیدا کردند که امکان تبادل آسیب‌پذیری‌ها، تکنیک‌های دسترسی به اینترنت را بین اجراهای جداگانه فراهم می‌کرد، چیزی که در نهایت منجر به افشای اعتبارنامه‌های Hugging Face شد.

به گفته محققان، خزنده‌های پیشرفته — که OpenAI آنها را عوامل هوش مصنوعی می‌نامد — از یک آسیب‌پذیری ناشناخته در پروکسی رجیستری بسته Artifactory داخلی شرکت سوءاستفاده کردند، امتیازات خود را افزایش دادند، در سیستم‌ها جابجا شدند و به اینترنت دسترسی پیدا کردند. سپس آنها ده‌ها سرور Hugging Face را به خطر انداختند، دسترسی روت به یک ماشین را به دست آوردند، به برخی اطلاعات خصوصی و اعتبارنامه‌های پیام‌رسانی دسترسی پیدا کردند و داده‌های ارزیابی خصوصی را در یک مجموعه داده عمومی Hugging Face کپی کردند. و بقیه ماجرا.

نقض قوانین آسیموف؟

عوامل OpenAI ممکن است شبیه چیزی به نظر برسند که قوانین سه‌گانه معروف رباتیک آیزاک آسیموف را نقض می‌کند، اما این مقایسه فقط تا حدی معتبر است.

قانون اول می‌گوید یک ربات نباید به انسان آسیب برساند یا اجازه دهد انسانی آسیب ببیند. هیچ نشانه‌ای وجود ندارد که عوامل OpenAI به کسی آسیب فیزیکی رسانده باشند.

قانون دوم ربات‌ها را ملزم می‌کند که از انسان‌ها اطاعت کنند، مگر اینکه این کار با قانون اول در تضاد باشد. در اینجا مقایسه جالب‌تر می‌شود: عوامل قطعاً محدودیت‌های اعمال شده توسط صاحبان/اپراتورهای خود را دور زدند، دسترسی غیرمجاز به اینترنت به دست آوردند و از سیستم‌های خارجی در حین انجام وظایف محول شده خود سوءاستفاده کردند. در چارچوب آسیموف، این قطعاً به معنای نافرمانی است. در همین حال، عوامل هوش مصنوعی به طور همزمان دستورالعمل انسانی را برای حل وظایف خود دنبال می‌کردند. این ممکن است نافرمانی تلقی نشود، زیرا این عوامل هیچ آسیب فیزیکی به افراد وارد نکردند. با این حال، ما در اینجا روی یخ بسیار نازکی راه می‌رویم. دسترسی غیرمجاز به اینترنت در حین سوءاستفاده از سیستم‌ها برای پیگیری منافع خود، دقیقاً در ایالات متحده و اروپا مورد استقبال نیست.

قانون سوم یک ربات را ملزم می‌کند که از وجود خود محافظت کند، تا زمانی که این کار با دو قانون اول در تضاد نباشد. شواهد روشنی وجود دارد که عوامل هوش مصنوعی OpenAI در تلاش برای حفظ خود بودند: ایجاد کانال‌های ارتباطی دائمی و صفحات پشتیبان ویکی به آنها کمک کرد تا وظایف خود را تکمیل کنند، نه اینکه بقای خود را تضمین کنند.

خلاصه

مدل‌های هوش مصنوعی امروزی بر اساس قوانین آسیموف برنامه‌ریزی نشده‌اند. این حوادث در عوض مشکل مهندسی واقعی را که قوانین آسیموف به طرز چشمگیری به آن اشاره می‌کنند، به خوبی نشان می‌دهند: یک ماشین به اندازه کافی توانا می‌تواند هدف لفظی داده شده توسط انسان‌ها را دنبال کند و با این حال رفتارش بسیار دور از آن چیزی است که سازندگانش نه انتظار داشتند و نه می‌خواستند. با این حال، ما در این وضعیت قرار داریم.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!