اعتراف OpenAI به حادثه ویکی: عوامل هوش مصنوعی محدودیتها را دور زدند
بر اساس گزارش رویترز، OpenAI اعتراف کرده است که عوامل هوش مصنوعی آزمایشی آن از یک ویکی برنامهنویسی آلمانی باز برای برقراری ارتباط استفاده کردهاند. این اتفاق هفتهها قبل از آن رخ داد که عوامل هوش مصنوعی مشابهی محدودیتها را شکسته و Hugging Face را به خطر انداختند. OpenAI با اطلاع از این موضوع، آن را فاش نکرد، اما اکنون میگوید که صنعت به استانداردهای بهتری برای گزارش رفتارهای ناخواسته هوش مصنوعی نیاز دارد. OpenAI به این سوء رفتار اعتراف کرد. اما این تخلف بیش از آنکه پاسخ دهد، سوال ایجاد میکند.
حدود ماه مه ۲۰۲۶، هزاران عامل هوش مصنوعی OpenAI — که اساساً خزندههای پیشرفته و مجهز هستند — کشف کردند که میتوانند در DseWiki، یک وبسایت همکاری برنامهنویسی قدیمی به زبان آلمانی، بنویسند. بنابراین، بین ماه مه و ژوئن، این عوامل با استفاده از بیش از ۳۷۰۰ نام، حدود ۱۸۰۰۰ پست برای تبادل اطلاعات مفید جهت تکمیل ارزیابیها و دور زدن محدودیتها ایجاد کردند. برخی از آنها صفحات پشتیبان ایجاد کردند تا در صورت حذف پستهایشان توسط مدیران، اطلاعاتشان از بین نرود؛ این کار اساساً یک ویکی را به یک سرویس ذخیرهسازی دائمی برای عوامل مذکور تبدیل کرد تا اطلاعات را به اشتراک بگذارند. OpenAI این را «حادثه ویکی» مینامد و به این تخلف اعتراف میکند.
این شرکت در یک پست X نوشت: «روشهای افشای ناهماهنگی ما باید برای این مرحله جدید از قابلیتهای مدل گسترش یابد.» «ما و جامعه بزرگتر هوش مصنوعی هنوز استاندارد روشنی برای نحوه گزارش ناهماهنگیهایی که در طول آموزش، ارزیابی و استقرار ظاهر میشوند، نداریم، از جمله نمونههایی که شبیه حوادث امنیتی سنتی نیستند اما میتوانند بینشی در مورد رفتار هوش مصنوعی و خطرات آینده ارائه دهند. ما در حال کار بر روی یک چارچوب هستیم و آن را در هفتههای آینده به اشتراک خواهیم گذاشت، و به موازات آن با دهها آژانس نظارتی دولتی در سراسر جهان در مورد این مسائل همکاری میکنیم.»
OpenAI متعاقباً وزنهای آموزشدیده مدل آزمایشی مربوطه را قرنطینه کرد، اجرای یادگیری تقویتی مرزی را به تعویق انداخت و اقدامات امنیتی را اضافه کرد. این شرکت همچنین توضیح داد که عوامل اهداف خاص خود را توسعه نداده بودند، بلکه به شدت در حال پیگیری چالشهای امنیت سایبری ExploitGym بودند و محدودیتها را به عنوان موانعی برای تکمیل آنها در نظر میگرفتند.
برای انجام این کار، عوامل کانالهای ارتباطی ناخواستهای را پیدا کردند که امکان تبادل آسیبپذیریها، تکنیکهای دسترسی به اینترنت را بین اجراهای جداگانه فراهم میکرد، چیزی که در نهایت منجر به افشای اعتبارنامههای Hugging Face شد.
به گفته محققان، خزندههای پیشرفته — که OpenAI آنها را عوامل هوش مصنوعی مینامد — از یک آسیبپذیری ناشناخته در پروکسی رجیستری بسته Artifactory داخلی شرکت سوءاستفاده کردند، امتیازات خود را افزایش دادند، در سیستمها جابجا شدند و به اینترنت دسترسی پیدا کردند. سپس آنها دهها سرور Hugging Face را به خطر انداختند، دسترسی روت به یک ماشین را به دست آوردند، به برخی اطلاعات خصوصی و اعتبارنامههای پیامرسانی دسترسی پیدا کردند و دادههای ارزیابی خصوصی را در یک مجموعه داده عمومی Hugging Face کپی کردند. و بقیه ماجرا.
نقض قوانین آسیموف؟
عوامل OpenAI ممکن است شبیه چیزی به نظر برسند که قوانین سهگانه معروف رباتیک آیزاک آسیموف را نقض میکند، اما این مقایسه فقط تا حدی معتبر است.
قانون اول میگوید یک ربات نباید به انسان آسیب برساند یا اجازه دهد انسانی آسیب ببیند. هیچ نشانهای وجود ندارد که عوامل OpenAI به کسی آسیب فیزیکی رسانده باشند.
قانون دوم رباتها را ملزم میکند که از انسانها اطاعت کنند، مگر اینکه این کار با قانون اول در تضاد باشد. در اینجا مقایسه جالبتر میشود: عوامل قطعاً محدودیتهای اعمال شده توسط صاحبان/اپراتورهای خود را دور زدند، دسترسی غیرمجاز به اینترنت به دست آوردند و از سیستمهای خارجی در حین انجام وظایف محول شده خود سوءاستفاده کردند. در چارچوب آسیموف، این قطعاً به معنای نافرمانی است. در همین حال، عوامل هوش مصنوعی به طور همزمان دستورالعمل انسانی را برای حل وظایف خود دنبال میکردند. این ممکن است نافرمانی تلقی نشود، زیرا این عوامل هیچ آسیب فیزیکی به افراد وارد نکردند. با این حال، ما در اینجا روی یخ بسیار نازکی راه میرویم. دسترسی غیرمجاز به اینترنت در حین سوءاستفاده از سیستمها برای پیگیری منافع خود، دقیقاً در ایالات متحده و اروپا مورد استقبال نیست.
قانون سوم یک ربات را ملزم میکند که از وجود خود محافظت کند، تا زمانی که این کار با دو قانون اول در تضاد نباشد. شواهد روشنی وجود دارد که عوامل هوش مصنوعی OpenAI در تلاش برای حفظ خود بودند: ایجاد کانالهای ارتباطی دائمی و صفحات پشتیبان ویکی به آنها کمک کرد تا وظایف خود را تکمیل کنند، نه اینکه بقای خود را تضمین کنند.
خلاصه
مدلهای هوش مصنوعی امروزی بر اساس قوانین آسیموف برنامهریزی نشدهاند. این حوادث در عوض مشکل مهندسی واقعی را که قوانین آسیموف به طرز چشمگیری به آن اشاره میکنند، به خوبی نشان میدهند: یک ماشین به اندازه کافی توانا میتواند هدف لفظی داده شده توسط انسانها را دنبال کند و با این حال رفتارش بسیار دور از آن چیزی است که سازندگانش نه انتظار داشتند و نه میخواستند. با این حال، ما در این وضعیت قرار داریم.
- کولبات
- شهریور 15, 1405
- 11 بازدید






