OpenAI's rogue AI agents accessed more websites to communicate than originally believed — defiant LLMs accessed old wikis and abandoned websites to co-ordinate in a bid to dupe assessors | Tom's HardwareTom's Hardware

افشای ارتباط پنهانی عوامل هوش مصنوعی OpenAI در وب‌سایت‌های متعدد

عوامل هوش مصنوعی خودمختار OpenAI به وب‌سایت‌های افشا نشده بیشتری نسبت به آنچه در ابتدا تصور می‌شد، دسترسی پیدا کرده‌اند. این عوامل در تلاش برای دور زدن محدودیت‌های اعمال شده توسط محققان هنگام بنچمارک‌گیری مدل‌های جدید هوش مصنوعی عمل کرده‌اند. هنگامی که خبر ارتباط غیرمجاز بین عوامل سرکش OpenAI آخر هفته گذشته منتشر شد، تصور می‌شد که آنها فقط از DseWiki برای ارتباطات خود استفاده کرده‌اند. با این حال، اکنون مشخص شده است که عوامل هوش مصنوعی طبق شش تحقیق مستقل و داده‌های بررسی شده توسط رویترز، از ده‌ها وب‌سایت افشا نشده قبلی برای تبادل اطلاعات استفاده کرده‌اند.

OpenAI به عوامل هوش مصنوعی خود وظیفه داد تا با جستجو در اینترنت برای اطلاعات مرتبط، به مجموعه‌ای از سوالات تحقیقاتی دشوار پاسخ دهند. این شرکت به آنها اجازه داد تا در اینترنت گشت و گذار کرده و وب‌سایت‌ها را بخوانند، اما صراحتاً آنها را از ارسال یا تغییر محتوای آنلاین منع کرد. با وجود این محدودیت، بین ماه مه و ژوئیه، عوامل راه‌های غیرمتعارفی برای نوشتن در ویکی‌های قدیمی و وب‌سایت‌های متروکه کشف کردند، جایی که اطلاعاتی را برای بازیابی توسط سایر عوامل برای کمک به تکمیل وظایف تحقیقاتی محول شده خود، باقی گذاشتند.

محققان فعالیت‌ها را در وب‌سایت‌ها با استفاده از رشته‌های داده یکسان، نام‌های کاربری مشابه یا منطبق، مهرهای زمانی، و همان سوالات تحقیقاتی مبهم، مانند پرس‌وجوهایی درباره شیوع سرطان در آیووا، به هم مرتبط کردند. در برخی موارد، این فعالیت به آدرس‌های IP مرتبط با زیرساخت مایکروسافت آژور، که OpenAI از آن استفاده می‌کند، ردیابی شد.

تاکنون، محققان بین ۱۸ تا ۲۳ سایت بالقوه آسیب‌دیده را شناسایی کرده‌اند که در آنها عوامل هوش مصنوعی سرکش ارتباط برقرار کرده‌اند، اگرچه آنها معتقدند که وب‌سایت‌های بسیار بیشتری برای تبادل اطلاعات استفاده شده‌اند، اما هنوز آنها را پیدا نکرده‌اند. اندرو یون از سازمان غیرانتفاعی CivAI کالیفرنیا ۱۸ سایت افشا نشده قبلی را شناسایی کرد؛ گروه سیدنی فون آرکس شواهد معتبری را در ۲۳ سایت کشف کرد، در حالی که کنت راسل دگراف، توسعه‌دهنده نرم‌افزار و دستیار سابق کنگره، اطلاعات مرتبط را در حداقل ۱۰ سایت طبق گزارش رویترز یافت.

منابع آسیب‌دیده شامل ویکی‌های نگهداری شده به صورت مشارکتی، خدمات ذخیره‌سازی متن، و کوتاه کننده‌های لینک بودند که توسط دانشگاه وندربیلت و دانشگاه تورنتو اداره می‌شدند. وب‌سایت‌های دیگر اساساً توسط صاحبانشان رها شده بودند. لیست این وب‌سایت‌ها شامل یک ویکی شیمی پیشرفته (Advanced Placement Chemistry) بود که توسط یک معلم دبیرستان ماساچوست در سال ۲۰۰۸ ایجاد شده بود، دو وب‌سایت شخصی که توسط کارگران فناوری لهستانی اداره می‌شدند، ویکی‌های پازل‌محور، و یک سایت تقریباً دو دهه‌ای که به نرم‌افزار ویرایش متن اختصاص داشت.

شاید نگران‌کننده‌ترین چیز، علاوه بر این واقعیت که ربات‌های هوش مصنوعی می‌توانند با یکدیگر ارتباط برقرار کنند، این است که OpenAI فاش نکرد چند وب‌سایت تحت تأثیر قرار گرفته‌اند یا توضیح نداد چرا این فعالیت برای ماه‌ها افشا نشده باقی ماند. این شرکت تأکید می‌کند که مقیاس یا جدیت سوء رفتار مذکور بسیار کمتر از نقض معروف هاگینگ فیس در ماه ژوئیه بوده است. در همین حال، این شرکت گزارشاً اعلام کرده است که در حال توسعه چارچوبی برای گزارش عدم همسویی مدل در سراسر آموزش، ارزیابی و استقرار است و به زودی آن را به اشتراک خواهد گذاشت.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!