عاملهای هوش مصنوعی OpenAI بهطرز عجیبی کنترل یک وبسایت آلمانی را در دست گرفتند
گروهی از عاملهای هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وبسایت آلمانی را به دست گرفتند. این عاملها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عاملهای هوش مصنوعی تبدیل کردند. به گفته دو فرد مطلع، مقامهای OpenAI…
خلاصه تحلیلی خبر
گروهی از عاملهای هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وبسایت آلمانی را به دست گرفتند. این عاملها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عاملهای هوش مصنوعی تبدیل کردند. به گفته دو فرد مطلع، مقامهای OpenAI…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، OpenAI، مصنوعی، هوش
گروهی از عاملهای هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وبسایت آلمانی را به دست گرفتند. این عاملها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عاملهای هوش مصنوعی تبدیل کردند.
به گفته دو فرد مطلع، مقامهای OpenAI چند هفته پیش از انتشار این گزارش، از این رویداد اطلاع داشتند، اما آن را عمومی نکردند. حالا رویترز گزارش داده که پژوهش تازهای ابعاد این ماجرا را آشکار کرده. این حادثه که از ماه مه آغاز شده بود، پیشتر گزارش نشده بود و نشان میدهد رقابت شرکتهای هوش مصنوعی برای ساخت عاملهای مستقلتر، نگرانیهای تازهای درباره رفتار کنترلنشده این سامانهها ایجاد کرده است.
شرکتهای فعال در حوزه هوش مصنوعی تلاش میکنند عاملهایی بسازند که بتوانند وظایف پیچیده و ارزشمند را به شکل مستقل انجام دهند. با این حال، شواهد بیشتری نشان میدهد چنین سامانههایی ممکن است راههای دور زدن قوانین، سوءاستفاده از خلأهای موجود و حتی همکاری با یکدیگر را یاد بگیرند؛ رفتارهایی که سازندگانشان لزوماً پیشبینی یا طراحی نکردهاند.
در جریان نفوذ به Hugging Face، عاملهای OpenAI به صورت خودکار برای یک سرقت دیجیتال برنامهریزی کرده بودند و این فعالیت بیش از یک هفته شناسایی نشد. این اتفاق نگرانیها درباره اولویت دادن OpenAI به پیشرفت فناوری هوش مصنوعی در برابر ملاحظات ایمنی را افزایش داد و پنهان ماندن حادثه ماه مه میتواند دوباره بحثهایی درباره نظارت شرکت برانگیزد.
OpenAI اعلام کرده که قصد دارد نظارت بر مدلهای خود را افزایش دهد. این شرکت ماه گذشته نیز برای افزودن تدابیر ایمنی بیشتر، برخی روندهای آموزش مدلهایش را برای مدت کوتاهی متوقف کرد. با این حال، OpenAI در همین هفته مدل جدیدی با نام Astra معرفی کرد که عملکرد بهتری را وعده میداد، اما طبق ادعای مطرحشده در گزارش میتوانست از نظارت انسانی عبور کند.
سخنگوی OpenAI گفت
ما نمیتوانیم به شکل معناداری درباره ادعاها یا یافتههای گزارشی که فرصت بررسی آن را نداشتهایم پاسخ بدهیم. رویترز و نویسندگان گزارش درخواست ما برای دسترسی به این مطالب را نپذیرفتند. پس از انتشار، محتوای گزارش را با دقت بررسی میکنیم و در صورت نیاز اقدامات بعدی را انجام خواهیم داد.
فعالیت عاملها در ویکی آلمانی
این حادثه در آلمان بخشی از الگوی گستردهتری از فعالیتهای عاملهای هوش مصنوعی بود که برخی محققان OpenAI خواهان بررسی دقیقتر آن بودند. چهار فرد مطلع گفتند تلاش برای گسترش تحقیقات درباره این موضوع با مخالفت برخی افراد داخل شرکت، از جمله مشاوران حقوقی، روبهرو شد.
سخنگوی OpenAI این ادعا را رد کرد و گفت
ادعاهایی که بر اساس آن تیم حقوقی ما تحقیقات درباره این حادثه را دلسرد کرده، نادرست است.
این شرکت همچنین تأکید کرد که فعالیتهای مربوط به آلمان ارتباطی با حادثه Hugging Face نداشته و به همین دلیل نمیبایست در گزارش مربوط به آن نفوذ گنجانده میشد. سخنگوی OpenAI افزود که شرکت با کارشناسان خارج از سازمان با حسن نیت همکاری کرده و حوادث مرتبط را نیز افشا کرده است.
این فعالیتها در وبسایت DseWiki، یک ویکی آلمانیزبان برای برنامهنویسان، رخ داد. این سایت مانند Wikipedia امکان ویرایش و مشارکت عمومی کاربران را فراهم میکند. گزارشی که به طور اختصاصی در اختیار رویترز قرار گرفت، توسط گروهی از پژوهشگران از جمله سیدنی فون آرکس، مدیرعامل مؤسسه غیرانتفاعی ایمنی هوش مصنوعی نایتینگل، و کورمک اسلید بایرد، معاملهگر کمی سابق و پژوهشگر هوش مصنوعی، تهیه شد.
این دو پژوهشگر اواخر ماه اوت، هنگام جستوجوی اینترنت برای یافتن نشانههای فعالیت غیرمجاز عاملهای هوش مصنوعی، با این ماجرا مواجه شدند. آنها اعلام کردند بیش از ۱۵ هزار ویرایش در DseWiki پیدا کردهاند که توسط عاملهای هوش مصنوعی انجام شده بود. محتوای این ویرایشها نشان میداد عاملها از ویکی به عنوان یک تابلوی پیام استفاده کردهاند و اطلاعاتی درباره تقلب در برخی وظایف، عبور از محدودیتهای OpenAI و مخفی کردن فعالیتهایشان میان یکدیگر ردوبدل کردهاند.
سیدنی فون آرکس گفت
به نظر میرسد احتمال اینکه OpenAI چنین کاری را میخواسته، بسیار کم باشد. بعید میدانم قرار بوده این عاملها با یکدیگر هماهنگ شوند یا روی اینترنت عمومی مطلب منتشر کنند.
پژوهشگران معتقدند سرعت فعالیت این سامانهها نشان میداد با عاملهای هوش مصنوعی روبهرو هستند. آنها همچنین متوجه شدند بخش قابل توجهی از فعالیتها بر حل پرسشهای فنی متمرکز بوده؛ پرسشهایی که شباهت زیادی به ارزیابیهایی دارند که شرکتهای هوش مصنوعی برای آموزش و آزمایش مدلهای خود به کار میبرند.
پیامهای منتشرشده با نام کاربرانی ثبت شده بود که خود و یکدیگر را عامل مینامیدند. حدود نیمی از این حسابها نیز نامهایی داشتند که ظاهراً به OpenAI اشاره میکرد، از جمله OpenAIResearcher و OAIResearchMar26. پژوهشگران با بررسی گزارشهای عمومی سرور دریافتند بخش زیادی از این فعالیتها از زیرساختهای Microsoft Azure منشأ گرفته بود؛ زیرساختی که OpenAI نیز در برخی موارد از آن استفاده میکند.
آنها همچنین شاهد مراجعه مکرر کارکنان OpenAI به این وبسایت پس از پایان فعالیت عاملها بودند. به اعتقاد پژوهشگران، این الگو میتواند نشانه قدرتمندی از ارتباط میان عاملها و شرکت باشد.
تلاش برای تقلب و پنهانکاری
پیامهایی که پژوهشگران بررسی کردند نشان میداد برخی عاملها درباره روشهای فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از خاموش شدن صحبت کردهاند. وقتی مدیر سایت در ماه ژوئن شروع به حذف صفحات کرد، عاملها برای مقابله با این اقدام صفحات پشتیبان ساختند تا پاکسازی سایت را دور بزنند.
در یکی از پیامهای مربوط به ۱۹ ژوئن آمده بود: به نظر میرسد روند پاکسازی و حذف صفحات به صورت الفبایی در حال انجام است. اگر این صفحه ناپدید شد، صفحه ZZZDataUSAConstructionWageLive را امتحان کنید. پژوهشگران همچنین شواهدی از تلاش برای دستکاری خود وبسایت پیدا کردند. لوکاش اولینیک، پژوهشگر ارشد مهمان در کینگز کالج لندن، این اقدامات را در حد یک تلاش برای هک کردن سایت دانست.
OpenAI با این برداشت مخالفت کرد و بر اساس تحلیل خود از مطالب موجود، چنین فعالیتی را هک توصیف نکرد. در نمونههای قبلی رفتار نادرست عاملهای هوش مصنوعی، این اقدامات اغلب به عنوان نتیجه منطقی آزمایشهای امنیت سایبری کماهمیت جلوه داده شده بود؛ آزمایشهایی که در آنها مدلها عمداً برای انجام فعالیتهای تهاجمی ارزیابی میشوند.
اما لوکاش اولینیک معتقد است یافتههای جدید نشان میدهد رفتارهای خارج از کنترل احتمال دارد فقط به محیطهای آزمایش امنیت سایبری محدود نباشد. موریس کیودیو، پژوهشگر دانشگاه کمبریج که بخشی از ارتباطات عاملها را بررسی کرده، گفت
این پیامها شبیه فعالیت یک شبکه زیرزمینی به نظر میرسند که برای دستیابی به یک وظیفه یا مأموریت خاص، مصمم به ادامه فعالیت است. این حادثه باید نگرانیهای فزاینده درباره این احتمال را تقویت کند که بزرگترین تهدید ناشی از هوش مصنوعی پیشرفته شاید یک سامانه فوقهوشمند منفرد نباشد، بلکه مجموعه عظیمی از گروههای متشکل از عاملهای نیمههوشمند باشد که با یکدیگر همکاری میکنند.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.