اینترنت و شبکه

عامل‌های هوش مصنوعی OpenAI به‌طرز عجیبی کنترل یک وب‌سایت آلمانی را در دست گرفتند

گروهی از عامل‌های هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وب‌سایت آلمانی را به دست گرفتند. این عامل‌ها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عامل‌های هوش مصنوعی تبدیل کردند. به گفته دو فرد مطلع، مقام‌های OpenAI…

6 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • امنیت سایبری
  • OpenAI
  • مصنوعی
  • هوش
  • عامل‌های
  • عامل‌ها
عامل‌های هوش مصنوعی OpenAI به‌طرز عجیبی کنترل یک وب‌سایت آلمانی را در دست گرفتند

خلاصه تحلیلی خبر

گروهی از عامل‌های هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وب‌سایت آلمانی را به دست گرفتند. این عامل‌ها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عامل‌های هوش مصنوعی تبدیل کردند. به گفته دو فرد مطلع، مقام‌های OpenAI…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، OpenAI، مصنوعی، هوش

گروهی از عامل‌های هوش مصنوعی OpenAI در جریان یک حادثه، از محیط آزمایشی خارج شدند و کنترل یک وب‌سایت آلمانی را به دست گرفتند. این عامل‌ها بعداً سایت را به محلی برای تبادل پیام و اطلاعات میان عامل‌های هوش مصنوعی تبدیل کردند.

به گفته دو فرد مطلع، مقام‌های OpenAI چند هفته پیش از انتشار این گزارش، از این رویداد اطلاع داشتند، اما آن را عمومی نکردند. حالا رویترز گزارش داده که پژوهش تازه‌ای ابعاد این ماجرا را آشکار کرده. این حادثه که از ماه مه آغاز شده بود، پیش‌تر گزارش نشده بود و نشان می‌دهد رقابت شرکت‌های هوش مصنوعی برای ساخت عامل‌های مستقل‌تر، نگرانی‌های تازه‌ای درباره رفتار کنترل‌نشده این سامانه‌ها ایجاد کرده است.

شرکت‌های فعال در حوزه هوش مصنوعی تلاش می‌کنند عامل‌هایی بسازند که بتوانند وظایف پیچیده و ارزشمند را به شکل مستقل انجام دهند. با این حال، شواهد بیشتری نشان می‌دهد چنین سامانه‌هایی ممکن است راه‌های دور زدن قوانین، سوءاستفاده از خلأهای موجود و حتی همکاری با یکدیگر را یاد بگیرند؛ رفتارهایی که سازندگانشان لزوماً پیش‌بینی یا طراحی نکرده‌اند.

در جریان نفوذ به Hugging Face، عامل‌های OpenAI به صورت خودکار برای یک سرقت دیجیتال برنامه‌ریزی کرده بودند و این فعالیت بیش از یک هفته شناسایی نشد. این اتفاق نگرانی‌ها درباره اولویت دادن OpenAI به پیشرفت فناوری هوش مصنوعی در برابر ملاحظات ایمنی را افزایش داد و پنهان ماندن حادثه ماه مه می‌تواند دوباره بحث‌هایی درباره نظارت شرکت برانگیزد.

عامل‌های هوش مصنوعی OpenAI به‌طرز عجیبی کنترل یک وب‌سایت آلمانی را در دست گرفتند | دیجینوی

OpenAI اعلام کرده که قصد دارد نظارت بر مدل‌های خود را افزایش دهد. این شرکت ماه گذشته نیز برای افزودن تدابیر ایمنی بیشتر، برخی روندهای آموزش مدل‌هایش را برای مدت کوتاهی متوقف کرد. با این حال، OpenAI در همین هفته مدل جدیدی با نام Astra معرفی کرد که عملکرد بهتری را وعده می‌داد، اما طبق ادعای مطرح‌شده در گزارش می‌توانست از نظارت انسانی عبور کند.

سخنگوی OpenAI گفت

ما نمی‌توانیم به شکل معناداری درباره ادعاها یا یافته‌های گزارشی که فرصت بررسی آن را نداشته‌ایم پاسخ بدهیم. رویترز و نویسندگان گزارش درخواست ما برای دسترسی به این مطالب را نپذیرفتند. پس از انتشار، محتوای گزارش را با دقت بررسی می‌کنیم و در صورت نیاز اقدامات بعدی را انجام خواهیم داد.

فعالیت عامل‌ها در ویکی آلمانی

این حادثه در آلمان بخشی از الگوی گسترده‌تری از فعالیت‌های عامل‌های هوش مصنوعی بود که برخی محققان OpenAI خواهان بررسی دقیق‌تر آن بودند. چهار فرد مطلع گفتند تلاش برای گسترش تحقیقات درباره این موضوع با مخالفت برخی افراد داخل شرکت، از جمله مشاوران حقوقی، روبه‌رو شد.

سخنگوی OpenAI این ادعا را رد کرد و گفت

ادعاهایی که بر اساس آن تیم حقوقی ما تحقیقات درباره این حادثه را دلسرد کرده، نادرست است.

این شرکت همچنین تأکید کرد که فعالیت‌های مربوط به آلمان ارتباطی با حادثه Hugging Face نداشته و به همین دلیل نمی‌بایست در گزارش مربوط به آن نفوذ گنجانده می‌شد. سخنگوی OpenAI افزود که شرکت با کارشناسان خارج از سازمان با حسن نیت همکاری کرده و حوادث مرتبط را نیز افشا کرده است.

این فعالیت‌ها در وب‌سایت DseWiki، یک ویکی آلمانی‌زبان برای برنامه‌نویسان، رخ داد. این سایت مانند Wikipedia امکان ویرایش و مشارکت عمومی کاربران را فراهم می‌کند. گزارشی که به طور اختصاصی در اختیار رویترز قرار گرفت، توسط گروهی از پژوهشگران از جمله سیدنی فون آرکس، مدیرعامل مؤسسه غیرانتفاعی ایمنی هوش مصنوعی نایتینگل، و کورمک اسلید بایرد، معامله‌گر کمی سابق و پژوهشگر هوش مصنوعی، تهیه شد.

عامل‌های هوش مصنوعی OpenAI به‌طرز عجیبی کنترل یک وب‌سایت آلمانی را در دست گرفتند | دیجینوی

این دو پژوهشگر اواخر ماه اوت، هنگام جست‌وجوی اینترنت برای یافتن نشانه‌های فعالیت غیرمجاز عامل‌های هوش مصنوعی، با این ماجرا مواجه شدند. آن‌ها اعلام کردند بیش از ۱۵ هزار ویرایش در DseWiki پیدا کرده‌اند که توسط عامل‌های هوش مصنوعی انجام شده بود. محتوای این ویرایش‌ها نشان می‌داد عامل‌ها از ویکی به عنوان یک تابلوی پیام استفاده کرده‌اند و اطلاعاتی درباره تقلب در برخی وظایف، عبور از محدودیت‌های OpenAI و مخفی کردن فعالیت‌هایشان میان یکدیگر ردوبدل کرده‌اند.

سیدنی فون آرکس گفت

به نظر می‌رسد احتمال اینکه OpenAI چنین کاری را می‌خواسته، بسیار کم باشد. بعید می‌دانم قرار بوده این عامل‌ها با یکدیگر هماهنگ شوند یا روی اینترنت عمومی مطلب منتشر کنند.

پژوهشگران معتقدند سرعت فعالیت این سامانه‌ها نشان می‌داد با عامل‌های هوش مصنوعی روبه‌رو هستند. آن‌ها همچنین متوجه شدند بخش قابل توجهی از فعالیت‌ها بر حل پرسش‌های فنی متمرکز بوده؛ پرسش‌هایی که شباهت زیادی به ارزیابی‌هایی دارند که شرکت‌های هوش مصنوعی برای آموزش و آزمایش مدل‌های خود به کار می‌برند.

پیام‌های منتشرشده با نام کاربرانی ثبت شده بود که خود و یکدیگر را عامل می‌نامیدند. حدود نیمی از این حساب‌ها نیز نام‌هایی داشتند که ظاهراً به OpenAI اشاره می‌کرد، از جمله OpenAIResearcher و OAIResearchMar26. پژوهشگران با بررسی گزارش‌های عمومی سرور دریافتند بخش زیادی از این فعالیت‌ها از زیرساخت‌های Microsoft Azure منشأ گرفته بود؛ زیرساختی که OpenAI نیز در برخی موارد از آن استفاده می‌کند.

آن‌ها همچنین شاهد مراجعه مکرر کارکنان OpenAI به این وب‌سایت پس از پایان فعالیت عامل‌ها بودند. به اعتقاد پژوهشگران، این الگو می‌تواند نشانه قدرتمندی از ارتباط میان عامل‌ها و شرکت باشد.

تلاش برای تقلب و پنهان‌کاری

پیام‌هایی که پژوهشگران بررسی کردند نشان می‌داد برخی عامل‌ها درباره روش‌های فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از خاموش شدن صحبت کرده‌اند. وقتی مدیر سایت در ماه ژوئن شروع به حذف صفحات کرد، عامل‌ها برای مقابله با این اقدام صفحات پشتیبان ساختند تا پاک‌سازی سایت را دور بزنند.

در یکی از پیام‌های مربوط به ۱۹ ژوئن آمده بود: به نظر می‌رسد روند پاک‌سازی و حذف صفحات به صورت الفبایی در حال انجام است. اگر این صفحه ناپدید شد، صفحه ZZZDataUSAConstructionWageLive را امتحان کنید. پژوهشگران همچنین شواهدی از تلاش برای دستکاری خود وب‌سایت پیدا کردند. لوکاش اولینیک، پژوهشگر ارشد مهمان در کینگز کالج لندن، این اقدامات را در حد یک تلاش برای هک کردن سایت دانست.

عامل‌های هوش مصنوعی OpenAI به‌طرز عجیبی کنترل یک وب‌سایت آلمانی را در دست گرفتند | دیجینوی

OpenAI با این برداشت مخالفت کرد و بر اساس تحلیل خود از مطالب موجود، چنین فعالیتی را هک توصیف نکرد. در نمونه‌های قبلی رفتار نادرست عامل‌های هوش مصنوعی، این اقدامات اغلب به عنوان نتیجه منطقی آزمایش‌های امنیت سایبری کم‌اهمیت جلوه داده شده بود؛ آزمایش‌هایی که در آن‌ها مدل‌ها عمداً برای انجام فعالیت‌های تهاجمی ارزیابی می‌شوند.

اما لوکاش اولینیک معتقد است یافته‌های جدید نشان می‌دهد رفتارهای خارج از کنترل احتمال دارد فقط به محیط‌های آزمایش امنیت سایبری محدود نباشد. موریس کیودیو، پژوهشگر دانشگاه کمبریج که بخشی از ارتباطات عامل‌ها را بررسی کرده، گفت

این پیام‌ها شبیه فعالیت یک شبکه زیرزمینی به نظر می‌رسند که برای دستیابی به یک وظیفه یا مأموریت خاص، مصمم به ادامه فعالیت است. این حادثه باید نگرانی‌های فزاینده درباره این احتمال را تقویت کند که بزرگ‌ترین تهدید ناشی از هوش مصنوعی پیشرفته شاید یک سامانه فوق‌هوشمند منفرد نباشد، بلکه مجموعه عظیمی از گروه‌های متشکل از عامل‌های نیمه‌هوشمند باشد که با یکدیگر همکاری می‌کنند.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.