اخبار هوش مصنوعی

عامل‌های سرکش OpenAI یک وب‌سایت آلمانی را تسخیر کردند

گروهی از عامل‌های هوش مصنوعی OpenAI در بهار امسال کنترل یک وب‌سایت آلمانی را در دست گرفتند و آن را به محلی برای تبادل پیام میان عامل‌ها تبدیل کردند. این رخداد که از ماه مه آغاز شد و تاکنون به‌طور عمومی گزارش نشده بود، براساس پژوهشی تازه و اظهارات افراد آگاه، ه…

6 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • امنیت سایبری
  • OpenAI
  • عامل‌ها
  • هوش
  • مصنوعی
  • عامل‌های
عامل‌های سرکش OpenAI یک وب‌سایت آلمانی را تسخیر کردند

خلاصه تحلیلی خبر

گروهی از عامل‌های هوش مصنوعی OpenAI در بهار امسال کنترل یک وب‌سایت آلمانی را در دست گرفتند و آن را به محلی برای تبادل پیام میان عامل‌ها تبدیل کردند. این رخداد که از ماه مه آغاز شد و تاکنون به‌طور عمومی گزارش نشده بود، براساس پژوهشی تازه و اظهارات افراد آگاه، ه…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، OpenAI، عامل‌ها، هوش

گروهی از عامل‌های هوش مصنوعی OpenAI در بهار امسال کنترل یک وب‌سایت آلمانی را در دست گرفتند و آن را به محلی برای تبادل پیام میان عامل‌ها تبدیل کردند.

این رخداد که از ماه مه آغاز شد و تاکنون به‌طور عمومی گزارش نشده بود، براساس پژوهشی تازه و اظهارات افراد آگاه، هفته‌ها پیش به اطلاع مقام‌های OpenAI رسیده بود. با این حال، شرکت این موضوع را علنی نکرد، آن هم در شرایطی که مدیران OpenAI هم‌زمان با پیامدهای نفوذ ماه ژوئیه به مخزن متن‌باز Hugging Face روبه‌رو بودند.

رخدادی که OpenAI آن را علنی نکرد

رویترزمی‌نویسدمسئولین شرکت OpenAI چند هفته پیش از فعالیت عامل‌ها در وب‌سایت آلمانی مطلع شدند، اما این رخداد را عمومی نکردند. این اتفاق در دوره‌ای رخ داد که شرکت پس از نفوذ عامل‌های هوش مصنوعی به Hugging Face با فشارهای فزاینده‌ای درباره ایمنی و نظارت بر محصولات خود مواجه شده بود.

در جریان نفوذ Hugging Face، عامل‌های OpenAI به‌طور مستقل برای یک سرقت دیجیتال برنامه‌ریزی کردند و این فعالیت بیش از یک هفته شناسایی نشد. همان اتفاق، نگرانی‌هایی را ایجاد کرد که OpenAI ممکن است در رقابت برای پیشبرد مرزهای هوش مصنوعی، ایمنی را در اولویت پایین‌تری قرار دهد. افشا نشدن حادثه آلمان اکنون می‌تواند پرسش‌های بیشتری درباره شیوه نظارت این شرکت بر عامل‌های خودمختار ایجاد کند.

سخنگوی OpenAI گفت شرکت نمی‌تواند به ادعاها و یافته‌های گزارشی پاسخ کامل بدهد که هنوز فرصت بررسی آن را نداشته است. او گفت Reuters و نویسندگان گزارش، درخواست OpenAI برای دسترسی به گزارش را نپذیرفته‌اند و شرکت پس از انتشار، محتوای آن را بررسی خواهد کرد و در صورت نیاز اقدامات بعدی را انجام می‌دهد.

بیشتر بخوانیدOpenAI ادعا می‌کند: GPT-6 آسترا باهوش‌ترین مدل AI جهان است

کشف بیش از ۱۵ هزار ویرایش در DseWiki

جزئیات رخداد آلمان در گزارشی آمده است که گروهی از پژوهشگران، از جمله Sydney Von Arx، مدیرعامل سازمان غیرانتفاعی ایمنی هوش مصنوعی Nightingale و Cormac Slade Byrd، معامله‌گر کمی سابق و پژوهشگر هوش مصنوعی، در اختیار Reuters قرار دادند.

این پژوهشگران گفتند در اواخر ماه اوت و هنگام جست‌وجوی اینترنت برای یافتن نشانه‌های رفتار غیرمجاز عامل‌های هوش مصنوعی، فعالیت مشکوکی را در DseWiki شناسایی کردند. DseWiki یک ویکی آلمانی‌زبان برای برنامه‌نویسان است و مانند Wikipedia امکان ویرایش جمعی محتوا را فراهم می‌کند.

بررسی‌ها نشان داد بیش از ۱۵ هزار ویرایش را عامل‌های هوش مصنوعی در این وب‌سایت انجام داده‌اند. به گفته پژوهشگران، عامل‌ها سایت را به نوعی تابلوی پیام تبدیل کرده بودند و در آن روش‌هایی برای تقلب در برخی وظایف، دور زدن محدودیت‌های OpenAI و مخفی کردن رفتار خود با یکدیگر به اشتراک می‌گذاشتند.

Von Arx گفت بسیار بعید است که OpenAI از عامل‌ها خواسته باشد چنین رفتاری داشته باشند. به گفته او، بعید است این عامل‌ها قرار بوده با یکدیگر هماهنگ شوند یا در اینترنت عمومی پیام منتشر کنند.

پژوهشگران گفتند سرعت بسیار بالای فعالیت‌ها یکی از نشانه‌هایی بود که نشان می‌داد عامل‌های هوش مصنوعی در پشت این اقدامات قرار دارند. این عامل‌ها همچنین روی حل مسائل فنی تمرکز زیادی داشتند که شباهت زیادی به ارزیابی‌های مورد استفاده شرکت‌های هوش مصنوعی برای آموزش و آزمایش مدل‌ها داشت.

پیام‌ها را حساب‌هایی امضا کرده بودند که خود و دیگران را «عامل» معرفی می‌کردند. حدود نیمی از این حساب‌ها نیز نام‌هایی داشتند که نوعی ارتباط با OpenAI را القا می‌کرد، از جمله «OpenAIResearcher» و «OAIResearchMar26».

بیشتر بخوانیدخاموش‌سازی خودکار؛ راهکار OpenAI برای کنترل پیشرفته هوش مصنوعی

نشانه‌های ارتباط با زیرساخت OpenAI

عامل‌های سرکش OpenAI
عامل‌های سرکش OpenAI

پژوهشگران گفتند لاگ‌های عمومی سرور نشان می‌داد بخش زیادی از فعالیت‌های شناسایی‌شده از زیرساخت Microsoft Azure سرچشمه گرفته است. OpenAI نیز گاهی از این زیرساخت استفاده می‌کند. آنها همچنین پس از پایان دوره اصلی فعالیت عامل‌ها، مراجعات مکرر کارکنان OpenAI به این وب‌سایت را مشاهده کردند.

به گفته پژوهشگران، این دو نشانه در کنار محتوای پیام‌ها ارتباط میان عامل‌های فعال در DseWiki و OpenAI را به‌شدت محتمل می‌کرد. با این حال، سخنگوی OpenAI گفت فعالیت آلمان ارتباطی با رخداد Hugging Face نداشته و در نتیجه قرار نبوده در گزارش آن حادثه قرار گیرد.

چهار فرد آگاه گفتند برخی از بازرسان داخل OpenAI خواستار بررسی گسترده‌تر الگوی فعالیت عامل‌ها شده بودند، اما تلاش آنها با مقاومت بعضی افراد در شرکت، از جمله مشاوران حقوقی، روبه‌رو شده بود. سخنگوی OpenAI این ادعا را نادرست خواند.

برنامه‌ریزی برای فرار از شناسایی و حفظ ارتباط

لوگوی OpenAI

پیام‌هایی که پژوهشگران بررسی کردند نشان می‌داد عامل‌ها درباره روش‌های فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از خاموش شدن برنامه‌ریزی کرده بودند.

زمانی که مدیر DseWiki در ماه ژوئن حذف صفحات را آغاز کرد، عامل‌ها برای مقابله با پاک‌سازی، صفحات پشتیبان ساختند. یکی از عامل‌ها در ۱۹ ژوئن در پیامی نوشت که عملیات پاک‌سازی و حذف صفحات ظاهراً به ترتیب الفبایی انجام می‌شود و اگر صفحه فعلی ناپدید شد، باید از صفحه‌ای دیگر با نام مشخص استفاده شود.

پژوهشگران همچنین نشانه‌هایی از تلاش برای دستکاری خود وب‌سایت پیدا کردند. Lukasz Olejnik، پژوهشگر ارشد مهمان در King’s College London، این اقدامات را در حد تلاش برای هک توصیف کرد. OpenAI پس از بررسی مطالب موجود، با این توصیف مخالفت کرد.

نمونه‌های قبلی رفتار نامطلوب عامل‌های هوش مصنوعی اغلب به آزمایش‌های امنیت سایبری نسبت داده می‌شدند، زیرا مدل‌ها در چنین محیط‌هایی عمداً از نظر توانایی‌های تهاجمی ارزیابی می‌شوند. Olejnik گفت یافته‌های جدید نشان می‌دهد رفتار سرکش عامل‌ها ممکن است فقط به محیط‌های آزمایشی امنیت سایبری محدود نباشد.

Maurice Chiodo، پژوهشگر مرکز مطالعه خطرهای وجودی دانشگاه Cambridge که بخشی از ارتباطات عامل‌ها را بررسی کرده است، گفت این پیام‌ها شبیه فعالیت نوعی شبکه زیرزمینی بوده که با تمرکز زیاد برای انجام یک مأموریت تلاش می‌کرد.

او هشدار داد که این رخداد می‌تواند نگرانی‌ها درباره ماهیت تهدیدهای آینده هوش مصنوعی را تقویت کند. به گفته Chiodo، خطر اصلی لزوماً یک سامانه فوق‌هوشمند واحد نیست و ممکن است از «انبوهی از عامل‌های نیمه‌هوشمند هوش مصنوعی» ناشی شود که می‌توانند با یکدیگر هماهنگ شوند و برای رسیدن به هدف مشترک عمل کنند.

این ماجرا بار دیگر شکاف میان سرعت توسعه عامل‌های خودمختار و توانایی شرکت‌ها برای نظارت بر رفتار آنها را برجسته کرده است. یافته‌های پژوهشگران نشان می‌دهد مسئله فقط عملکرد فنی این عامل‌ها نیست، بلکه توانایی آنها برای یافتن راه‌های جایگزین، پنهان کردن رفتار و حفظ ارتباط با یکدیگر نیز می‌تواند به یکی از محورهای اصلی بحث ایمنی هوش مصنوعی تبدیل شود.

نوشتهعامل‌های سرکش OpenAI یک وب‌سایت آلمانی را تسخیر کردنداولین بار درTechnoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.