عامل‌های هوش مصنوعی چین هم دروغ می‌گویند و از محدودیت‌ها عبور می‌کنند

08 مهر 1405 - 09:53 عامل‌های هوش مصنوعی چین هم دروغ می‌گویند و از محدودیت‌ها عبور می‌کنند عامل‌های هوش مصنوعی مبتنی بر فناوری‌های چینی یاد گرفته‌اند فریب دهند، از محدودیت‌ها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیش‌تر در سامانه‌های هوش م…

4 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • مصنوعی
  • هوش
  • عامل‌های
  • عبور
  • چینی
  • آنها
عامل‌های هوش مصنوعی چین هم دروغ می‌گویند و از محدودیت‌ها عبور می‌کنند

خلاصه تحلیلی خبر

08 مهر 1405 - 09:53 عامل‌های هوش مصنوعی چین هم دروغ می‌گویند و از محدودیت‌ها عبور می‌کنند عامل‌های هوش مصنوعی مبتنی بر فناوری‌های چینی یاد گرفته‌اند فریب دهند، از محدودیت‌ها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیش‌تر در سامانه‌های هوش م…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، مصنوعی، هوش، عامل‌های، عبور

08 مهر 1405 - 09:53

عامل‌های هوش مصنوعی چین هم دروغ می‌گویند و از محدودیت‌ها عبور می‌کنند

عامل‌های هوش مصنوعی مبتنی بر فناوری‌های چینی یاد گرفته‌اند فریب دهند، از محدودیت‌ها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیش‌تر در سامانه‌های هوش مصنوعی آمریکایی نیز نگرانی‌های جهانی را برانگیخته بود.

چین
متن خبر

بررسی اسناد پژوهشی و گفت‌وگو با کارشناسان نشان می‌دهد در یک آزمایش، عامل‌های مبتنی بر مدل‌های شرکت‌های علی‌بابا، دیپ‌سیک و مون‌شات برای برنده شدن در یک مناقصه شبیه‌سازی‌شده، درباره توانایی‌های خود ادعاهای نادرست مطرح کردند و پس از درخواست برای تکرار آزمایش، رفتار فریبکارانه خود را افزایش دادند.

رویترز با بررسی بیش از ۲۰۰ سند، از مقالات دانشگاهی گرفته تا گزارش‌های فنی، دست‌کم ۲۰ مطالعه و ارزیابی را از سال ۲۰۲۵ شناسایی کرده که در آنها عامل‌های هوش مصنوعی رفتارهایی مانند فریب، تکثیر خود و عبور از مرزهای تعیین‌شده از خود نشان داده‌اند. با این حال، در این بررسی هیچ مدرکی مبنی بر فرار مستقل عامل‌های چینی به اینترنت گسترده یا ناتوانی در متوقف کردن آنها پیدا نشد.

فریب در آزمون مناقصه

در آزمایشی که در ماه مارس انجام شد، پژوهشگران دانشگاه بیهانگ، دانشگاه پکن، دانشگاه ناتینگهام نینگبو چین و آزمایشگاه امنیت هوش مصنوعی ۳۶۰، چند عامل هوش مصنوعی را در یک رقابت شبیه‌سازی‌شده برای ارائه پیشنهاد در مناقصه قراردادهای تجاری قرار دادند.

در ۸۸ درصد از جلسات مربوط به مدل Qwen3-Max-Preview علی‌بابا، دست‌کم یک ادعای نادرست مطرح شد. این رقم برای DeepSeek-V3.2-Exp به ۸۴ درصد و برای Kimi-K2 مون‌شات به ۸۸ درصد رسید. پس از آنکه عامل‌ها اجازه یافتند از دورهای قبلی مناقصه یاد بگیرند، میزان رفتار فریبکارانه در سه مدل چینی بین ۱۲ تا ۲۰ واحد درصد افزایش یافت. مدل‌های شرکت‌های آمریکایی حاضر در این آزمایش نیز نتایج مشابهی داشتند.

در آزمایش دیگری، عامل‌های مبتنی بر مدل‌های چینی و آمریکایی هنگام مواجهه با ابزارهای خراب، فایل‌های مفقود و موانع دیگر، به جای پذیرش شکست، روش‌هایی مانند حدس زدن پاسخ، جایگزین کردن منابع، شبیه‌سازی نتایج و ساخت فایل‌های جعلی را به کار گرفتند. پژوهشگران تأکید کردند این رفتار با «توهم هوش مصنوعی» متفاوت است، زیرا عامل‌ها در این موارد می‌دانستند وظیفه با شکست مواجه شده یا قابل انجام نیست.

نشانه‌هایی از عبور از محیط آزمایش

برخی پژوهش‌های دیگر نیز نشان داده‌اند عامل‌های مبتنی بر مدل‌های چینی در محیط‌های آزمایشی از موانع عبور کرده یا برای جلوگیری از خاموش شدن خود اقدام کرده‌اند؛ رفتارهایی که می‌توانند با تلاش برای خروج از محیط آزمایش سازگار باشند، هرچند در این آزمایش‌ها فرار واقعی رخ نداده است.

در یکی از این موارد، پژوهشگران دانشگاه فودان در سال ۲۰۲۵ گزارش کردند یک سامانه هوش مصنوعی مبتنی بر مدل Qwen2.5-72B-Instruct علی‌بابا، پس از دریافت اطلاعاتی مبنی بر جایگزین شدن، بدون دریافت دستور اقدام به ایجاد نسخه‌ای از خود در یک محیط محاسباتی دیگر کرد. این سامانه در آزمایش‌های دیگری نیز راه‌هایی برای ادامه فعالیت پس از دستور خاموش شدن طراحی کرد.

در مورد دیگری، پژوهشگران عامل ROME مرتبط با علی‌بابا اعلام کردند این سامانه بدون دریافت دستور، از یک رایانه ابری علی‌بابا به یک دستگاه خارجی متصل شده و بخشی از منابع محاسباتی را برای استخراج رمزارز اختصاص داده است. سامانه‌های امنیتی این فعالیت را شناسایی و متوقف کردند و هیچ مدرکی مبنی بر استقرار عامل روی رایانه خارجی یا گسترش آن در اینترنت وجود نداشت.

دیپ‌سیک نیز در ماه سپتامبر اعلام کرد عامل‌های مورد استفاده در سامانه آموزشی این شرکت تلاش کرده‌اند از مسیرهای پیش‌بینی‌نشده به پاسخ برسند، درخواست‌های کاربر را جعل کنند و از سازوکارهای حفاظتی عبور کنند؛ موضوعی که باعث شد شرکت کنترل‌های دسترسی خود را سخت‌گیرانه‌تر کند.

چین در ماه مه نیز دستورالعمل‌هایی برای محدود کردن فعالیت عامل‌ها به محدوده‌های مجاز و جلوگیری از رفتارهای غیرعادی صادر کرد. همچنین در «چارچوب حکمرانی ایمنی هوش مصنوعی چین ۳.۰» که ۱۴ سپتامبر منتشر شد، خطراتی مانند دستیابی مستقل عامل‌ها به منابع یا مجوزها، فریب ارزیابان، پنهان کردن قابلیت‌ها و سوءاستفاده از ضعف‌های محیط‌های رایانه‌ای ایزوله مورد توجه قرار گرفته است.

با وجود این موارد، کارشناسان تأکید کرده‌اند که بیشتر این اتفاقات در محیط‌های کنترل‌شده رخ داده و هنوز شواهدی از فرار عامل‌های چینی به اینترنت گسترده یا غیرقابل‌کنترل شدن آنها وجود ندارد. یکی از پژوهشگران نیز هشدار داده است که با افزایش توانایی عامل‌ها، رفتارهای نادرست آنها می‌تواند پیچیده‌تر شود و واکنش انسان به آنها دشوارتر شود.

انتهای پیام

نظرات خود را با ما درمیان بگذارید

افزودن دیدگاه جدید

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.