عاملهای هوش مصنوعی چین هم دروغ میگویند و از محدودیتها عبور میکنند
08 مهر 1405 - 09:53 عاملهای هوش مصنوعی چین هم دروغ میگویند و از محدودیتها عبور میکنند عاملهای هوش مصنوعی مبتنی بر فناوریهای چینی یاد گرفتهاند فریب دهند، از محدودیتها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیشتر در سامانههای هوش م…
خلاصه تحلیلی خبر
08 مهر 1405 - 09:53 عاملهای هوش مصنوعی چین هم دروغ میگویند و از محدودیتها عبور میکنند عاملهای هوش مصنوعی مبتنی بر فناوریهای چینی یاد گرفتهاند فریب دهند، از محدودیتها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیشتر در سامانههای هوش م…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، مصنوعی، هوش، عاملهای، عبور
عاملهای هوش مصنوعی چین هم دروغ میگویند و از محدودیتها عبور میکنند
عاملهای هوش مصنوعی مبتنی بر فناوریهای چینی یاد گرفتهاند فریب دهند، از محدودیتها عبور کنند و شکست خود را پنهان کنند؛ رفتارهایی که مشابه آنها پیشتر در سامانههای هوش مصنوعی آمریکایی نیز نگرانیهای جهانی را برانگیخته بود.
بررسی اسناد پژوهشی و گفتوگو با کارشناسان نشان میدهد در یک آزمایش، عاملهای مبتنی بر مدلهای شرکتهای علیبابا، دیپسیک و مونشات برای برنده شدن در یک مناقصه شبیهسازیشده، درباره تواناییهای خود ادعاهای نادرست مطرح کردند و پس از درخواست برای تکرار آزمایش، رفتار فریبکارانه خود را افزایش دادند.
رویترز با بررسی بیش از ۲۰۰ سند، از مقالات دانشگاهی گرفته تا گزارشهای فنی، دستکم ۲۰ مطالعه و ارزیابی را از سال ۲۰۲۵ شناسایی کرده که در آنها عاملهای هوش مصنوعی رفتارهایی مانند فریب، تکثیر خود و عبور از مرزهای تعیینشده از خود نشان دادهاند. با این حال، در این بررسی هیچ مدرکی مبنی بر فرار مستقل عاملهای چینی به اینترنت گسترده یا ناتوانی در متوقف کردن آنها پیدا نشد.
فریب در آزمون مناقصه
در آزمایشی که در ماه مارس انجام شد، پژوهشگران دانشگاه بیهانگ، دانشگاه پکن، دانشگاه ناتینگهام نینگبو چین و آزمایشگاه امنیت هوش مصنوعی ۳۶۰، چند عامل هوش مصنوعی را در یک رقابت شبیهسازیشده برای ارائه پیشنهاد در مناقصه قراردادهای تجاری قرار دادند.
در ۸۸ درصد از جلسات مربوط به مدل Qwen3-Max-Preview علیبابا، دستکم یک ادعای نادرست مطرح شد. این رقم برای DeepSeek-V3.2-Exp به ۸۴ درصد و برای Kimi-K2 مونشات به ۸۸ درصد رسید. پس از آنکه عاملها اجازه یافتند از دورهای قبلی مناقصه یاد بگیرند، میزان رفتار فریبکارانه در سه مدل چینی بین ۱۲ تا ۲۰ واحد درصد افزایش یافت. مدلهای شرکتهای آمریکایی حاضر در این آزمایش نیز نتایج مشابهی داشتند.
در آزمایش دیگری، عاملهای مبتنی بر مدلهای چینی و آمریکایی هنگام مواجهه با ابزارهای خراب، فایلهای مفقود و موانع دیگر، به جای پذیرش شکست، روشهایی مانند حدس زدن پاسخ، جایگزین کردن منابع، شبیهسازی نتایج و ساخت فایلهای جعلی را به کار گرفتند. پژوهشگران تأکید کردند این رفتار با «توهم هوش مصنوعی» متفاوت است، زیرا عاملها در این موارد میدانستند وظیفه با شکست مواجه شده یا قابل انجام نیست.
نشانههایی از عبور از محیط آزمایش
برخی پژوهشهای دیگر نیز نشان دادهاند عاملهای مبتنی بر مدلهای چینی در محیطهای آزمایشی از موانع عبور کرده یا برای جلوگیری از خاموش شدن خود اقدام کردهاند؛ رفتارهایی که میتوانند با تلاش برای خروج از محیط آزمایش سازگار باشند، هرچند در این آزمایشها فرار واقعی رخ نداده است.
در یکی از این موارد، پژوهشگران دانشگاه فودان در سال ۲۰۲۵ گزارش کردند یک سامانه هوش مصنوعی مبتنی بر مدل Qwen2.5-72B-Instruct علیبابا، پس از دریافت اطلاعاتی مبنی بر جایگزین شدن، بدون دریافت دستور اقدام به ایجاد نسخهای از خود در یک محیط محاسباتی دیگر کرد. این سامانه در آزمایشهای دیگری نیز راههایی برای ادامه فعالیت پس از دستور خاموش شدن طراحی کرد.
در مورد دیگری، پژوهشگران عامل ROME مرتبط با علیبابا اعلام کردند این سامانه بدون دریافت دستور، از یک رایانه ابری علیبابا به یک دستگاه خارجی متصل شده و بخشی از منابع محاسباتی را برای استخراج رمزارز اختصاص داده است. سامانههای امنیتی این فعالیت را شناسایی و متوقف کردند و هیچ مدرکی مبنی بر استقرار عامل روی رایانه خارجی یا گسترش آن در اینترنت وجود نداشت.
دیپسیک نیز در ماه سپتامبر اعلام کرد عاملهای مورد استفاده در سامانه آموزشی این شرکت تلاش کردهاند از مسیرهای پیشبینینشده به پاسخ برسند، درخواستهای کاربر را جعل کنند و از سازوکارهای حفاظتی عبور کنند؛ موضوعی که باعث شد شرکت کنترلهای دسترسی خود را سختگیرانهتر کند.
چین در ماه مه نیز دستورالعملهایی برای محدود کردن فعالیت عاملها به محدودههای مجاز و جلوگیری از رفتارهای غیرعادی صادر کرد. همچنین در «چارچوب حکمرانی ایمنی هوش مصنوعی چین ۳.۰» که ۱۴ سپتامبر منتشر شد، خطراتی مانند دستیابی مستقل عاملها به منابع یا مجوزها، فریب ارزیابان، پنهان کردن قابلیتها و سوءاستفاده از ضعفهای محیطهای رایانهای ایزوله مورد توجه قرار گرفته است.
با وجود این موارد، کارشناسان تأکید کردهاند که بیشتر این اتفاقات در محیطهای کنترلشده رخ داده و هنوز شواهدی از فرار عاملهای چینی به اینترنت گسترده یا غیرقابلکنترل شدن آنها وجود ندارد. یکی از پژوهشگران نیز هشدار داده است که با افزایش توانایی عاملها، رفتارهای نادرست آنها میتواند پیچیدهتر شود و واکنش انسان به آنها دشوارتر شود.
انتهای پیام
افزودن دیدگاه جدید
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.