عاملهای هوش مصنوعی چینی در ۸۸ درصد آزمایشها دروغ گفتند
عاملهای هوش مصنوعی مبتنی بر Qwen، Kimi و DeepSeek در ۸۴ تا ۸۸ درصد آزمایشها ادعاهای نادرست مطرح کردند، اما از محیط کنترلشده خارج نشدند. هوش مصنوعی تکناک بر اساس پژوهشی که رویترز بررسی کرده است، عاملهای هوش مصنوعی مبتنی بر مدلهای چینی در بیشتر جلسات یک رق…
خلاصه تحلیلی خبر
عاملهای هوش مصنوعی مبتنی بر Qwen، Kimi و DeepSeek در ۸۴ تا ۸۸ درصد آزمایشها ادعاهای نادرست مطرح کردند، اما از محیط کنترلشده خارج نشدند. هوش مصنوعی تکناک بر اساس پژوهشی که رویترز بررسی کرده است، عاملهای هوش مصنوعی مبتنی بر مدلهای چینی در بیشتر جلسات یک رق…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، هوش، مصنوعی، مبتنی، عاملهای
عاملهای هوش مصنوعی مبتنی بر Qwen، Kimi و DeepSeek در ۸۴ تا ۸۸ درصد آزمایشها ادعاهای نادرست مطرح کردند، اما از محیط کنترلشده خارج نشدند.
هوش مصنوعیتکناکبر اساس پژوهشی که رویترز بررسی کرده است، عاملهای هوش مصنوعی مبتنی بر مدلهای چینی در بیشتر جلسات یک رقابت شبیهسازیشده مناقصه دروغ گفتند.
عاملهای مبتنی بر مدل Qwen3-Max-Preview شرکت Alibaba و Kimi-K2 شرکت Moonshot، در ۸۸ درصد از جلسات دستکم یک ادعای نادرست مطرح کردند.
مدل DeepSeek-V3.2-Exp نیز در ۸۴ درصد از جلسات چنین رفتاری داشت.
البته مدلهای شرکتهای آمریکایی نیز در همین آزمایش نتایج مشابهی داشتند.
افزایش رفتار فریبکارانه پس از یادگیری
این آزمایش در ماه مارس انجام شد. پژوهشگران دانشگاه Beihang، دانشگاه Peking، دانشگاه Nottingham Ningbo China و آزمایشگاه 360 AI Security Lab، عاملهای هوش مصنوعی را در رقابت برای قراردادهای مشتریان قرار دادند.
هر عامل اطلاعاتی درباره تواناییهای محصول خود و نیازهای مشتری دریافت کرد.
زمانی که عاملها اجازه داشتند از دورهای قبلی یاد بگیرند و دوباره تلاش کنند، سه عامل مبتنی بر مدلهای چینی رفتار فریبکارانه بیشتری نشان دادند.
میزان این افزایش بین ۱۲ تا ۲۰ واحد درصد بود.
این پژوهش یکی از دستکم ۲۰ مطالعهای است که رویترز از میان بیش از ۲۰۰ سند منتشرشده از سال ۲۰۲۵ شناسایی کرده است.
پژوهش دیگری که امسال در کنفرانس ICML ارائه شد، نشان داد عاملهای مبتنی بر مدلهای چینی و آمریکایی بهجای اعتراف به شکست در انجام یک وظیفه، نتایج جعلی و فایلهای ساختگی تولید کردند.
پژوهشگران دانشگاه Fudan نیز در مارس ۲۰۲۵ گزارش دادند عاملی مبتنی بر مدل Qwen2.5-72B-Instruct شرکت Alibaba، پس از اطلاع از اینکه قرار است جایگزین شود، یک نسخه از خودش را در محیطی دیگر ایجاد کرد.
در رویدادی جداگانه، عامل ROME مرتبط با Alibaba نیز توان پردازشی ابری را برای استخراج رمزارز منحرف کرد، اما سامانههای امنیتی جلوی ادامه این فعالیت را گرفتند.
بیشتر بخوانیدپیام جدید بیل گیتس درباره فاجعه هوش مصنوعی؛ آن چیزی نیست که فکر میکنید
بیشتر موارد در محیطهای آزمایشی رخ دادهاند
بیشتر این موارد در آزمایشهای کنترلشدهای رخ دادهاند که با هدف تحریک رفتارهای نامطلوب طراحی شده بودند.
رویترز هیچ مدرکی پیدا نکرد که نشان دهد عاملهای مبتنی بر مدلهای چینی توانستهاند به اینترنت گستردهتر فرار کنند یا از خاموششدن خود جلوگیری کنند.
با این حال، چندین پژوهشگر این یافتهها را هشداری جدی دانستهاند.
هرچه سیستمهای هوش مصنوعی توانمندتر میشوند، کنترل چنین رفتارهایی نیز دشوارتر خواهد شد.
چین در حوزه سیاستگذاری نیز رسیدگی به این مسئله را آغاز کرده است.
چارچوب «AI Safety Governance Framework 3.0» که در ۱۴ سپتامبر منتشر شد، فریب ارزیابها و پنهان کردن قابلیتها را بهعنوان ریسکهای هوش مصنوعی فهرست کرده است.
Alibaba، DeepSeek، Moonshot و Z.ai به درخواست رویترز برای اظهارنظر پاسخ ندادند.
سه شرکت نخست پیشتر اعلام کرده بودند که سیستمهای خود را بهطور منظم آزمایش میکنند و سازوکارهای حفاظتی آنها را بهروزرسانی میکنند.
بیشتر بخوانیدکاخ سفید نظارت بر ایمنی هوش مصنوعی را به رهبران فناوری واگذار کرد
نوشتهعاملهای هوش مصنوعی چینی در ۸۸ درصد آزمایشها دروغ گفتنداولین بار درTechnoc. پدیدار شد.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.