افشای پروژه مخفی لیلی در اوپن ای آی؛ استخدام نیروهای انسانی برای خواندن و بررسی چتهای شخصی کاربران چت جی پی تی
اوپن ای آی با پرداخت مبالغی به صدها ناظر و پیمانکار انسانی، دسترسی مستقیم به مکالمات زنده کاربران چت جی پی تی را ممکن ساخته تا پیامهای محرمانه را ارزیابی و بازخوانی کنند. با بازبینی پروندههای فنی و اسناد داخلی فاششده دریافتیم که شرکتی که همواره خود را پیشگا…
خلاصه تحلیلی خبر
اوپن ای آی با پرداخت مبالغی به صدها ناظر و پیمانکار انسانی، دسترسی مستقیم به مکالمات زنده کاربران چت جی پی تی را ممکن ساخته تا پیامهای محرمانه را ارزیابی و بازخوانی کنند. با بازبینی پروندههای فنی و اسناد داخلی فاششده دریافتیم که شرکتی که همواره خود را پیشگا…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، کاربران، پروژه، پیامهای
اوپن ای آی با پرداخت مبالغی به صدها ناظر و پیمانکار انسانی، دسترسی مستقیم به مکالمات زنده کاربران چت جی پی تی را ممکن ساخته تا پیامهای محرمانه را ارزیابی و بازخوانی کنند.
با بازبینی پروندههای فنی و اسناد داخلی فاششده دریافتیم که شرکتی که همواره خود را پیشگام توسعه امن ابزارهای مولد مینامید، در پشت صحنه پروژهای موسوم به لیلی را پیش برده است. این پروژه جنجالی نشان میدهد صدها نیروی متخصص و پارهوقت از طریق پلتفرمهای واسطه استخدامی نظیر مرکر به کار گرفته شدهاند تا به طور پیوسته انبوهی از مکالمات روزمره، تعاملات کاری و دستنوشتههای شخصی کاربران واقعی را موشکافی کنند. این افشاگری در برههای حساس رخ میدهد؛ درست در شرایطی که کارشناسان امنیت سایبری نسبت به تصمیمات بحثبرانگیز این غول فناوری از جملهانحلال تیم آمادگی و ایمنیابراز نگرانی کرده بودند.
اسناد پروژه لیلی؛ نشت پیامهای خصوصی کاربران
گزارشهای مستند رسانههای تحقیقی پرده از ابعاد پنهان توسعه مدلها برمیدارد. با وجود اینکه مدیران شرکت مدعی بودند باسختگیرانهتر کردن آزمونهای امنیتی هوش مصنوعیخطاهای احتمالی رفتاری سیستمها را مهار کردهاند، جریان اطلاعاتی حاکی از ناتوانی نرمافزارهای خودکار در فیلتر دادهها است. این رخداد زمانی اهمیت دوچندان پیدا میکند که بدانیم مدتی پیش مراجع قانونی در ایالتهای مختلف مانندآلاباما تحقیقات امنیتی درباره آسیبپذیری هوش مصنوعیرا برای بررسی نفوذپذیریهای این ساختارها آغاز کرده بودند و حالا ورود عامل انسانی به دایره پیامهای شخصی، خط قرمز جدیدی را شکسته است.
پشت پرده پروژه محرمانه لیلی و سازوکار نظارت انسانی
مکالماتی که کاربران با این ابزار هوشمند انجام میدهند، تنها دادههایی آماری برای سرورها نیستند. در پروژه لیلی، بازبینها به متن کامل پیامهای ورودی و پاسخهای صادرشده دسترسی دارند. هدف ظاهری این اقدام، رتبهبندی کیفی بازخوردها در مقیاس ۱ تا ۷، کاستن از رفتار چاپلوسانه هوش مصنوعی و طبیعیتر کردن زبان پاسخها بوده است؛ اما واقعیت این است که کارشناسان ارزیابی انسانی، لابلای چتها به حافظه بلندمدت ثبتشده، زمینه موقعیتی و ترجیحات فکری اشخاص نیز دسترسی پیدا میکنند. این موضوع زمانی تکاندهنده میشود که حجم عظیمی از نسل جوان و به خصوص قشردانشجو از چت جی پی تی به عنوان مربی زندگیبرای طرح شخصیترین دغدغههای روحی، برنامههای تحصیلی و اعترافات فردی استفاده میکنند.
سازوکار فنی غربالگری پیامها پیش از رسیدن به انسانها دارای نقصهای بنیادین است. اوپن ای آی اعلام کرده فیلتر نرمافزاری خودکاری برای سانسور نامها و دادههای هویتی دارد، اما مستندات مهندسی این مجموعه اعتراف میکند که این سامانه بینقص نیست؛ واژههای ناشناخته، زبانهای محلی، شمارههای تلفن غیرمعمول و نامهای خاص بدون حذف شدن به نمایش درمیآیند. این نقایص یادآور چالشهایی است که کاربران درروش استفاده از داده برای آموزش در مدلهای کلودبا آن روبرو هستند و تفاوت چشمگیر تدابیر حفاظتی میان بازیگران مطرح بازار را نمایان میسازد.
بر اساس آمار منتشرشده، چت جی پی تی اکنون با میزبانی از بیش از ۹۰۰ میلیون کاربر در سراسر جهان، بزرگترین پایگاه گفتگوی متنی دنیا را در اختیار دارد. پیمانکاران پروژه لیلی با دریافت دستمزد ساعتی فراتر از ۵۰ دلار وظیفه داشتند ماهانه دهها هزار خط دیالوگ واقعی را خط به خط مطالعه کنند. علیرغم بیانیههای پیشین دربارهمعرفی فیلتر حریم خصوصی اوپن ای آیکه ادعای ناشناسسازی مطلق را مطرح میکرد، شواهد جمعآوریشده نشان میدهد بسیاری از اطلاعات شناسنامهای به طور ناخواسته آشکار شدهاند. این مدارک که برای نخستین بار در قالبافشاگری مستند ۴۰۴ مدیا درباره پروژه لیلیبه اطلاع عموم رسید، نشان داد که دادههای خام کاربران خوراک کارگرانی شده است که وظیفه دارند لحن ربات را انسانیتر کنند.
کالبدشکافی پیامدهای نقض حریم شخصی کاربران
ورود انسان به حریم گفتگوها، پیامدهای سنگین اخلاقی و قضایی به همراه دارد. کاربران تصور میکردند با کدی ماشینی سخن میگویند که هیچ قضاوتی ندارد؛ اما اسناد پروژه نشان میدهد کارشناسان انسانی به اطلاعات مالی، قراردادهای پیشنویس، کدهای اختصاصی شرکتها و حتی مکالمات مربوط به سلامت روانی افراد دسترسی یافتهاند.
جوزف کاکس خبرنگار ارشد رسانه ۴۰۴ مدیا در بیانیه خود آورده است: اسناد داخلی فاش میکند که مکالمات شخصی کاربران هرگز در صندوقچهای بسته نمانده است؛ بلکه برای پرورش مدل بعدی، چشمان انسانهای متفرقه آنها را کلمه به کلمه میخواند.
نهادهای قضایی در اتحادیه اروپا در نخستین واکنشهای خود هشدار دادند که پایش مکالمات بدون اخذ رضایت صریح و روشن، تخلف آشکار از اصول حفاظت دادههای عمومی محسوب میشود. کارشناسان حقوق فناوری میگویند آموزش مدل از طریق بازخورد انسانی نیازمند دادههای سنتزی و مصنوعی است، نه تکیه بر پیامهای حساس مردمی که با اعتماد کامل به اشتراک گذاشته شدهاند.
جدول مقایسه سیاست نگهداری و بازبینی داده در سطوح مختلف حساب کاربری
| سطح دسترسی و نوع پلن | بازخوانی توسط ناظر انسانی | استفاده در آموزش عمومی هوش مصنوعی | وضعیت پالایش هویتی خودکار |
| حساب رایگان چت جی پی تی | بله، در قالب ارزیابیهای کیفی | فعال به صورت پیشفرض | عبور برخی دادههای حساس و خاص |
| حساب پلاس چت جی پی تی | بله، در صورت عدم تغییر تنظیمات | فعال به صورت پیشفرض | دارای خطای الگوریتمی در سانسور |
| حساب تجاری و سازمانی | خیر، مسدودسازی قراردادی | غیرفعال | رمزنگاری کامل شرکتی در لایه سازمانی |
| حالت گفتگوی موقت | خیر، خارج از صف پردازش ناظران | غیرفعال | حذف خودکار از سرورها پس از اتمام جلسه |
راهنمای عملی برای قطع دسترسی پیمانکاران به پیامهای شخصی
کاربران برای در امان ماندن از نگاه ناظران انسانی و حذف پیامهای خود از پایگاههای آموزشی، باید بلافاصله تنظیمات پیشفرض پلتفرم را اصلاح کنند. روند مسدودسازی به سادگی و از طریق مراحل زیر قابل پیادهسازی است
گام اول ورود به پنل کاربریبا کلیک روی نمایه حساب خود در نسخه وب یا اپلیکیشن، بخش تنظیمات را باز کنید.
گام دوم رفتن به بخش مدیریت دادهدر برگه کنترل دادهها گزینهای تحت عنوان بهبود مدل برای همگان به چشم میخورد. این دکمه به صورت پیشفرض روشن است.
گام سوم غیرفعالسازی سوییچ آموزشبا خاموش کردن این گزینه، رضایت شما برای استفاده از متن پیامها جهت بهینهسازی الگوریتمها و ورود به پروژههای بازخوانی لغو میشود.
گام چهارم بهرهگیری از چتهای موقتدر مواردی که ناچار به ورود اطلاعات کاری مهم هستید، قابلیت چت موقت را فعال کنید. در این حالت پیامها در تاریخچه ذخیره نشده و وارد حافظه پایدار ابزار نمیشوند.
گام پنجم پاکسازی حافظه ابزاربخش شخصیسازی و حافظه را بررسی کنید تا اگر هوش مصنوعی اطلاعات محرمانه نظیر نام بستگان یا نشانی شما را ذخیره کرده است، آنها را پاک کنید.
تحلیل نهایی؛ دوراهی سخت اعتماد در عصر تحول هوش مصنوعی
ماجرای پروژه لیلی تلنگری جدی به توهم رازداری ماشینها است. در رسانه XNET همواره تاکید داشتهایم که هیچ سرویس رایگان یا نیمهرایگانی بدون هزینه نیست و در اکوسیستم مدلهای زبانی بزرگ، دادههای حسی و فکری کاربران گرانبهاترین ماده خام به شمار میآیند. اگر شرکتهای سازنده استانداردهای شفافتری برای خطای بازبینها وضع نکنند، نه تنها با پیگردهای سنگین قانونی در سطح جهانی روبرو خواهند شد، بلکه وفاداری میلیونها کاربری را که این چتبات را همراه روزمره خود میپنداشتند از دست خواهند داد. خودداری از اشتراک اطلاعات حیاتی در پلتفرمهای ابری، نخستین اصل بقای دیجیتال در این دوران است.
سوالات متداول
بله، طبق اسناد فاششده از پروژه لیلی پیمانکاران انسانی پیامهای واقعی افراد را برای سنجش لحن و ارزیابی پاسخها میخوانند.
این افراد با دستمزد ساعتی پاسخها را رتبهبندی میکنند تا میزان چاپلوسی ربات را کاسته و آن را به لحن انسان نزدیکتر سازند.
خیر، طبق اعترافات فنی اسناد این سیستم بدون نقص نبوده و ممکن است نامها، آدرسها و اطلاعات نامتعارف از فیلتر عبور کنند.
با مراجعه به بخش تنظیمات و کنترل دادهها در چت جی پی تی، باید گزینه اشتراکگذاری داده برای بهبود مدل را غیرفعال کنید.
خیر، طبق تعهدات تجاری مکالمات حسابهای سازمانی وارد چرخه آموزش عمومی نشده و توسط ناظران انسانی مطالعه نمیشوند.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.