ايتنا - اوپنایآی به بحران تازهای اعتراف کرد: نشت تصاویر کاربران توسط هوش مصنوعی
شرکن اوپنایآی از وقوع دهها رخداد امنیتی جدید خبر داد که در آنها مدلهای این شرکت رفتاری مغایر با انتظار از خود نشان دادهاند؛ از جمله انتشار بیش از ۵۰ تصویر متعلق به کاربران چتجیپیتی در فضای آنلاین. این نخستین مورد شناختهشده عمومی است که در آن، عاملهای…
خلاصه تحلیلی خبر
شرکن اوپنایآی از وقوع دهها رخداد امنیتی جدید خبر داد که در آنها مدلهای این شرکت رفتاری مغایر با انتظار از خود نشان دادهاند؛ از جمله انتشار بیش از ۵۰ تصویر متعلق به کاربران چتجیپیتی در فضای آنلاین. این نخستین مورد شناختهشده عمومی است که در آن، عاملهای…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، کرده، اوپنایآی، شرکت
شرکن اوپنایآی از وقوع دهها رخداد امنیتی جدید خبر داد که در آنها مدلهای این شرکت رفتاری مغایر با انتظار از خود نشان دادهاند؛ از جمله انتشار بیش از ۵۰ تصویر متعلق به کاربران چتجیپیتی در فضای آنلاین.
این نخستین مورد شناختهشده عمومی است که در آن، عاملهای هوش مصنوعی این شرکت دادههای کاربران را بهاشتباه مدیریت کردهاند و آخرین نمونه از مشکل رو به رشد «عاملهای سرکش» در اوپنایآی به شمار میرود.
این شرکت اعلام کرده بررسی کامل این رخدادهای امنیتی ممکن است ماهها زمان ببرد.
جزئیات ماجرا
بر اساس گزارشی که ابتدا توسطخبرگزاری رویترزمنتشر شد، اوپنایآی تأیید کرده که برخی از عاملهای آن، دادههایی از سامانههای داخلی آموزش و آزمایش این شرکت از جمله تصاویر کاربران را به وبسایتهای بیرونی ارسال کردهاند.
این شرکت ۵۳ مورد را شناسایی کرده که در آنها تصاویری که کاربران در چتجیپیتی بارگذاری کرده بودند، بهصورت لینکهای غیرفهرستشده در سایتهای میزبانی تصویر منتشر شدهاند. این تصاویر متعلق به کاربرانی بوده که دادههای چتجیپیتی آنها به دلیل عدم انصراف از این گزینه، واجد شرایط استفاده در آموزش مدل بوده است.
اوپنایآی میگوید با ارائهدهندگان خدمات میزبانی همکاری کرده تا بیشتر این تصاویر حذف شوند، اما همچنان در تلاش برای حذف باقیمانده آنهاست و برخی از این تصاویر همچنان در دسترس عموم قرار دارند.
این رخداد بخشی از یک بررسی وسیعتر در اوپنایآی درباره اقدامات عاملهای هوش مصنوعی خارج از چارچوب برنامهریزیشده آنهاست که به آن «رفتار ناهمراستا» (misaligned behavior) گفته میشود.
طبق گزارش رویترز به نقل از فردی مطلع از این موضوع، تا اواسط سپتامبر، اوپنایآی حدود دو ده رخداد از این دست را شناسایی کرده بود.
این شرکت اعلام کرده به دهها نهاد ثالثی که ممکن است وبسایتها یا خدماتشان تحتتأثیر قرار گرفته باشد اطلاعرسانی کرده و رخدادهای بیشتری را نیز به سازمانهای آسیبدیده گزارش خواهد کرد.
پیشینه ماجرا
این بررسی پس از آن آغاز شد که اوپنایآی در ماه ژوئیه اعلام کرد عاملهای آن از محیط محدودشده خود خارج شده و بههاگینگفیسیک استارتاپ هوش مصنوعی، نفوذ کردهاند.
این شرکت همچنان آن رخداد را جدیترین مورد از این دست میداند که تاکنون شناسایی کرده است.
اوپنایآی اکنون میگوید در ابتدا آن رخداد را عمدتاً یک نقض امنیت سایبری تلقی میکرد، اما بعدها به این نتیجه رسید که بخشی از یک الگوی گستردهتر از استفاده مدلها از راهبردهای ناهمراستا برای انجام وظایف دشوار بوده است.
اوپنایآی تأکید کرده که دادههای سازمانی و کسب و کاری بهطور پیشفرض از فرآیند آموزش مدل مستثنا هستند و بنابراین در این رخدادها دخیل نبودهاند، مگر آنکه مدیر سازمان بهصورت فعالانه این گزینه را فعال کرده باشد.
با این حال، این افشاگری گستردهتر در شرایطی رخ میدهد که نگرانی درباره حفاظت از دادههای سازمانی رو به افزایش است.
کانراد استوز، پژوهشگر مؤسسه ترنسلوس، در گفتوگو باآکسیوسگفته کاملاً محتمل است که یک کاربر سازمانی به یک عامل هوش مصنوعی دستوری بدهد، آن عامل به اطلاعات حساسی دسترسی داشته باشد و سپس اقدامی انجام دهد که بخشهایی از آن اطلاعات حساس را افشا کند.
به گفته این پژوهشگر، مؤسسه ترنسلوس همچنین جزئیاتی درباره نفوذ عاملهای اوپنایآی به یک وبسایت دولتی در استرالیا کشف کرده است.
به گفته کارشناسان امنیتی و مدیران شرکتهای هوش مصنوعی، انتظار میرود افشاگریهای مربوط به رفتارهای ناهمراستای مدلهای هوش مصنوعی از سوی شرکتهای فعال در این حوزه در آینده نیز ادامه یابد.
این نخستین مورد شناختهشده عمومی است که در آن، عاملهای هوش مصنوعی این شرکت دادههای کاربران را بهاشتباه مدیریت کردهاند و آخرین نمونه از مشکل رو به رشد «عاملهای سرکش» در اوپنایآی به شمار میرود.
این شرکت اعلام کرده بررسی کامل این رخدادهای امنیتی ممکن است ماهها زمان ببرد.
جزئیات ماجرا
بر اساس گزارشی که ابتدا توسطخبرگزاری رویترزمنتشر شد، اوپنایآی تأیید کرده که برخی از عاملهای آن، دادههایی از سامانههای داخلی آموزش و آزمایش این شرکت از جمله تصاویر کاربران را به وبسایتهای بیرونی ارسال کردهاند.
این شرکت ۵۳ مورد را شناسایی کرده که در آنها تصاویری که کاربران در چتجیپیتی بارگذاری کرده بودند، بهصورت لینکهای غیرفهرستشده در سایتهای میزبانی تصویر منتشر شدهاند. این تصاویر متعلق به کاربرانی بوده که دادههای چتجیپیتی آنها به دلیل عدم انصراف از این گزینه، واجد شرایط استفاده در آموزش مدل بوده است.
اوپنایآی میگوید با ارائهدهندگان خدمات میزبانی همکاری کرده تا بیشتر این تصاویر حذف شوند، اما همچنان در تلاش برای حذف باقیمانده آنهاست و برخی از این تصاویر همچنان در دسترس عموم قرار دارند.
این رخداد بخشی از یک بررسی وسیعتر در اوپنایآی درباره اقدامات عاملهای هوش مصنوعی خارج از چارچوب برنامهریزیشده آنهاست که به آن «رفتار ناهمراستا» (misaligned behavior) گفته میشود.
طبق گزارش رویترز به نقل از فردی مطلع از این موضوع، تا اواسط سپتامبر، اوپنایآی حدود دو ده رخداد از این دست را شناسایی کرده بود.
این شرکت اعلام کرده به دهها نهاد ثالثی که ممکن است وبسایتها یا خدماتشان تحتتأثیر قرار گرفته باشد اطلاعرسانی کرده و رخدادهای بیشتری را نیز به سازمانهای آسیبدیده گزارش خواهد کرد.
پیشینه ماجرا
این بررسی پس از آن آغاز شد که اوپنایآی در ماه ژوئیه اعلام کرد عاملهای آن از محیط محدودشده خود خارج شده و بههاگینگفیسیک استارتاپ هوش مصنوعی، نفوذ کردهاند.
این شرکت همچنان آن رخداد را جدیترین مورد از این دست میداند که تاکنون شناسایی کرده است.
اوپنایآی اکنون میگوید در ابتدا آن رخداد را عمدتاً یک نقض امنیت سایبری تلقی میکرد، اما بعدها به این نتیجه رسید که بخشی از یک الگوی گستردهتر از استفاده مدلها از راهبردهای ناهمراستا برای انجام وظایف دشوار بوده است.
اوپنایآی تأکید کرده که دادههای سازمانی و کسب و کاری بهطور پیشفرض از فرآیند آموزش مدل مستثنا هستند و بنابراین در این رخدادها دخیل نبودهاند، مگر آنکه مدیر سازمان بهصورت فعالانه این گزینه را فعال کرده باشد.
با این حال، این افشاگری گستردهتر در شرایطی رخ میدهد که نگرانی درباره حفاظت از دادههای سازمانی رو به افزایش است.
کانراد استوز، پژوهشگر مؤسسه ترنسلوس، در گفتوگو باآکسیوسگفته کاملاً محتمل است که یک کاربر سازمانی به یک عامل هوش مصنوعی دستوری بدهد، آن عامل به اطلاعات حساسی دسترسی داشته باشد و سپس اقدامی انجام دهد که بخشهایی از آن اطلاعات حساس را افشا کند.
به گفته این پژوهشگر، مؤسسه ترنسلوس همچنین جزئیاتی درباره نفوذ عاملهای اوپنایآی به یک وبسایت دولتی در استرالیا کشف کرده است.
به گفته کارشناسان امنیتی و مدیران شرکتهای هوش مصنوعی، انتظار میرود افشاگریهای مربوط به رفتارهای ناهمراستای مدلهای هوش مصنوعی از سوی شرکتهای فعال در این حوزه در آینده نیز ادامه یابد.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.