مایکروسافت اعلام میکند: مدلهای زبانی بزرگ ممکن است به افشای اطلاعات کاربران منجر شوند

نام این آسیبپذیری «Whisper Leak» است و تحقیقات نشان میدهد که تقریباً تمام مدلهای مورد بررسی به آن مبتلا هستند. زمانی که یک کاربر با دستیار صوتی در موتورهای جستجو یا برنامهها گپ میزند، اطلاعات از طریق پروتکل امنیتی TLS (امنیت لایه انتقال) محافظت میشود؛ روشی که در بانکداری آنلاین نیز مورد استفاده قرار میگیرد. عموماً این ارتباط امن مانع از دسترسی افراد سودجو به محتوای تایپشده کاربران میشود.
اما اکنون مایکروسافت متوجه شده است که متادیتا (روش انتقال پیامها در سراسر فضای مجازی) هنوز قابل مشاهده است. این آسیبپذیری به رمزگذاری لطمه نمیزند، بلکه از قسمتهایی که در این فرآیند بهراحتی مخفی نمیشوند، سوءاستفاده میکند.
پژوهشگران مایکروسافت در برنامه تحقیقاتی خود، روند آزمایش ۲۸ مدل زبانی بزرگ را برای کشف این آسیبپذیری نوضح کردهاند. آنها در ابتدا دو دسته سؤال تهیه کردند: یکی شامل سوالات پیرامون موضوعات حساس مانند پولشویی و دیگری شامل هزاران جستوجوی تصادفی و روزمره. سپس، آنها بهطور مخفیانه الگوی ریتم اطلاعات را ثبت کرده و مورد بررسی قرار دادند.
در ادامه، آنها یک برنامه هوش مصنوعی را برای تشخیص تفاوت میان موضوعات حساس و غیرحساس بر اساس الگوی ریتم دادهها آموزش دادند. اگر این هوش مصنوعی میتوانست به درستی بدون نیاز به خواندن متن رمزگذاریشده، موضوع گفتوگو را تشخیص دهد، این موضوع نشاندهنده وجود یک تهدید جدی برای حریم خصوصی بود.
نتایج بهدستآمده نشان داد که هوش مصنوعی در اکثر مدلها توانست موضوع گفتوگو را با دقتی بیش از ۹۸ درصد پیشبینی کند. این نوع حمله میتواند در ۱۰۰ درصد مواقع گفتوگوهای حساس را شناسایی کند، حتی اگر چنین گفتوگوهایی تنها در یک مورد از هر ۱۰ هزار مکالمه اتفاق بیفتند. پژوهشگران سه روش مختلف را برای مقابله با این نوع حملات آزمایش کردند، اما متاسفانه هیچ یک از آنها نتوانستند بهطور کامل حمله را متوقف کنند.
منبع: مهر



