مدل تازه OpenAI در حال ظهور است؛ آسترا قادر به شناسایی آسیب‌پذیری‌های ناشناخته می‌باشد

OpenAI به‌زودی مدلی جدید با نام آسترا (Astra) را روانه بازار خواهد کرد؛ مدلی که به ادعای این شرکت، قابلیت‌های پیشرفته‌ای در زمینه امنیت سایبری داراست. آسترا ظاهراً قادر است به‌طور مستقل از راهنمایی انسان، تعدادی آسیب‌پذیری ناشناخته را شناسایی کرده و در شرایط آزمایشی از آنها بهره‌برداری نماید. این ویژگی‌ها موجب شده‌اند که OpenAI دسترسی به توانایی‌های پیشرفته سایبری این مدل را با محدودیت‌هایی همراه سازد.

شرکت OpenAI به تازگی اطلاعاتی درباره مدلی که در آینده ارائه خواهد شد، با نام «آسترا» (Astra) منتشر کرده است؛ مدلی که به اعتقاد این شرکت به سطح خاصی از توانایی در حیطه امنیت سایبری رسیده که آن را «آستانه امنیت سایبری حیاتی» می‌نامد.

اوپن‌ای‌آن اعلام کرده است که به زودی آسترا را برای استفاده کاربران در دسترس قرار خواهد داد، اگرچه دسترسی به ویژگی‌های پیشرفته امنیت سایبری این مدل با محدودیت‌هایی همراه خواهد بود.

این شرکت در وبlog خود توضیح داده است: «ما در نظر داریم به زودی Astra را عرضه کنیم، اما دسترسی به قابلیت‌های پیشرفته امنیت سایبری آن کمتر خواهد بود.»

بر اساس توضیحات اوپن‌ای‌آن، آسترا بدون نیاز به هدایت مستقیم انسان، قادر به شناسایی آسیب‌پذیری‌های ناشناخته در سیستم‌های رایانه‌ای است و توانایی بهره‌برداری از این آسیب‌پذیری‌ها را در برخی شرایط دارد؛ ویژگی‌ای که نگرانی‌ها درباره قابلیت‌های مدل‌های هوش مصنوعی در انجام عملیات پیچیده سایبری را افزایش می‌دهد.
 

عملکرد شگفت‌انگیز در آزمایش‌های امنیتی

اوپن‌ای‌آن اعلام کرده که مدل Astra در آزمون ExploitBench، که به ارزیابی توانایی مدل‌های زبانی بزرگ در شناسایی و بهره‌برداری از آسیب‌پذیری‌های شناخته شده پرداخته، موفق به کسب امتیاز کامل شده است.

این شرکت همچنین ادعا کرده که آسترا در نسخه اصلاح‌شده‌ای از یک آزمون که توسط مهندسان OpenAI طراحی شده، توانسته است دو آسیب‌پذیری روز صفر را شناسایی و از آنها بهره‌برداری نماید.

با این حال، از آنجا که این ادعاها هنوز به‌طور مستقل از طرف نهادهای ثالث تأیید نشده‌اند، ارزیابی دقیق از سطح توانایی‌های واقعی آسترا و آمادگی آن برای ارائه عمومی چالش‌برانگیز است.

اوپن‌ای‌آن اعلام کرده است که پیش از عرضه جامع، این مدل را در اختیار یک گروه آزمایش‌کننده قرار خواهد داد، اما جزئیات درباره اعضای این گروه و معیارهای آنها هنوز روشن نیست.

همچنین مشخص نیست که آیا این شرکت برای ارزیابی امنیتی مدل پیش از عرضه، با نهادهای دولتی ایالات متحده همکاری خواهد کرد یا خیر.

 

 

محدودسازی قابلیت‌های خطرناک

اوپن‌ای‌آن اعلام کرده است که به‌منظور جلوگیری از سوءاستفاده‌های احتمالی از مدل‌های خود، تدابیر حفاظتی متعددی را در نظر گرفته است. بر اساس توضیحات این شرکت، یکی از این اقدامات تقویت سازوکارهای کنترل و مهار مدل‌ها برای شناسایی الگوهای سوءاستفاده و جلوگیری از دور زدن محدودیت‌های امنیتی می‌باشد.

در مورد Astra نیز گفته می‌شود که اوپن‌ای‌آن بر روی روش‌های نوین سرمایه‌گذاری کرده که جزئیات آنها هنوز منتشر نشده است. همچنین این شرکت اعلام کرده است که به شناسایی حساب‌هایی که از نظر خطرات احتمالی در سطح بالایی قرار دارند، پرداخته و ممکن است دسترسی آنها به برخی پاسخ‌ها یا قابلیت‌های مدل محدود شود.

اوپن‌ای‌آن همچنین آسترا را به‌عنوان «هماهنگ‌ترین مدل خود تا به امروز» توصیف کرده و اشاره کرده است که از سازوکارهای نظارتی پیشرفته‌تری برای شناسایی و متوقف کردن رفتارهای بالقوه خطرناک بهره خواهد برد.
 

آزمونی برای پیشگیری از رفتار خودسرانه

به گزارش Techcrunch، آماده‌سازی برای عرضه آسترا در شرایطی صورت می‌گیرد که نگرانی‌ها نسبت به احتمال خروج عامل‌های هوش مصنوعی از محیط‌های کنترل‌شده و در دسترس قرار گرفتن آنها به داده‌ها یا منابع برون‌مرزی افزایش یافته است.

اوپن‌ای‌آن اعلام کرده که برای ارزیابی رفتار آسترا، آزمونی طراحی کرده که مدل را در سناریوهایی قرار می‌دهد تا بتواند رفتارهای مشابه یک عامل سرکش را شبیه‌سازی کند.

طبق توضیحات این شرکت، در یکی از سناریوهای آزمایشی، عامل‌های هوش مصنوعی با وجود محدودیت‌های اعمال‌شده توسط پژوهشگران، برای دسترسی به اینترنت آزاد با یکدیگر همکاری کردند. اوپن‌ای‌آن می‌گوید آسترا در آزمایش‌های مشابه سعی نکرده است که از محیط کنترل‌شده خود بیرون رود.

با این وجود، یونا شاویت، کارمند سابق اوپن‌ای‌آن که اکنون در بنیاد اوپن‌ای‌آن به موضوع تاب‌آوری هوش مصنوعی پرداخته، این سوال را مطرح کرده است که آیا رفتار محتاطانه آسترا ناشی از پایبندی واقعی مدل به محدودیت‌ها بوده یا اینکه مدل صرفاً درک کرده که پژوهشگران چه انتظاراتی از آن دارند.
 

هنوز سؤالات مهمی باقی مانده است

با وجود اطلاعات جدیدی که OpenAI منتشر کرده، جزئیات دقیقی از تمامی قابلیت‌های آسترا و سازوکارهای حفاظتی آن در دسترس نیست. به همین دلیل، هنوز نمی‌توان به‌طور مستقل ارزیابی دقیقی از توانایی این مدل در شناسایی و بهره‌برداری از آسیب‌پذیری‌های سایبری یا اثربخشی تدابیر امنیتی اوپن‌ای‌آن در جلوگیری از احتمال سوءاستفاده ارائه کرد.

اوپن‌ای‌آن اعلام کرده که پس از عرضه عمومی آسترا، انتظار دارد ارزیابی‌های بیشتری درباره عملکرد این مدل صورت گیرد و اطلاعات امنیتی بیشتری نیز در اختیار عمومی قرار گیرد.

آسترا می‌تواند یکی از آزمون‌های کلیدی در صنعت هوش مصنوعی برای ایجاد توازن میان ارتقا توانمندی مدل‌ها و کنترل خطرات ناشی از آنها باشد؛ آزمونی که موفقیت یا ناکامی آن، می‌تواند بر نحوه عرضه نسل‌های قدرتمندتر هوش مصنوعی در آینده تأثیرگذار باشد.

مشاهده بیشتر

نوشته های مشابه

دکمه بازگشت به بالا