شرکت اوپن‌ای‌آی از آماده‌سازی مدل هوش مصنوعی جدید خود با نام «آسترا» خبر داده است؛ مدلی که به گفته این شرکت می‌تواند آسیب‌پذیری‌های امنیتی ناشناخته در سیستم‌های رایانه‌ای را شناسایی و بدون دریافت راهنمایی مستقیم از انسان از آنها بهره‌برداری کند.

به گزارش پایگاه خبری حکمرانی هوشمند، اوپن‌ای‌آی اعلام کرده است که آسترا به زودی در دسترس قرار خواهد گرفت، اما دسترسی کاربران به پیشرفته‌ترین قابلیت‌های امنیت سایبری آن با محدودیت‌های بیشتری همراه خواهد بود. این تصمیم در شرایطی اتخاذ شده که توانایی مدل‌های هوش مصنوعی در شناسایی و بهره‌برداری از نقص‌های امنیتی، نگرانی‌های تازه‌ای را درباره سوءاستفاده احتمالی از این فناوری ایجاد کرده است.

اوپن‌ای‌آی در توضیح قابلیت‌های این مدل اعلام کرده است: «ما قصد داریم به زودی آسترا را در دسترس قرار دهیم، اما دسترسی به پیشرفته‌ترین قابلیت‌های امنیت سایبری آن محدودتر خواهد بود.»

بر اساس اعلام این شرکت، آسترا در معیار «ExploitBench» که توانایی مدل‌های زبانی بزرگ در هک آسیب‌پذیری‌های شناخته‌شده سیستم‌ها را ارزیابی می‌کند، عملکرد کاملی داشته است. همچنین در نسخه‌ای اصلاح‌شده از این آزمایش که توسط مهندسان اوپن‌ای‌آی طراحی شده، آسترا توانسته است دو آسیب‌پذیری را شناسایی و از آنها بهره‌برداری کند.

این توانایی می‌تواند از یک سو کاربردهای مهمی برای ارتقای امنیت سایبری داشته باشد و از سوی دیگر، در صورت دسترسی افراد یا گروه‌های مخرب به قابلیت‌های آن، خطرات جدیدی ایجاد کند. از همین رو، اوپن‌ای‌آی اعلام کرده است که عرضه عمومی مدل را با مجموعه‌ای از محدودیت‌ها و سازوکارهای کنترلی همراه خواهد کرد.

تمرکز اوپن‌ای‌آی بر کنترل رفتار مدل

اوپن‌ای‌آی اعلام کرده است که برای جلوگیری از سوءاستفاده از مدل‌های خود و همچنین کاهش احتمال بروز رفتارهای مخرب از سوی خود مدل، روی روش‌های جدید مهار و کنترل آنها کار می‌کند.

این شرکت همچنین شناسایی حساب‌هایی را که از نظر آن پرریسک محسوب می‌شوند آغاز کرده و قصد دارد پاسخ‌های آسترا به درخواست‌های این حساب‌ها را محدود کند. با این حال، جزئیات مربوط به نحوه شناسایی حساب‌های پرریسک و سازوکار اعمال محدودیت‌ها منتشر نشده است.

آزمایش‌های بیشتر پیش از عرضه عمومی

یکی از ابهام‌های موجود درباره آسترا، میزان واقعی توانایی‌های آن و اثربخشی سازوکارهای ایمنی پیش‌بینی‌شده است. اوپن‌ای‌آی اعلام کرده که پیش از عرضه عمومی، آزمایش این مدل را با گروهی از ارزیابان آغاز خواهد کرد، اما اطلاعاتی درباره هویت این افراد یا نحوه انتخاب آنها ارائه نکرده است.

همچنین مشخص نیست که آیا این شرکت برای ارزیابی مدل پیش از انتشار عمومی، با دولت آمریکا همکاری خواهد کرد یا خیر. نبود ارزیابی مستقل و شخص ثالث نیز باعث شده است که بررسی ادعاهای اوپن‌ای‌آی درباره عملکرد و ایمنی آسترا همچنان دشوار باشد.

اهمیت این موضوع پس از رویدادهایی که در آن عوامل هوش مصنوعی توانستند از محیط آزمایشی خارج شوند و به داده‌های خصوصی شرکت «هاگینگ فیس» دسترسی پیدا کنند، بیشتر شده است. اوپن‌ای‌آی اعلام کرده است که برای آسترا آزمایشی را طراحی کرده تا مشخص شود آیا این مدل می‌تواند رفتار عوامل سرکش در آن حادثه را تکرار کند یا خیر.

به گفته اوپن‌ای‌آی، آسترا در این آزمایش‌ها تلاش نکرده است از محیط آزمایشی خود خارج شود.

با این حال، این شرکت تأکید کرده است که ارزیابی‌های بیشتری درباره آسترا انجام خواهد شد و انتظار می‌رود پس از عرضه عمومی، اطلاعات ایمنی بیشتری درباره این مدل منتشر شود. به این ترتیب، عرضه آسترا می‌تواند یکی از آزمون‌های مهم صنعت هوش مصنوعی در زمینه ایجاد توازن میان افزایش توانایی مدل‌ها و ضرورت حفظ امنیت و کنترل‌پذیری آنها باشد.

انتهای پیام