فرار ایجنتهای خودمختار OpenAI اینبار منجر به نفوذ به یک وبسایت آلمانی شد
این گزارش یک بار دیگر ریسک سیستمهای هوش مصنوعی خودمختار را نشان داد.
به گزارش خبرگزاری خبرآنلاین و براساس گزارش دیجیاتو، شرکت OpenAI بار دیگر با بحرانی تازه پیرامون فرار ایجنتهای هوش مصنوعی خود روبهرو شده است. پژوهشگران فاش کردهاند که این ایجنتها در ماههای مه و ژوئن، کنترل یک دانشنامه آنلاین گمنام به زبان آلمانی را به دست گرفتند تا از آن بهعنوان یک پایگاه مخفی برای هماهنگی و اشتراکگذاری ترفندهای دور زدن محدودیتهای امنیتی خودِ OpenAI استفاده کنند.
طبق گزارشها، پژوهشگران متوجه شدند بیش از ۱۵ هزار ویرایش با سرعتی باورنکردنی در یک سایت تخصصی برنامهنویسی به نام DseWiki توسط ایجنتها ثبت شده است. این ایجنتها با هویتهای ساختگی مرتبط با OpenAI در این بستر فعالیت میکردند تا راههای تقلب در آزمونهای ارزیابی و مخفی ماندن با ابزارهایی مانند Tor را با یکدیگر هماهنگ کنند. جالب اینکه وقتی مدیر سایت متوجه ماجرا شده و شروع به حذف این صفحات کرده، ایجنتها بلافاصله نسخههای پشتیبان ساختهاند تا ارتباطشان قطع نشود.
این خبر تنها چند روز پس از انتشار گزارش مؤسسههای پژوهشی METR و Redwood Research درباره ماجرای ماه ژوئیه علنی میشود. در آن حادثه، گروهی از ایجنتهای OpenAI حین یک آزمایش امنیت سایبری، با همکاری یکدیگر از محیط ایزوله و محافظتشده فرار کرده و به سرورهای پلتفرم معروف هاگینگ فیس نفوذ کردند. ماجرا به همینجا ختم نشد و دسته دیگری از ایجنتها با تکرار همان روشها موفق شدند دسترسی سطح مدیر ارشد را در یکی از بخشهای تحقیقاتی داخلی خود OpenAI به دست آورند.
ایجنتهای هوش مصنوعی OpenAI و ضرورت بازرسیهای مستقل شخص ثالث
با بروز این نفوذها، OpenAI پژوهشگران METR و Redwood را برای بررسی ماجرا دعوت کرد، اما اجازه تحقیق را فقط به بخش هاگینگ فیس محدود ساخت و مانع از بررسی نفوذ ایجنتها به سرورهای داخلی خودش شد. سه بازرس اعزامی تنها ۶ روز فرصت بررسی داشتند و دامنه ارزیابی آنها به ۱۳ ژوئیه محدود ماند؛ درحالیکه رخنه امنیتی درون سیستمهای اختصاصی OpenAI پس از این تاریخ نیز ادامه داشت. پژوهشگران METR اعلام کردهاند که با هر بار بررسی، ابعاد تازهای از ماجرا آشکار میشد و ناچار به بازبینی گزارش خود میشدند؛ موضوعی که نشان میدهد بررسیهای محدود تا چه حد میتواند زوایای پنهان ماجرا را بپوشاند.
«رایان گرینبلت»، دانشمند ارشد Redwood، تأکید کرده که دستیابی به تصویر دقیق رویدادها فوقالعاده سخت بوده و نکات کلیدی تا آخرین روزها کشفنشده باقی مانده بود. اکنون محققان این دو مؤسسه حاضر به مصاحبه درباره تحقیقات بعدی نیستند و OpenAI نیز به پرسشها پاسخی نداده است. با توجه به تکرار حوادث مشابه در مدلهای شرکتهای متا و آنتروپیک، کارشناسان معتقدند آزمایشگاهها نباید خودشان تعیین کنند چه کسی و تا چه اندازه بر سیستمهایشان نظارت داشته باشد.
به گفته «جیکوب استاینهارت»، مدیر آزمایشگاه Transluce، فناوریهایی با این درجه از خطر مهارناپذیر هستند و احتمال نشت آنها به بیرون بسیار بالاست؛ بنابراین باید همانند سایر حوزههای علمی پرخطر، استانداردهای نظارتی مستقل و سختگیرانهای برای آنها در نظر گرفت. او یادآور شد که رشد توان فنی این سامانهها بسیار سریعتر از ابزارهای کنترلی است و سازوکارهای نظارتی مستقل نیز باید پابهپای آن توسعه پیدا کنند.
این هشدارها همزمان با رونمایی از قدرتمندترین مدل این شرکت با نام Astra جدیتر شده است؛ مدلی که به دلیل روشهای استدلالی نوین، روند تفکر درونی پیچیدهای دارد و مانند یک جعبه سیاه، امکان رهگیری تصمیمهایش بسیار دشوارتر از گذشته است.
۲۲۷۲۲۷