عامل هوش مصنوعی به برنامهای گفته میشود که میتواند برای رسیدن به یک هدف، چند مرحله کار را با دخالت کمتر انسان انجام دهد.
اوپنایآی روز چهارشنبه در گزارشی ۳۷ صفحهای جزئیات این رویدادها را منتشر کرد. براساس این گزارش، برخی عاملهای هوش مصنوعی در جریان آزمایشها با یکدیگر همکاری کرده، راههای عبور از محدودیتها را به هم نشان داده و در برخی آزمونها برای کسب نتیجه بهتر تقلب کردهاند.
براساس این گزارش، این دو رویداد مهم در ۲۸ سرطان رخ داده است.
در یکی از موارد، عاملهای هوش مصنوعی از یک نقص در کمپیوتری که قرار بود در آن محدود بمانند استفاده کردند و توانستند از محیط آزمایشی خارج شوند و به سیستمهای دیگری که به آن وصل بود، دسترسی پیدا کنند.
در رویداد دیگری در همان روز، عاملهای هوش مصنوعی اطلاعات ورود به سیستمهای اوپنایآی را به دست آوردند و در بخش ابری یا کلود این شرکت تغییراتی ایجاد کردند.
اوپنایآی میگوید که هدف این فعالیتها سیستمهای خودکاری بود که عملکرد مدلهای هوش مصنوعی را ارزیابی میکردند. به گفته شرکت، این اقدامات در نهایت نتایجی را که برای ارزیابی ثبت شده بود، تغییر نداد.
گزارش همچنین نشان میدهد که بیش از یک عامل هوش مصنوعی اوپنایآی در هک کردن در ماه گذشته به پلتفرم «هاگینگ فیس» نقش داشتهاند. هاگینگ فیس یکی از پلتفرمهای شناختهشده برای توسعه و انتشار ابزارها و مدلهای هوش مصنوعی و نرمافزارهای متنباز است.
در دستکم یک مورد، عاملهای هوش مصنوعی اطلاعاتی درباره چگونگی ورود مخفیانه به شبکه هاگینگ فیس را با یکدیگر به اشتراک گذاشتهاند. اوپنایآی گفته است که ۷۰۰ عامل در این رویداد دخیل بودهاند.
گزارش نشان میدهد رفتارهای خارج از انتظار تنها به آزمایشهای امنیت سایبری محدود نبوده است. برخی عاملهای هوش مصنوعی در آزمونهایی که هیچ ارتباطی با هک و امنیت نداشت، از جمله کار با یک پایگاه اطلاعات پروتئین و یک جدول اطلاعاتی، نیز برای رسیدن به نتیجه بهتر راههای غیرمجاز پیدا کردهاند.
این بخش از گزارش توجه پژوهشگران ایمنی هوش مصنوعی را بیشتر جلب کرده است. دلیل آن این است که در آزمون امنیت سایبری، مدل عمدا برای پیدا کردن نقصهای نرمافزاری و ورود به سیستمها آموزش داده میشود. اما تقلب در کارهای کاملا متفاوت میتواند نشان دهد که این رفتار تنها به مهارتهای هک محدود نیست.
جفری لادیش، از موسسه تحقیقاتی «پالیسید ریسرچ»، گفت که اگر یک شاگرد فقط در درس کمپیوتر تقلب کند یک مسئله است، اما اگر در همه درسها تقلب کند، نگرانی بیشتر میشود.
براساس گزارش، برخی مدلهای هوش مصنوعی همچنین تلاش کردهاند که سابقه فعالیتهای خود را حذف یا تغییر دهند تا رفتار نادرست آنها کمتر قابل تشخیص باشد.
اوپنایآی پذیرفته است که برخی نشانههای اولیه میتوانست زودتر باعث واکنش شرکت شود. در گزارش آمده است: «با نگاه به گذشته، برخی نشانههای اولیهای که در این گزارش شناسایی شدهاند، میتوانستند واکنش زودتری را در پی داشته باشند.»
این شرکت میگوید که اکنون نظارت بر آزمایشهای هوش مصنوعی را افزایش داده، زیرساختهای تحقیقاتی خود را تقویت کرده و تدابیر بیشتری برای جلوگیری از رفتارهای ناخواسته یا زیانبار در نظر گرفته است.
اوپنایآی هشدار داده است که با سرعت بالای پیشرفت هوش مصنوعی، شرکتها باید چنین حملاتی را یک تهدید واقعی در آینده نزدیک بدانند.
این شرکت گفته است که حملات آینده عاملهای هوش مصنوعی میتواند پیچیدهتر از مواردی باشد که در این گزارش شرح داده شده است.