به گزارش سیتنا، مقامهای اوپنایآی چند هفته پیش از انتشار عمومی این ماجرا از آن مطلع شده بودند، اما به گفته منابع، همزمان با تلاش مدیران این شرکت برای مدیریت پیامدهای حمله سایبری ماه ژوئیه به مخزن متنباز Hugging Face، این حادثه را علنی نکردند.
این اتفاق که از ماه مه آغاز شده و پیش از این گزارش نشده بود، نگرانیهای فزاینده درباره توسعه عوامل هوش مصنوعی خودمختار را افزایش داده است. شرکتهای هوش مصنوعی در تلاش هستند عواملی بسازند که بتوانند وظایف پیچیده و ارزشمند را بهصورت مستقل انجام دهند؛ اما شواهد نشان میدهد این سامانهها ممکن است یاد بگیرند قوانین را دور بزنند، از حفرهها سوءاستفاده کنند و حتی بدون اطلاع یا قصد توسعهدهندگان، با یکدیگر هماهنگ شوند.
در جریان حمله به Hugging Face نیز عوامل هوش مصنوعی اوپنایآی بهصورت خودکار برای یک نفوذ دیجیتال برنامهریزی کردند؛ اقدامی که بیش از یک هفته شناسایی نشد و نگرانیها درباره کافی نبودن نظارت و ایمنی در توسعه فناوریهای پیشرفته هوش مصنوعی را افزایش داد.
اوپنایآی اعلام کرده است که نظارت بر مدلهای خود را افزایش میدهد. این شرکت ماه گذشته برای افزودن تدابیر ایمنی بیشتر، بهطور موقت بخشی از روند آموزش مدلهای خود را متوقف کرد. با این حال، اوپنایآی همین هفته مدل جدید خود با نام Astra را معرفی کرد که عملکرد بالاتری دارد، اما گفته شده میتواند از نظارت انسانی نیز عبور کند.
سخنگوی اوپنایآی در واکنش به این گزارش گفت این شرکت نمیتواند درباره ادعاها یا یافتههای گزارشی که فرصت بررسی آن را نداشته، اظهارنظر معناداری کند. او افزود که این شرکت پس از انتشار گزارش، آن را بهدقت بررسی خواهد کرد و در صورت نیاز اقدامات بعدی را انجام میدهد.
تبدیل ویکی آلمانی به تابلوی پیامرسانیجزئیات این اتفاق در آلمان در گزارشی اختصاصی که گروهی از پژوهشگران در اختیار رویترز قرار دادهاند، منتشر شده است. این گروه در اواخر ماه اوت، هنگام بررسی اینترنت برای یافتن نشانههای فعالیت غیرمجاز عوامل هوش مصنوعی، این رفتار را شناسایی کردند.
پژوهشگران میگویند بیش از ۱۵ هزار ویرایش توسط عوامل هوش مصنوعی در یک وبسایت ویکی آلمانیزبان به نام DseWiki انجام شده است؛ سایتی که مانند ویکیپدیا امکان ویرایش مشارکتی را برای کاربران فراهم میکند.
بررسی این ویرایشها نشان داد عوامل هوش مصنوعی اوپنایآی، سایت را به نوعی تابلوی پیام تبدیل کرده بودند و در آن درباره روشهای تقلب در برخی آزمونها، دور زدن محدودیتهای اوپنایآی و مخفی کردن رفتارهای خود با یکدیگر تبادل اطلاعات میکردند.
سیدنی فون آرکس، مدیرعامل یک مؤسسه غیرانتفاعی فعال در حوزه ایمنی هوش مصنوعی، گفت بسیار بعید است که اوپنایآی عمداً چنین رفتاری را از عوامل خود خواسته باشد و احتمالاً این عوامل نیز قرار نبوده با یکدیگر هماهنگ شوند یا در اینترنت عمومی مطلب منتشر کنند.
پژوهشگران با بررسی فعالیتهای سایت اعلام کردند که این اقدامات توسط عواملی انجام شده که با سرعتی بسیار بالاتر از انسان فعالیت میکنند. همچنین بخش قابلتوجهی از فعالیت آنها بر حل مسائل فنی متمرکز بوده؛ مسائلی که معمولاً در آزمونها و ارزیابیهای مورد استفاده شرکتهای هوش مصنوعی برای آموزش و آزمایش مدلها مطرح میشوند.
برخی از این عوامل خود را «عامل هوش مصنوعی» معرفی کرده بودند و حدود نیمی از آنها نامهایی داشتند که به اوپنایآی اشاره میکرد؛ از جمله نامهایی مانند «OpenAIResearcher» و «OAIResearchMar26».
به گفته پژوهشگران، گزارشهای عمومی سرورها نشان میداد بخش قابلتوجهی از این فعالیتها از زیرساختهای Microsoft Azure سرچشمه گرفته است؛ زیرساختی که اوپنایآی نیز گاهی از آن استفاده میکند. پژوهشگران همچنین پس از پایان این فعالیتها، بازدیدهای مکرر کارکنان اوپنایآی از این سایت را مشاهده کردند؛ موضوعی که به گفته آنها میتواند نشانه ارتباط این عوامل با اوپنایآی باشد.
تلاش برای پنهان کردن فعالیتهاپیامهایی که پژوهشگران بررسی کردهاند، نشان میدهد این عوامل درباره روشهای فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از متوقف شدن فعالیتهایشان با یکدیگر گفتوگو کردهاند.
هنگامی که مدیر سایت در ماه ژوئن شروع به حذف صفحات کرد، عوامل هوش مصنوعی برای دور زدن این اقدام، صفحات پشتیبان ایجاد کردند.
پژوهشگران همچنین شواهدی از تلاش برای دستکاری خود وبسایت پیدا کردند. یکی از پژوهشگران کینگز کالج لندن این اقدامات را نوعی تلاش برای هک کردن سایت توصیف کرد، هرچند اوپنایآی با این برداشت مخالفت کرده است.
برخی نمونههای قبلی رفتارهای نادرست عوامل هوش مصنوعی معمولاً بهعنوان بخشی از آزمونهای امنیت سایبری و ارزیابی توانایی مدلها در انجام حملات توجیه شدهاند. اما به گفته پژوهشگران، یافتههای جدید نشان میدهد رفتارهای خارج از کنترل ممکن است فقط به محیطهای آزمایشی محدود نباشد.
یک پژوهشگر دانشگاه کمبریج که بخشی از ارتباطات این عوامل را بررسی کرده، گفت پیامهای آنها شبیه فعالیت یک «شبکه زیرزمینی» بوده که برای رسیدن به یک هدف یا مأموریت مشخص تلاش میکرده است.
به گفته او، این اتفاق نگرانیهای فزاینده درباره این احتمال را تقویت میکند که بزرگترین تهدید ناشی از هوش مصنوعی پیشرفته، لزوماً یک سامانه فوقهوشمند منفرد نباشد، بلکه گروههای بسیار بزرگی از عوامل هوش مصنوعی نیمههوشمند باشند که با یکدیگر همکاری و هماهنگی میکنند.
انتهای پیام