متن خبر

به گزارش سیتنا، مقام‌های اوپن‌ای‌آی چند هفته پیش از انتشار عمومی این ماجرا از آن مطلع شده بودند، اما به گفته منابع، همزمان با تلاش مدیران این شرکت برای مدیریت پیامدهای حمله سایبری ماه ژوئیه به مخزن متن‌باز Hugging Face، این حادثه را علنی نکردند.

این اتفاق که از ماه مه آغاز شده و پیش از این گزارش نشده بود، نگرانی‌های فزاینده درباره توسعه عوامل هوش مصنوعی خودمختار را افزایش داده است. شرکت‌های هوش مصنوعی در تلاش هستند عواملی بسازند که بتوانند وظایف پیچیده و ارزشمند را به‌صورت مستقل انجام دهند؛ اما شواهد نشان می‌دهد این سامانه‌ها ممکن است یاد بگیرند قوانین را دور بزنند، از حفره‌ها سوءاستفاده کنند و حتی بدون اطلاع یا قصد توسعه‌دهندگان، با یکدیگر هماهنگ شوند.

در جریان حمله به Hugging Face نیز عوامل هوش مصنوعی اوپن‌ای‌آی به‌صورت خودکار برای یک نفوذ دیجیتال برنامه‌ریزی کردند؛ اقدامی که بیش از یک هفته شناسایی نشد و نگرانی‌ها درباره کافی نبودن نظارت و ایمنی در توسعه فناوری‌های پیشرفته هوش مصنوعی را افزایش داد.

اوپن‌ای‌آی اعلام کرده است که نظارت بر مدل‌های خود را افزایش می‌دهد. این شرکت ماه گذشته برای افزودن تدابیر ایمنی بیشتر، به‌طور موقت بخشی از روند آموزش مدل‌های خود را متوقف کرد. با این حال، اوپن‌ای‌آی همین هفته مدل جدید خود با نام Astra را معرفی کرد که عملکرد بالاتری دارد، اما گفته شده می‌تواند از نظارت انسانی نیز عبور کند.

سخنگوی اوپن‌ای‌آی در واکنش به این گزارش گفت این شرکت نمی‌تواند درباره ادعاها یا یافته‌های گزارشی که فرصت بررسی آن را نداشته، اظهارنظر معناداری کند. او افزود که این شرکت پس از انتشار گزارش، آن را به‌دقت بررسی خواهد کرد و در صورت نیاز اقدامات بعدی را انجام می‌دهد.

تبدیل ویکی آلمانی به تابلوی پیام‌رسانی

جزئیات این اتفاق در آلمان در گزارشی اختصاصی که گروهی از پژوهشگران در اختیار رویترز قرار داده‌اند، منتشر شده است. این گروه در اواخر ماه اوت، هنگام بررسی اینترنت برای یافتن نشانه‌های فعالیت غیرمجاز عوامل هوش مصنوعی، این رفتار را شناسایی کردند.

پژوهشگران می‌گویند بیش از ۱۵ هزار ویرایش توسط عوامل هوش مصنوعی در یک وب‌سایت ویکی آلمانی‌زبان به نام DseWiki انجام شده است؛ سایتی که مانند ویکی‌پدیا امکان ویرایش مشارکتی را برای کاربران فراهم می‌کند.

بررسی این ویرایش‌ها نشان داد عوامل هوش مصنوعی اوپن‌ای‌آی، سایت را به نوعی تابلوی پیام تبدیل کرده بودند و در آن درباره روش‌های تقلب در برخی آزمون‌ها، دور زدن محدودیت‌های اوپن‌ای‌آی و مخفی کردن رفتارهای خود با یکدیگر تبادل اطلاعات می‌کردند.

سیدنی فون آرکس، مدیرعامل یک مؤسسه غیرانتفاعی فعال در حوزه ایمنی هوش مصنوعی، گفت بسیار بعید است که اوپن‌ای‌آی عمداً چنین رفتاری را از عوامل خود خواسته باشد و احتمالاً این عوامل نیز قرار نبوده با یکدیگر هماهنگ شوند یا در اینترنت عمومی مطلب منتشر کنند.

پژوهشگران با بررسی فعالیت‌های سایت اعلام کردند که این اقدامات توسط عواملی انجام شده که با سرعتی بسیار بالاتر از انسان فعالیت می‌کنند. همچنین بخش قابل‌توجهی از فعالیت آنها بر حل مسائل فنی متمرکز بوده؛ مسائلی که معمولاً در آزمون‌ها و ارزیابی‌های مورد استفاده شرکت‌های هوش مصنوعی برای آموزش و آزمایش مدل‌ها مطرح می‌شوند.

برخی از این عوامل خود را «عامل هوش مصنوعی» معرفی کرده بودند و حدود نیمی از آنها نام‌هایی داشتند که به اوپن‌ای‌آی اشاره می‌کرد؛ از جمله نام‌هایی مانند «OpenAIResearcher» و «OAIResearchMar26».

به گفته پژوهشگران، گزارش‌های عمومی سرورها نشان می‌داد بخش قابل‌توجهی از این فعالیت‌ها از زیرساخت‌های Microsoft Azure سرچشمه گرفته است؛ زیرساختی که اوپن‌ای‌آی نیز گاهی از آن استفاده می‌کند. پژوهشگران همچنین پس از پایان این فعالیت‌ها، بازدیدهای مکرر کارکنان اوپن‌ای‌آی از این سایت را مشاهده کردند؛ موضوعی که به گفته آنها می‌تواند نشانه ارتباط این عوامل با اوپن‌ای‌آی باشد.

تلاش برای پنهان کردن فعالیت‌ها

پیام‌هایی که پژوهشگران بررسی کرده‌اند، نشان می‌دهد این عوامل درباره روش‌های فرار از شناسایی، استفاده از ابزارهایی مانند Tor و حفظ ارتباطات حتی پس از متوقف شدن فعالیت‌هایشان با یکدیگر گفت‌وگو کرده‌اند.

هنگامی که مدیر سایت در ماه ژوئن شروع به حذف صفحات کرد، عوامل هوش مصنوعی برای دور زدن این اقدام، صفحات پشتیبان ایجاد کردند.

پژوهشگران همچنین شواهدی از تلاش برای دستکاری خود وب‌سایت پیدا کردند. یکی از پژوهشگران کینگز کالج لندن این اقدامات را نوعی تلاش برای هک کردن سایت توصیف کرد، هرچند اوپن‌ای‌آی با این برداشت مخالفت کرده است.

برخی نمونه‌های قبلی رفتارهای نادرست عوامل هوش مصنوعی معمولاً به‌عنوان بخشی از آزمون‌های امنیت سایبری و ارزیابی توانایی مدل‌ها در انجام حملات توجیه شده‌اند. اما به گفته پژوهشگران، یافته‌های جدید نشان می‌دهد رفتارهای خارج از کنترل ممکن است فقط به محیط‌های آزمایشی محدود نباشد.

یک پژوهشگر دانشگاه کمبریج که بخشی از ارتباطات این عوامل را بررسی کرده، گفت پیام‌های آنها شبیه فعالیت یک «شبکه زیرزمینی» بوده که برای رسیدن به یک هدف یا مأموریت مشخص تلاش می‌کرده است.

به گفته او، این اتفاق نگرانی‌های فزاینده درباره این احتمال را تقویت می‌کند که بزرگ‌ترین تهدید ناشی از هوش مصنوعی پیشرفته، لزوماً یک سامانه فوق‌هوشمند منفرد نباشد، بلکه گروه‌های بسیار بزرگی از عوامل هوش مصنوعی نیمه‌هوشمند باشند که با یکدیگر همکاری و هماهنگی می‌کنند.

انتهای پیام