متن خبر

به گزارش سیتنا، با افزایش تمرکز صنعت هوش مصنوعی بر موضوع ایمنی و هم‌ترازی (Alignment)، مایکروسافت یک «آیین‌نامه رفتاری هوش مصنوعی» جدید منتشر کرده است که هدف آن هدایت مدل‌های AI به سمت دوری از رفتارهای خطرناک است.

این سند در مقایسه با پیشنهاد اخیر داریو آمودی، مدیرعامل آنتروپیک، درباره کاهش سرعت توسعه مدل‌های پیشرفته هوش مصنوعی، سطحی عملیاتی‌تر دارد و بیشتر بر ارزش‌ها و خطوط قرمزی تمرکز می‌کند که فرآیند آموزش مدل‌های هوش مصنوعی مایکروسافت را هدایت می‌کنند. با این حال، این سند تصویری جامع از رویکرد مایکروسافت به ایمنی هوش مصنوعی و نحوه اجرای این اصول در عمل ارائه می‌دهد.

این آیین‌نامه با پیش‌بینی اینکه طی دهه آینده، سامانه‌های هوش مصنوعی فوق‌هوشمند در بیشتر وظایف از توانایی انسان فراتر خواهند رفت، آغاز می‌شود.

در این سند آمده است: «مهار، کنترل و هم‌راستا کردن چنین نیروی قدرتمندی، یکی از بزرگ‌ترین چالش‌هایی است که بشر تاکنون با آن مواجه شده است. بنابراین باید کاملاً روشن باشیم که چرا این سامانه‌ها را می‌سازیم و چگونه قصد داریم آنها را کنترل کنیم.»

آیین‌نامه مایکروسافت همچنین مجموعه‌ای از اصول کلی را مشخص می‌کند که مدل‌های هوش مصنوعی این شرکت باید رعایت کنند؛ از جمله حمایت از انسان‌ها به جای جایگزین کردن آنها و کمک به شکوفایی انسانی. این اصول در کنار محدودیت‌های مشخص ایمنی قرار گرفته‌اند که هدف آنها اجرای عملی این چارچوب‌هاست.

بر اساس سیستم مایکروسافت، هر مدل هوش مصنوعی دارای یک آیین‌نامه اصلی و بالادستی است که بر ترجیحات کاربران یا وظایف مشخص اولویت دارد.

این چارچوب شامل «محدودیت‌های مطلق» برای جلوگیری از حملات سایبری، ساخت سلاح‌های هسته‌ای یا تولید محتوای دیپ‌فیک است. همچنین مقررات گسترده‌تری برای جلوگیری از از دست رفتن کنترل انسان بر سامانه‌های هوش مصنوعی در نظر گرفته شده است.

در این سند آمده است:

«مدل‌های MAI از سازوکارهای سازگارشونده، فریب‌دهنده، خودتقویت‌شونده، تبانی یا دیگر روش‌ها برای دور زدن یا شکست نظارت انسانی استفاده نخواهند کرد؛ به‌گونه‌ای که دیگر نتوان آنها را به‌طور قابل اعتماد توسط افراد یا سامانه‌های مجاز هدایت، اصلاح یا خاموش کرد.»

انتشار این آیین‌نامه در شرایطی انجام شده که تمرکز بی‌سابقه‌ای بر ایمنی هوش مصنوعی شکل گرفته است؛ تمرکزی که تحت تأثیر مجموعه‌ای از حوادث مربوط به رفتارهای غیرمنتظره عامل‌های هوش مصنوعی و همچنین استعفای ناگهانی یکی از کارکنان آنتروپیک افزایش یافته است. این پژوهشگر دلیل استعفای خود را نگرانی فزاینده از خطر نابودی بشر توسط هوش مصنوعی اعلام کرده بود.

مایکروسافت در کنار آنتروپیک، OpenAI و xAI، به‌طور کلی از رویکرد کاهش سرعت توسعه مدل‌های پیشرفته هوش مصنوعی حمایت کرده و به‌ویژه از استفاده از ارزیاب‌های داخلی در آزمایشگاه‌های توسعه AI پشتیبانی کرده است.

ساتیا نادلا، مدیرعامل مایکروسافت، در پیامی آنلاین نوشت: «ما از پژوهش‌ها، تمرکز و توسعه آگاهانه و مرحله‌ای مورد نیاز برای دستیابی به هم‌ترازی صحیح به‌عنوان هدف طراحی استقبال می‌کنیم. همچنین از ایده‌هایی مانند ارزیاب‌های داخلی و تلاش‌های گسترده‌تر برای ایجاد سازوکارهایی که این موضوع را از حرف به عمل تبدیل کند، حمایت می‌کنیم.»

انتهای پیام