آنتروپیک (Anthropic) جزئیات بیشتری درباره واترمارک Claude منتشر کرده است. این واترمارک با ایجاد الگوهای نامرئی در انتخاب کلمات کار می‌کند و برای خواننده قابل‌تشخیص نیست؛ بااین‌حال، ابزار مخصوص می‌تواند وجود آن را شناسایی کند.

خلاصه خبر در یک نگاه:

واترمارک Claude از الگوهای نامرئی در انتخاب کلمات استفاده می‌کند.
آنتروپیک این سیستم را برپایه SynthID-Text گوگل دیپ‌مایند پیاده‌سازی می‌کند.
ویرایش جزئی احتمالاً واترمارک را حذف نمی‌کند، اما بازنویسی کامل می‌تواند آن را از بین ببرد.
واترمارک روی کد تأثیر بسیار کمتری نسبت‌به متن عادی خواهد داشت.
آنتروپیک یک API برای تشخیص واترمارک ارائه خواهد کرد.

واترمارک Claude چگونه در متن قرار می‌گیرد؟

هوش‌مصنوعی Claude هنگام تولید متن گاهی می‌تواند میان چند واژه هم‌معنی یا نزدیک به یکدیگر انتخاب کند. آنتروپیک از همین انتخاب‌های کم‌اهمیت برای ایجاد یک الگوی قابل‌شناسایی در متن استفاده خواهد کرد. برای مثال، مدل می‌تواند هنگام توصیف آب‌وهوا میان واژه‌هایی مانند «overcast» و «grey» انتخاب کند. این انتخاب‌ها برای خواننده طبیعی به‌نظر می‌رسند، اما درکنار یکدیگر الگویی می‌سازند که سیستم مجهز به کلید مربوطه می‌تواند آن را تشخیص دهد.

آنتروپیک می‌گوید این فرایند کیفیت خروجی Claude را کاهش نمی‌دهد و کاربران از روی ظاهر متن نمی‌توانند وجود واترمارک را تشخیص دهند.

آنتروپیک از SynthID-Text گوگل استفاده می‌کند

آنتروپیک برای اجرای این سیستم از SynthID-Text استفاده می‌کند؛ روشی که تیم گوگل دیپ‌مایند (Google DeepMind) در سال ۲۰۲۴ معرفی کرد. این شرکت همچنین قصد دارد API مخصوصی برای بررسی وجود واترمارک منتشر کند.

واترمارک با ابزارهای معمول تشخیص متن هوش مصنوعی تفاوت دارد. ابزارهای تشخیص AI معمولاً سبک و الگوهای نگارشی را تحلیل می‌کنند، اما SynthID-Text به‌دنبال الگویی است که هنگام تولید متن به‌صورت هدفمند ایجاد شده است.

آنتروپیک برای واترمارک Claude از فناوری SynthID-Text استفاده می‌کند.

آیا می‌توان واترمارک Claude را با ویرایش متن حذف کرد؟

بله، اما میزان ویرایش اهمیت دارد. به‌گفته آنتروپیک، ویرایش جزئی احتمالاً واترمارک را کاملاً حذف نمی‌کند؛ درمقابل، بازنویسی کامل و جایگزین‌کردن همه کلمات می‌تواند آن را از بین ببرد. اگر کاربر متن خود را فقط برای ویرایش یا بازخوانی دراختیار Claude قرار دهد، نتیجه به میزان تغییرات بستگی دارد. وقتی Claude تنها بخش کوچکی را تغییر دهد، مقدار متن تولیدشده توسط مدل ممکن است برای ایجاد یک واترمارک قابل‌تشخیص کافی نباشد.

واترمارک Claude چه تأثیری روی کدنویسی دارد؟

کدهای تولیدشده با Claude واترمارک بسیار کمتری خواهند داشت، زیرا مدل هنگام برنامه‌نویسی آزادی کمتری برای انتخاب میان گزینه‌های مختلف دارد و باید کد قابل‌اجرا تولید کند. البته آنتروپیک می‌تواند در بخش‌هایی با انتخاب‌های اختیاری، مانند کامنت‌های کد، از واترمارک استفاده کند. این شرکت می‌گوید این فناوری تأثیر ناچیزی بر خود کد خواهد داشت.

چرا آنتروپیک پاسخ‌های Claude را واترمارک می‌کند؟

آنتروپیک این تغییر را برای رعایت الزامات شفافیت مرتبط با قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) اجرا می‌کند. این الزامات از شرکت‌های هوش مصنوعی می‌خواهند سازوکاری برای شناسایی محتوای تولیدشده با AI داشته باشند.

به‌گفته آنتروپیک، Claude تنها مدل مجهز به واترمارک نخواهد بود و دیگر توسعه‌دهندگان بزرگ مدل‌های هوش مصنوعی که آیین‌نامه مربوطه را پذیرفته‌اند نیز سیستم‌های خود را پیاده‌سازی خواهند کرد.

جمع‌بندی

واترمارک Claude بدون افزودن نشانه قابل‌مشاهده به متن، الگویی قابل‌شناسایی در انتخاب کلمات ایجاد می‌کند. این فناوری دربرابر ویرایش محدود مقاومت دارد، اما بازنویسی کامل می‌تواند آن را حذف کند و تأثیر آن بر کدنویسی نیز ناچیز خواهد بود.

به‌نظر شما واترمارک نامرئی راهکار مناسبی برای مشخص‌کردن محتوای تولیدشده با هوش مصنوعی است؟ دیدگاه خود را در بخش نظرات بنویسید.

نوشته واترمارک Claude چگونه کار می‌کند؟ آنتروپیک جزئیات را توضیح داد اولین بار در ترنجی پدیدار شد.