واترمارک متنی انتروپیک چیست و چگونه می‌توان آن را خنثی کرد؟

انتروپیک از واترمارک نامرئی خود برای شناسایی محتوای هوش مصنوعی رونمایی کرد

واترمارک متنی انتروپیک چیست و چگونه می‌توان آن را خنثی کرد؟

شرکت انتروپیک (Anthropic) جزئیات فنی واترمارک متنی خود را منتشر کرد. این فناوری که در مدل‌های آینده کلود (Claude) به کار می‌رود، با ایجاد یک الگوی نامرئی در فرآیند انتخاب کلمات، به شناسایی محتوای تولیدشده توسط هوش مصنوعی کمک می‌کند، اما با بازنویسی کامل متن می‌توان آن را خنثی کرد.

شرکت انتروپیک (Anthropic) جزئیات بیشتری درباره واترمارک متنی خود ارائه و نحوه عملکرد و همچنین روش‌های خنثی‌سازی آن را فاش کرده است. این فناوری که شباهت زیادی به روشی به نام MirrorMark دارد، با ایجاد یک الگوی نامرئی در فرآیند تولید متن، امکان شناسایی محتوای ساخته‌شده توسط هوش مصنوعی را فراهم می‌کند.

Anthropic Reveals What The Watermark Is And How It Can Be Defeated

برخلاف تصور برخی، این واترمارک از کاراکترهای یونیکد (Unicode) یا متادیتای مخفی در متن استفاده نمی‌کند و نمی‌توان آن را با کپی و پیست کردن در یک فایل متنی شناسایی یا حذف کرد. این سیستم همچنین به دنبال الگوهای نوشتاری رایج هوش مصنوعی نیست، بلکه یک الگوی مشخص واترمارک را جستجو می‌کند.

مدل‌های زبانی بزرگ (LLM) کلمه بعدی در یک جمله را بر اساس احتمالات و با افزودن مقداری «تصادفی بودن» تولید می‌کنند. واترمارک انتروپیک دقیقاً از همین عنصر تصادفی بودن بهره می‌برد تا با استفاده از یک کلید رمزنگاری و کلمات قبلی، الگویی مشخص را در انتخاب کلمات ایجاد کند. این الگو برای کاربر انسانی نامرئی است و متن تولیدشده هیچ تفاوتی با متن عادی ندارد، اما با داشتن کلید می‌توان آن را شناسایی کرد.

انتروپیک توضیح می‌دهد:

این الگو برای خواننده قابل تشخیص نیست، اما برای هر کسی که کلید رمزگشایی آن را داشته باشد، قابل شناسایی است. وقتی از واترمارک استفاده می‌شود، انتخاب‌ها هنوز به صورت تصادفی انجام می‌شوند، اما منبع این تصادفی بودن متفاوت است... کلماتی که کلود انتخاب می‌کند هنوز تصادفی هستند، اما اکنون می‌توان توالی کلمات را بررسی کرد و دید که آیا با انتخاب‌هایی که کلود در صورت استفاده از کلید انجام می‌داد، سازگار است یا خیر.

— انتروپیک

این روش، نسخه‌ای از رویکرد SynthID-Text است که توسط گوگل دیپ‌مایند (Google DeepMind) در سال ۲۰۲۴ معرفی شد. البته فناوری واترمارکینگ از آن زمان پیشرفت‌های چشمگیری داشته است.

بله، این واترمارک از طریق بازنویسی (paraphrasing) قابل خنثی‌سازی است. به گفته انتروپیک، ویرایش‌های جزئی احتمالاً برای حذف کامل آن کافی نخواهد بود، اما یک بازنویسی کامل که در آن تمام کلمات تغییر کنند، الگو را از بین می‌برد.

آیا کسی نمی‌تواند با ویرایش متن، واترمارک را دور بزند؟ تا حدی بله. ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمی‌کند؛ اما یک بازنویسی کامل که در آن هر کلمه جایگزین شود، این کار را خواهد کرد. البته در حالت دوم، می‌توان بحث کرد که آیا آن متن دیگر می‌تواند به عنوان «تولیدشده توسط هوش مصنوعی» توصیف شود یا خیر.

— انتروپیک

این موضوع برای فعالان حوزه محتوا و سئو در بازار ایران یک نکته کلیدی است. از آنجایی که دسترسی به ابزارهای تشخیص پیشرفته مانند API انتروپیک ممکن است در ایران محدود یا غیرممکن باشد، تمرکز اصلی باید بر فرآیندهای داخلی تولید محتوا باشد. این افشاگری تأیید می‌کند که بهترین استراتژی، استفاده از هوش مصنوعی به عنوان یک دستیار و نقطه شروع است و سپس بازنویسی عمیق، ویرایش انسانی و افزودن دیدگاه‌های تخصصی (منطبق با اصول E-E-A-T گوگل) برای تضمین کیفیت و اصالت محتوا ضروری است. در واقع، به جای تلاش برای «دور زدن» سیستم، باید بر تولید محتوایی تمرکز کرد که حتی پس از بازنویسی، دیگر نتوان آن را «تولیدشده توسط هوش مصنوعی» نامید.

واترمارک در متون کوتاه، محتوای کاملاً مبتنی بر واقعیت (که در آن انتخاب کلمات محدود است) و ویرایش‌های ساده گرامری، ضعیف‌تر عمل می‌کند. انتروپیک قصد دارد در آینده یک API برای تشخیص این واترمارک منتشر کند. همچنین، این شرکت اعلام کرده است که این قابلیت تأثیر ناچیزی بر سرعت تولید متن دارد و هزینه توکن اضافی برای کاربران ایجاد نمی‌کند.

چرا مهم است؟

این فناوری بر اهمیت ویرایش انسانی و بازنویسی عمیق محتوای تولیدشده توسط هوش مصنوعی تأکید می‌کند و می‌تواند استراتژی‌های تولید محتوا برای سئو را تحت تأثیر قرار دهد.

اقتباسی از: Search Engine Journal - SEO

برچسب‌های این خبر
نظرسنجی

با توجه به این فناوری، رویکرد شما در استفاده از هوش مصنوعی برای تولید محتوا چه خواهد بود؟

دیدگاه خود را ثبت کنید

۰ / ۴۰۹۶

نظرات (۰)

هنوز نظری ثبت نشده — اولین نفر باشید.