واترمارک متنی انتروپیک چیست و چگونه میتوان آن را خنثی کرد؟
انتروپیک از واترمارک نامرئی خود برای شناسایی محتوای هوش مصنوعی رونمایی کرد
شرکت انتروپیک (Anthropic) جزئیات فنی واترمارک متنی خود را منتشر کرد. این فناوری که در مدلهای آینده کلود (Claude) به کار میرود، با ایجاد یک الگوی نامرئی در فرآیند انتخاب کلمات، به شناسایی محتوای تولیدشده توسط هوش مصنوعی کمک میکند، اما با بازنویسی کامل متن میتوان آن را خنثی کرد.
شرکت انتروپیک (Anthropic) جزئیات بیشتری درباره واترمارک متنی خود ارائه و نحوه عملکرد و همچنین روشهای خنثیسازی آن را فاش کرده است. این فناوری که شباهت زیادی به روشی به نام MirrorMark دارد، با ایجاد یک الگوی نامرئی در فرآیند تولید متن، امکان شناسایی محتوای ساختهشده توسط هوش مصنوعی را فراهم میکند.
برخلاف تصور برخی، این واترمارک از کاراکترهای یونیکد (Unicode) یا متادیتای مخفی در متن استفاده نمیکند و نمیتوان آن را با کپی و پیست کردن در یک فایل متنی شناسایی یا حذف کرد. این سیستم همچنین به دنبال الگوهای نوشتاری رایج هوش مصنوعی نیست، بلکه یک الگوی مشخص واترمارک را جستجو میکند.
مدلهای زبانی بزرگ (LLM) کلمه بعدی در یک جمله را بر اساس احتمالات و با افزودن مقداری «تصادفی بودن» تولید میکنند. واترمارک انتروپیک دقیقاً از همین عنصر تصادفی بودن بهره میبرد تا با استفاده از یک کلید رمزنگاری و کلمات قبلی، الگویی مشخص را در انتخاب کلمات ایجاد کند. این الگو برای کاربر انسانی نامرئی است و متن تولیدشده هیچ تفاوتی با متن عادی ندارد، اما با داشتن کلید میتوان آن را شناسایی کرد.
انتروپیک توضیح میدهد:
این الگو برای خواننده قابل تشخیص نیست، اما برای هر کسی که کلید رمزگشایی آن را داشته باشد، قابل شناسایی است. وقتی از واترمارک استفاده میشود، انتخابها هنوز به صورت تصادفی انجام میشوند، اما منبع این تصادفی بودن متفاوت است... کلماتی که کلود انتخاب میکند هنوز تصادفی هستند، اما اکنون میتوان توالی کلمات را بررسی کرد و دید که آیا با انتخابهایی که کلود در صورت استفاده از کلید انجام میداد، سازگار است یا خیر.
— انتروپیک
این روش، نسخهای از رویکرد SynthID-Text است که توسط گوگل دیپمایند (Google DeepMind) در سال ۲۰۲۴ معرفی شد. البته فناوری واترمارکینگ از آن زمان پیشرفتهای چشمگیری داشته است.
بله، این واترمارک از طریق بازنویسی (paraphrasing) قابل خنثیسازی است. به گفته انتروپیک، ویرایشهای جزئی احتمالاً برای حذف کامل آن کافی نخواهد بود، اما یک بازنویسی کامل که در آن تمام کلمات تغییر کنند، الگو را از بین میبرد.
آیا کسی نمیتواند با ویرایش متن، واترمارک را دور بزند؟ تا حدی بله. ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمیکند؛ اما یک بازنویسی کامل که در آن هر کلمه جایگزین شود، این کار را خواهد کرد. البته در حالت دوم، میتوان بحث کرد که آیا آن متن دیگر میتواند به عنوان «تولیدشده توسط هوش مصنوعی» توصیف شود یا خیر.
— انتروپیک
این موضوع برای فعالان حوزه محتوا و سئو در بازار ایران یک نکته کلیدی است. از آنجایی که دسترسی به ابزارهای تشخیص پیشرفته مانند API انتروپیک ممکن است در ایران محدود یا غیرممکن باشد، تمرکز اصلی باید بر فرآیندهای داخلی تولید محتوا باشد. این افشاگری تأیید میکند که بهترین استراتژی، استفاده از هوش مصنوعی به عنوان یک دستیار و نقطه شروع است و سپس بازنویسی عمیق، ویرایش انسانی و افزودن دیدگاههای تخصصی (منطبق با اصول E-E-A-T گوگل) برای تضمین کیفیت و اصالت محتوا ضروری است. در واقع، به جای تلاش برای «دور زدن» سیستم، باید بر تولید محتوایی تمرکز کرد که حتی پس از بازنویسی، دیگر نتوان آن را «تولیدشده توسط هوش مصنوعی» نامید.
واترمارک در متون کوتاه، محتوای کاملاً مبتنی بر واقعیت (که در آن انتخاب کلمات محدود است) و ویرایشهای ساده گرامری، ضعیفتر عمل میکند. انتروپیک قصد دارد در آینده یک API برای تشخیص این واترمارک منتشر کند. همچنین، این شرکت اعلام کرده است که این قابلیت تأثیر ناچیزی بر سرعت تولید متن دارد و هزینه توکن اضافی برای کاربران ایجاد نمیکند.
چرا مهم است؟
این فناوری بر اهمیت ویرایش انسانی و بازنویسی عمیق محتوای تولیدشده توسط هوش مصنوعی تأکید میکند و میتواند استراتژیهای تولید محتوا برای سئو را تحت تأثیر قرار دهد.
اقتباسی از: Search Engine Journal - SEO
نظرات (۰)
هنوز نظری ثبت نشده — اولین نفر باشید.