شرکت آنتروپیک در یک پست وبلاگی، به پرسشهای اساسی کاربران درباره نحوه واترمارکگذاری روی متون تولیدشده توسط چتبات Claude پاسخ داده است. این توضیحات به مسائلی از قبیل شیوه عملکرد این فناوری، امکان حذف یا پنهانسازی آن با ویرایش متن و تأثیر آن بر کدهای برنامهنویسی پرداخته است.
تصمیم آنتروپیک برای ثبت واترمارک مخفی روی متون از زمان اعلام رسمی آن با بحثهای گستردهای میان کاربران روبرو شده بود. این شرکت اعلام کرده که برای پایبندی به منشور شفافیت قانون هوش مصنوعی اتحادیه اروپا اقدام به درج واترمارک میکند؛ قانونی که شرکتهای توسعهدهنده هوش مصنوعی را به استفاده از سیستمهای شناسایی محتوای تولیدشده ملزم میسازد. در این میان، برخی کاربران این سازوکار را اقدام نادرستی تلقی کردهاند و گروهی دیگر گزارش دادهاند که اشتراکهای خود را لغو خواهند کرد.
آنتروپیک در تشریح این فناوری توضیح داده که هنگام تصمیمگیریهای با حساسیت پایین در انتخاب کلمات مترادف برای پاسخ، چتبات Claude الگویی پنهان در متن ایجاد میکند. این الگو برای خواننده عادی کاملاً نامرئی است، اما هر فرد یا سامانهای که کلید رمزگشایی را در اختیار داشته باشد، میتواند آن را ردیابی کند. این شرکت تأکید کرده که واترمارکگذاری به هیچ وجه روی کیفیت متن تولیدی اثر منفی نمیگذارد و پاسخهای دارای واترمارک از نمونههای بدون آن تفکیکپذیر نیستند.
سازوکار فنی واترمارک Claude و تأثیر ویرایش بر آن
این سیستم با بهرهگیری از رویکرد «SynthID-Text» که تیم گوگل دیپمایند در سال ۲۰۲۴ معرفی کرد، پیادهسازی شده است. همچنین آنتروپیک در نظر دارد یک رابط برنامهنویسی کاربردی (API) برای تشخیص واترمارک عرضه کند. به گفته آنتروپیک، این روش بنیادین با ابزارهای سنتی تشخیص متن هوش مصنوعی تفاوت دارد؛ ابزارهایی مانند سامانههای شرکت Pangram که صرفاً به دنبال الگوهای تکراری نگارشی میگردند، با این الگوریتمهای کدگذاری ریاضی قابل مقایسه نیستند.

در پاسخ به این پرسش که آیا بازنویسی متن واترمارک را از بین میبرد یا خیر، آنتروپیک بیان کرده که ویرایشهای جزئی و سبک احتمالاً واترمارک را پاک نخواهند کرد، اما بازنویسی کامل متن که در آن تمام کلمات جایگزین شوند، آن را به کلی حذف میکند. بااینحال، در صورت بازنویسی کامل، دیگر نمیتوان اثر مذکور را به عنوان متن تولیدشده توسط هوش مصنوعی در نظر گرفت. در صورتی که Claude تنها برای ویرایش یک متن انسانی استفاده شود، تشخیص واترمارک به میزان دخل و تصرف آن در متن بستگی دارد؛ اگر تغییرات اندک باشد، کلمات توسط انسان نوشته شدهاند و نشانهای برای ردیابی وجود نخواهد داشت.
واترمارک روی کدهای برنامهنویسی اثر بسیار کمتری نسبت به متنهای عادی دارد؛ چون هوش مصنوعی برای درست کار کردن کد نمیتواند کلمات را آزادانه تغییر دهد. بااینحال، در بخشهایی مثل کامنتها و توضیحات کد که دست مدل برای انتخاب واژهها بازتر است، امکان ثبت واترمارک وجود دارد، هرچند این موضوع روی عملکرد اصلی کد تأثیری نمیگذارد.
آنتروپیک خاطرنشان کرده که Claude تنها مدلی نیست که متون واترمارکشده تولید خواهد کرد، زیرا سایر شرکتهای بزرگ این حوزه نیز منشور مذکور را امضا کردهاند و سازوکارهای اختصاصی خود را فعال میکنند. درهمینحال، گوگل اخیراً قابلیت جدیدی را برای جمینای معرفی کرده بود که ثبت واترمارک دیدنی روی عکس و ویدیوهای ساخته شده با هوش مصنوعی را غیرفعال میکند.
نظرات کاربران