به گزارش بانگ سروش؛ آنتروپیک روز جمعه با انتشار یک پست وبلاگی تلاش کرد به برخی سوالات اساسی درباره نحوه واترمارک کردن متون تولید شده توسط چتبات خود«کلاود»، پاسخ دهد. سوالاتی از قبیل: واترمارکگذاری در واقع چگونه کار میکند؟ و آیا میتوان آن را با ویرایش پنهان کرد؟
کاربران کلود از زمانی که این شرکت اوایل این هفته اعلام کرد برای پیروی از «کد شفافیت» قانون هوش مصنوعی اتحادیه اروپا، که شرکتهای فعال در این حوزه را ملزم به استفاده از سیستمهایی برای شناسایی محتوای تولیدشده توسط هوش مصنوعی میکند، این واترمارکها را اعمال خواهد کرد، درباره این اقدام بحث و گفتگو کردهاند.
به عنوان مثال، در ردیت، یک کاربر این اقدام را «توطئهای علیه کاربران بیگناه کلود» توصیف کرد، در حالی که کاربر دیگری ادعا کرد: «تنها دلیلی که نمیخواهید این ویژگی وجود داشته باشد، دروغ گفتن به مردم است.» همچنین وبسایت بیزینس اینسایدر گزارش داده که «دهها» کاربر در شبکه اجتماعی ایکس ادعا کردهاند که اشتراک خود را در کلود به همین دلیل لغو کردهاند.
کلاود آنتروپیک الگویی در پاسخها ایجاد کند که غیرقابل تشخیص است
پست جدید آنتروپیک با یک نمای کلی از مفهوم واترمارکگذاری آغاز میشود و توضیح میدهد که هنگام انتخابهای «کمریسک» — مانند انتخاب بین کلمات «ابری» و «خاکستری» برای توصیف آب و هوا — کلاود میتواند الگویی در پاسخهای خود ایجاد کند که «برای خواننده غیرقابل تشخیص است، اما برای هر کسی که کلید رمزگشایی آن را داشته باشد، قابل شناسایی است.»
این شرکت اعلام کرد: «واترمارکگذاری بر کیفیت خروجی کلود تأثیری ندارد. برای یک خواننده، پاسخ واترمارکشده با پاسخ بدون واترمارک تفاوتی ندارد.»
به طور خاصتر، آنتروپیک گفت که از رویکرد SynthID-Text که تیم گوگل دیپمایند در سال ۲۰۲۴ معرفی کرد، استفاده خواهد کرد و قصد دارد یک API برای تشخیص واترمارک منتشر کند. این شرکت همچنین خاطرنشان کرد که واترمارکگذاری با رویکردهای تشخیص هوش مصنوعی که توسط شرکتهایی مانند پانگرم ارائه میشود، متفاوت است؛ رویکردهایی که به دنبال «نشانههایی» در نوشتار (مانند ساختار «این [X] نیست، بلکه [Y] است») برای آشکار کردن استفاده از هوش مصنوعی هستند: «تشخیص این الگوها اساساً با بررسی واترمارک متفاوت است.»
آیا کسی میتواند برای پنهان کردن واترمارک، متن را بازنویسی کند؟ آنتروپیک گفت این امکان وجود دارد، اما «ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمیکند»، در حالی که «بازنویسی کامل که در آن هر کلمه جایگزین شود، ااین کار را انجام خواهد داد.»
این شرکت افزود: «البته در حالت دوم، قابل بحث است که آیا دیگر میتوان متن را تولیدشده توسط هوش مصنوعی توصیف کرد یا خیر.»
در مورد اینکه آیا واترمارک در متنی که فقط توسط کلود تصحیح یا ویرایش شده است قابل تشخیص خواهد بود یا خیر، آنتروپیک گفت که این به «طول متن و میزان ویرایش کلود بستگی دارد.» اگر فقط به صورت سبک ویرایش شده باشد، «تقریباً تمام کلمات» توسط نویسنده انسانی نوشته شده است و «چیز بسیار کمی (اگر چیزی باشد) برای چسبیدن واترمارک وجود دارد.»
در همین حال، کدها باید واترمارک کمتری نسبت به سایر متون داشته باشند، زیرا مدل باید کدهای کاربردی ایجاد کند و آزادی انتخاب بین گزینههای مختلف به همان اندازه معتبر را نخواهد داشت.
آنتروپیک گفت: «با این حال، در مناطقی که انتخاب دلخواه بین کلمات یا اصطلاحات خاص در کد وجود دارد، میتوان از واترمارک استفاده کرد، مانند نظرات داخل کد. اما طبق تعریف، تأثیر آن بر کد واقعی تولیدشده ناچیز خواهد بود.»
آنتروپیک همچنین گفت که کلود تنها چتبات هوش مصنوعی نخواهد بود که متن واترمارکشده تولید میکند، زیرا «سایر توسعهدهندگان بزرگ مدل نیز همین کد عمل را امضا کردهاند و واترمارکهای خود را پیادهسازی خواهند کرد.»