دانش و فن‌آوری » پیشخوان خبر » جدیدترین عناوین » مطالب ویژه
کد خبر : 6329
دوشنبه - ۹ شهریور ۱۴۰۵ - ۲۳:۰۹
واترمارک گذاری در محتوای تولید شده توسط هوش مصنوعی

آنتروپیک، پیش قراول جلوگیری از سوء استفاده از هوش مصنوعی

آنتروپیک گفت که کلود تنها چت‌بات هوش مصنوعی نخواهد بود که متن واترمارک‌شده تولید می‌کند، زیرا «سایر توسعه‌دهندگان بزرگ مدل نیز همین کد عمل را امضا کرده‌اند و واترمارک‌های خود را پیاده‌سازی خواهند کرد.» و اضافه کرد که واترمارک‌گذاری این شرکت با رویکردهای تشخیص هوش مصنوعی که توسط شرکت‌هایی مانند پانگرم ارائه می‌شود، متفاوت است.این شرکت همچنین قصد دارد یک API برای تشخیص واترمارک منتشر کند

آنتروپیک، پیش قراول جلوگیری از سوء استفاده از هوش مصنوعی

به گزارش بانگ سروش؛ آنتروپیک روز جمعه با انتشار یک پست وبلاگی تلاش کرد به برخی سوالات اساسی درباره نحوه واترمارک کردن متون تولید شده توسط چت‌بات خود«کلاود»، پاسخ دهد. سوالاتی از قبیل: واترمارک‌گذاری در واقع چگونه کار می‌کند؟ و آیا می‌توان آن را با ویرایش پنهان کرد؟

کاربران کلود از زمانی که این شرکت اوایل این هفته اعلام کرد برای پیروی از «کد شفافیت» قانون هوش مصنوعی اتحادیه اروپا، که شرکت‌های فعال در این حوزه را ملزم به استفاده از سیستم‌هایی برای شناسایی محتوای تولیدشده توسط هوش مصنوعی می‌کند، این واترمارک‌ها را اعمال خواهد کرد، درباره این اقدام بحث و گفتگو کرده‌اند.

به عنوان مثال، در ردیت، یک کاربر این اقدام را «توطئه‌ای علیه کاربران بی‌گناه کلود» توصیف کرد، در حالی که کاربر دیگری ادعا کرد: «تنها دلیلی که نمی‌خواهید این ویژگی وجود داشته باشد، دروغ گفتن به مردم است.» همچنین وب‌سایت بیزینس اینسایدر گزارش داده که «ده‌ها» کاربر در شبکه اجتماعی ایکس ادعا کرده‌اند که اشتراک خود را در کلود به همین دلیل لغو کرده‌اند.

کلاود آنتروپیک الگویی در پاسخ‌ها ایجاد کند که غیرقابل تشخیص است

پست جدید آنتروپیک با یک نمای کلی از مفهوم واترمارک‌گذاری آغاز می‌شود و توضیح می‌دهد که هنگام انتخاب‌های «کم‌ریسک» — مانند انتخاب بین کلمات «ابری» و «خاکستری» برای توصیف آب و هوا — کلاود می‌تواند الگویی در پاسخ‌های خود ایجاد کند که «برای خواننده غیرقابل تشخیص است، اما برای هر کسی که کلید رمزگشایی آن را داشته باشد، قابل شناسایی است.»

این شرکت اعلام کرد: «واترمارک‌گذاری بر کیفیت خروجی کلود تأثیری ندارد. برای یک خواننده، پاسخ واترمارک‌شده با پاسخ بدون واترمارک تفاوتی ندارد.»

به طور خاص‌تر، آنتروپیک گفت که از رویکرد SynthID-Text که تیم گوگل دیپ‌مایند در سال ۲۰۲۴ معرفی کرد، استفاده خواهد کرد و قصد دارد یک API برای تشخیص واترمارک منتشر کند. این شرکت همچنین خاطرنشان کرد که واترمارک‌گذاری با رویکردهای تشخیص هوش مصنوعی که توسط شرکت‌هایی مانند پانگرم ارائه می‌شود، متفاوت است؛ رویکردهایی که به دنبال «نشانه‌هایی» در نوشتار (مانند ساختار «این [X] نیست، بلکه [Y] است») برای آشکار کردن استفاده از هوش مصنوعی هستند: «تشخیص این الگوها اساساً با بررسی واترمارک متفاوت است.»

آیا کسی می‌تواند برای پنهان کردن واترمارک، متن را بازنویسی کند؟ آنتروپیک گفت این امکان وجود دارد، اما «ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمی‌کند»، در حالی که «بازنویسی کامل که در آن هر کلمه جایگزین شود، ااین کار را انجام خواهد داد.»

این شرکت افزود: «البته در حالت دوم، قابل بحث است که آیا دیگر می‌توان متن را تولیدشده توسط هوش مصنوعی توصیف کرد یا خیر.»

در مورد اینکه آیا واترمارک در متنی که فقط توسط کلود تصحیح یا ویرایش شده است قابل تشخیص خواهد بود یا خیر، آنتروپیک گفت که این به «طول متن و میزان ویرایش کلود بستگی دارد.» اگر فقط به صورت سبک ویرایش شده باشد، «تقریباً تمام کلمات» توسط نویسنده انسانی نوشته شده است و «چیز بسیار کمی (اگر چیزی باشد) برای چسبیدن واترمارک وجود دارد.»

در همین حال، کدها باید واترمارک کمتری نسبت به سایر متون داشته باشند، زیرا مدل باید کدهای کاربردی ایجاد کند و آزادی انتخاب بین گزینه‌های مختلف به همان اندازه معتبر را نخواهد داشت.

آنتروپیک گفت: «با این حال، در مناطقی که انتخاب دلخواه بین کلمات یا اصطلاحات خاص در کد وجود دارد، می‌توان از واترمارک استفاده کرد، مانند نظرات داخل کد. اما طبق تعریف، تأثیر آن بر کد واقعی تولیدشده ناچیز خواهد بود.»

آنتروپیک همچنین گفت که کلود تنها چت‌بات هوش مصنوعی نخواهد بود که متن واترمارک‌شده تولید می‌کند، زیرا «سایر توسعه‌دهندگان بزرگ مدل نیز همین کد عمل را امضا کرده‌اند و واترمارک‌های خود را پیاده‌سازی خواهند کرد.»