دیگر محتوای کلود بیردپا نیست؛ همه تولیدات واترمارک میشوند
شرکت آنتروپیک(Anthropic) آییننامه اتحادیه اروپا در مورد شفافیت محتوای تولید شده توسط هوش مصنوعی خود موسوم به کلود(Claude) را امضا کرده است و از این پس تمام محتوای تولید شده با استفاده از ابزارهای خود را واترمارک خواهد کرد. به گزارش ایرانیان تحلیل، طبق تحلیل موسسه Ahrefs در سال ۲۰۲۵، از حدود ۹ میلیون صفحه […]
شرکت آنتروپیک(Anthropic) آییننامه اتحادیه اروپا در مورد شفافیت محتوای تولید شده توسط هوش مصنوعی خود موسوم به کلود(Claude) را امضا کرده است و از این پس تمام محتوای تولید شده با استفاده از ابزارهای خود را واترمارک خواهد کرد.
به گزارش ایرانیان تحلیل، طبق تحلیل موسسه Ahrefs در سال ۲۰۲۵، از حدود ۹ میلیون صفحه در وب، تقریباً سه چهارم صفحات تازه منتشر شده اکنون حاوی متن نوشته شده توسط ماشینها هستند. ضمن اینکه این رقم شامل اسناد آفلاین نمیشود. همچنین فقط متن را پوشش میدهد.
هوش مصنوعی مولد اکنون موسیقی، تصاویر، نرمافزار، عکس و ویدیوهای قانعکنندهای تولید میکند. مشکل این است که تشخیص بخش زیادی از آن از آثار ساخته شده توسط انسان دشوار شده و نگرانیهای شفافیت و امنیتی را افزایش داده است.
پاسخ اتحادیه اروپا به این نگرانیها، وضع مقررات است. طبق ماده ۵۰(۲) قانون هوش مصنوعی اتحادیه اروپا، ارائه دهندگان سیستمهای هوش مصنوعی مولد موظف هستند تمام محتوای تولید شده را به عنوان محتوای تولید شده مصنوعی یا دستکاری شده قابل تشخیص کنند.
شرکت آنتروپیک که شرکت پشتیبان هوش مصنوعی «کلود» است، آییننامه عملکرد این اتحادیه در مورد شفافیت محتوای تولید شده توسط هوش مصنوعی را امضا کرده است و اکنون قصد دارد خروجیهای «کلود» را در سراسر اکوسیستم خود «واترمارک» کند.
به گفته این شرکت، متن دارای یک واترمارک آماری نامرئی خواهد بود، در حالی که فرمتهای تصویری پشتیبانی شده (مانند PNG، JPG یا SVG) فرادادههای امضا شدهای را دریافت میکنند که نشان میدهد Claude در این کار مشارکت داشته است.
هوش مصنوعی مولد در نوشتار، موسیقی، هنر، نرمافزار و تقریباً هر چیز دیجیتالی گسترش یافته است. برای بسیاری، کار را سریعتر و ارزانتر کرده است. برعکس، نگرانیهای جدی در مورد استفاده و امنیت غیرمسئولانه نیز ایجاد کرده است. استفاده از هوش مصنوعی برای تولید کامل مقالات دانشگاهی یا در قراردادهای محتوایی که هوش مصنوعی به صراحت مجاز نیست، نگرانیهای معتبری هستند. سپس موارد کماهمیتتری وجود دارد که افراد متوجه میشوند آهنگ یا ویدیوی تأثیرگذاری که تحسین میکردند، از ابتدا به طرز فریبندهای توسط هوش مصنوعی تولید شده است.
با این حال، مسئله بسیار بزرگتر در مورد امنیت است. محتوای تولید شده توسط هوش مصنوعی آنقدر قدرتمند شده است که شناسایی آن به طور فزایندهای دشوار میشود. البته که ویدیوی یک گربه عضلانی که در حال قدم زدن روی ماه در اقیانوس است، حساب نمیشود، اما ویدیویی از یک چهره عمومی که خواستار خشونت یا یک سند رسمی جعلی است، میتواند عواقب وخیمی داشته باشد.
اینها برخی از مسائلی هستند که واترمارک و شناسایی میتواند به حل آنها کمک کنند. شرکت آنتروپیک میگوید که علامتگذاری آن برای خروجی مدلهای پشتیبانی شده در هر جایی که «کلود» اجرا میشود، از جمله API پلتفرم کلود، برنامههای کلود، کلود کد، کلود کوورک و کلود تگ، اعمال میشود. دامنه این علامتگذاری به محصولات شخص ثالث ساخته شده بر اساس API کلود نیز میرسد، زیرا علامتگذاری به جای هر رابط کاربری واحد، در خروجی قرار میگیرد.
مدلهایی که در تاریخ ۲ اوت ۲۰۲۶ یا بعد از آن عرضه شدهاند، از علامتگذاری در زمان عرضه پشتیبانی میکنند، در حالی که این شرکت در تلاش است تا آن را در ماههای آینده تحت یک دوره انتقالی که قانون اتحادیه اروپا اجازه میدهد، به مدلهای قدیمیتر اضافه کند.
اگرچه این الزام، اروپایی است، اما شرکت آنتروپیک از ابتدا واترمارک را در سراسر جهان اعمال میکند و میگوید هنوز راهی پایدار برای محدود کردن آن بر اساس مناطق مختلف ندارد.
این علامتگذاری چگونه کار میکند؟ آنتروپیک برای متن، از نسخهای از روش SynthID-Text گوگل دیپمایند استفاده میکند. این روش به کاراکترهای پنهان یا فرادادههای متصل به یک سند متکی نیست. در عوض، واترمارک از طریق کلماتی که کلود هنگام تولید متن انتخاب میکند، ایجاد میشود.
مدلهای زبانی بزرگ هنگام تولید متن، هر کلمه بعدی را از مجموعهای از کاندیداهای محتمل انتخاب میکنند. در بسیاری از موقعیتها، چندین کلمه میتوانند یک جمله را به یک اندازه خوب ادامه دهند، بنابراین انتخاب معمولاً به صورت تصادفی انجام میشود.
با واترمارک به سبک SynthID، یک کلید مخفی و متن قبلی بر آن انتخاب تأثیر میگذارند. در تعداد کافی از کلمات، آن انتخابهای کوچک به یک الگوی آماری تبدیل میشوند. بنابراین در حالی که متن هنوز به طور طبیعی خوانده میشود، اکنون دارای امضایی است که یک آشکارساز با کلید مناسب میتواند آن را بررسی کند تا مشخص کند که آیا الگوی انتخاب کلمه آن شبیه به تولید واترمارک «کلود» است یا خیر.
آنتروپیک میگوید که این تکنیک هیچ کاراکتری به متن اضافه نمیکند، به هیچ توکن اضافی نیاز ندارد، کیفیت خروجی را تغییر نمیدهد و هیچ چیزی را که کاربر، سازمان یا چت را شناسایی کند، حمل نمیکند.
آنتروپیک برای فایلهای پشتیبانی شده از یک تکنیک مرسومتر استفاده میکند. وقتی کلود فرمتهایی مانند PNG، JPG یا SVG تولید میکند، یک یادداشت امضا شده با رمزنگاری را در فراداده فایل تحت استاندارد باز C2PA ضمیمه میکند. هیچ چیز در خود تصویر تغییر نمیکند، تنها اعتبارنامه ثبت میکند که کلود فایل را ساخته یا پردازش کرده است و هیچ اطلاعات شخصی را در خود نگه نمیدارد.
سپس یک خواننده سازگار میتواند آن اعتبارنامه را بررسی کند و تشخیص دهد که کلود فایل را پردازش کرده است یا خیر. از آنجا که اطلاعات به صورت رمزنگاری امضا شدهاند، میتواند به آشکار شدن اینکه آیا اعتبارنامه یا فایل متعاقباً دستکاری شده است یا خیر نیز کمک کند.
در حالی که آنتروپیک نحوه علامتگذاری خروجی متن خود را کشف کرده است، هنوز در حال کشف نحوه تشخیص این علامتگذاریها است. آنتروپیک میگوید یک API تشخیص واترمارک در حال روی کار آمدن است، اما هنوز نحوه کار آن را نهایی نکرده است. برای فایلها، هر ابزار آگاه از C2PA میتواند اعتبارنامههای فایل را بخواند و این شرکت قول بررسیکنندههای خود را داده است.
اکنون شرکت آنتروپیک اذعان میکند که نشانههایش سیگنال هستند، نه مدرک قطعی تولید هوش مصنوعی. یک واترمارک شناساییشده فقط نشان میدهد که کلود احتمالاً در مقطعی درگیر بوده است، نه اینکه یک انسان به طور کلی آن متن را ننوشته باشد.
از آنجا که واترمارک به هر کلمهای که کلود انتخاب میکند متصل میشود، نمیتواند نویسندگی را از کمک جدا کند. آنتروپیک خاطرنشان میکند که نمیتواند «کلود این را نوشت» را از «کلود این را به شدت ویرایش کرده است» تشخیص دهد و ترجمهای که کلود تولید میکند کاملاً واترمارک شده است، زیرا هر کلمه انتخاب خودش است.
در بخش تشخیص نیز این شرکت اذعان میکند که اگرچه ویرایش سبک احتمالاً واترمارک را به طور کامل حذف نمیکند، اما یک بازنویسی کامل که در آن هر کلمه جایگزین میشود، این کار را انجام خواهد داد که در آن مرحله، متن به هر حال به سختی توسط هوش مصنوعی تولید شده است.
متنی که به شدت ویرایش، بازنویسی، ترجمه یا با نوشتههای دیگر مخلوط شده باشد، ممکن است به اندازه کافی الگوی آماری کلود را از دست بدهد تا غیرقابل تشخیص شود. در عمل، کسی که عمداً سعی در پنهان کردن دخالت کلود دارد، میتواند به سادگی خروجی را به طور قابل توجهی بازنویسی کند.
دیدگاه تان را بنویسید