شرکت آنتروپیک (Anthropic)، توسعهدهنده هوش مصنوعی «کلود» (Claude)، آییننامه اتحادیه اروپا در مورد شفافیت محتوای تولیدشده توسط هوش مصنوعی را امضا کرده و اعلام کرده است که تمام خروجیهای مدلهای خود را در سراسر جهان واترمارک خواهد کرد.
به گزارش پایگاه خبری حکمرانی هوشمند، بر اساس تحلیل مؤسسه Ahrefs در سال ۲۰۲۵، از حدود ۹ میلیون صفحه در وب، تقریباً «سهچهارم صفحات تازه منتشر شده اکنون حاوی متن نوشته شده توسط ماشینها هستند». این آمار که تنها متن وب را پوشش میدهد و اسناد آفلاین را شامل نمیشود، نشاندهنده گسترش بیسابقه محتوای تولیدشده توسط هوش مصنوعی در فضای دیجیتال است.
هوش مصنوعی مولد اکنون موسیقی، تصاویر، نرمافزار، عکس و ویدیوهای قانعکنندهای تولید میکند. تشخیص این محتوا از آثار ساختهشده توسط انسان بهطور فزایندهای دشوار شده است و این مسئله نگرانیهای جدی در حوزه شفافیت و امنیت ایجاد کرده است.
اتحادیه اروپا با وضع مقرراتی در این زمینه، گامی اساسی برداشته است. طبق ماده ۵۰(۲) قانون هوش مصنوعی اتحادیه اروپا، ارائهدهندگان سیستمهای هوش مصنوعی مولد موظف هستند تمام محتوای تولیدشده را بهعنوان محتوای تولیدشده مصنوعی یا دستکاریشده قابل تشخیص کنند.
شرکت آنتروپیک بهعنوان پشتیبان هوش مصنوعی «کلود»، آییننامه عملکرد اتحادیه اروپا را امضا کرده و اکنون قصد دارد خروجیهای «کلود» را در سراسر اکوسیستم خود واترمارک کند.
به گفته این شرکت، «متن دارای یک واترمارک آماری نامرئی خواهد بود»، در حالی که فرمتهای تصویری پشتیبانیشده (مانند PNG، JPG یا SVG) فرادادههای امضا شدهای دریافت میکنند که نشان میدهد «کلود» در تولید آن مشارکت داشته است.
جالبتوجه اینکه اگرچه این الزام مختص اتحادیه اروپاست، اما آنتروپیک واترمارک را از ابتدا در سراسر جهان اعمال میکند و اعلام کرده که «هنوز راهی پایدار برای محدود کردن آن بر اساس مناطق مختلف ندارد».
آنتروپیک برای واترمارک متن، از نسخهای از روش SynthID-Text گوگل دیپمایند استفاده میکند. این روش به کاراکترهای پنهان یا فرادادههای متصل به سند متکی نیست؛ بلکه واترمارک از طریق کلماتی که کلود هنگام تولید متن انتخاب میکند، ایجاد میشود.
شرکت آنتروپیک توضیح میدهد که مدلهای زبانی بزرگ هنگام تولید متن، هر کلمه بعدی را از مجموعهای از کاندیداهای محتمل انتخاب میکنند. با واترمارک به سبک SynthID، «یک کلید مخفی و متن قبلی بر آن انتخاب تأثیر میگذارند» و در تعداد کافی از کلمات، این انتخابهای کوچک به یک الگوی آماری تبدیل میشوند.
به گفته آنتروپیک، این تکنیک «هیچ کاراکتری به متن اضافه نمیکند، به هیچ توکن اضافی نیاز ندارد، کیفیت خروجی را تغییر نمیدهد و هیچ چیزی را که کاربر، سازمان یا چت را شناسایی کند، حمل نمیکند».
برای فایلهای تصویری، آنتروپیک از تکنیک مرسومتری استفاده میکند؛ وقتی کلود فرمتهایی مانند PNG، JPG یا SVG تولید میکند، یک یادداشت امضا شده با رمزنگاری را در فراداده فایل تحت استاندارد باز C2PA ضمیمه میکند.
آنتروپیک با صراحت اذعان کرده است که نشانههایش «سیگنال هستند، نه مدرک قطعی تولید هوش مصنوعی». یک واترمارک شناساییشده فقط نشان میدهد که «کلود» احتمالاً در مقطعی درگیر بوده است، نه اینکه یک انسان بهطور کلی آن متن را ننوشته باشد.
از آنجا که واترمارک به هر کلمهای که کلود انتخاب میکند متصل میشود، این شرکت نمیتواند «کلود این را نوشت» را از «کلود این را به شدت ویرایش کرده است» تشخیص دهد. همچنین ترجمهای که کلود تولید میکند کاملاً واترمارک شده است، زیرا هر کلمه انتخاب خودش است.
آنتروپیک در بخش تشخیص نیز تأکید دارد که اگرچه ویرایش سبک احتمالاً واترمارک را بهطور کامل حذف نمیکند، اما «یک بازنویسی کامل که در آن هر کلمه جایگزین میشود، این کار را انجام خواهد داد» و در آن مرحله، متن به هر حال به سختی توسط هوش مصنوعی تولید شده است. همچنین «متنی که به شدت ویرایش، بازنویسی، ترجمه یا با نوشتههای دیگر مخلوط شده باشد، ممکن است به اندازه کافی الگوی آماری کلود را از دست بدهد تا غیرقابل تشخیص شود».
اقدام شرکت آنتروپیک در پیادهسازی واترمارک برای خروجیهای «کلود»، گامی مهم در جهت شفافسازی محتوای تولیدشده توسط هوش مصنوعی محسوب میشود. با این حال، همانگونه که خود شرکت اذعان دارد، این روش بهویژه در برابر بازنویسیهای عمدی، محدودیتهای قابلتوجهی دارد و نمیتواند بهعنوان مدرکی قطعی برای تشخیص دخالت هوش مصنوعی در تولید محتوا عمل کند. در نهایت، این رویکرد هرچند کامل نیست، اما نشاندهنده تلاش صنعت برای پاسخ به نگرانیهای فزاینده درباره شفافیت و امنیت در عصر گسترش محتوای مصنوعی است.
انتهای پیام
