anthropic

Anthropic اعلام کرده است که مدل‌های آینده Claude به‌صورت داخلی دارای واترمارک متنی خواهند بود؛ تغییری که به گفته این شرکت برای تطبیق با الزامات شفافیت قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) انجام می‌شود. نکته مهم اینجاست که واترمارک Claude شبیه یک نوشته، علامت یا کاراکتر مخفی نیست که بتوان آن را در متن مشاهده کرد. Anthropic به‌جای اضافه کردن اطلاعات قابل مشاهده، هنگام تولید متن روی انتخاب میان واژه‌هایی که از نظر معنایی تقریباً معادل هستند، تغییرات آماری بسیار ظریفی ایجاد می‌کند و از همین الگو برای تشخیص احتمال دخالت Claude استفاده می‌کند.

این شرکت می‌گوید نتیجه برای خواننده عملاً قابل تشخیص نیست و کیفیت یا محتوای پاسخ نیز به شکل عملی تغییر نمی‌کند. همچنین واترمارک هیچ شناسه‌ای از کاربر، سازمان یا مکالمه در خود ندارد و نمی‌تواند متن را به یک شخص مشخص نسبت دهد. Anthropic همچنین اعلام کرده است که قصد دارد یک API برای تشخیص واترمارک نیز ارائه کند تا بتوان احتمال دخالت Claude در یک متن را به‌صورت فنی بررسی کرد.

واترمارک Claude بدون اضافه کردن چیزی به متن ایجاد می‌شود

روش Anthropic بر اساس نحوه طبیعی تولید متن توسط مدل‌های زبانی کار می‌کند. Claude مانند دیگر مدل‌های زبانی، متن را کلمه‌به‌کلمه تولید می‌کند و در هر مرحله میان چندین گزینه احتمالی برای کلمه بعدی انتخاب انجام می‌دهد. همیشه یک گزینه کاملاً قطعی وجود ندارد؛ برای مثال در یک جمله ممکن است چند واژه مختلف از نظر معنا کاملاً طبیعی باشند و تفاوت آنها تأثیر خاصی بر مفهوم نهایی نداشته باشد.

Anthropic از همین انتخاب‌های کم‌اهمیت استفاده می‌کند. مدل در تعداد زیادی از این تصمیم‌ها، الگوی آماری خاصی را دنبال می‌کند که برای خواننده طبیعی و نامحسوس است، اما در صورت داشتن کلید تشخیص مناسب می‌توان آن الگو را شناسایی کرد. بنابراین چیزی مانند «Claude» یا یک شناسه مخفی به متن اضافه نمی‌شود؛ خود الگوی انتخاب کلمات نقش واترمارک را ایفا می‌کند.

Anthropic می‌گوید این روش از خانواده تکنیک SynthID-Text گوگل است که Google DeepMind در سال 2024 درباره آن پژوهش منتشر کرده بود. مزیت چنین روشی این است که واترمارک را می‌توان در جریان تولید متن ایجاد کرد، بدون اینکه لازم باشد یک رشته مخفی، کاراکتر نامرئی یا داده اضافی به خروجی اضافه شود.

آیا می‌توان واترمارک را با ویرایش متن از بین برد؟

تا حدی. Anthropic می‌گوید ویرایش‌های سبک احتمالاً واترمارک را به‌طور کامل حذف نمی‌کنند و بخشی از الگوی آماری همچنان می‌تواند باقی بماند. اما اگر متن به‌طور کامل بازنویسی شود و تقریباً تمام کلمات آن تغییر کنند، امکان از بین رفتن واترمارک بسیار بیشتر است. همین موضوع یک نکته مهم درباره ماهیت این فناوری را نشان می‌دهد: هدف آن ارائه یک اثبات ریاضی و قطعی درباره نویسنده متن نیست، بلکه تعیین احتمال دخالت Claude در تولید یا پردازش آن است.

Anthropic صراحتاً تأکید می‌کند که واترمارک نمی‌تواند میان جمله‌ای که کاملاً توسط Claude نوشته شده و متنی که انسان نوشته اما Claude آن را به‌شکل گسترده ویرایش کرده تمایز قطعی بگذارد. به همین دلیل، نتیجه یک سامانه تشخیص واترمارک بیشتر باید به‌صورت «احتمالاً Claude در تولید این متن نقش داشته است» تفسیر شود، نه اینکه «Claude قطعاً نویسنده این متن بوده است».

متن‌های طولانی برای تشخیص مناسب‌تر هستند

هرچه متن طولانی‌تر باشد، مدل فرصت بیشتری برای انجام همان انتخاب‌های آماری کوچک دارد. در نتیجه، الگوی واترمارک نیز داده بیشتری برای شناسایی در اختیار سامانه تشخیص قرار می‌دهد.

به همین دلیل، تشخیص در یک پاراگراف بسیار کوتاه دشوارتر از یک مقاله یا متن طولانی خواهد بود. Anthropic همچنین اشاره کرده است که اگر Claude فقط یک متن انسانی را کمی ویرایش یا تصحیح کند، ممکن است تعداد انتخاب‌های انجام‌شده توسط مدل آن‌قدر کم باشد که تشخیص قابل‌اعتمادی امکان‌پذیر نباشد.

این محدودیت از نظر کاربرد عملی مهم است، زیرا بسیاری از استفاده‌های واقعی از AI شامل ویرایش جزئی هستند. برای مثال، ممکن است نویسنده یک متن را خودش نوشته باشد و فقط از Claude برای اصلاح چند جمله استفاده کند. در چنین شرایطی، وجود یا نبود واترمارک نمی‌تواند به‌تنهایی مشخص کند چه کسی محتوای اصلی را نوشته است.

کدنویسی وضعیت متفاوتی دارد

واترمارک کردن کد برنامه‌نویسی دشوارتر است. در متن معمولی، Claude بارها با انتخاب میان واژه‌ها و عبارت‌های مختلف روبه‌رو می‌شود، اما در کد اغلب گزینه‌های معتبر بسیار محدودتر هستند. یک تابع یا دستور ممکن است از نظر نحوی فقط چند شکل مشخص داشته باشد و تغییر آن می‌تواند عملکرد برنامه را خراب کند.

Anthropic می‌گوید به همین دلیل، کد معمولاً فرصت کمتری برای ایجاد واترمارک دارد و قابلیت تشخیص در آن ضعیف‌تر از متن عادی است. با این حال، بخش‌هایی مانند کامنت‌ها و متن‌های توضیحی داخل کد می‌توانند همچنان حاوی نشانه‌های واترمارک باشند.

ترجمه‌های Claude نیز واترمارک خواهند داشت

یک نکته جالب این است که واترمارک فقط برای متن‌هایی که Claude از صفر تولید می‌کند در نظر گرفته نشده است. Anthropic گفته است ترجمه‌های انجام‌شده توسط Claude نیز واترمارک خواهند داشت، زیرا در این حالت نیز انتخاب تک‌تک کلمات خروجی توسط مدل انجام می‌شود.

در نتیجه، این فناوری صرفاً به تولید مقاله، پاسخ چت یا متن تبلیغاتی محدود نمی‌شود و می‌تواند طیف گسترده‌ای از خروجی‌های زبانی Claude را پوشش دهد.

چرا Anthropic این کار را انجام می‌دهد؟

دلیل رسمی Anthropic، ارتباط مستقیم با EU AI Act است. طبق توضیحات این شرکت، از 2 آگوست 2026 الزامات مربوط به علامت‌گذاری محتوای تولیدشده توسط AI در بازار اتحادیه اروپا اجرایی شده و شرکت‌های ارائه‌دهنده مدل‌های هوش مصنوعی باید راهی برای مشخص کردن محتوای تولیدی خود داشته باشند. Anthropic می‌گوید مدل واترمارکینگ جدیدش در همین چارچوب توسعه داده شده است.

اما Anthropic تصمیم گرفته این تغییر را فقط برای اروپا اعمال نکند. طبق توضیحات رسمی شرکت، اجرای محدود منطقه‌ای فعلاً راهکار قابل اتکایی نیست و به همین دلیل واترمارک برای خروجی Claude به‌صورت جهانی اعمال خواهد شد. مدل‌های قدیمی‌تر نیز قرار است طی ماه‌های آینده تحت پوشش قرار بگیرند.

این تصمیم اهمیت زیادی دارد، زیرا نشان می‌دهد مقررات یک بازار بزرگ می‌تواند حتی نحوه تولید خروجی مدل‌های جهانی را تغییر دهد.

این واترمارک با ابزارهای AI Detector فرق دارد

یکی از مهم‌ترین نکات این است که نباید واترمارک Claude را با سرویس‌هایی مانند ابزارهای تشخیص متن تولیدشده توسط هوش مصنوعی یکی دانست.

AI Detectorهای معمولی تلاش می‌کنند از روی سبک نوشتار، انتخاب کلمات، ساختار جمله و الگوهای زبانی حدس بزنند که یک متن توسط AI تولید شده است. اما واترمارک Anthropic دارای یک الگوی از پیش طراحی‌شده و یک کلید تشخیص است که به سامانه اجازه می‌دهد به دنبال همان علامت آماری خاص بگردد. به همین دلیل، Anthropic معتقد است این روش از تشخیص صرفاً سبکی متفاوت است.

این تفاوت از نظر دقت مهم است. یک AI Detector مستقل می‌تواند روی متنی که توسط انسان نوشته شده نیز نتیجه اشتباه بدهد، اما سیستم واترمارک برای شناسایی الگویی طراحی شده که در زمان تولید خروجی توسط همان مدل ایجاد شده است.

البته هیچ‌کدام از این روش‌ها قرار نیست در تمام شرایط نتیجه قطعی بدهند؛ مخصوصاً وقتی متن کوتاه باشد یا به‌شدت بازنویسی شده باشد.

آیا می‌توان فهمید چه کسی از Claude استفاده کرده است؟

خیر؛ دست‌کم بر اساس طراحی اعلام‌شده Anthropic، چنین اطلاعاتی در واترمارک وجود ندارد. این شرکت تصریح می‌کند که واترمارک هیچ اطلاعات شناسایی‌کننده‌ای ندارد و نمی‌توان از آن برای تشخیص اینکه کدام فرد، سازمان یا حساب کاربری متن را تولید کرده استفاده کرد. حتی نمی‌توان با آن یک متن را به یک گفت‌وگوی مشخص در Claude نسبت داد. بنابراین واترمارک در درجه اول برای پاسخ به این سؤال طراحی شده است که آیا Claude احتمالاً در تولید یا پردازش این متن دخالت داشته است یا نه؟

این موضوع برای کاربردهای آموزشی، رسانه‌ای و حقوقی اهمیت زیادی دارد، زیرا نتیجه واترمارک نباید با شناسایی هویت نویسنده اشتباه گرفته شود.

برای تصاویر و فایل‌های دیگر چه اتفاقی می‌افتد؟

Anthropic برای محتوای غیرمتنی نیز رویکرد متفاوتی دارد. این شرکت گفته است برای تصاویر و برخی انواع فایل‌های پشتیبانی‌شده، به‌جای واترمارک آماری متن از C2PA Content Credentials در متادیتای فایل استفاده می‌کند. این استاندارد برای ثبت اطلاعات مربوط به منشأ و سابقه محتوای دیجیتال طراحی شده است.

بنابراین یک سیستم واحد برای تمام انواع خروجی Claude وجود ندارد؛ روش مورد استفاده بسته به نوع محتوای تولیدشده متفاوت است.

آغاز دوره‌ای که تشخیص محتوای AI بخشی از خود مدل می‌شود

اقدام Anthropic را می‌توان نشانه مهمی در مسیر آینده محتوای تولیدشده با هوش مصنوعی دانست. تا امروز بخش بزرگی از بحث تشخیص محتوای AI بر پایه ابزارهای شخص ثالث بود؛ ابزارهایی که تلاش می‌کردند از روی ویژگی‌های متن حدس بزنند یک محتوا توسط انسان نوشته شده یا ماشین.

حالا خود مدل‌های بزرگ شروع به اضافه کردن نشانگرهای قابل تشخیص به خروجی‌شان کرده‌اند. Anthropic می‌گوید شرکت‌های بزرگ دیگری که همان Code of Practice اتحادیه اروپا را پذیرفته‌اند نیز قرار است از روش‌های واترمارکینگ خود استفاده کنند.

این تغییر می‌تواند در آینده روی شیوه استفاده از محتوای AI در دانشگاه‌ها، رسانه‌ها، پلتفرم‌های انتشار محتوا و حتی فرایندهای حقوقی اثر بگذارد. با این حال، باید در نظر داشت که واترمارک فعلی ابزار اثبات قطعی نویسندگی نیست و مخصوصاً در متن‌های کوتاه یا بازنویسی‌شده محدودیت دارد.

در نهایت، Anthropic با Claude یک گام مهم برداشته است: تشخیص دخالت AI دیگر صرفاً مسئله‌ای برای نرم‌افزارهای تشخیص متن نیست و خود مدل نیز بخشی از اطلاعات مربوط به منشأ محتوایش را در فرایند تولید وارد می‌کند. اینکه این استاندارد تا چه اندازه در عمل قابل اعتماد خواهد بود و سایر شرکت‌های AI چگونه آن را پیاده می‌کنند، احتمالاً یکی از موضوعات مهم ماه‌ها و سال‌های آینده خواهد بود.

5 از 5 امتیاز