آنتروپیک قصد دارد برای افزایش شفافیت محتوای تولیدشده با هوش مصنوعی، نشانههای نامرئی را به متنها و تصاویر تولیدی چتبات Claude اضافه کند. این قابلیت قرار است به پلتفرمها و سیستمهای نرمافزاری کمک کند منشأ محتوای تولیدشده توسط هوش مصنوعی را آسانتر تشخیص دهند.
آنتروپیک در راستای قوانین جدید اتحادیه اروپا درباره شفافیت محتوای هوش مصنوعی، سازوکار جدیدی برای شناسایی خروجیهای Claude در نظر گرفته است. بر اساس این طرح، متنها و تصاویر تولیدشده توسط مدلهای کلاد به دادهها یا نشانههایی مجهز میشوند که برای انسان قابل مشاهده نیستند، اما سیستمهای نرمافزاری میتوانند آنها را شناسایی کنند.
واترمارک کلاد برای چشم انسان قابل مشاهده نیست
نشانهگذاری جدید به شکلی طراحی شده است که ظاهر و محتوای خروجیهای Claude را تغییر ندهد. آنتروپیک میگوید این قابلیت ابتدا در مدلهای جدید فعال میشود و سپس بهتدریج مدلهای قدیمیتر را نیز پوشش خواهد داد.
قرار است این سیستم در تمامی مسیرهای ارائه خدمات Claude از جمله نسخه وب، API و ابزارهای توسعهدهندگان مورد استفاده قرار گیرد. در نتیجه، منشأ محتوای تولیدشده صرفنظر از اینکه از کدام محصول یا بستر Claude دریافت شده باشد، قابل تشخیص خواهد بود.

تصاویر کلاد با استاندارد C2PA نشانهگذاری میشوند
برای تصاویر تولیدشده، آنتروپیک از استاندارد C2PA استفاده میکند. این استاندارد پیشتر از سوی شرکتهایی مانند گوگل و مایکروسافت نیز مورد استفاده قرار گرفته و برای ثبت اطلاعات مربوط به منشأ و سابقه محتوای دیجیتال طراحی شده است.
متادیتای C2PA میتواند به پلتفرمها کمک کند تشخیص دهند یک تصویر با ابزار هوش مصنوعی تولید شده است یا از منبع دیگری به دست آمده است. البته این نوع اطلاعات معمولاً بخشی از فراداده فایل محسوب میشود و امکان حذف آن توسط برخی ابزارها وجود دارد.
واترمارک نامرئی درون متن قرار میگیرد
نشانهگذاری متنها از تصاویر پیچیدهتر است. آنتروپیک اعلام کرده که برای این بخش، واترمارکی نامرئی را مستقیماً در ساختار متن تولیدشده قرار میدهد؛ بدون اینکه معنا، کیفیت یا خوانایی پاسخ تحت تأثیر قرار گیرد.
به گفته این شرکت، چون واترمارک بخشی از خود متن خواهد بود، هنگام کپی و انتقال محتوا به محیطهای دیگر نیز همراه آن منتقل میشود. این نشانه همچنین میتواند پس از انجام برخی ویرایشها همچنان قابل شناسایی باقی بماند.
نکته مهم این است که نشانهگذاری در سطح مدل انجام میشود. بنابراین تفاوتی ندارد کاربر متن را از نسخه وب Claude، API یا یکی دیگر از محصولات مبتنی بر این مدل دریافت کرده باشد.
آیا تشخیص متن تولیدشده توسط هوش مصنوعی قابل اعتماد خواهد بود؟
هدف آنتروپیک این است که تشخیص محتوای تولیدشده توسط هوش مصنوعی برای پلتفرمهای آنلاین سادهتر شود و مرز میان محتوای انسانی و ماشینی شفافتر باشد. با این حال، میزان مقاومت این فناوری در برابر روشهای حذف یا دورزدن واترمارک همچنان مشخص نیست.
در مورد تصاویر نیز یکی از چالشهای شناختهشده، امکان حذف متادیتای C2PA است. درباره واترمارک متنی آنتروپیک نیز هنوز مشخص نیست که این نشانه پس از ویرایشهای گسترده، بازنویسی یا تغییرات دیگر تا چه اندازه قابل تشخیص باقی میماند.
با وجود این محدودیتها، اقدام آنتروپیک را میتوان بخشی از روند گستردهتر صنعت هوش مصنوعی برای ایجاد سازوکارهای قابل اعتمادتر جهت شناسایی محتوای تولیدشده توسط مدلهای هوش مصنوعی دانست؛ روندی که با افزایش استفاده از ابزارهایی مانند Claude اهمیت بیشتری پیدا کرده است.


