کلاد

کلاد به متن‌ها و تصاویر تولیدشده توسط هوش مصنوعی واترمارک نامرئی اضافه می‌کند

آنتروپیک قصد دارد برای افزایش شفافیت محتوای تولیدشده با هوش مصنوعی، نشانه‌های نامرئی را به متن‌ها و تصاویر تولیدی چت‌بات Claude اضافه کند. این قابلیت قرار است به پلتفرم‌ها و سیستم‌های نرم‌افزاری کمک کند منشأ محتوای تولیدشده توسط هوش مصنوعی را آسان‌تر تشخیص دهند.

آنتروپیک در راستای قوانین جدید اتحادیه اروپا درباره شفافیت محتوای هوش مصنوعی، سازوکار جدیدی برای شناسایی خروجی‌های Claude در نظر گرفته است. بر اساس این طرح، متن‌ها و تصاویر تولیدشده توسط مدل‌های کلاد به داده‌ها یا نشانه‌هایی مجهز می‌شوند که برای انسان قابل مشاهده نیستند، اما سیستم‌های نرم‌افزاری می‌توانند آن‌ها را شناسایی کنند.

واترمارک کلاد برای چشم انسان قابل مشاهده نیست

نشانه‌گذاری جدید به شکلی طراحی شده است که ظاهر و محتوای خروجی‌های Claude را تغییر ندهد. آنتروپیک می‌گوید این قابلیت ابتدا در مدل‌های جدید فعال می‌شود و سپس به‌تدریج مدل‌های قدیمی‌تر را نیز پوشش خواهد داد.

قرار است این سیستم در تمامی مسیرهای ارائه خدمات Claude از جمله نسخه وب، API و ابزارهای توسعه‌دهندگان مورد استفاده قرار گیرد. در نتیجه، منشأ محتوای تولیدشده صرف‌نظر از اینکه از کدام محصول یا بستر Claude دریافت شده باشد، قابل تشخیص خواهد بود.

کلاد

تصاویر کلاد با استاندارد C2PA نشانه‌گذاری می‌شوند

برای تصاویر تولیدشده، آنتروپیک از استاندارد C2PA استفاده می‌کند. این استاندارد پیش‌تر از سوی شرکت‌هایی مانند گوگل و مایکروسافت نیز مورد استفاده قرار گرفته و برای ثبت اطلاعات مربوط به منشأ و سابقه محتوای دیجیتال طراحی شده است.

متادیتای C2PA می‌تواند به پلتفرم‌ها کمک کند تشخیص دهند یک تصویر با ابزار هوش مصنوعی تولید شده است یا از منبع دیگری به دست آمده است. البته این نوع اطلاعات معمولاً بخشی از فراداده فایل محسوب می‌شود و امکان حذف آن توسط برخی ابزارها وجود دارد.

واترمارک نامرئی درون متن قرار می‌گیرد

نشانه‌گذاری متن‌ها از تصاویر پیچیده‌تر است. آنتروپیک اعلام کرده که برای این بخش، واترمارکی نامرئی را مستقیماً در ساختار متن تولیدشده قرار می‌دهد؛ بدون اینکه معنا، کیفیت یا خوانایی پاسخ تحت تأثیر قرار گیرد.

به گفته این شرکت، چون واترمارک بخشی از خود متن خواهد بود، هنگام کپی و انتقال محتوا به محیط‌های دیگر نیز همراه آن منتقل می‌شود. این نشانه همچنین می‌تواند پس از انجام برخی ویرایش‌ها همچنان قابل شناسایی باقی بماند.

نکته مهم این است که نشانه‌گذاری در سطح مدل انجام می‌شود. بنابراین تفاوتی ندارد کاربر متن را از نسخه وب Claude، API یا یکی دیگر از محصولات مبتنی بر این مدل دریافت کرده باشد.

آیا تشخیص متن تولیدشده توسط هوش مصنوعی قابل اعتماد خواهد بود؟

هدف آنتروپیک این است که تشخیص محتوای تولیدشده توسط هوش مصنوعی برای پلتفرم‌های آنلاین ساده‌تر شود و مرز میان محتوای انسانی و ماشینی شفاف‌تر باشد. با این حال، میزان مقاومت این فناوری در برابر روش‌های حذف یا دورزدن واترمارک همچنان مشخص نیست.

در مورد تصاویر نیز یکی از چالش‌های شناخته‌شده، امکان حذف متادیتای C2PA است. درباره واترمارک متنی آنتروپیک نیز هنوز مشخص نیست که این نشانه پس از ویرایش‌های گسترده، بازنویسی یا تغییرات دیگر تا چه اندازه قابل تشخیص باقی می‌ماند.

با وجود این محدودیت‌ها، اقدام آنتروپیک را می‌توان بخشی از روند گسترده‌تر صنعت هوش مصنوعی برای ایجاد سازوکارهای قابل اعتمادتر جهت شناسایی محتوای تولیدشده توسط مدل‌های هوش مصنوعی دانست؛ روندی که با افزایش استفاده از ابزارهایی مانند Claude اهمیت بیشتری پیدا کرده است.

دیدگاه‌ خود را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

به بالا بروید