• درباره انجمن
  • تماس با انجمن
26 مرداد 1405 ( دوشنبه )
انجمن دیجیتال مارکتینگ
  • خانه
  • دیجیتال مارکتینگ
  • وب
  • سئو
  • برندینگ
  • دنیای تبلیغات
  • تکنولوژی
  • کسب و کار
  • بازاریابی محتوا
  • هنر
  • گوناگون
بدون نتیجه
مشاهده تمام نتایج
  • خانه
  • دیجیتال مارکتینگ
  • وب
  • سئو
  • برندینگ
  • دنیای تبلیغات
  • تکنولوژی
  • کسب و کار
  • بازاریابی محتوا
  • هنر
  • گوناگون
بدون نتیجه
مشاهده تمام نتایج
انجمن دیجیتال مارکتینگ
بدون نتیجه
مشاهده تمام نتایج
Anthropic جزئیات واترمارک متن Claude را فاش کرد؛ آیا می‌توان واترمارک هوش مصنوعی را شکست داد؟

Anthropic جزئیات واترمارک متن Claude را فاش کرد؛ آیا می‌توان واترمارک هوش مصنوعی را شکست داد؟

26 مرداد 1405
در اخبار گوناگون
0
Share on FacebookShare on Twitter

به نقل از انجمن دیجیتال مارکتینگ، Anthropic جزئیات بیشتری درباره فناوری واترمارک متن تولیدشده توسط Claude منتشر کرده است؛ فناوری‌ای که قرار است به شناسایی محتوای تولیدشده توسط هوش مصنوعی کمک کند. برخلاف تصور رایج، این واترمارک شامل کاراکترهای مخفی، فاصله‌های خاص، نشانه‌های Unicode یا حتی استفاده غیرعادی از خط تیره بلند نیست، بلکه در خود الگوی انتخاب کلمات هنگام تولید متن قرار می‌گیرد. به همین دلیل، تشخیص آن برای کاربر عادی تقریباً غیرممکن است.

این اقدام Anthropic در شرایطی انجام می‌شود که موضوع شناسایی محتوای تولیدشده با هوش مصنوعی به یکی از مسائل مهم صنعت محتوا، آموزش، سئو و فناوری تبدیل شده است. شرکت‌ها و پلتفرم‌های هوش مصنوعی تلاش می‌کنند روش‌هایی برای تشخیص منشأ محتوای تولیدشده ارائه کنند، در حالی که کاربران و تولیدکنندگان محتوا نیز به دنبال درک این موضوع هستند که واترمارک چگونه عمل می‌کند و آیا امکان حذف یا بی‌اثر کردن آن وجود دارد.

بر اساس توضیحات جدید Anthropic، فناوری مورد استفاده در Claude نسخه‌ای از رویکرد SynthID-Text است که توسط Google DeepMind توسعه یافته است. با این حال، نباید تصور کرد که فناوری Anthropic دقیقاً همان نسخه اولیه SynthID است؛ زیرا روش‌های واترمارک‌گذاری متنی در سال‌های اخیر پیشرفت قابل توجهی داشته‌اند.

واترمارک متنی Anthropic چگونه کار می‌کند؟

برای درک فناوری جدید Claude باید ابتدا بدانیم مدل‌های زبانی بزرگ چگونه متن تولید می‌کنند. وقتی یک مدل هوش مصنوعی در حال نوشتن جمله است، برای انتخاب کلمه بعدی معمولاً چندین گزینه محتمل را در اختیار دارد. مدل بر اساس احتمال‌های محاسبه‌شده یکی از این گزینه‌ها را انتخاب می‌کند و بخشی از این فرایند نیز به عنصر تصادفی بودن وابسته است.

Anthropic از همین ویژگی برای ایجاد واترمارک استفاده می‌کند. در این روش، مدل همچنان کلمات را به شکل طبیعی انتخاب می‌کند، اما منبع تصادفی بودن این انتخاب‌ها تغییر می‌کند. یک کلید اختصاصی واترمارک و تعدادی از کلمات قبلی متن در تعیین انتخاب بعدی نقش دارند.

در نتیجه، متن نهایی برای خواننده تفاوت محسوسی با یک متن معمولی تولیدشده توسط مدل ندارد. کاربر نمی‌تواند صرفاً با خواندن متن تشخیص دهد که واترمارک وجود دارد. در عوض، فرد یا سامانه‌ای که کلید مربوط به واترمارک را در اختیار داشته باشد، می‌تواند بررسی کند که آیا الگوی انتخاب کلمات با الگویی که Claude در هنگام استفاده از آن کلید ایجاد می‌کند، مطابقت دارد یا خیر.

هیچ کاراکتر مخفی به متن اضافه نمی‌شود

یکی از نکات مهم اعلام‌شده از سوی Anthropic این است که واترمارک Claude به شکل کاراکترهای Unicode مخفی یا نشانه‌های قابل استخراج در متن قرار نمی‌گیرد. بنابراین روش‌هایی که بر جست‌وجوی کاراکترهای نامرئی یا نشانه‌های خاص در یک متن متکی هستند، لزوماً نمی‌توانند این واترمارک را شناسایی کنند.

همچنین این فناوری به معنای استفاده بیشتر از یک نشانه نگارشی خاص، مانند em dash، یا الگوهای رایج نوشتاری مدل‌های زبانی نیست. در واقع، هدف سیستم شناسایی یک سبک نوشتاری خاص نیست؛ بلکه تشخیص یک الگوی آماری مشخص در انتخاب کلمات است.

واترمارک Claude با تشخیص سبک نوشتاری AI تفاوت دارد

بسیاری از ابزارهای تشخیص محتوای هوش مصنوعی تلاش می‌کنند بر اساس ویژگی‌هایی مانند ساختار جملات، انتخاب واژگان، میزان تکرار، طول جملات یا الگوهای آماری تشخیص دهند که یک متن توسط انسان نوشته شده یا مدل هوش مصنوعی.

اما فناوری واترمارک Anthropic رویکرد متفاوتی دارد. این فناوری به دنبال اثبات این نیست که یک متن «شبیه نوشته هوش مصنوعی» است؛ بلکه به دنبال یک الگوی مشخص است که در زمان تولید متن توسط Claude ایجاد شده است.

این تفاوت اهمیت زیادی دارد. یک متن ممکن است از نظر سبک کاملاً طبیعی به نظر برسد و هیچ نشانه واضحی از تولید ماشینی نداشته باشد، اما اگر الگوی مربوط به واترمارک در انتخاب کلمات آن وجود داشته باشد، سامانه تشخیص می‌تواند آن را شناسایی کند.

Anthropic از نسخه‌ای از SynthID-Text استفاده می‌کند

Anthropic اعلام کرده است که فناوری واترمارک متن Claude بر اساس رویکرد SynthID-Text ساخته شده است. SynthID-Text فناوری‌ای است که Google DeepMind در سال ۲۰۲۴ معرفی کرد و مبنای آن نیز تغییر کنترل‌شده در فرایند تصادفی انتخاب کلمات است.

با این حال، Anthropic تأکید کرده که فناوری آن صرفاً همان پیاده‌سازی قدیمی نیست. خانواده روش‌های واترمارک‌گذاری متنی در فاصله سال‌های ۲۰۲۴ تا ۲۰۲۶ توسعه یافته‌اند و پژوهشگران روی افزایش مقاومت آن‌ها در برابر ویرایش، بازنویسی و تغییرات متن کار کرده‌اند.

بنابراین بهتر است فناوری Claude را یک پیاده‌سازی جدیدتر از ایده کلی SynthID-Text بدانیم، نه اینکه آن را با نسخه اولیه این فناوری کاملاً یکسان فرض کنیم.

آیا می‌توان واترمارک Anthropic را حذف کرد؟

پاسخ کوتاه این است که بله، دست‌کم در شرایط خاص امکان تضعیف یا حذف اثر واترمارک وجود دارد. خود Anthropic نیز تأیید کرده که بازنویسی کامل متن می‌تواند واترمارک را از بین ببرد.

دلیل این مسئله ساده است: واترمارک در الگوی انتخاب کلمات قرار گرفته است. اگر بخش قابل توجهی از کلمات متن تغییر کند، الگوی اولیه نیز دیگر همان ساختار را نخواهد داشت. بنابراین بازنویسی گسترده می‌تواند قابلیت شناسایی واترمارک را کاهش دهد.

با این حال، Anthropic می‌گوید ویرایش‌های سبک لزوماً برای حذف کامل واترمارک کافی نیستند. در نتیجه، تغییر چند کلمه یا اصلاح جزئی جمله‌ها الزاماً باعث از بین رفتن سیگنال واترمارک نمی‌شود.

بازنویسی کامل با ویرایش جزئی تفاوت دارد

یک نکته مهم این است که میان «اصلاح متن» و «بازنویسی کامل» تفاوت وجود دارد. اگر کاربر فقط چند اشتباه نگارشی یا دستوری را اصلاح کند، بخش بزرگی از الگوی اصلی همچنان باقی می‌ماند.

اما اگر تقریباً تمام جملات و واژگان از نو نوشته شوند، بخش زیادی از انتخاب‌های کلمه‌ای اولیه Claude از بین می‌رود. در چنین شرایطی تشخیص واترمارک دشوارتر خواهد شد.

با این حال، استفاده از این موضوع به عنوان راهی برای دور زدن سامانه‌های شناسایی محتوا، تضمینی نیست؛ زیرا عملکرد تشخیص به طول متن، نوع محتوا، میزان تغییرات و روش تشخیص نیز وابسته است.

واترمارک در متن‌های کوتاه ضعیف‌تر است

Anthropic یکی دیگر از محدودیت‌های مهم فناوری خود را نیز توضیح داده است: هرچه تعداد کلمات متن کمتر باشد، تشخیص واترمارک دشوارتر می‌شود.

این موضوع از نظر آماری قابل درک است. برای شناسایی یک الگو، سیستم تشخیص به تعداد کافی نمونه نیاز دارد. اگر متن تنها چند جمله کوتاه داشته باشد، داده کافی برای اطمینان از وجود الگوی واترمارک وجود ندارد.

در مقابل، در متن‌های طولانی‌تر، تعداد انتخاب‌های کلمه‌ای بیشتر است و سامانه تشخیص می‌تواند الگوی مورد نظر را با اطمینان بیشتری بررسی کند. بنابراین نباید انتظار داشت که واترمارک در همه انواع محتوا با یک میزان دقت قابل شناسایی باشد.

محتوای factual نیز چالش دیگری برای واترمارک است

نوع محتوای تولیدشده نیز روی قدرت واترمارک تأثیر می‌گذارد. در متون کاملاً factual یا مبتنی بر اطلاعات دقیق، مدل همیشه آزادی زیادی برای انتخاب کلمات ندارد. زمانی که یک مفهوم باید با واژه یا عبارت مشخصی بیان شود، فضای انتخاب مدل محدودتر می‌شود.

در چنین شرایطی، امکان ایجاد الگوی واترمارک نیز محدودتر خواهد بود. Anthropic اشاره کرده است که واترمارک در محتوای factual می‌تواند ضعیف‌تر عمل کند؛ زیرا تعداد گزینه‌های مناسب برای انتخاب کلمات کمتر است.

ویرایش دستوری می‌تواند تشخیص واترمارک را دشوار کند

یکی دیگر از موارد جالب، استفاده از Claude برای اصلاح گرامر و علائم نگارشی است. اگر یک متن واترمارک‌شده تنها از نظر دستور زبان یا نشانه‌گذاری ویرایش شود، ممکن است فقط تعداد کمی از کلمات آن تغییر کنند.

در نتیجه، سیگنال واترمارک ممکن است فقط در بخش کوچکی از متن باقی بماند و تعداد تغییرات برای تشخیص قطعی کافی نباشد. این مسئله نشان می‌دهد که فناوری واترمارک متنی هنوز با محدودیت‌هایی روبه‌رو است و نباید آن را یک روش کاملاً بی‌نقص برای شناسایی منشأ محتوا دانست.

MirrorMark چه تفاوتی با SynthID دارد؟

در بحث واترمارک متن، فناوری‌های جدیدتری نیز در حال ظهور هستند. یکی از نمونه‌های مورد اشاره MirrorMark است که رویکردهای مربوط به SynthID را توسعه می‌دهد.

یکی از تفاوت‌های مهم در این خانواده از روش‌ها، امکان استفاده از اطلاعات بیشتر در ساختار واترمارک است. SynthID در قالب یک واترمارک zero-bit می‌تواند اساساً وجود یا نبود یک واترمارک را مشخص کند، در حالی که روش‌های جدیدتر می‌توانند ظرفیت بیشتری برای رمزگذاری اطلاعات داشته باشند.

در روش‌هایی مانند MirrorMark، واترمارک می‌تواند در بخش‌های مختلف متن توزیع شود و از کلمات اطراف برای تعیین محل و نحوه قرارگیری آن استفاده شود. هدف چنین رویکردهایی افزایش مقاومت واترمارک در برابر ویرایش و بازنویسی است.

آیا Anthropic از MirrorMark استفاده می‌کند؟

نباید بدون مدرک نتیجه گرفت که Anthropic دقیقاً از MirrorMark استفاده می‌کند. آنچه شرکت اعلام کرده این است که فناوری آن نسخه‌ای از رویکرد SynthID-Text است.

بنابراین MirrorMark را باید به عنوان نمونه‌ای از مسیر توسعه فناوری‌های واترمارک متنی در نظر گرفت، نه به عنوان نام فناوری مورد استفاده Claude. تفاوت میان این دو موضوع برای تحلیل دقیق خبر اهمیت دارد.

واترمارک Claude برای سئو و تولید محتوا چه معنایی دارد؟

گسترش واترمارک‌های متنی می‌تواند برای صنعت تولید محتوا و سئو نیز اهمیت داشته باشد. استفاده از هوش مصنوعی در تولید مقالات، توضیحات محصولات، محتوای شبکه‌های اجتماعی و متون تبلیغاتی در سال‌های اخیر افزایش یافته است و به همین دلیل، موضوع تشخیص منشأ محتوا اهمیت بیشتری پیدا کرده است.

با این حال، وجود واترمارک به معنای بی‌ارزش بودن محتوای تولیدشده توسط AI نیست. کیفیت، دقت، اصالت، ارزش افزوده و میزان تخصص موجود در محتوا همچنان عوامل مهمی هستند. کسب‌وکارها باید به جای تمرکز صرف بر اینکه متن با هوش مصنوعی تولید شده یا نه، روی کیفیت و ارزش واقعی محتوا تمرکز کنند.

برای متخصصان سئو نیز موضوع مهم‌تر، درک تغییرات موتورهای جست‌وجو و سیستم‌های هوش مصنوعی در ارزیابی محتواست. محتوای سطحی و تکراری، چه توسط انسان تولید شده باشد و چه با AI، نمی‌تواند به تنهایی یک استراتژی محتوایی قدرتمند ایجاد کند.

Anthropic چه برنامه‌ای برای تشخیص واترمارک دارد؟

Anthropic اعلام کرده است که قصد دارد یک API برای تشخیص واترمارک ارائه کند. چنین ابزاری می‌تواند به توسعه‌دهندگان و پلتفرم‌ها اجازه دهد بررسی کنند آیا یک متن احتمالاً با استفاده از مدل‌های Claude و تحت سیستم واترمارک مربوطه تولید شده است یا خیر.

البته عملکرد هر سیستم تشخیص باید با توجه به محدودیت‌های آن ارزیابی شود. متن کوتاه، محتوای factual و ویرایش گسترده می‌توانند فرایند تشخیص را دشوارتر کنند. بنابراین نباید نتیجه یک ابزار تشخیص را به تنهایی به عنوان اثبات قطعی منشأ یک متن در نظر گرفت.

برای فایل‌های تصویری چه اتفاقی می‌افتد؟

Anthropic در توضیحات خود به محتوای غیرمتنی نیز اشاره کرده است. برای فایل‌های تصویری مانند JPG، PNG و SVG، استفاده از استانداردهای متادیتای C2PA مطرح شده است.

C2PA رویکردی متفاوت از واترمارک متنی دارد و اطلاعات مربوط به منشأ و اعتبار محتوا را در قالب اطلاعات مرتبط با فایل ثبت می‌کند. استفاده از چنین استانداردهایی می‌تواند بخشی از روند گسترده‌تر صنعت فناوری برای ایجاد شفافیت درباره منشأ محتوای دیجیتال باشد.

مهم‌ترین نکات درباره واترمارک Claude

  • واترمارک Claude در فرایند انتخاب کلمات ایجاد می‌شود.
  • کاراکتر Unicode یا نشانه مخفی به متن اضافه نمی‌شود.
  • این فناوری صرفاً به تشخیص سبک نگارش رایج مدل‌های AI متکی نیست.
  • Anthropic می‌گوید روش آن نسخه‌ای از رویکرد SynthID-Text است.
  • متن‌های طولانی‌تر معمولاً برای تشخیص واترمارک مناسب‌تر هستند.
  • محتوای factual به دلیل محدودیت در انتخاب واژه‌ها می‌تواند سیگنال ضعیف‌تری ایجاد کند.
  • ویرایش جزئی الزاماً واترمارک را از بین نمی‌برد.
  • بازنویسی گسترده می‌تواند اثر واترمارک را کاهش دهد.
  • Anthropic قصد دارد API تشخیص واترمارک را ارائه کند.
  • برای برخی فایل‌های تصویری، C2PA به عنوان روش ثبت اطلاعات منشأ محتوا مورد استفاده قرار می‌گیرد.

جمع‌بندی؛ آینده شناسایی محتوای تولیدشده با هوش مصنوعی

افشای جزئیات بیشتر درباره واترمارک Claude نشان می‌دهد که صنعت هوش مصنوعی به سمت روش‌های پیچیده‌تر برای شناسایی منشأ محتوا حرکت می‌کند. روش Anthropic برخلاف تصور رایج، به دنبال قرار دادن نشانه‌های قابل مشاهده یا کاراکترهای مخفی در متن نیست؛ بلکه الگوی خاصی را در فرایند انتخاب کلمات ایجاد می‌کند که در صورت در اختیار داشتن کلید مناسب، قابل تشخیص است.

این فناوری البته محدودیت‌هایی نیز دارد. متن‌های کوتاه، محتوای بسیار factual و ویرایش‌های گسترده می‌توانند قدرت تشخیص را کاهش دهند. در نتیجه، واترمارک را نباید یک راهکار کاملاً شکست‌ناپذیر دانست. با این حال، توسعه این فناوری‌ها می‌تواند در آینده به پلتفرم‌ها، ناشران و توسعه‌دهندگان کمک کند منشأ محتوای دیجیتال را با دقت بیشتری بررسی کنند.

از سوی دیگر، پیشرفت واترمارک‌های هوش مصنوعی اهمیت بحث شفافیت در تولید محتوا را افزایش می‌دهد. با افزایش استفاده از مدل‌هایی مانند Claude، ChatGPT و سایر ابزارهای مولد، تشخیص منشأ محتوا احتمالاً به یکی از موضوعات مهم حوزه فناوری، سئو، آموزش و رسانه تبدیل خواهد شد.

برای دنبال کردن تازه‌ترین اخبار، تحلیل‌ها و آموزش‌های مرتبط با هوش مصنوعی، سئو و بازاریابی دیجیتال، به انجمن دیجیتال مارکتینگ مراجعه کنید.

برچسب ها: Claude، Anthropic، تشخیص محتوای AIواترمارک هوش مصنوعی
نوشته قبلی

چگونه بفهمیم حساب‌های هوش مصنوعی ما هک شده‌اند؟ راهنمای بررسی امنیت ChatGPT، Claude و Perplexity

نوشته‌ی بعدی

سئو مخاطب‌محور چیست؟ چگونه با تمرکز بر مخاطب هدف، رتبه گوگل و ترافیک باکیفیت را افزایش دهیم؟

آخرین اخبار

سئو مخاطب‌محور چیست؟ چگونه با تمرکز بر مخاطب هدف، رتبه گوگل و ترافیک باکیفیت را افزایش دهیم؟

سئو مخاطب‌محور چیست؟ چگونه با تمرکز بر مخاطب هدف، رتبه گوگل و ترافیک باکیفیت را افزایش دهیم؟

Anthropic جزئیات واترمارک متن Claude را فاش کرد؛ آیا می‌توان واترمارک هوش مصنوعی را شکست داد؟

Anthropic جزئیات واترمارک متن Claude را فاش کرد؛ آیا می‌توان واترمارک هوش مصنوعی را شکست داد؟

چگونه بفهمیم حساب‌های هوش مصنوعی ما هک شده‌اند؟ راهنمای بررسی امنیت ChatGPT، Claude و Perplexity

چگونه بفهمیم حساب‌های هوش مصنوعی ما هک شده‌اند؟ راهنمای بررسی امنیت ChatGPT، Claude و Perplexity

گوگل سرچ دیگر فقط جست‌وجو نیست؛ تبدیل Google Search به AI Search چه معنایی برای برندها دارد؟

گوگل سرچ دیگر فقط جست‌وجو نیست؛ تبدیل Google Search به AI Search چه معنایی برای برندها دارد؟

۲۳ درصد برندها بدون معرفی جایگزین، پست CMO را حذف می‌کنند؛ چرا حذف مدیر ارشد بازاریابی می‌تواند به برند آسیب بزند؟

۲۳ درصد برندها بدون معرفی جایگزین، پست CMO را حذف می‌کنند؛ چرا حذف مدیر ارشد بازاریابی می‌تواند به برند آسیب بزند؟

گوگل امکان حذف واترمارک قابل مشاهده از تصاویر، ویدئوها و آهنگ‌های تولیدشده با هوش مصنوعی را فراهم کرد

گوگل امکان حذف واترمارک قابل مشاهده از تصاویر، ویدئوها و آهنگ‌های تولیدشده با هوش مصنوعی را فراهم کرد

درباره انجمن دیجیتال مارکتینگ ایران

رسانه يكي از مهمترین ابزارهاي گسترش بصیرت و آگاهی ملی به شمار می رود.
عرفان نیوز منافع ملي، مصالح مردم و باورهاي ايماني جامعه را وظيفه خود مي‌داند و با رويكرد «مردم‌ محور» واقعيت‌هاي اجتماعي را رصد کرده و مطالب مفید را در اختیار کاربران خود قرار میدهد.

موضوعات

  • اخبار
  • اخبار استارتاپ‌ها
  • اخبار اینترنت
  • اخبار بازاریابی ایمیل
  • اخبار بازاریابی محتوا
  • اخبار بازاریابی ویدیو
  • اخبار برندینگ
  • اخبار تکنولوژی
  • اخبار دیجیتال مارکتینگ
  • اخبار سئو
  • اخبار شبکه های اجتماعی
  • اخبار کسب و کار
  • اخبار گوناگون
  • اخبار موتورهای جستجو
  • اخبار هنر
  • اخبار هوش مصنوعی
  • اخبار وب
  • دنیای تبلیغات
  • سایر مقالات
  • مقالات
  • مقالات اینترنت
  • مقالات بازاریابی ایمیل
  • مقالات بازاریابی محتوا
  • مقالات بازاریابی ویدیو
  • مقالات برندینگ
  • مقالات تکنولوژی
  • مقالات دیجیتال مارکتینگ
  • مقالات سئو
  • مقالات شبکه‌های اجتماعی
  • مقالات هوش مصنوعی
  • ویژه خبرها

دنبال کنید

  • درباره انجمن
  • تماس با انجمن

کلیه حقوق مادی و معنوی این سایت متعلق به پایگاه خبری تحلیلی عرفان نیوز است و استفاده از مطالب با ذکر منبع بلامانع است.

بدون نتیجه
مشاهده تمام نتایج
  • خانه
  • دیجیتال مارکتینگ
  • وب
  • سئو
  • برندینگ
  • دنیای تبلیغات
  • تکنولوژی
  • کسب و کار
  • بازاریابی محتوا
  • هنر
  • گوناگون

کلیه حقوق مادی و معنوی این سایت متعلق به پایگاه خبری تحلیلی عرفان نیوز است و استفاده از مطالب با ذکر منبع بلامانع است.