مقدمه: چطور بفهمیم چیزی را هوش مصنوعی ساخته؟
با پیشرفت مدلهای مولد، تشخیص «ساخته انسان» از «ساخته ماشین» سختتر میشود. یک راه حل، واترمارک نامرئی است: امضایی که هنگام تولید در خروجی جاسازی میشود و بعداً با ابزار مناسب قابلتشخیص است.
در ۸ مهر ۱۴۰۵ (۳۰ سپتامبر ۲۰۲۶) گوگل دیپمایند SynthID Bio را معرفی کرد؛ روشی برای واترمارک کردن پروتئینهایی که هوش مصنوعی طراحی میکند. این خبر بهانه خوبی است تا اصل ایده واترمارک را از ابتدا بررسی کنیم.
واترمارک، تشخیص و منشأ؛ سه مفهوم متفاوت
- واترمارک: سیگنالی که سازنده محتوا عمداً درون خروجی میگذارد.
- تشخیص (detection): تلاش برای فهمیدن اینکه آیا محتوا مصنوعی است یا نه، بدون اینکه سازنده سیگنالی گذاشته باشد؛ مثلاً از روی ناهنجاریهای آماری.
- منشأ (provenance): ثبت تاریخچه محتوا: چه کسی ساخته، چه ابزاری، چه ویرایشهایی. استاندارد C2PA برای متادیتای منشأ در همین حوزه است. اینها جانشین هم نیستند و در کنار هم قویترند.
واترمارک متن چطور کار میکند؟
یک ایده شناختهشده در پژوهشها این است: مدل زبانی در هر قدم از میان توکنهای ممکن، یکی را انتخاب میکند. میتوان با یک کلید مخفی انتخاب را کمی به سمت مجموعهای از توکنها متمایل کرد. این انحراف برای خواننده نامحسوس است، اما کسی که کلید را دارد میتواند در متن بلند ببیند توکنهای «ترجیحی» بیشتر از حد تصادف آمدهاند.
برای تصویر و صدا، روشها معمولاً سیگنالی را در پیکسلها یا طیف فرکانسی جاسازی میکنند که با برش، فشردهسازی و تغییر اندازه تا حدی باقی میماند.
محدودیت مهم: واترمارک در متن کوتاه ضعیف است و اگر متن بازنویسی شود میتواند از بین برود.
SynthID Bio: واترمارک برای پروتئین
طبق توضیح گوگل، SynthID Bio واترمارکی نامرئی و قابلراستیآزمایی را در خروجیهای زیستی طراحیشده با هوش مصنوعی، مانند توالی پروتئین و ساختار سهبعدی پیشبینیشده، جاسازی میکند و هدفش حفظ عملکرد زیستی است.
نتایج گزارششده: در آزمایشهای آزمایشگاهی روی چند هدف شامل PD-L1، دامنه اتصال به گیرنده در پروتئین اسپایک SARS-CoV-2 و VEGF-A، توزیع میل ترکیبی (binding affinity) پروتئینهای واترمارکدار تقریباً با نسخههای بدون واترمارک یکی بود. یعنی امضا ظاهراً عملکرد را خراب نکرده است.
هدف نهایی ایجاد یک لایه منشأ برای زیستامنیتی و پایگاههای داده علمی است؛ مثلاً اینکه بتوان ورودیهای مصنوعی را علامت زد.
محدودیتها و برداشتهای غلط
- واترمارک نشاندهنده ایمنی نیست. فقط میگوید منشأ مصنوعی است، نه اینکه محتوا بیخطر است.
- هر واترمارک به آشکارساز مخصوص خودش نیاز دارد. سیگنال یک شرکت را ابزار شرکت دیگر لزوماً نمیبیند.
- حذف عمدی ممکن است. مهاجم مصمم میتواند با بازنویسی یا بازسازی محتوا امضا را تضعیف کند.
- نبودِ واترمارک یعنی انسانی نیست. بسیاری مدلها اصلاً واترمارک نمیگذارند.
- تازه است. SynthID Bio هنوز یک پژوهش تازه است و استحکام آن در برابر حملههای هدفمند باید در عمل سنجیده شود.
جمعبندی
واترمارک یک لایه از دفاع است، نه راهحل کامل. برای کسبوکارها، ترکیب سه چیز منطقیتر است: واترمارک و متادیتای منشأ هنگام تولید، ابزارهای تشخیص هنگام دریافت محتوا، و رویههای انسانی برای موارد مهم. هر جا محتوای مصنوعی تولید میکنید، علامتگذاری شفاف هم یک اعتمادسازی ساده و هم، در بعضی بازارها، یک الزام قانونی است.




