واترمارک متن AI در سال 2026: تفاوت OpenAI، Google و Anthropic در چیست
OpenAI واترمارک متنی ساخت اما هرگز منتشرش نکرد. Google سیستم SynthID را عرضه و متنباز کرد. Anthropic واترمارک Claude را اجباری کرد. هر سیستم چه میکند، چه چیزی را ثابت میکند و برای نوشتار شما چه معنایی دارد.
OpenAI، Google و Anthropic هر سه فناوری یکسانی ساختهاند: واترمارک آماری برای متن تولیدشده با AI. OpenAI هرگز نسخهٔ خود را منتشر نکرد. Google سیستم SynthID را درون Gemini به کار انداخت و روش را بهطور کامل منتشر کرد. Anthropic در اوت 2026 واترمارک Claude را برای هر کاربری در جهان اجباری کرد. اگر به هر شکلی با کمک AI مینویسید، این سه تصمیم اکنون تعیین میکنند اسناد شما چگونه داوری شوند.
واترمارک در 11 اوت 2026 از یک موضوع پژوهشی به خبر اصلی تبدیل شد، وقتی Anthropic اعلام کرد هر مدل جدید Claude خروجی متنی خود را علامتگذاری میکند. آن اعلامیه را در راهنمای واترمارک Claude بهتفصیل بررسی کردیم. این مقاله تصویر کامل را ارائه میدهد: واترمارک متن چیست، هر یک از سه آزمایشگاه بزرگ چگونه آن را پیاده کرد یا نگه داشت، و هر سیستم دربارهٔ یک نوشته چه چیزی را ثابت میکند.
واترمارک متن AI چیست؟
واترمارک متن AI الگویی آماری است پنهان در انتخاب واژههای متن تولیدشده که در همان لحظهٔ تولید کاشته میشود تا آشکارسازی که کلید درست را دارد بتواند بعدها تأیید کند متن از یک سیستم AI مشخص آمده است. نه برچسبی دیدنی است، نه نویسهای پنهان و نه فرادادهای چسبیده به فایل. نشان در خودِ واژهها زندگی میکند.
این تمایز مهم است، چون واژهٔ "واترمارک" سرسری برای سه چیز متفاوت به کار میرود:
| چیستی | جای آن | از کپیپیست جان به در میبرد؟ | |
|---|---|---|---|
| واترمارک آماری | سوگیری در واژههایی که مدل برمیگزیند | در خود متن | بله |
| فرادادهٔ فایل (C2PA) | برچسب منشأ با امضای دیجیتال | در ظرف فایل | نه، کپی متن ساده آن را میزداید |
| نویسههای بیعرض | یونیکد نامرئی جاسازیشده در متن | میان نویسههای دیدنی | نه، بهسادگی پاک میشوند |
از این سه، تنها واترمارک آماری است که از کپی، پیست، بازنویسی در سند تازه و تبدیل قالب جان به در میبرد. به همین دلیل هر سه آزمایشگاه بزرگ برای متن به همین رسیدند، و به همین دلیل "واترمارکپاککنهایی" که نویسههای نامرئی را میروبند در برابرش هیچ کاری از پیش نمیبرند. صفحهٔ پاککنندهٔ رایگان واترمارک Claude ما این شکست را با منابع مستند کرده است.
واترمارک آماری واقعاً چگونه کار میکند؟
در هر گام نوشتن جمله، مدل زبانی میان چند واژهٔ تقریباً همارز انتخاب میکند و واترمارک بیصدا این تاسها را دستکاری میکند. دستور بنیادین را Kirchenbauer و همکارانش در University of Maryland در ژانویهٔ 2023 در A Watermark for Large Language Models (ICML 2023) منتشر کردند. سازوکارش چنین است:
- پیش از انتخاب هر واژه، کلیدی محرمانه که از واژههای قبلی مشتق میشود، واژگان را به مجموعهٔ برگزیده و مجموعهٔ خنثی تقسیم میکند.
- مدل انتخابش را به سمت مجموعهٔ برگزیده متمایل میکند. "suggest" به جای "indicate"، "across" به جای "among". هر انتخاب منفرد کاملاً طبیعی به نظر میرسد.
- آشکارسازی که کلید را دارد میشمارد متن چند بار در مجموعههای برگزیده میافتد. نوشتار انسانی برحسب تصادف به نرخ مورد انتظار میرسد. متن واترمارکدار بسیار بیشتر میرسد و آزمونی آماری این ناسازگاری را نشان میدهد.
هیچ واژهٔ منفردی گواه چیزی نیست. سیگنال تنها در دهها یا صدها انتخاب پدیدار میشود؛ برای همین قطعههای بلند آسانتر از کوتاهها آزموده میشوند و تشخیص همیشه احتمالاتی است، نه مهری از جنس آری یا نه.
سیستم عملیاتی Google DeepMind که اکتبر 2024 در Nature با عنوان Scalable watermarking for identifying large language model outputs منتشر شد، این روش را با تکنیکی به نام نمونهگیری تورنمنتی پالایش کرد؛ تکنیکی که کیفیت متن را چنان نگه میدارد که بتواند بیصدا درون محصولی مصرفی در مقیاس بزرگ اجرا شود. اهمیت این مقاله از Google فراتر میرود: همین مبنای منتشرشده است که Anthropic برای پیادهسازی Claude به آن ارجاع میدهد.
ضعف اصلی پیش از بیشترِ استقرارها منتشر شده بود. در مارس 2023، Krishna و همکاران در Paraphrasing evades detectors of AI-generated text (NeurIPS 2023) نشان دادند بازتولید عبارتبندی یک قطعه، تشخیص را در همهٔ روشها فرو میریزد، واترمارک هم در میانشان. سیگنال تنها در توالی دقیق توکنها زندگی میکند و نه جای دیگر؛ پس هر چیزی که آن توالی را بازنویسی کند، از جمله ویراستار انسانی، مدرک را هم بازنویسی میکند. امروز هر شرکتی که واترمارک عرضه میکند، این محدودیت را در مستندات خودش قید کرده است.
OpenAI: شرکتی که آن را اختراع کرد و هرگز عرضه نکرد
OpenAI سالهاست واترمارک متنی کارآمدی دارد و تاکنون تصمیم گرفته منتشرش نکند. این ایده را نخستین بار Scott Aaronson، که آن زمان در OpenAI روی ایمنی کار میکرد، در سخنرانی نوامبر 2022 علنی کرد: انتخاب مدل میان واژههای تقریباً همارز را با تابعی رمزنگارانه و محرمانه سوگیری بده تا خود متن ثابت کند از کجا آمده است. آن سخنرانی بر همهٔ سیستمهای مستقرشده مقدم است و سند بنیانگذار این حوزه به شمار میرود.
در مهٔ 2024، OpenAI وضعیت پروژه را در گزارش منشأ محتوا، Understanding the source of what we see and hear online، شرح داد. شرکت گفت روش واترمارک متنیاش دقیق است و حتی در برابر ویرایشهای کوچک هم مؤثر، اما تا سبکسنگینکردن ریسکها انتشار را نگه داشته است. دو ریسکی که OpenAI برشمرد مستقیم به نویسندگان دانشگاهی مربوط است:
- دورزدن آسان. بازنویسی یا ترجمهٔ متن نشان را میزداید، درست همانطور که پژوهش 2023 پیشبینی کرده بود. واترمارکی که عمدتاً فقط کسانی را میگیرد که از وجودش بیخبرند، ابزار اجرایی ضعیفی است.
- اثر نامتناسب بر غیربومیزبانهای انگلیسی. OpenAI صریح گفت واترمارک میتواند استفادهٔ مشروع از AI بهعنوان دستیار نوشتن را برای کسانی که به زبان دوم مینویسند بدنام کند. مقالهٔ ما دربارهٔ اینکه چرا آشکارسازهای AI نویسندگان غیربومی را نشان میکنند همین مسئله را از سمت آشکارسازها بررسی میکند.

گزارش منشأ خودِ OpenAI: روش کار میکند و شرکت خودش دلایل منتشرنکردنش را فهرست میکند.
برای تصویر و صدا، OpenAI راه دیگری رفت: فرادادهٔ منشأ C2PA در خروجیهای DALL-E و Sora؛ برچسبی در سطح فایل، نه نشانی درون محتوا. اما متن: تا پایان اوت 2026 خروجی ChatGPT هیچ واترمارکی ندارد. شرکتی که این فناوری را پیشنهاد داد، همچنان تنها عضو این سه است که هرگز مستقرش نکرده است.
Google: نخست مستقر کرد، سپس دستور را بخشید
Google DeepMind نخست مستقر کرد، کامل منتشر کرد و سپس روش را گشود. سیستم آن، SynthID، در 2023 بهصورت واترمارک تصویر آغاز شد و در 2024 به متن گسترش یافت. وقتی مقالهٔ Nature در اکتبر 2024 درآمد، SynthID-Text از قبل در محیط عملیاتی درون Gemini کار میکرد و به نخستین واترمارک متنی آماری مستقرشده در مقیاس مصرفی بدل شد.

SynthID متن، تصویر، صدا و ویدئو را پوشش میدهد و از اکتبر 2024 در خروجی متنی Gemini فعال است.
سپس Google پیادهسازی را بهصورت متنباز روی Hugging Face منتشر کرد تا هر توسعهدهندهای بتواند همان طرح واترمارک را روی مدلهای خودش اعمال کند. در مهٔ 2025 نیز SynthID Detector را معرفی کرد؛ درگاهی برای راستیآزمایی که در آن میتوان محتوا را از نظر نشانهای SynthID در متن، تصویر، صدا و ویدئو بررسی کرد.
یک محدودیت دامنه اهمیت دارد: SynthID فقط محتوای مدلهای خود Google را علامت میزند و فقط همان را مییابد. دربارهٔ خروجی ChatGPT یا Claude هیچ نمیگوید و اسکن پاک SynthID به این معنا نیست که متن را انسان نوشته است. تنها یعنی مدلهای Google آن را ننوشتهاند؛ ادعایی بسیار محدودتر.
Anthropic: دیرتر از همه جنبید، سختگیرترین سیاست
Anthropic دیرتر از همه مستقر کرد و اجباریترین پوشش را گذاشت. هر مدل Claude که از 2 اوت 2026 به بعد عرضه شود، واترمارکی آماری در خروجی متنیاش جاسازی میکند؛ در سراسر جهان، در همهٔ پلنها، بدون هیچ گزینهٔ انصراف. شرکت سازوکار را در مقالهٔ توضیحی How Claude's text watermark works و دامنهٔ سیاست را در مقالهٔ مرکز راهنمایی How Claude marks AI-generated content شرح داده است: Claude API، claude.ai، Claude Code، Claude Cowork و Claude Tag همگی مشمولاند. مدلهای پیش از تاریخ برش در دورهٔ گذارند و Anthropic میگوید علامتگذاری را به آنها هم میافزاید. در کنار نشان آماری، فایلهای تولیدی Claude فرادادهٔ C2PA نیز دارند؛ سیستم دومی جداگانه که کپی متن ساده آن را میزداید.

سیاست با واژههای خود Anthropic: هر مدل تازه، هر سکو، سراسر جهان، و مدلهای قدیمی هم در حال افزودهشدناند.
مستندات Anthropic حدها را بیپرده میگوید. تشخیص احتمالاتی است. نشان نمیتواند سندی را که Claude نوشته از سندی که انسان نوشته و Claude اندکی ویراسته تمیز دهد. بازنویسی کامل آن را میزداید. همهٔ اینها، از جمله اینکه تشخیص مثبت واقعاً چه چیزی را ثابت میکند و اگر نوشتهٔ خودتان علامت خورد چه کنید، در راهنمای ویژهٔ واترمارک Claude آمده است.
زمانبندی از مقررات پیروی میکند. Anthropic آییننامهٔ عملی شفافیت محتوای تولیدشده با AI ذیل مادهٔ 50(2) EU AI Act را امضا کرده است؛ مادهای که از ارائهدهندگان سیستمهای AI مولد میخواهد خروجیها "در قالبی ماشینخوان علامتگذاری و بهعنوان تولید مصنوعی قابلتشخیص" باشند. این تکالیف شفافیت از 2 اوت 2026 لازمالاجرا شد: دقیقاً همان تاریخ برش سیاست مدلهای Anthropic، نه روز پیش از اعلان عمومی. Anthropic به جای رفتار جداگانه برای ترافیک EU، پیروی جهانی را برگزید. Google از همان طراحی سازگار بود. خروجی متنی بینشان OpenAI پرسش باز انطباق برای 2027 است.
سه رویکرد، کنار هم
| OpenAI | Google DeepMind | Anthropic | |
|---|---|---|---|
| واترمارک متن مستقر شده؟ | نه | بله (Gemini، از اکتبر 2024) | بله (مدلهای Claude از 2 اوت 2026) |
| تکنیک | سوگیری نمونهگیری رمزنگارانه (ساخته، منتشرنشده) | نمونهگیری تورنمنتی SynthID-Text | نشان نمونهگیری آماری به سبک SynthID |
| پوشش | برای متن هیچ | فقط مدلهای Google | همهٔ مدلهای تازهٔ Claude؛ قدیمیها در گذار |
| انصراف | موضوعیت ندارد | نه | نه |
| آشکارساز عمومی | نه | درگاه SynthID Detector (2025) | در برنامه، هنوز منتشرنشده |
| طرح منتشر شده؟ | فقط سخنرانیهای مفهومی | مقالهٔ Nature + متنباز | مقالهٔ توضیحی مبتنی بر پژوهش منتشرشده |
| فرادادهٔ فایل (C2PA) | بله، تصویر و صدا | بله، در همهٔ رسانهها | بله، روی فایلهای تولیدی |
| حدود اعلامشده | دورزدن، انگ ESL | دامنه محدود به مدلهای خودی | احتمالاتی؛ ویرایشها مؤلف را مبهم میکنند |
الگوی ستونها چنین است: OpenAI واترمارک متن را مسئلهای سیاستی حلنشده میبیند، Google آن را زیرساختی برای استانداردسازی، و Anthropic تکلیفی انطباقی که باید تماموکمال اجرا شود.
این برای پژوهشگران و نویسندگان دانشگاهی چه معنایی دارد
پیامدهای عملی یکسره بسته به این است که کدام ابزارها به متن شما دست میزنند. اگر با ChatGPT پیشنویس میزنید، متن شما امروز واترمارک ندارد. اگر با Gemini پیشنویس میزنید، نشانی از SynthID دارد که فقط آشکارساز Google میخواندش. اگر با مدل فعلی Claude پیشنویس یا ویرایش میکنید، نشان Anthropic را دارد و هیچ تنظیمی خاموشش نمیکند.
سه نکته که نویسندهٔ دانشگاهی باید بداند:
واترمارک ابزار را شناسایی میکند، نه مؤلف را. هر شرکت در مستندات خودش همین را میگوید و تکرارش لازم است، چون سیاستهای نهادها همیشه این تمایز را نمیگذارند. متن شاید علامت خورده باشد چون AI پیشنویسش کرده، چون AI دو جملهاش را ویراسته، یا چون بندی علامتدار در آن نقل شده است. اگر نهاد شما آزمون واترمارک اجرا میکند، آنچه ثابت میشود فقط این است که مدلی مشخص در لحظهای متن را لمس کرده، نه بیشتر. راهنمای ما دربارهٔ اعتراض به پرچم نادرست تشخیص AI نشان میدهد در صورت نیاز این استدلال را چگونه مطرح کنید.
واترمارک و آشکارساز AI دو فناوری متفاوت با خطاهای متفاوتاند. آشکارسازهایی مانند Turnitin یا GPTZero از سبک آماری حدس میزنند، با مشکلات دقتی که مستند کردهایم. تشخیص واترمارک آزمونی کلیدمحور است با نرخ مثبت کاذب بسیار پایین روی متن انسانی بینشان. عدمتقارن در منفی کاذب وارونه میشود: آزمون واترمارک هیچ متن AI برآمده از مدلی که علامت نمیزند را نمیگیرد؛ و این امروز تمام ChatGPT را در بر میگیرد.
افشا همچنان محکمترین موضع شماست. واترمارک استفادهٔ پنهانی از AI را پرریسکتر و استفادهٔ اعلامشده را امنتر میکند، چون جریان کاری اعلامشده از نشان مثبت هیچ هراسی ندارد. بیشتر مجلهها و دانشگاهها اکنون سیاست صریح استفاده از AI دارند؛ سیاست استفاده از AI ما توضیح میدهد این خطوط را در ابزارهای خودمان چگونه میکشیم و الگویی معقول از استفادهٔ شفاف است.
چه چیزی واترمارک متن را میزداید و چه چیزی نه
بازنویسی میزداید؛ تغییر قالب نه. کپی، پیست، عوضکردن فونت، تبدیل قالب فایل و روبیدن نویسههای نامرئی همگی واترمارک آماری را دستنخورده میگذارند، چون نشان در انتخاب واژههاست. آنچه میزدایدش هر چیزی است که عبارتبندی را از نو بسازد: ویرایش عمیق انسانی، ترجمه یا بازنویسی واقعی؛ همانطور که پژوهش استواری NeurIPS 2023 پیش از راهافتادن این سیستمها نشان داده بود.
هر دو سو اینجا مهماند. ناپدیدشدن نشان متن را از آن شما نمیکند و ماندنش هم آن را غیر از آن شما نمیکند. پیشنویس بازنویسیشدهٔ AI همچنان سندی است با کمک AI که قواعد افشای نهاد شما بر آن جاری است. AI text humanizer ما پیشنویسهای AI-یار را به لحنی دانشگاهی و طبیعی بازمینویسد و چون این فرایند توالی توکنها را از نو میسازد، نشانهای آماری از آن جان به در نمیبرند. برای متن Claude بهطور خاص، پاککنندهٔ رایگان واترمارک Claude هر جمله را با عبارتبندی تازه بیان میکند و واقعیتها، اعداد و ارجاعها را دستنخورده نگه میدارد. آنچه هیچ ابزاری تغییرش نمیدهد دِین شما به خواننده است: شفافیت دربارهٔ چگونگی ساختهشدن سند.

بازنویسی تنها عملیاتی است که نشان آماری را میزداید و این ابزار دقیقاً همین را جمله به جمله انجام میدهد.
این ماجرا به کجا میرود
تا 2027 سه چیز را زیر نظر بگیرید. نخست، آیا OpenAI منتشر میکند: اجرای مادهٔ 50 از سوی EU موضع "ساخته اما منتشرنشده" را برای متن روزبهروز گرانتر میکند. دوم، آیا آزمونها همگرا میشوند: جهانی که در آن هر آزمایشگاه بزرگ با طرحی منتشرشده علامت میزند، جهانی است که دانشگاهها بهجای حدس از روی سبک، کلیدها را میآزمایند؛ بهبودی واقعی نسبت به تشخیص پرخطای مثبت کاذب امروز. سوم، آیا همکارپذیری از راه میرسد: امروز سه آزمایشگاه یعنی سه نشان ناسازگار و هیچ آزمون همگانی. C2PA این شکاف را برای فایلها پر میکند؛ برای متن خام هنوز هیچچیز پرش نمیکند.
آیا ChatGPT متنش را واترمارک میکند؟
نه. تا اوت 2026، OpenAI روش واترمارک متنی ساخته اما مستقر نکرده است؛ موضعی که شرکت در گزارش منشأ مهٔ 2024 توضیح داد. خروجی متنی ChatGPT نه نشان آماری دارد و نه نویسهٔ پنهان. OpenAI روی فایلهای رسانهای DALL-E و Sora فرادادهٔ منشأ C2PA میگذارد که سیستمی جداگانه در سطح فایل است.
آیا Google Gemini متنش را واترمارک میکند؟
بله. خروجی Gemini از اکتبر 2024 واترمارک SynthID-Text ساخت Google DeepMind را دارد. نشانی آماری در انتخاب واژهها، نامرئی برای خواننده و قابلبررسی با SynthID Detector گوگل. فقط بر مدلهای خود Google اعمال میشود؛ پس نتیجهٔ منفی SynthID دربارهٔ متن سیستمهای AI دیگر هیچ نمیگوید.
آیا Claude متنش را واترمارک میکند؟
بله. هر مدل Claude عرضهشده از 2 اوت 2026 به بعد در خروجی متنیاش نشان آماری جاسازی میکند؛ در همهٔ سکوها و پلنها، بدون انصراف، و فایلهای تولیدی Claude افزون بر آن فرادادهٔ C2PA دارند. مدلهای پیش از آن تاریخ هنوز خروجی را علامت نمیزنند؛ Anthropic میگوید در دورهٔ گذار به آنها هم میافزاید. جزئیات کامل در راهنمای واترمارک Claude ماست.
آیا دانشگاهها میتوانند واترمارک AI را تشخیص دهند؟
فقط با همکاری سازنده، چون تشخیص کلید او را میخواهد. Google برای محتوای SynthID درگاه عمومی تشخیص دارد. Anthropic میگوید پشتیبانی از تشخیص برای کاربران و اشخاص ثالث در برنامه است اما هنوز آشکارساز عمومی نداده است. هیچ بستهٔ رایج ضدسرقت ادبی فعلاً نشان آماری هیچ آزمایشگاهی را راستیآزمایی نمیکند؛ پس "تشخیص AI" نهادی امروز همچنان حدس سبکی است، نه راستیآزمایی واترمارک.
آیا قانون واترمارک AI را الزامی کرده است؟
در EU عملاً بله. مادهٔ 50(2) EU AI Act از ارائهدهندگان AI مولد میخواهد خروجیها در قالبی ماشینخوان علامت بخورند و بهعنوان تولید مصنوعی قابلتشخیص باشند و تکالیف شفافیت از 2 اوت 2026 جاری است. Anthropic آییننامهٔ مرتبط را امضا و پیروی جهانی را انتخاب کرد. اینکه ناظران با واترمارک متنی منتشرنشدهٔ OpenAI چه میکنند، پرسشی است که در 2027 باید پایید.
آیا واترمارک AI از ترجمه جان به در میبرد؟
نه. واترمارک آماری در توالی دقیق واژههایی زندگی میکند که مدل برگزیده و ترجمه هر واژه را عوض میکند. بازنویسی عمیق و ویرایش سنگین انسانی هم همینطورند. این محدودیت در متون داوریشده مستند است و هر شرکتی که واترمارک عرضه میکند آن را میپذیرد.
منابع
- Anthropic, How Claude's text watermark works, اوت 2026
- مرکز راهنمای Anthropic, How Claude marks AI-generated content, 2026
- OpenAI, Understanding the source of what we see and hear online, مه 2024
- Google DeepMind, SynthID
- Dathathri et al., Scalable watermarking for identifying large language model outputs, Nature, اکتبر 2024
- Google, SynthID Detector announcement, مه 2025
- Hugging Face, Introducing SynthID Text, اکتبر 2024
- Kirchenbauer et al., A Watermark for Large Language Models, ICML 2023
- Krishna et al., Paraphrasing evades detectors of AI-generated text, NeurIPS 2023
- Scott Aaronson, My AI Safety Lecture for UT Effective Altruism, نوامبر 2022
- European Union, AI Act, Article 50
- C2PA, Coalition for Content Provenance and Authenticity

دانا یک تولید کننده محتوا در ProofreaderPro است، جایی که او وبلاگ روزانه و عملیات نوشتن را اداره می کند. او مقالاتی را در مورد نحوه عملکرد پلتفرم ویرایش آنلاین می نویسد و هر روز با پیام های مشتری رسیدگی می کند و امتیاز رضایت پنج ستاره را نشان می دهد.