AI टेक्स्ट वॉटरमार्किंग 2026: OpenAI, Google और Anthropic में क्या अंतर है
OpenAI ने टेक्स्ट वॉटरमार्क बनाया लेकिन कभी जारी नहीं किया। Google ने SynthID जारी करके उसे ओपन सोर्स कर दिया। Anthropic ने Claude का वॉटरमार्क अनिवार्य बना दिया। हर सिस्टम क्या करता है, क्या साबित करता है, और आपके लेखन के लिए इसका क्या अर्थ है।
OpenAI, Google और Anthropic, तीनों ने एक ही तकनीक बनाई है: AI-जनित टेक्स्ट के लिए एक सांख्यिकीय वॉटरमार्क। OpenAI ने अपना संस्करण कभी जारी नहीं किया। Google ने SynthID को Gemini के अंदर लागू किया और पूरी विधि प्रकाशित कर दी। Anthropic ने अगस्त 2026 में Claude के वॉटरमार्क को दुनिया के हर उपयोगकर्ता के लिए अनिवार्य बना दिया। यदि आप किसी भी रूप में AI की सहायता से लिखते हैं, तो ये तीनों निर्णय अब यह तय करते हैं कि आपके दस्तावेज़ों को कैसे परखा जाएगा।
वॉटरमार्किंग 11 अगस्त, 2026 को एक शोध विषय से मुख्यधारा की खबर बन गई, जब Anthropic ने घोषणा की कि हर नया Claude मॉडल अपने टेक्स्ट आउटपुट को मार्क करता है। उस घोषणा को हमने अपने Claude वॉटरमार्क गाइड में विस्तार से कवर किया है। यह लेख पूरी तस्वीर प्रस्तुत करता है: टेक्स्ट वॉटरमार्क क्या है, तीनों प्रमुख AI कंपनियों ने इसे कैसे लागू किया या रोके रखा, और हर सिस्टम किसी लेख के बारे में क्या साबित करता है।
AI टेक्स्ट वॉटरमार्क क्या है?
AI टेक्स्ट वॉटरमार्क जनित टेक्स्ट के शब्द चयन में छिपा एक सांख्यिकीय पैटर्न है, जो जनरेशन के क्षण में ही डाला जाता है, ताकि सही कुंजी रखने वाला डिटेक्टर बाद में सत्यापित कर सके कि टेक्स्ट किसी विशेष AI सिस्टम से आया है। यह कोई दिखने वाला लेबल नहीं है, कोई छिपा हुआ कैरेक्टर नहीं है, और न ही फ़ाइल से जुड़ा मेटाडेटा है। यह चिह्न शब्दों के भीतर ही रहता है।
यह भेद महत्वपूर्ण है, क्योंकि "वॉटरमार्क" शब्द तीन अलग-अलग चीज़ों के लिए ढीले ढंग से इस्तेमाल होता है:
| यह क्या है | यह कहाँ रहता है | कॉपी-पेस्ट में बचता है? | |
|---|---|---|---|
| सांख्यिकीय वॉटरमार्क | मॉडल कौन से शब्द चुनता है, उसमें एक झुकाव | स्वयं टेक्स्ट में | हाँ |
| फ़ाइल मेटाडेटा (C2PA) | एक हस्ताक्षरित प्रोविनेंस लेबल | फ़ाइल कंटेनर में | नहीं, सादे टेक्स्ट की कॉपी इसे हटा देती है |
| ज़ीरो-विड्थ कैरेक्टर | टेक्स्ट में डाले गए अदृश्य Unicode | दिखने वाले अक्षरों के बीच | नहीं, आसानी से हटाए जाते हैं |
तीनों में से केवल सांख्यिकीय वॉटरमार्किंग ही कॉपी, पेस्ट, नए दस्तावेज़ में दोबारा टाइप करने और फ़ॉर्मेट बदलने के बाद भी बची रहती है। इसीलिए तीनों प्रमुख कंपनियों ने टेक्स्ट के लिए यही तरीका अपनाया, और इसीलिए अदृश्य कैरेक्टर हटाने वाले "वॉटरमार्क रिमूवर" इसके सामने कुछ नहीं कर पाते। हमारा निःशुल्क Claude वॉटरमार्क रिमूवर पृष्ठ इस विफलता को स्रोतों सहित प्रलेखित करता है।
सांख्यिकीय वॉटरमार्किंग वास्तव में कैसे काम करती है?
वाक्य लिखने के हर चरण पर भाषा मॉडल कई लगभग समान शब्दों में से चुनाव करता है, और वॉटरमार्क चुपचाप उस चुनाव को प्रभावित करता है। इसकी बुनियादी विधि जनवरी 2023 में University of Maryland के Kirchenbauer और सहयोगियों ने A Watermark for Large Language Models (ICML 2023) में प्रकाशित की। यह इस तरह काम करती है:
- हर शब्द चुने जाने से पहले, पिछले शब्दों से व्युत्पन्न एक गुप्त कुंजी शब्दावली को एक पसंदीदा समूह और एक तटस्थ समूह में बाँटती है।
- मॉडल अपने चुनाव को पसंदीदा समूह की ओर झुकाता है। "indicate" के बजाय "suggest"। "among" के बजाय "across"। हर व्यक्तिगत चुनाव पूरी तरह स्वाभाविक दिखता है।
- कुंजी रखने वाला डिटेक्टर गिनता है कि टेक्स्ट कितनी बार पसंदीदा समूहों में पड़ता है। मानव लेखन संयोगवश अपेक्षित दर पर पहुँचता है। वॉटरमार्क वाला टेक्स्ट उससे कहीं अधिक बार पहुँचता है, और एक सांख्यिकीय परीक्षण इस विसंगति को पकड़ लेता है।
कोई एक शब्द किसी बात का प्रमाण नहीं है। संकेत दर्जनों या सैकड़ों चुनावों में ही उभरता है, इसीलिए लंबे अंशों की जाँच छोटे अंशों से आसान होती है, और इसीलिए डिटेक्शन हमेशा संभाव्य होता है, हाँ/नहीं की मुहर नहीं।
Google DeepMind का प्रोडक्शन सिस्टम, जो अक्टूबर 2024 में Nature में Scalable watermarking for identifying large language model outputs के रूप में प्रकाशित हुआ, इसे टूर्नामेंट सैंपलिंग नामक तकनीक से परिष्कृत करता है, जो टेक्स्ट की गुणवत्ता इतनी अच्छी बनाए रखती है कि यह उपभोक्ता उत्पाद के अंदर बड़े पैमाने पर चुपचाप चल सके। यह पेपर Google से आगे भी महत्वपूर्ण है: यही वह प्रकाशित आधार है जिसका उल्लेख Anthropic Claude के कार्यान्वयन के लिए करता है।
मुख्य कमज़ोरी अधिकांश तैनातियों से पहले ही प्रकाशित हो चुकी थी। मार्च 2023 में Krishna और सहयोगियों ने Paraphrasing evades detectors of AI-generated text (NeurIPS 2023) में दिखाया कि किसी अंश के शब्दों को दोबारा लिखने से हर विधि का डिटेक्शन ढह जाता है, वॉटरमार्किंग सहित। संकेत केवल टोकन के सटीक क्रम में रहता है, इसलिए जो भी उस क्रम को दोबारा लिखता है, मानव संपादक भी, वह प्रमाण को भी मिटा देता है। आज वॉटरमार्क लागू करने वाली हर कंपनी अपनी दस्तावेज़ीकरण में यह सीमा स्वयं बताती है।
OpenAI: जिसने इसे बनाया लेकिन कभी जारी नहीं किया
OpenAI के पास वर्षों से काम करता हुआ टेक्स्ट वॉटरमार्क है और उसने अब तक इसे जारी न करने का निर्णय लिया है। यह विचार सबसे पहले सार्वजनिक रूप से Scott Aaronson ने रखा, जो तब OpenAI में सुरक्षा पर काम कर रहे थे, एक नवंबर 2022 के व्याख्यान में: लगभग समान शब्दों में मॉडल के चुनाव को एक गुप्त क्रिप्टोग्राफ़िक फ़ंक्शन से झुकाओ, ताकि टेक्स्ट स्वयं सिद्ध करे कि वह कहाँ से आया। वह व्याख्यान हर तैनात सिस्टम से पहले का है और इस क्षेत्र का संस्थापक दस्तावेज़ है।
मई 2024 में OpenAI ने अपने प्रोविनेंस अपडेट Understanding the source of what we see and hear online में परियोजना की स्थिति बताई। कंपनी ने कहा कि उसकी टेक्स्ट वॉटरमार्किंग विधि सटीक है और छोटे संपादनों के विरुद्ध प्रभावी भी, लेकिन वह जोखिमों का आकलन करते हुए रिलीज़ रोके हुए है। OpenAI ने जो जोखिम गिनाए, उनमें से दो अकादमिक लेखकों के लिए सीधे महत्वपूर्ण हैं:
- आसान बाईपास। टेक्स्ट का पैराफ़्रेज़ या अनुवाद चिह्न को हटा देता है, ठीक जैसा 2023 के शोध ने पहले ही बताया था। जो वॉटरमार्क ज़्यादातर उन्हीं लोगों को पकड़ता है जो उसके अस्तित्व से अनजान हैं, वह प्रवर्तन का कमज़ोर साधन है।
- गैर-देशी अंग्रेज़ी लेखकों पर असमान प्रभाव। OpenAI ने कहा कि वॉटरमार्किंग दूसरी भाषा में लिखने वालों के लिए AI को लेखन-सहायक के रूप में इस्तेमाल करने के वैध उपयोग को कलंकित कर सकती है। हमारा लेख AI डिटेक्टर गैर-देशी लेखकों को क्यों फ़्लैग करते हैं इसी समस्या को डिटेक्टर की ओर से देखता है।

OpenAI का अपना प्रोविनेंस अपडेट: विधि काम करती है, और कंपनी स्वयं वे कारण गिनाती है जिनके चलते उसने इसे जारी नहीं किया।
छवियों और ऑडियो के लिए OpenAI ने अलग रास्ता चुना: DALL-E और Sora के आउटपुट में C2PA प्रोविनेंस मेटाडेटा, जो सामग्री के भीतर का चिह्न नहीं बल्कि फ़ाइल-स्तर का लेबल है। टेक्स्ट के लिए, अगस्त 2026 के अंत तक, ChatGPT के आउटपुट में कोई वॉटरमार्क नहीं है। जिस कंपनी ने यह तकनीक प्रस्तावित की, वही तीनों में अकेली है जिसने इसे कभी तैनात नहीं किया।
Google: पहले लागू किया, फिर पूरी विधि बाँट दी
Google DeepMind ने सबसे पहले लागू किया, पूरा प्रकाशित किया, फिर विधि खोल दी। उसका सिस्टम SynthID 2023 में छवि वॉटरमार्क के रूप में शुरू हुआ और 2024 में टेक्स्ट तक विस्तृत हुआ। अक्टूबर 2024 में Nature पेपर आने तक SynthID-Text पहले से ही Gemini के अंदर प्रोडक्शन में चल रहा था, जिससे यह उपभोक्ता पैमाने पर तैनात पहला सांख्यिकीय टेक्स्ट वॉटरमार्क बना।

SynthID टेक्स्ट, छवि, ऑडियो और वीडियो को कवर करता है, और अक्टूबर 2024 से Gemini के टेक्स्ट आउटपुट में सक्रिय है।
इसके बाद Google ने कार्यान्वयन को Hugging Face पर ओपन सोर्स के रूप में प्रकाशित किया, ताकि कोई भी डेवलपर वही वॉटरमार्किंग योजना अपने मॉडलों पर लागू कर सके। मई 2025 में उसने SynthID Detector की घोषणा की, एक सत्यापन पोर्टल जहाँ टेक्स्ट, छवि, ऑडियो और वीडियो में SynthID चिह्नों की जाँच की जा सकती है।
एक सीमा महत्वपूर्ण है: SynthID केवल Google के अपने मॉडलों की सामग्री को मार्क और डिटेक्ट करता है। वह ChatGPT या Claude के आउटपुट के बारे में कुछ नहीं कहता, और साफ़ SynthID स्कैन का अर्थ यह नहीं कि टेक्स्ट मानव-लिखित है। उसका अर्थ केवल इतना है कि Google के मॉडलों ने उसे नहीं लिखा, जो कहीं संकरा दावा है।
Anthropic: सबसे बाद में आया, सबसे सख़्त नीति
Anthropic ने सबसे देर से तैनाती की, और अनिवार्य दायरा सबसे चौड़ा रखा। 2 अगस्त, 2026 को या उसके बाद लॉन्च हुआ हर Claude मॉडल अपने टेक्स्ट आउटपुट में सांख्यिकीय वॉटरमार्क जोड़ता है, दुनिया भर में, हर प्लान पर, बिना किसी ऑप्ट-आउट के। कंपनी तंत्र को अपने व्याख्याता लेख How Claude's text watermark works में और नीति का दायरा हेल्प-सेंटर लेख How Claude marks AI-generated content में बताती है: Claude API, claude.ai, Claude Code, Claude Cowork और Claude Tag, सब इसके दायरे में हैं। कटऑफ़ से पहले लॉन्च हुए मॉडल संक्रमण अवधि में हैं, और Anthropic का कहना है कि वह उनमें भी मार्किंग जोड़ रहा है। सांख्यिकीय चिह्न के साथ-साथ Claude-जनित फ़ाइलों में C2PA मेटाडेटा भी होता है, एक दूसरा, अलग सिस्टम जिसे सादे टेक्स्ट की कॉपी हटा देती है।

नीति Anthropic के अपने शब्दों में: हर नया मॉडल, हर प्लैटफ़ॉर्म, दुनिया भर में, और पुराने मॉडल भी जोड़े जा रहे हैं।
Anthropic का दस्तावेज़ीकरण सीमाएँ सीधे बताता है। डिटेक्शन संभाव्य है। चिह्न यह भेद नहीं कर सकता कि दस्तावेज़ Claude ने लिखा या मानव ने लिखा और Claude ने हल्का संपादन किया। पूर्ण पुनर्लेखन उसे हटा देता है। यह सब, जिसमें यह भी शामिल है कि सकारात्मक डिटेक्शन वास्तव में क्या साबित करता है और आपके अपने लेखन के मार्क होने पर क्या करना चाहिए, हमने समर्पित Claude वॉटरमार्क गाइड में समझाया है।
समय नियमन का अनुसरण करता है। Anthropic ने EU AI Act के तहत Article 50(2) के Code of Practice on Transparency of AI-Generated Content पर हस्ताक्षर किए हैं, जो जनरेटिव AI सिस्टम प्रदाताओं से अपेक्षा करता है कि आउटपुट "मशीन-पठनीय प्रारूप में मार्क हों और कृत्रिम रूप से जनित के रूप में पहचाने जा सकें।" ये पारदर्शिता दायित्व 2 अगस्त, 2026 से लागू हुए: Anthropic की मॉडल नीति की ठीक वही कटऑफ़ तारीख़, सार्वजनिक घोषणा से नौ दिन पहले। Anthropic ने EU ट्रैफ़िक के लिए अलग व्यवहार रखने के बजाय वैश्विक अनुपालन चुना। Google पहले से ही डिज़ाइन के स्तर पर अनुपालन में था। OpenAI का बिना चिह्न वाला टेक्स्ट आउटपुट 2027 का खुला अनुपालन प्रश्न है।
तीनों दृष्टिकोण, आमने-सामने
| OpenAI | Google DeepMind | Anthropic | |
|---|---|---|---|
| टेक्स्ट वॉटरमार्क तैनात? | नहीं | हाँ (Gemini, अक्टूबर 2024 से) | हाँ (2 अगस्त, 2026 से Claude मॉडल) |
| तकनीक | क्रिप्टोग्राफ़िक सैंपलिंग झुकाव (बना, अप्रकाशित) | SynthID-Text टूर्नामेंट सैंपलिंग | सांख्यिकीय सैंपलिंग चिह्न, SynthID-शैली |
| दायरा | टेक्स्ट के लिए कुछ नहीं | केवल Google के मॉडल | सभी नए Claude मॉडल; पुराने संक्रमण में |
| ऑप्ट-आउट | लागू नहीं | नहीं | नहीं |
| सार्वजनिक डिटेक्टर | नहीं | SynthID Detector पोर्टल (2025) | योजना में, अभी जारी नहीं |
| योजना प्रकाशित? | केवल अवधारणा व्याख्यान | Nature पेपर + ओपन सोर्स | व्याख्याता लेख, प्रकाशित शोध पर आधारित |
| फ़ाइल मेटाडेटा (C2PA) | हाँ, छवि और ऑडियो | हाँ, सभी माध्यमों में | हाँ, जनित फ़ाइलों पर |
| बताई गई सीमाएँ | बाईपास, ESL कलंक | दायरा अपने मॉडलों तक सीमित | संभाव्य, संपादन लेखकत्व धुँधलाते हैं |
स्तंभों का पैटर्न यह है: OpenAI टेक्स्ट वॉटरमार्किंग को एक अनसुलझी नीति-समस्या मानता है, Google उसे मानकीकृत करने योग्य बुनियादी ढाँचा मानता है, और Anthropic उसे पूरी तरह लागू करने योग्य अनुपालन दायित्व मानता है।
शोधकर्ताओं और अकादमिक लेखकों के लिए इसका क्या अर्थ है
व्यावहारिक परिणाम इस पर निर्भर करते हैं कि आपके टेक्स्ट को कौन से टूल छूते हैं। यदि आप ChatGPT से ड्राफ़्ट करते हैं, तो आज आपके टेक्स्ट में कोई वॉटरमार्क नहीं है। यदि आप Gemini से ड्राफ़्ट करते हैं, तो उसमें SynthID चिह्न है जिसे केवल Google का डिटेक्टर पढ़ सकता है। यदि आप किसी वर्तमान Claude मॉडल से ड्राफ़्ट या संपादन करते हैं, तो उसमें Anthropic का चिह्न है, और कोई सेटिंग उसे बंद नहीं करती।
अकादमिक लेखकों के लिए तीन बातें:
वॉटरमार्क टूल की पहचान करता है, लेखक की नहीं। हर कंपनी अपनी दस्तावेज़ीकरण में यही कहती है, और इसे दोहराना ज़रूरी है क्योंकि संस्थागत नीतियाँ हमेशा यह भेद नहीं करतीं। टेक्स्ट इसलिए मार्क हो सकता है कि AI ने उसे ड्राफ़्ट किया, इसलिए कि AI ने उसके दो वाक्यों का संपादन किया, या इसलिए कि कोई मार्क किया हुआ अनुच्छेद उद्धृत हुआ। यदि आपका संस्थान वॉटरमार्क जाँच चलाता है, तो जाँच केवल इतना साबित करती है कि किसी बिंदु पर एक विशेष मॉडल ने टेक्स्ट को छुआ, इससे अधिक कुछ नहीं। झूठे AI डिटेक्शन फ़्लैग की अपील पर हमारा गाइड बताता है कि ज़रूरत पड़ने पर यह तर्क कैसे रखा जाए।
वॉटरमार्क और AI डिटेक्टर अलग-अलग तकनीकें हैं, जिनकी विफलताएँ भी अलग हैं। Turnitin या GPTZero जैसे डिटेक्टर सांख्यिकीय शैली से अनुमान लगाते हैं, जिनकी सटीकता की समस्याएँ हमने प्रलेखित की हैं। वॉटरमार्क डिटेक्शन कुंजी-आधारित परीक्षण है, जिसकी बिना चिह्न वाले मानव टेक्स्ट पर झूठी-सकारात्मक दर बहुत कम है। असंतुलन झूठे-नकारात्मक में पलट जाता है: वॉटरमार्क जाँच किसी भी ऐसे AI टेक्स्ट को नहीं पकड़ती जो वॉटरमार्क न करने वाले मॉडल से आया हो, जिसमें आज पूरा ChatGPT शामिल है।
प्रकटीकरण आपकी सबसे मज़बूत स्थिति बनी हुई है। वॉटरमार्किंग चुपचाप AI उपयोग को जोखिमभरा और घोषित AI उपयोग को सुरक्षित बनाती है, क्योंकि घोषित वर्कफ़्लो को सकारात्मक चिह्न से कोई डर नहीं। अधिकांश जर्नलों और विश्वविद्यालयों के पास अब स्पष्ट AI-उपयोग नीतियाँ हैं; हमारी AI उपयोग नीति बताती है कि हम अपने टूल्स में ये रेखाएँ कैसे खींचते हैं, और पारदर्शी उपयोग कैसा दिखता है इसका यह एक उचित नमूना है।
टेक्स्ट वॉटरमार्क क्या हटाता है, और क्या नहीं
पुनर्लेखन उसे हटाता है; फ़ॉर्मेटिंग नहीं। कॉपी, पेस्ट, फ़ॉन्ट बदलना, फ़ाइल फ़ॉर्मेट बदलना और अदृश्य कैरेक्टर हटाना, ये सब सांख्यिकीय वॉटरमार्क को पूरी तरह अक्षुण्ण छोड़ते हैं, क्योंकि चिह्न शब्द चयन में है। उसे वही हटाता है जो शब्दों को दोबारा जनित करता है: गहरा मानवीय संपादन, अनुवाद, या वास्तविक पैराफ़्रेज़, जैसा NeurIPS 2023 के शोध ने इन सिस्टमों के आने से पहले ही स्थापित कर दिया था।
यहाँ दोनों दिशाएँ महत्वपूर्ण हैं। चिह्न का मिट जाना टेक्स्ट को आपका नहीं बना देता, और चिह्न का बचा रहना टेक्स्ट को गैर-आपका नहीं बना देता। दोबारा लिखा गया AI ड्राफ़्ट अब भी AI-सहायता प्राप्त दस्तावेज़ है, जिस पर आपके संस्थान के प्रकटीकरण नियम लागू होते हैं। हमारा AI text humanizer AI-सहायता प्राप्त ड्राफ़्ट को स्वाभाविक अकादमिक शैली में दोबारा लिखता है, और चूँकि वह प्रक्रिया टोकन क्रम को दोबारा जनित करती है, सांख्यिकीय चिह्न उसमें नहीं बचते। विशेष रूप से Claude टेक्स्ट के लिए, निःशुल्क Claude वॉटरमार्क रिमूवर हर वाक्य को नए शब्दों में व्यक्त करता है और तथ्य, संख्याएँ और उद्धरण ज्यों के त्यों रखता है। जो कोई टूल नहीं बदल सकता, वह है पाठक के प्रति आपका दायित्व: दस्तावेज़ कैसे बना, इस बारे में पारदर्शिता।

पुनर्लेखन ही वह एकमात्र क्रिया है जो सांख्यिकीय चिह्न को हटाती है, और यही यह टूल वाक्य-दर-वाक्य करता है।
आगे क्या होगा
2027 तक तीन चीज़ों पर नज़र रखें। पहली, क्या OpenAI जारी करता है: Article 50 का EU प्रवर्तन "बना है पर जारी नहीं" स्थिति को टेक्स्ट के लिए लगातार महँगा बनाता जा रहा है। दूसरी, क्या डिटेक्टर एक जगह पहुँचते हैं: जिस दुनिया में हर बड़ी कंपनी प्रकाशित योजना से वॉटरमार्क करती है, वहाँ विश्वविद्यालय शैली से अनुमान लगाने के बजाय कुंजियाँ जाँचेंगे, जो आज के झूठी-सकारात्मकता वाले डिटेक्शन से वास्तविक सुधार होगा। तीसरी, क्या अंतर-संचालनीयता आती है: आज तीन कंपनियों का अर्थ है तीन असंगत चिह्न और कोई सार्वभौमिक जाँच नहीं। फ़ाइलों के लिए वह कमी C2PA पूरी करता है; कच्चे टेक्स्ट के लिए अभी कुछ नहीं करता।
क्या ChatGPT अपने टेक्स्ट को वॉटरमार्क करता है?
नहीं। अगस्त 2026 तक OpenAI ने टेक्स्ट वॉटरमार्किंग विधि बनाई है लेकिन तैनात नहीं की, जिसका कारण कंपनी ने अपने मई 2024 के प्रोविनेंस अपडेट में बताया। ChatGPT के टेक्स्ट आउटपुट में न कोई सांख्यिकीय वॉटरमार्क है, न छिपे कैरेक्टर। OpenAI DALL-E और Sora की मीडिया फ़ाइलों पर C2PA प्रोविनेंस मेटाडेटा ज़रूर लगाता है, जो एक अलग, फ़ाइल-स्तर का सिस्टम है।
क्या Google Gemini अपने टेक्स्ट को वॉटरमार्क करता है?
हाँ। Gemini के आउटपुट में अक्टूबर 2024 से Google DeepMind का SynthID-Text वॉटरमार्क है। यह शब्द चयन में छिपा सांख्यिकीय चिह्न है, पाठकों को अदृश्य, और Google के SynthID Detector से जाँचा जा सकता है। यह केवल Google के अपने मॉडलों पर लागू होता है, इसलिए नकारात्मक SynthID परिणाम दूसरे AI सिस्टमों के टेक्स्ट के बारे में कुछ नहीं कहता।
क्या Claude अपने टेक्स्ट को वॉटरमार्क करता है?
हाँ। 2 अगस्त, 2026 को या उसके बाद लॉन्च हुआ हर Claude मॉडल अपने टेक्स्ट आउटपुट में सांख्यिकीय वॉटरमार्क जोड़ता है, हर प्लैटफ़ॉर्म और प्लान पर, बिना ऑप्ट-आउट के, और Claude-जनित फ़ाइलों में अतिरिक्त C2PA मेटाडेटा होता है। उस तारीख़ से पहले लॉन्च हुए मॉडल अभी अपने आउटपुट को मार्क नहीं करते; Anthropic का कहना है कि संक्रमण अवधि में उनमें भी मार्किंग जोड़ी जा रही है। पूरा विवरण हमारे Claude वॉटरमार्क गाइड में है।
क्या विश्वविद्यालय AI वॉटरमार्क पकड़ सकते हैं?
केवल कंपनी के सहयोग से, क्योंकि डिटेक्शन के लिए कंपनी की कुंजी चाहिए। Google SynthID सामग्री के लिए सार्वजनिक डिटेक्टर पोर्टल देता है। Anthropic का कहना है कि उपयोगकर्ताओं और तीसरे पक्षों के लिए डिटेक्शन समर्थन की योजना है, लेकिन उसने अभी कोई सार्वजनिक डिटेक्टर जारी नहीं किया। कोई भी मुख्यधारा का प्लेजियरिज़्म सूट फ़िलहाल किसी भी कंपनी के सांख्यिकीय वॉटरमार्क सत्यापित नहीं कर सकता, इसलिए संस्थागत "AI डिटेक्शन" आज भी शैली-आधारित अनुमान है, वॉटरमार्क सत्यापन नहीं।
क्या AI वॉटरमार्किंग क़ानूनन अनिवार्य है?
EU में, प्रभावतः हाँ। EU AI Act का Article 50(2) जनरेटिव AI प्रदाताओं से अपेक्षा करता है कि आउटपुट मशीन-पठनीय प्रारूप में मार्क हों और कृत्रिम रूप से जनित के रूप में पहचाने जा सकें, और ये पारदर्शिता दायित्व 2 अगस्त, 2026 से लागू हैं। Anthropic ने संबंधित Code of Practice पर हस्ताक्षर किए और वैश्विक अनुपालन चुना। OpenAI के अप्रकाशित टेक्स्ट वॉटरमार्क के साथ नियामक क्या करते हैं, यही 2027 में देखने की बात है।
क्या AI वॉटरमार्क अनुवाद में बचते हैं?
नहीं। सांख्यिकीय वॉटरमार्क मॉडल के चुने शब्दों के सटीक क्रम में रहता है, और अनुवाद हर शब्द बदल देता है। यही बात गहरे पैराफ़्रेज़ और भारी मानवीय संपादन पर भी लागू होती है। यह सीमा समकक्ष-समीक्षित शोध में प्रलेखित है और वॉटरमार्क लागू करने वाली हर कंपनी इसे स्वीकार करती है।
स्रोत
- Anthropic, How Claude's text watermark works, अगस्त 2026
- Anthropic Help Center, How Claude marks AI-generated content, 2026
- OpenAI, Understanding the source of what we see and hear online, मई 2024
- Google DeepMind, SynthID
- Dathathri et al., Scalable watermarking for identifying large language model outputs, Nature, अक्टूबर 2024
- Google, SynthID Detector announcement, मई 2025
- Hugging Face, Introducing SynthID Text, अक्टूबर 2024
- Kirchenbauer et al., A Watermark for Large Language Models, ICML 2023
- Krishna et al., Paraphrasing evades detectors of AI-generated text, NeurIPS 2023
- Scott Aaronson, My AI Safety Lecture for UT Effective Altruism, नवंबर 2022
- European Union, AI Act, Article 50
- C2PA, Coalition for Content Provenance and Authenticity

डाना ProofreaderPro में एक सामग्री निर्माता है, जहां वह दैनिक ब्लॉग और लेखन कार्य चलाती है। वह इस पर लेख लिखती है कि ऑनलाइन संपादन प्लेटफ़ॉर्म कैसे काम करता है, और वह हर दिन ग्राहक संदेशों को संभालती है, जिसमें पांच सितारा संतुष्टि स्कोर दिखाया जाता है।