ProofreaderPro.ai
Humanizace textu AI

AI textové vodoznakování v roce 2026: Jak se OpenAI, Google a Anthropic liší

OpenAI vytvořilo textové watermarkování, ale nikdy jej nedodalo. Google dodalo SynthID a otevřeně ho zpřístupnilo. Anthropic zavedlo povinné používání Cloude. Co každé řešení dělá, co prokazuje a co to znamená pro vaše psaní.

Dana|19. 8. 2026|10 min čtení
AI textové vodoznakování v roce 2026: Jak se OpenAI, Google a Anthropic liší - ProofreaderPro Blog

OpenAI, Google a Anthropic všechny vybudovaly stejnou technologii: statistický watermark pro text generovaný AI. OpenAI nikdy neuvolnilo svou verzi. Google nasadil SynthID uvnitř Gemini a zveřejnil metodu. Anthropic učinil Claudeův watermark povinným pro každého uživatele v srpnu 2026. Pokud píšete s pomocí AI v jakékoli formě, všechna tři rozhodnutí nyní formují to, jak je vaše dokumenty posuzují.

Watermarking se 11. srpna 2026 přesunul z výzkumného tématu do hlavních zpráv, když Anthropic oznámil, že každý nový model Claude označuje svůj textový výstup. Toto oznámení jsme podrobně rozebrali v našem vysvětlení Claude watermarku. Tento průvodce pokrývá celý obraz: co je textový watermark, jak každá ze tří hlavních laboratoří jeho implementaci provedla nebo zadržela a co který systém prokazuje o napsaném textu.

Co je AI text watermark?

AI text watermark je statistický vzor ukrytý ve volbě slov generovaného textu, vložený v okamžiku generování tak, aby detektor s odpovídajícím klíčem mohl později ověřit, že text pochází z konkrétního systému AI. Není to viditelný štítek, ani skrytý znak, ani metadata připojená k souboru. Značka žije přímo ve slovech.

Tento rozdíl je důležitý, protože termín "watermark" se volně používá pro tři různé věci:

Co to jeKde to žijePřežije kopírování a vložení?
Statistický watermarkZkreslení v tom, která slova si model vybíráV samotném textuAno
Metadata souboru (C2PA)Podepsaný štítek původuKontejner souboruNe, prostý text je odstraní
Zero-width znakyNeviditelné Unicode vložené do textuMezi viditelnými znakyNe, dají se snadno odstranit

Statistický watermarking je jediný z těch tří, který přežije kopírování, vkládání, přepsání do nového dokumentu a převod formátu. Proto se na něj pro text shodly všechny tři hlavní laboratoře a proto "odstraňovače watermarků", které mažou neviditelné znaky, proti němu nic nezmůžou. Naše stránka bezplatný odstraňovač Claude watermarku tento způsob selhání dokumentuje se zdroji.

Jak vlastně statistické watermarking funguje?

Při každém kroku psaní věty si jazykový model vybírá mezi několika téměř ekvivalentními slovy a watermark nenápadně naloží kostkami. Základní postup publikovali Kirchenbauer a kolegové z University of Maryland v lednu 2023 v A Watermark for Large Language Models (ICML 2023). Funguje to takto:

  1. Předtím, než je vybráno každé slovo, tajný klíč odvozený z předchozích slov rozdělí slovník na preferovanou množinu a neutrální množinu.
  2. Model jemně posune volbu směrem k preferované množině. „suggest“ místo „indicate“. „across“ místo „among“. Každá jednotlivá volba vypadá zcela přirozeně.
  3. Detektor, který má klíč, počítá, jak často text dopadá do preferovaných množin. Lidské psaní trefuje očekávanou míru náhodou. Text s watermarkem ji trefuje příliš často a statistický test odchylku označí.

Žádné jediné slovo není důkazem čehokoli. Signál se objeví až napříč desítkami nebo stovkami voleb, proto se delší pasáže testují snáz než krátké a proto je detekce vždy pravděpodobnostní, nikoli razítko ano/ne.

Produkční systém Google DeepMind, publikovaný v Nature v říjnu 2024 jako Scalable watermarking for identifying large language model outputs, to zdokonalil technikou zvanou tournament sampling, která zachovává kvalitu textu dostatečně dobře na to, aby mohla tiše běžet ve spotřebitelském produktu ve velkém měřítku. Tento článek je důležitý i mimo Google: jde o publikovaný základ, na který Anthropic odkazuje pro implementaci Claude.

Hlavní slabina byla publikována ještě před většinou nasazení. V březnu 2023 Krishna a kolegové ukázali v Paraphrasing evades detectors of AI-generated text (NeurIPS 2023), že přegenerování znění pasáže sráží detekci napříč metodami, včetně watermarkingu. Signál žije v přesné sekvenci tokenů a nikde jinde, takže cokoli, co tuto sekvenci přepíše, včetně lidského editora, přepíše i důkaz. Každý dodavatel, který dnes watermark nasazuje, uvádí toto omezení ve vlastní dokumentaci.

Časová osa od 2022 do 2026 ukazující, že OpenAI navrhla text watermarking a nikdy jej nevydala, Google nasadil SynthID-Text a zveřejnil jeho open-source verzi, Anthropic nasadil watermark Claude po celém světě v srpnu 2026 a milníky EU AI Act, které utvářely načasování

OpenAI: společnost, která to vynalezla a nikdy nevydala

OpenAI má už roky funkční textový watermark a dosud se rozhodla jej neuvolnit. Myšlenku poprvé veřejně popsal Scott Aaronson, tehdy pracující na bezpečnosti v OpenAI, v přednášce z listopadu 2022: zkreslovat volby modelu mezi téměř rovnocennými slovy pomocí tajné kryptografické funkce, aby samotný text dokazoval, odkud pochází. Tato přednáška předchází každému nasazenému systému a je zakládajícím dokumentem oboru.

V květnu 2024 OpenAI popsala stav projektu ve své aktualizaci provenance, Understanding the source of what we see and hear online. Společnost uvedla, že její metoda textového watermarkingu byla přesná a účinná proti drobným úpravám, ale že s vydáním čeká, dokud zváží kompromisy. Dvě z OpenAI jmenovaných rizik se akademických autorů dotýkají přímo:

  • Snadné obcházení. Parafrázování nebo překlad textu značku odstraní, přesně jak předpověděl výzkum z roku 2023. Watermark, který zachytí hlavně lidi, kteří o něm nevědí, je slabý nástroj prosazování.
  • Nespravedlivý dopad na nerodilé mluvčí angličtiny. OpenAI uvedla, že watermarking by mohl stigmatizovat legitimní používání AI jako pomocníka při psaní u lidí píšících v druhém jazyce. Náš článek o proč AI detektory označují nerodilé autory se zabývá stejným problémem z pohledu detektorů.

Sekce o textovém watermarkingu v aktualizaci provenance OpenAI z května 2024, která uvádí, že funkční metoda textového watermarkingu existuje, že je zranitelná vůči překladu a přeformulování a že by mohla nepřiměřeně dopadat na nerodilé mluvčí angličtiny

Vlastní aktualizace provenance OpenAI: metoda funguje a společnost uvádí důvody, proč ji dosud nevydala.

Pro obrázky a audio zvolila OpenAI jiný přístup: metadata provenance C2PA ve výstupech DALL-E a Sora, což je značka na úrovni souboru, nikoli značka přímo v obsahu. U textu, k pozdnímu srpnu 2026, výstup ChatGPT nenese žádný watermark. Společnost, která technologii navrhla, zůstává jedinou ze tří, která ji nikdy nenasadila.

Google: první, kdo ji nasadil, a pak dal recept dál

Google DeepMind ji nasadil jako první, pak vše publikoval a nakonec metodu zpřístupnil. Jeho systém, SynthID, začal jako watermark pro obrázky v roce 2023 a v roce 2024 se rozšířil na text. V době, kdy v říjnu 2024 vyšel článek v Nature, SynthID-Text už běžel uvnitř Gemini v produkci, což z něj udělalo první statistický textový watermark nasazený ve spotřebitelském měřítku.

Přehledová stránka SynthID od Google DeepMind, která popisuje SynthID jako nástroj pro watermarking k identifikaci AI generovaného obsahu napříč textem, obrázky, audiem a videem

SynthID pokrývá text, obrázky, audio i video a v textových výstupech Gemini je aktivní od října 2024.

Google následně implementaci zveřejnil jako open source na Hugging Face, takže kterýkoli vývojář mohl stejný watermarkingový postup použít i pro své vlastní modely. V květnu 2025 oznámil SynthID Detector, ověřovací portál, kde lze obsah kontrolovat na značky SynthID napříč textem, obrázky, audiem a videem.

Jedno omezení rozsahu je podstatné: SynthID pouze značí a pouze detekuje obsah z vlastních modelů Googlu. Nevypovídá nic o výstupech ChatGPT nebo Claude a čistý scan SynthID neznamená, že text napsal člověk. Znamená to, že ho nenapsaly modely Googlu, což je mnohem užší tvrzení.

Anthropic: poslední v pohybu, nejpřísnější politika

Anthropic nasadil nejpozději, s nejširším povinným rozsahem. Každý model Claude uvedený na trh 2. August 2026 nebo později vkládá do svého textového výstupu statistický watermark, celosvětově, na všech tarifech, bez možnosti vypnutí. Společnost mechanismus popisuje ve svém vysvětlení, Jak funguje textový watermark Claude, a rozsah politiky v článku nápovědy, Jak Claude označuje AI-generated obsah: jsou zahrnuty Claude API, claude.ai, Claude Code, Claude Cowork a Claude Tag. Modely uvedené před tímto datem jsou v přechodném období a Anthropic uvádí, že do nich také přidává podporu označování. Vedle statistické značky nesou soubory vytvořené Claude také metadata C2PA, druhý, oddělený systém, který prosté kopírování textu odstraní.

Článek zásad v centru nápovědy Anthropic uvádějící závazky k označování: nové modely označují od prvního dne, označování platí celosvětově napříč všemi platformami Claude, podpora detekce se plánuje a starší modely jsou v přechodném období

Politika slovy Anthropic: každý nový model, každá platforma, celosvětově, se zařazením starších modelů.

Dokumentace Anthropic přímo uvádí i omezení. Detekce je pravděpodobnostní. Značka nedokáže rozlišit dokument, který napsal Claude, od dokumentu, který napsal člověk a Claude jej jen lehce upravil. Úplné přepsání ji odstraní. Všechny tyto body jsme prošli, včetně toho, co ve skutečnosti prokazuje pozitivní detekce a co dělat, pokud je váš vlastní text označen, v samostatném průvodci watermarkem Claude.

Načasování sleduje regulaci. Anthropic podepsal článek 50(2) Kodexu praxe o transparentnosti obsahu vytvořeného AI podle EU AI Act, který od poskytovatelů generativních AI systémů vyžaduje, aby zajistili, že výstupy budou "označeny ve strojově čitelném formátu a budou detekovatelné jako uměle generované." Tyto povinnosti v oblasti transparentnosti se staly závaznými 2. August 2026: přesně v tento den v zásadách modelů Anthropic, tedy devět dní před veřejným oznámením. Anthropic se rozhodl vyhovět globálně místo toho, aby pro provoz z EU udržoval odlišné chování. Google už byl v souladu z podstaty návrhu. Textový výstup OpenAI bez označení je otevřenou otázkou souladu pro rok 2027.

Tři přístupy vedle sebe

OpenAIGoogle DeepMindAnthropic
Nasazen textový watermark?NeAno (Gemini, od Oct 2024)Ano (modely Claude od 2. August 2026)
TechnikaKryptografické zkreslení vzorkování (zabudované, nezveřejněné)Tournament sampling SynthID-TextStatistická značka při vzorkování, ve stylu SynthID
RozsahŽádný pro textPouze modely GoogleVšechny nové modely Claude; starší modely v přechodu
Možnost vypnutíNelze použítNeNe
Veřejný detektorNePortál SynthID Detector (2025)Plánován, zatím nevydán
Schéma zveřejněno?Pouze koncepční přednáškyČlánek Nature + open sourceVysvětlení, založené na zveřejněné práci
Metadata souboru (C2PA)Ano, obrázky a audioAno, napříč médiiAno, u vygenerovaných souborů
Uvedená omezeníObcházení, stigma pro ESLRozsah omezen na vlastní modelyPravděpodobnostní, úpravy rozmazávají autorství

Vzorec napříč sloupci: OpenAI považuje textový watermark za nevyřešený politický problém, Google jej chápe jako infrastrukturu k normalizaci a Anthropic jej bere jako povinnost vyplývající z regulace, kterou je třeba plně zavést.

Co to znamená pro výzkumníky a akademické autory

Praktické důsledky závisí na tom, které nástroje přicházejí do styku s vaším textem. Pokud píšete návrh v ChatGPT, váš text dnes nenese žádný vodoznak. Pokud píšete návrh v Gemini, nese značku SynthID, kterou dokáže číst pouze detektor od Google. Pokud píšete nebo upravujete text pomocí aktuálního modelu Claude, nese značku Anthropic a neexistuje žádné nastavení, které by to vypnulo.

Akademičtí autoři by měli vědět tři věci:

Vodoznak identifikuje nástroj, ne autora. Každý dodavatel to uvádí ve své dokumentaci a stojí za to to zopakovat, protože institucionální pravidla tento rozdíl ne vždy rozlišují. Text může být označen proto, že jej AI napsala, proto, že AI provedla dvouvětovou jazykovou editaci, nebo proto, že byl citován označený odstavec. Pokud vaše instituce provádí kontroly vodoznaků, kontrola dokládá jen to, že se konkrétní model textu v určitém okamžiku dotkl, nic víc. Náš průvodce k odvolání proti falešnému označení AI detekcí popisuje, jak tento argument uplatnit, když na něm záleží.

Vodoznaky a AI detektory jsou odlišné technologie s odlišnými režimy selhání. Detektory jako Turnitin nebo GPTZero odhadují na základě statistického stylu, s problémy přesnosti, které jsme zdokumentovali. Detekce vodoznaku je test založený na klíči s velmi nízkou mírou falešně pozitivních výsledků u neoznačeného lidského textu. Asymetrie se u falešně negativních výsledků obrací: kontrola vodoznaku přehlédne jakýkoli AI text z modelu, který vodoznak nepoužívá, a to dnes zahrnuje veškerý ChatGPT.

Nejlepší pozici vám stále dává zveřejnění. Vodoznakování činí tiché používání AI rizikovějším a přiznané používání AI bezpečnějším, protože u zveřejněného pracovního postupu není třeba se pozitivní značky obávat. Většina časopisů a univerzit nyní má výslovné zásady pro používání AI; naše zásady používání AI vysvětlují, jak tyto hranice vymezujeme napříč našimi vlastními nástroji, a je to rozumná předloha toho, jak vypadá transparentní používání.

Co odstraní vodoznak v textu a co ne

Přepsání jej odstraní, přeformátování ne. Kopírování, vkládání, změna písma, převod mezi formáty souborů i odstranění neviditelných znaků ponechají statistický vodoznak zcela nedotčený, protože značka je ve volbě slov. Co jej odstraní, je cokoli, co znovu vygeneruje formulaci: hlubší lidská editace, překlad nebo skutečné parafrázování, jak ukázala studie odolnosti z NeurIPS 2023 ještě před uvedením těchto systémů na trh.

Důležité jsou zde oba směry. To, že značka zmizí, neznamená, že text je váš, a to, že značka přetrvá, neznamená, že text váš není. Přepsaný návrh vytvořený s pomocí AI je stále dokument s asistencí AI, na který se vztahují pravidla o zveřejnění vaší instituce. Náš AI text humanizer přepisuje návrhy s podporou AI do přirozeného akademického stylu, a protože tento proces znovu generuje posloupnost tokenů, statistické značky jej nepřežijí. U textu v Claude konkrétně bezplatný Claude watermark remover přeformuluje každou větu do nové podoby a přitom zachová nezměněná fakta, čísla i citace. To, co žádný nástroj změnit nemůže, je to, co dlužíte čtenáři: transparentnost o tom, jak byl dokument vytvořen.

Bezplatný Claude watermark remover na ProofreaderPro.ai, který přeformuluje každou větu označeného úseku do nové podoby a přitom zachová nezměněná fakta, čísla i citace

Přepsání je jediná operace, která odstraní statistickou značku, a právě to tento nástroj dělá, větu po větě.

Kam to půjde dál

Sledujte do roku 2027 tři věci. Zaprvé, zda OpenAI něco nasadí: prosazování v EU podle článku 50 činí z pozice „systém postavený, ale nevydaný“ pro text čím dál dražší variantu. Zadruhé, zda se detektory sjednotí: svět, v němž každý významný lab vodoznačí podle zveřejněného schématu, je svět, v němž univerzity kontrolují klíče místo odhadování podle stylu, což by byl skutečný pokrok oproti dnešní detekci náchylné k falešně pozitivním výsledkům. Zatřetí, zda dorazí interoperabilita: dnes znamenají tři laby tři nekompatibilní značky a žádnou univerzální kontrolu. C2PA tu mezeru vyplňuje pro soubory; pro čistý text ji zatím nevyplňuje nic.

Vodoznačuje ChatGPT svůj text?

Ne. K srpnu 2026 má OpenAI vyvinutou metodu vodoznačkování textu, ale nenasadila ji, což společnost vysvětlila ve své květnové aktualizaci o původu obsahu z roku 2024. Textový výstup ChatGPT nenese žádný statistický vodoznak ani skryté znaky. OpenAI však aplikuje metadata původu C2PA na mediální soubory DALL-E a Sora, což je samostatný systém na úrovni souborů.

Vodoznačuje Google Gemini svůj text?

Ano. Výstup Gemini nese od října 2024 vodoznak SynthID-Text od Google DeepMind. Jde o statistickou značku ve volbě slov, neviditelnou pro čtenáře, kterou lze ověřit pomocí detektoru SynthID od Googlu. Platí pouze pro vlastní modely Googlu, takže negativní výsledek SynthID nevypovídá nic o textu z jiných systémů AI.

Vodoznačuje Claude svůj text?

Ano. Každý model Claude uvedený na trh 2. srpna 2026 nebo později vkládá do svého textového výstupu statistický vodoznak, na všech platformách a tarifech, bez možnosti vypnutí, a soubory vytvořené Claudem navíc nesou metadata C2PA. Modely uvedené před tímto datem zatím svůj výstup neoznačují; Anthropic uvádí, že jim během přechodného období podporu označování doplňuje. Plné podrobnosti najdete v našem vysvětlení vodoznaku Claude.

Mohou univerzity detekovat vodoznaky AI?

Jen se součinností dodavatele, protože detekce vyžaduje jeho klíč. Google nabízí veřejný detekční portál pro obsah SynthID. Anthropic uvádí, že podpora detekce pro uživatele a třetí strany je v plánu, ale veřejný detektor zatím nevydal. Žádný běžný plagiátorský nástroj dnes neumí ověřovat statistické vodoznaky od žádného labu, takže institucionální „detekce AI“ dnes stále znamená odhad podle stylu, nikoli ověření vodoznaku.

Vyžaduje zákon vodoznakování AI?

V EU ano, fakticky. Článek 50(2) EU AI Act vyžaduje, aby poskytovatelé generativní AI zajistili, že výstupy jsou označeny v strojově čitelném formátu a lze je rozpoznat jako uměle generované, přičemž povinnosti transparentnosti se uplatňují od 2. srpna 2026. Anthropic podepsal související Code of Practice a zvolil celosvětovou shodu. Jak regulátoři naloží s nevydaným textovým vodoznakem OpenAI, je otázka, kterou je třeba sledovat v roce 2027.

Přežijí vodoznaky AI překlad?

Ne. Statistický vodoznak žije v přesné posloupnosti slov, která model zvolil, a překlad každé slovo nahradí. Totéž platí pro hlubokou parafrázi a výrazné lidské úpravy. Toto omezení je doloženo v recenzované literatuře a uznávají ho všichni dodavatelé, kteří vodoznak nasazují.

Zdroje

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana je tvůrcem obsahu ve společnosti ProofreaderPro, kde provozuje každodenní blog a psaní. Píše články o tom, jak funguje online platforma pro úpravy, a každý den zpracovává zprávy od zákazníků, což dokazuje pětihvězdičkové skóre spokojenosti.

Pokračujte ve čtení

Vyzkoušejte Text Humanizer zdarma

Začněte zdarma
Proofreader Pro AI
Vylepšete svůj výzkum s ProofreaderPro.ai, světovým lídrem v oblasti korektorů založených na umělé inteligenci, přizpůsobeným pro akademické texty.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
© 2026 ProofreaderPro.ai. Vedoucí akademický korektor, editor a humanizátor. Vyrobeno s ❤️ a jazykově správnou syntaxi 🌳s