ProofreaderPro.ai
AI szöveg humanizálása

AI szöveg vízjelölés 2026-ban: miben különbözik az OpenAI, a Google és az Anthropic?

Az OpenAI szöveg vízjelet fejlesztett ki, de sosem szállította le. A Google kiadta a SynthID-et, és nyíltan közzétette. Az Anthropic bevezette a Claude kötelező ellenőrzését. Mit csinál mindegyik rendszer, mit bizonyít, és mit jelent ez a te írásaidra nézve.

Dana|Aug 19, 2026|10 perc alatt olvasható
AI szöveg vízjelölés 2026-ban: miben különbözik az OpenAI, a Google és az Anthropic? - ProofreaderPro.ai Blog

OpenAI, a Google és az Anthropic mind ugyanazt a technológiát építették fel: egy statisztikai vízjelet az AI által generált szöveghez. Az OpenAI a saját változatát soha nem adta ki. A Google beépítette a SynthID-t a Gemini-be, és közzétette a módszert. Az Anthropic 2026 augusztusában minden felhasználó számára kötelezővé tette a Claude vízjelét. Ha bármilyen formában AI-támogatással írsz, ez a három döntés most már mind befolyásolja, hogyan ítélik meg a dokumentumaidat.

A vízjelezés 2026. augusztus 11-én került át a kutatási témából a fősodrú hírek közé, amikor az Anthropic bejelentette, hogy minden új Claude modell megjelöli a szöveges kimenetét. Erről a bejelentésről részletesen írtunk a Claude vízjel magyarázó cikkünkben. Ez az útmutató a teljes képet mutatja be: mi a szöveges vízjel, hogyan valósította meg vagy tartotta vissza azt a három nagy labor mindegyike, és mit bizonyítanak ezek a rendszerek egy adott szövegről.

Mi az az AI szöveges vízjel?

Az AI szöveges vízjel egy statisztikai minta, amely a generált szöveg szóválasztásaiba van rejtve, és a létrehozás pillanatában kerül beillesztésre, hogy egy megfelelő kulccsal rendelkező detektor később ellenőrizni tudja, a szöveg egy adott AI rendszerből származik. Ez nem látható címke, nem rejtett karakter, és nem fájlhoz csatolt metaadat. A jel magukban a szavakban él.

Ez a különbség azért fontos, mert a „vízjel” kifejezést lazán három különböző dologra használják:

Mi ezHol találhatóÁtéli a másolást és beillesztést?
Statisztikai vízjelElfogultság abban, hogy a modell mely szavakat választjaMaga a szövegIgen
Fájlmetaadat (C2PA)Aláírt eredetiségjelA fájl konténereNem, a sima szövegként történő másolás eltávolítja
Zéró szélességű karakterekLáthatatlan Unicode, amelyet a szövegbe szúrnakA látható karakterek közöttNem, triviálisan eltávolítható

A statisztikai vízjelezés az egyetlen a három közül, amely túléli a másolást, beillesztést, az új dokumentumba való újragépelést és a formátumkonverziót. Ezért convergált erre a három nagy labor a szöveg esetében, és ezért nem tesz semmit ellene az, ha valaki láthatatlan karaktereket eltávolító „vízjel-eltávolítókat” használ. A ingyenes Claude vízjel-eltávolító oldalunk forrásokkal dokumentálja ezt a hibamódot.

Hogyan működik valójában a statisztikai vízjelezés?

A mondatírás minden egyes lépésénél egy nyelvi modell több, egymáshoz nagyon közeli szó közül választ, és a vízjel észrevétlenül megdolgozza a kockadobást. Az alapvető receptet Kirchenbauer és munkatársai tették közzé a Marylandi Egyetemen 2023 januárjában, az A Watermark for Large Language Models című tanulmányban (ICML 2023). Így működik:

  1. Minden szó kiválasztása előtt az előző szavakból származtatott titkos kulcs két csoportra osztja a szókincset: egy előnyben részesített készletre és egy semleges készletre.
  2. A modell az előnyben részesített készlet felé tereli a választását. „Suggest” az „indicate” helyett. „Across” az „among” helyett. Minden egyes döntés teljesen természetesnek tűnik.
  3. Az a detektor, amely birtokolja a kulcsot, megszámolja, milyen gyakran esik a szöveg az előnyben részesített készletekbe. Az emberi írás véletlenből az elvárt arányt hozza. A vízjellel ellátott szöveg viszont túlságosan gyakran talál oda, és egy statisztikai teszt jelzi az eltérést.

Egyetlen szó sem bizonyít semmit. A jel csak több tucat vagy több száz választás során rajzolódik ki, ezért a hosszabb szövegrészeket könnyebb tesztelni, mint a rövidet, és ezért a detektálás mindig valószínűségi, nem pedig igen vagy nem típusú bélyeg.

A Google DeepMind termelési rendszere, amelyet 2024 októberében a Nature közölt Scalable watermarking for identifying large language model outputs címmel, ezt a tournament sampling nevű technikával finomította, amely elég jól megőrzi a szöveg minőségét ahhoz, hogy nagy léptékben, észrevétlenül fusson egy fogyasztói termékben. Ennek a tanulmánynak a jelentősége túlmutat a Google-on: ez a publikált alap, amelyre Anthropic hivatkozik Claude megvalósításánál.

A fő gyengeséget még a legtöbb bevezetés előtt publikálták. 2023 márciusában Krishna és munkatársai a Paraphrasing evades detectors of AI-generated text című tanulmányban (NeurIPS 2023) kimutatták, hogy egy szövegrész újrafogalmazása minden módszernél összeomlasztja a detektálást, így a vízjelezésnél is. A jel a pontos tokenláncban él, és sehol máshol, ezért ami ezt a láncot átírja, egy emberi szerkesztő is, az bizonyítékot is átír vagy eltüntet. Minden ma vízjelet szállító gyártó saját dokumentációjában meg is említi ezt a korlátot.

2022 és 2026 közötti idővonal, amelyen az OpenAI szövegvízjelezést javasol, de sosem adja ki, a Google bevezeti és nyílt forrásúvá teszi a SynthID-Textet, Anthropic világszerte bevezeti a Claude vízjelet 2026 augusztusában, és az EU AI Act mérföldkövei alakítják az időzítést

OpenAI: a cég, amely megalkotta, de sosem adta ki

Az OpenAI évek óta rendelkezik működő szöveges vízjellel, de mindeddig úgy döntött, hogy nem teszi közzé. Az ötletet először Scott Aaronson ismertette nyilvánosan, aki akkor az OpenAI-nál a biztonsággal foglalkozott, egy 2022. novemberi előadásban: a modell választásait a közel azonos értékű szavak között egy titkos kriptográfiai függvénnyel kell elfogulttá tenni, hogy maga a szöveg bizonyítsa, honnan származik. Ez az előadás megelőz minden telepített rendszert, és a terület alapdokumentumának számít.

2024 májusában az OpenAI a származáskövetési frissítésében írta le a projekt állását, Understanding the source of what we see and hear online. A vállalat azt közölte, hogy a szöveges vízjelezési módszere pontos és hatékony a kisebb szerkesztésekkel szemben, de a bevezetést addig halogatja, amíg mérlegeli az előnyöket és hátrányokat. Az OpenAI által megnevezett kockázatok közül kettő közvetlenül érinti az akadémiai szerzőket:

  • Könnyű megkerülhetőség. Az átfogalmazás vagy a szöveg lefordítása eltünteti a jelet, pontosan ahogy a 2023-as kutatás előre jelezte. Az a vízjel, amely leginkább azokat érinti, akik nem tudnak a létezéséről, gyenge érvényesítési eszköz.
  • Aránytalan hatás a nem anyanyelvi angolul beszélőkre. Az OpenAI szerint a vízjelezés megbélyegezheti az AI legitim használatát mint írási segédeszközt azok számára, akik második nyelven írnak. A mi cikkünk arról, miért jelölik meg az AI-detektorok a nem anyanyelvi szerzőket ugyanezt a problémát a detektorok oldaláról tárgyalja.

Az OpenAI 2024. májusi származáskövetési frissítésének szöveges vízjeles része, amely szerint létezik működő szöveges vízjeles módszer, hogy az sebezhető a fordítással és az átfogalmazással szemben, és hogy aránytalanul érintheti a nem anyanyelvi angolul beszélőket

Az OpenAI saját származáskövetési frissítése: a módszer működik, és a vállalat felsorolja, miért nem adta még ki.

Képek és hang esetében az OpenAI más utat választott: C2PA származási metaadatokat a DALL-E és Sora kimeneteiben, ami fájl szintű címke, nem pedig a tartalomba épített jel. Szövegnél 2026. augusztus végéig a ChatGPT kimenete nem hordoz vízjelet. A technológiát javasló vállalat továbbra is az egyetlen a három közül, amely soha nem vezette be.

Google: először bevezette, aztán közzétette a receptet

A Google DeepMind volt az első, amely bevezette, teljes egészében közzétette, majd elérhetővé tette a módszert. A rendszere, SynthID, 2023-ban képi vízjelként indult, majd 2024-ben kibővült szövegre is. Mire 2024 októberében megjelent a Nature cikk, a SynthID-Text már élesben futott a Gemini rendszerében, így ez lett az első statisztikai szöveges vízjel, amelyet fogyasztói léptékben telepítettek.

A Google DeepMind SynthID áttekintő oldala, amely a SynthID-t az AI által generált tartalom azonosítására szolgáló vízjelezési eszközként írja le szöveg, képek, hang és videó esetében

  • A SynthID szöveget, képeket, hangot és videót fed le, és 2024 októbere óta élőben működik a Gemini szöveges kimenetében.*

A Google ezután nyílt forráskódként közzétette a megvalósítást a Hugging Face-en, lehetővé téve, hogy bármely fejlesztő ugyanezt a vízjelezési sémát a saját modelljein alkalmazza. 2025 májusában bejelentette a SynthID Detectort, egy ellenőrző portált, ahol a tartalmakat meg lehet vizsgálni SynthID jelek után szöveg, képek, hang és videó esetében.

Egy terjedelmi korlát fontos: a SynthID csak a Google saját modelljeinek tartalmát jelöli és csak azokat képes felismerni. Nem mond semmit a ChatGPT vagy a Claude kimenetéről, és egy tiszta SynthID-vizsgálat nem jelenti azt, hogy a szöveget ember írta. Ez csak azt jelenti, hogy a Google modelljei nem írták, ami sokkal szűkebb állítás.

Anthropic: utoljára lépett, a legszigorúbb szabályzat

Az Anthropic a legkésőbb vezette be, a legszélesebb kötelező lefedettséggel. A 2026. August 2. után indított minden Claude-modell statisztikai vízjelet ágyaz be a szöveges kimenetébe, világszerte, minden csomagon, opt-out lehetőség nélkül. A vállalat a mechanizmust a magyarázatában, How Claude's text watermark works, a szabályzat hatókörét pedig a súgóközpont cikkében, How Claude marks AI-generated content írja le: a Claude API, a claude.ai, a Claude Code, a Claude Cowork és a Claude Tag mind érintett. A határidő előtt indított modellek átmeneti időszakban vannak, és az Anthropic azt mondja, hogy ezekhez is hozzáadja a jelölési támogatást. A statisztikai jel mellett a Claude által generált fájlok C2PA metaadatot is hordoznak, amely egy második, külön rendszer, és amelyet a sima szöveg másolása eltávolít.

Az Anthropic súgóközpontbeli szabályzati cikke, amely felsorolja a jelölési vállalásokat: az új modellek az első naptól jelölnek, a jelölés világszerte minden Claude platformon érvényes, a detektálási támogatás tervben van, és a régebbi modellek átmeneti időszakban vannak

Az Anthropic saját szavaival megfogalmazott szabályzat: minden új modell, minden platform, világszerte, a régebbi modellek bevonásával.

Az Anthropic dokumentációja közvetlenül kimondja a korlátokat. A detektálás valószínűségi alapú. A jel nem tud különbséget tenni aközött, hogy egy dokumentumot Claude írt, vagy egy ember írta, és Claude csak enyhén szerkesztette. Egy teljes átírás eltávolítja. Mindezt, beleértve azt is, hogy egy pozitív detektálás valójában mit bizonyít, és mit tegyen, ha a saját írását jelölik, a külön Claude watermark útmutatóban részletesen végigvettük.

Az időzítés összhangban van a szabályozással. Az Anthropic aláírta az EU AI Act szerinti Article 50(2) Code of Practice on Transparency of AI-Generated Content dokumentumot, amely előírja a generatív AI-rendszerek szolgáltatóinak, hogy gondoskodjanak arról, hogy a kimenetek "marked in a machine-readable format and detectable as artificially generated." Ezek az átláthatósági kötelezettségek 2026. August 2. napján váltak alkalmazandóvá: ez pontosan az a határidő, amely az Anthropic modellpolitikájában szerepel, kilenc nappal a nyilvános bejelentés előtt. Az Anthropic úgy döntött, hogy globálisan felel meg, ahelyett, hogy az EU forgalmára külön viselkedést tartana fenn. A Google már eleve megfelelt. Az OpenAI jelöletlen szöveges kimenete a 2027-es nyitott megfelelési kérdés.

A három megközelítés egymás mellett

OpenAIGoogle DeepMindAnthropic
Szöveges watermark bevezetve?NemIgen (Gemini, 2024 Oct óta)Igen (Claude modellek 2026. August 2. óta)
TechnikaKriptográfiai mintavételezési torzítás (beépítve, nem publikált)SynthID-Text tornamintavételezésStatisztikai mintavételi jel, SynthID-szerű
LefedettségNincs szövegreCsak Google-modellekMinden új Claude-modell; a régebbi modellek átmenetben
Opt-outNem értelmezhetőNemNem
Nyilvános detektorNincsSynthID Detector portál (2025)Tervben van, még nem adták ki
A séma közzétéve?Csak koncepcionális előadásokNature-cikk + nyílt forráskódMagyarázat, publikált munkára alapozva
Fájlmetaadat (C2PA)Igen, képek és hang eseténIgen, minden médiatípusnálIgen, a generált fájlokon
Megjelölt korlátokMegkerülés, ESL stigmaA hatókör saját modellekre korlátozódikValószínűségi, a szerzőséget a szerkesztések elmoshatják

Az oszlopok mintázata egyértelmű: az OpenAI a szöveges watermarkingot még megoldatlan szakpolitikai problémának tekinti, a Google infrastruktúraként kezeli, amelyet szabványosítani kell, az Anthropic pedig megfelelési kötelezettségként, amelyet teljes körűen végre kell hajtani.

Mit jelent ez a kutatók és az akadémiai írók számára

A gyakorlati következmények attól függenek, hogy mely eszközök érintik a szöveget. Ha ChatGPT-vel készíted a vázlatot, a szöveged ma nem hordoz vízjelet. Ha Gemini-vel készíted, akkor SynthID-jelölést hordoz, amelyet csak a Google detektora tud olvasni. Ha egy aktuális Claude modellel írod vagy szerkeszted a szöveget, akkor Anthropic-jelölést hordoz, és nincs olyan beállítás, amellyel ezt ki lehetne kapcsolni.

Az akadémiai íróknak három dolgot érdemes tudniuk:

A vízjel egy eszközt azonosít, nem a szerzőt. Minden gyártó így írja le ezt a saját dokumentációjában, és érdemes ezt ismét elmondani, mert az intézményi szabályzatok nem mindig tesznek különbséget. A szöveg azért lehet megjelölve, mert egy AI megírta, mert egy AI két mondatát átszerkesztette, vagy mert egy megjelölt bekezdést idéztek benne. Ha az intézményed vízjel-ellenőrzést futtat, az ellenőrzés azt bizonyítja, hogy egy adott modell valamikor érintette a szöveget, és semmi többet. Az ál AI-észlelési jelzés elleni fellebbezés című útmutatónk azt mutatja be, hogyan lehet ezt az érvet előadni, amikor számít.

A vízjelek és az AI detektorok különböző technológiák, eltérő hibamódokkal. Az olyan detektorok, mint a Turnitin vagy a GPTZero, statisztikai stílusból tippelnek, a pontossági problémákkal, amelyeket dokumentáltunk. A vízjel-észlelés kulcsalapú teszt, amelynek nagyon alacsony a hamis pozitív aránya a meg nem jelölt emberi szövegen. A aszimmetria a hamis negatívoknál fordul meg: a vízjel-ellenőrzés kihagy minden olyan AI szöveget, amely vízjelet nem használó modellből származik, és ez ma a ChatGPT összes változatát is magában foglalja.

A nyilvánosságra hozatal marad a legerősebb álláspontod. A vízjelezés kockázatosabbá teszi a titkos AI-használatot, és biztonságosabbá a nyilvánosságra hozott AI-használatot, mert egy bejelentett munkafolyamatnak nincs mitől tartania egy pozitív jelölés esetén. A legtöbb folyóirat és egyetem ma már kifejezett AI-használati szabályzatokkal rendelkezik; a mi AI-használati szabályzatunk elmagyarázza, hogyan húzzuk meg ezeket a határokat a saját eszközeink között, és ez ésszerű minta arra, hogyan néz ki az átlátható használat.

Mi távolítja el a szöveg vízjelét, és mi nem

Az átírás eltávolítja; az újraformázás nem. A másolás, beillesztés, a betűtípusok módosítása, a fájlformátumok közötti átalakítás és a láthatatlan karakterek eltávolítása mind teljesen érintetlenül hagyja a statisztikai vízjelet, mert a jel a szóválasztásban van. Ami eltávolítja, az minden olyan művelet, amely újragenerálja a megfogalmazást: egy alapos emberi szerkesztés, egy fordítás vagy egy valódi parafrázis, ahogyan azt a NeurIPS 2023 robustness work kimutatta, még mielőtt ezek a rendszerek megjelentek volna.

Mindkét irány számít itt. A jel eltűnése nem teszi a szöveget a tieddé, és a jel megmaradása nem teszi a szöveget nem a tieddé. Egy átírt AI vázlat továbbra is AI-val támogatott dokumentum, amelyre az intézményed nyilvánosságra hozatali szabályai vonatkoznak. A mi AI text humanizer eszközünk az AI-val támogatott vázlatokat természetes akadémiai regiszterbe írja át, és mivel ez a folyamat újragenerálja a tokenek sorozatát, a statisztikai jelek nem maradnak meg benne. Kifejezetten Claude szöveghez a free Claude watermark remover minden mondatot friss megfogalmazásban fejez ki, miközben a tények, számok és hivatkozások változatlanok maradnak. Amit egyetlen eszköz sem tud megváltoztatni, az az, amit az olvasóddal szemben tartozol neki: az átláthatóságot arról, hogyan készült a dokumentum.

A ProofreaderPro.ai ingyenes Claude vízjel-eltávolítója, amely minden mondatot friss megfogalmazásban fejez ki egy megjelölt részletből, miközben a tények, számok és hivatkozások változatlanok maradnak

A parafrázis az az egyetlen művelet, amely eltávolít egy statisztikai jelet, és pontosan ezt végzi ez az eszköz, mondatról mondatra.

Ez hová vezet tovább

2027-ig három dolgot érdemes figyelni. Először is, hogy OpenAI szállít-e: az EU 50. cikkének végrehajtása egyre költségesebbé teszi a szöveg esetében a "megépített, de ki nem adott" állapotot. Másodszor, hogy a detektorok közelednek-e egymáshoz: egy olyan világ, ahol minden nagy laboratórium közzétett sémával vízjelez, olyan világ, ahol az egyetemek kulcsokat ellenőriznek a stílusból való találgatás helyett, ami valódi előrelépés lenne a mai hamis pozitívokra hajlamos detektáláshoz képest. Harmadszor, hogy megérkezik-e az interoperabilitás: ma három labor három inkompatibilis jelzést jelent, és nincs univerzális ellenőrzés. A C2PA ezt a fájloknál pótolja; a nyers szövegnél még semmi sem pótolja.

A ChatGPT vízjelezi a szövegét?

Nem. 2026 augusztusáig OpenAI kidolgozott egy szövegvízjelzési módszert, de nem vezette be, ahogy ezt a vállalat a 2024. májusi eredetiségre vonatkozó frissítésében kifejtette. A ChatGPT szöveges kimenete sem statisztikai vízjelet, sem rejtett karaktereket nem tartalmaz. OpenAI a DALL-E és a Sora médiafájlokra C2PA eredetiségi metaadatot alkalmaz, ami ettől független, fájlszintű rendszer.

A Google Gemini vízjelezi a szövegét?

Igen. A Gemini kimenete 2024 októbere óta tartalmazza a Google DeepMind SynthID-Text vízjelét. Ez egy statisztikai jel a szóválasztásokban, az olvasók számára láthatatlan, és a Google SynthID Detectorával ellenőrizhető. Csak a Google saját modelljeire vonatkozik, így egy negatív SynthID-eredmény semmit sem mond más AI rendszerek szövegéről.

A Claude vízjelezi a szövegét?

Igen. Minden, 2026. augusztus 2-án vagy azután kiadott Claude modell statisztikai vízjelet ágyaz be a szöveges kimenetébe, minden platformon és csomagban, opt-out nélkül, és a Claude által generált fájlok emellett C2PA metaadatot is tartalmaznak. Az ennél korábban kiadott modellek még nem jelölik a kimenetüket; Anthropic szerint a támogatást egy átmeneti időszak alatt adja hozzájuk. A teljes részletek a Claude vízjelről szóló magyarázatunkban olvashatók.

Az egyetemek képesek észlelni az AI vízjeleket?

Csak a szolgáltató együttműködésével, mert az észleléshez a szolgáltató kulcsa szükséges. A Google nyilvános detektorportált kínál a SynthID-tartalmakhoz. Anthropic szerint a felhasználók és harmadik felek számára az észlelési támogatás tervben van, de nyilvános detektort még nem adott ki. Jelenleg egyetlen elterjedt plágiumellenőrző csomag sem tudja hitelesíteni egyik labor statisztikai vízjeleit sem, így az intézményi "AI detection" ma továbbra is stílusalapú találgatást jelent, nem vízjel-ellenőrzést.

Az AI vízjelezése törvényileg kötelező?

Az EU-ban gyakorlatilag igen. Az EU AI Act 50. cikkének (2) bekezdése előírja, hogy a generatív AI szolgáltatóknak gondoskodniuk kell arról, hogy a kimenetek géppel olvasható formátumban legyenek megjelölve, és mesterségesen generáltként észlelhetők legyenek, a transzparencia-kötelezettségek pedig 2026. augusztus 2-től alkalmazandók. Anthropic aláírta a kapcsolódó Magatartási Kódexet, és a világméretű megfelelést választotta. Az a kérdés, hogy a szabályozók hogyan kezelik OpenAI ki nem adott szövegvízjelét, 2027-ben lesz majd figyelendő.

Átmegy-e az AI vízjel a fordításon?

Nem. A statisztikai vízjel a modell által kiválasztott szavak pontos sorozatában él, a fordítás pedig minden szót lecserél. Ugyanez igaz a mély paraphrasingre és a jelentős emberi szerkesztésre is. Ezt a korlátot a szakirodalom is dokumentálja, és minden olyan szolgáltató elismeri, amely vízjelet szállít.

Források

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana a ProofreaderPro tartalomkészítője, ahol napi blogot vezet és írási műveleteket végez. Ő írja a cikkeket az online szerkesztőplatform működéséről, és minden nap kezeli az ügyfelek üzeneteit, amiről ötcsillagos elégedettségi pontszámot tudhat.

Olvasás folytatása

Próbáld ki a(z) Text Humanizer ingyenes verziót

Kezdés ingyenesen
Proofreader Pro AI
Fejlessze kutatását a ProofreaderPro.ai segítségével, a világ vezető mesterséges intelligenciával működő lektorálója, amely az akadémiai szövegekhez lett testre szabva.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
© 2026 ProofreaderPro.ai. Egy vezető tudományos korrektor, szerkesztő és humanizáló. Készült ezzel ❤️ és nyelvileg helyes szintaxis 🌳s