Az Anthropic Claude vízjele, magyarázat (2026)
A Claude mostantól egy láthatatlan vízjelet ágyaz a szövegébe. Hogyan működik, mi éli túl, és mit bizonyít valójában egy pozitív észlelés.
- augusztus 11-én az Anthropic bejelentette, hogy a Claude elkezd egy láthatatlan vízjelet beágyazni az általa írt szövegbe. Néhány órán belül a leghangosabb tiltakozás nem a hallgatóktól érkezett. Azoktól az ügyvédektől, akadémikusoktól és kutatóktól jött, akik a Claude-ot arra használják, hogy olyan szövegeket szerkesszenek nyelvileg, amelyek teljes egészében a sajátjuk, és akik épp akkor tudták meg, hogy a munkájuk mostantól egy gép által generált jelölőt fog hordozni.
A rövid verzió: a vízjel egy statisztikai torzítás, amelyet a Claude szóválasztására alkalmaznak, nem pedig egy rejtett karakter, amelyet a dokumentumodba szúrnak be. Túléli a másolást, beillesztést, újraformázást és a sima szöveggé alakítást. Nem éli túl az átfogalmazást, a fordítást vagy a jelentős szerkesztést. Minden, 2026. augusztus 2-án vagy azt követően kiadott Claude modellre vonatkozik, világszerte, letiltási lehetőség nélkül. És egy pozitív észlelés azt jelzi, hogy a Claude feldolgozhatta a szöveget. Nem azt mondja meg, ki írta.
Ez az útmutató azt mutatja be, mit épített valójában az Anthropic, mi a második jelölési rendszer, amelyről szinte egyáltalán nem esett szó, mit bizonyít és mit nem bizonyít a jelölés, és mit tehetsz, ha a saját írásod jelölést kapott.
Mit jelentett be valójában az Anthropic?
A szabályzatot az Anthropic súgóközpontjában tették közzé egy How Claude marks AI-generated content című cikkben. A lényeg:
| Bejelentés dátuma | 2026. augusztus 11. |
| Hatálya alá tartozik | Minden Claude modell, amelyet 2026. augusztus 2-án vagy azt követően adtak ki |
| Régebbi modellek | Az Anthropic szerint egy átmeneti időszak alatt dolgozik a jelölés hozzáadásán |
| Érintett felületek | Claude API, claude.ai, Claude Code, Claude Cowork, Claude Tag, valamint a Claude az AWS, a Google Cloud és a Microsoft Foundry szolgáltatásain keresztül |
| Földrajzi hatály | Világszerte |
| Leiratkozás | Nincs, egyik csomag esetében sem |
| Észlelés | Az Anthropic saját eszközein keresztül tervezett, idővonal megadása nélkül |
A mozgatórugó szabályozási. Az Anthropic aláírta az EU AI Act 50. cikk (2) bekezdésének a gépi tanulással generált tartalom átláthatóságára vonatkozó magatartási kódexét, amely előírja, hogy a generatív rendszerek szolgáltatóinak meg kell jelölniük a kimenetüket, hogy az gépi eredetűként azonosítható legyen. A kötelezettség európai. Az Anthropic döntése, hogy ezt a világ minden felhasználójára alkalmazza, nem csak az EU-s forgalomra, az már nem az.
Hogyan működik a Claude vízjele?
Ez az a rész, amelyet szinte minden cikk rosszul magyarázott az első 48 órában, és a téves magyarázat olyan megoldásokhoz vezet, amelyek egyszerűen nem működhetnek.
Amikor egy nyelvi modell ír, nem az egyetlen helyes következő szót választja. Egy mondaton belül a legtöbb ponton több folytatás is statisztikailag közel egyenértékű: néhány szó, amelyek közül bármelyik természetesen hangzana. A vízjel ezt a választást az Anthropic által birtokolt titkos kulcs alapján torzítja. Egyetlen döntés önmagában nem feltűnő. Elég hosszú szövegrészletben a döntések felhalmozódó mintázata olyan eloszlást alkot, amelyet a kulcsot birtokló észlelő meg tud mérni.
Ebből három következmény adódik, és ezek szinte mindent megmagyaráznak a jel viselkedéséről:
Semmi sem kerül hozzá a szöveghez. Nincsenek nulla szélességű karakterek, rejtett szóközök, metaadatmezők, formázási trükkök. A vízjel annak a tulajdonsága, hogy mely szavakat választották, ezért mondhatja az Anthropic pontosan azt, hogy ez nem változtatja meg a kimenet jelentését, minőségét vagy olvashatóságát.
A szavakkal együtt utazik. Másold a szöveget e-mailbe, illeszd be Wordbe, alakítsd sima szöveggé, változtasd meg a fájlformátumot. A szavak változatlanok, így az aláírás is változatlan.
Nagy mennyiség kell hozzá. Egy tokeneloszláson végzett statisztikai méréshez elegendő számú tokenre van szükség. Maga az Anthropic is a vízjel esetleges hiányának okaként említi, ha egy tartalom „túl rövid a megbízható észleléshez”.
A második rendszer, amelyről senki nem beszélt: C2PA fájlmetaadat
A szöveges vízjel kapta a címlapokat, de Anthropic két mechanizmust jelentett be, nem egyet.
Amikor a Claude fájlt generál próza helyett, konkrétan .svg, .png és .jpg formátumban, Anthropic digitálisan aláírt eredetiségi metaadatot csatol a C2PA szabvány alapján, a Coalition for Content Provenance and Authenticity kezdeményezését követve. Ez egy másik technológia, amely a probléma másik felét oldja meg: iparági támogatású formátum egy eszköz eredetének és módosítási előtörténetének rögzítésére, kriptográfiailag aláírva, hogy a manipuláció kimutatható legyen.
Sokkal sérülékenyebb is, mint a szöveges jel. Anthropic elismeri, hogy a C2PA metaadat eltávolítható formátumkonvertáláskor, olyan eszközben történő újramentéskor, amely nem támogatja a szabványt, vagy egyszerűen egy képernyőkép készítésével. A metaadat a fájl mellett létezik; a statisztikai vízjel a szavakban. Ez a tartósságbeli különbség az oka annak, hogy a szöveges jel kavarta a vitát, a fájljel pedig nem.
Mi távolítja el a vízjelet, és mi nem
A választóvonal mechanikus, nem pedig annak kérdése, mennyi erőfeszítést tesz bele. Vagy egy művelet változatlanul hagyja a tényleges szavaidat, vagy újraalkotja őket.
| Művelet | Megmarad a jel? | Miért |
|---|---|---|
| Másolás és beillesztés | Igen | A szavak változatlanok |
| Újraformázás, fájltípus váltása | Igen | A szavak változatlanok |
| Láthatatlan karakterek eltávolítása | Igen | Nem voltak eltávolítható karakterek |
| Könnyű lektorálás | Általában | A legtöbb szóválasztás megmarad egy enyhe átdolgozás után |
| Erős szerkesztés | Gyakran nem | Anthropic szerint a jel "megmaradhat bizonyos szerkesztések során" |
| Fordítás más nyelvre | Nem | A token-sorozatot teljesen újraépítik |
| Jelentős átírás | Nem | Minden szóválasztás újra megszületik, egy másik modell által |
| Nagyon rövid részletek | Nem mérhető | A megbízható jelhez szükséges küszöb alatt van |
Kereskedelmi szempontból a harmadik sor a lényeges. A jelenleg vízjel-eltávolítóként árult ingyenes eszközök többsége a nullaszéles Unicode karaktereket és a láthatatlan szóközöket keresi, majd törli, amit talál. Ez ésszerű válasz volt egy valóban más problémára, Claude vízjelével szemben azonban pontosan semmit nem ér. Ha valaki egy ilyen tisztítóval futtatja át a Claude kimenetét, az eredmény ugyanúgy mérhető, mint bemenetként.
Mit bizonyít valójában egy pozitív észlelés?
Kevesebbet, mint amit az "észlelés" szó sugall, és ezt érdemes komolyan venni, mert az intézményi szabályozás most gyorsan készül.
A pozitív eredmény azt jelzi, hogy egy részletet Claude feldolgozhatott. Anthropic egyértelműen kimondja, hogy az észlelt vízjel nem bizonyítja, hogy Claude írta a tartalmat, nyilvánvaló okból: az emberek gyakran használják a modellt saját maguk által írt szövegek szerkesztésére, fordítására és összefoglalására. A mérés nem tud különbséget tenni aközött, hogy Claude egy dokumentumot megírt, vagy csak csiszolt rajta.
A negatív eredmény még ennél is kevesebbet bizonyít. A jelöletlen szöveg lehet ember által írt, lehet olyan modellből származó, amely egyáltalán nem használ vízjelet, lehet Claude-kimenet, amelyet erősen átdolgoztak, vagy egyszerűen túl rövid lehet a méréshez.
Van még egy gyakorlati korlát, amit érdemes tudni: az általános célú AI detektorok nem tudják olvasni ezt a jelet. Az észleléshez Anthropic kulcsa szükséges, ezért ez Anthropic saját eszközein keresztül történik, amelyeknek a bejelentéskor nem volt ismert megjelenési ütemtervük. Azok a detektorok, amelyeket az intézményed már most használ, ma nem olvassák Claude vízjelét.
Miért az szerkesztőktől jött a visszhang, nem azoktól, akik AI-t rejtegetnek
A reakció erősen negatív volt, és ennek a formája a történet üzleti és etikai szempontból legérdekesebb része.
Az uralkodó panasz nem az volt, hogy "most már nem tudom sajátomként eladni az AI-val készült munkát". Hanem az, hogy "most a saját írásomat is AI-ként jelöli". Peter Harrell ügyvéd ezt egyenesen így fogalmazta meg: ha saját szövegét tölti fel egy korrektúrához, Claude "watermark my (human written, AI-copy edited) text as AI, which seems ridiculous". Maya Sen politikatudós ugyanezt a pontot emelte ki a változtatás kapcsán, mondván, hogy az a hozzá hasonló emberek számára kevésbé hasznossá teszi a modellt. Erick Erickson rádiós műsorvezető: "the stuff I've written will be watermarked that Claude did the work."
Valós és konkrét problémát írnak le: false attribution. A vízjel azt rögzíti, hogy a modell tokenek egy sorozatát állította elő. Azt nem, és szerkezetileg nem is tudja rögzíteni, hogy ki hozta létre az ötleteket, az érvelést, a kutatást vagy az eredeti vázlatot. Egy olyan író számára, akinek a munkáltatója, kiadója, folyóirata vagy egyeteme egy pozitív jelet a gépi szerzőség eldöntött bizonyítékaként értelmez, ez a rés nem akadémiai kérdés.
A fejlesztők ennek egy párhuzamos változatát emelték ki. A kód rutinszerűen átmegy formázókon, lintelőkön és refaktoráló eszközökön, amelyek mind átírják a megmaradt tokenválasztásokat. Egy szokásos fejlesztési folyamatban a jel gyorsan romlik, ami megbízhatatlanná teszi olyan kóderedet use case számára, amelyre néhányan azonnal gondoltak.
Hol helyezkedik el ez a szélesebb iparágban
Az Anthropic nem az első, de a mező sokkal szűkebb, mint azt a legtöbb tudósítás sugallta.
A Google SynthID-je volt az egyetlen, nagy szolgáltató által nagy léptékben bevezetett szövegvízjel, ugyanarra az alapötletre építve, vagyis a tokenvalószínűségek generálás közbeni torzítására. Képekkel kezdődött 2023-ban, majd kiterjedt a szövegre, hangra és videóra, és a Google-n túl is átvették, többek között az OpenAI a képek és a hangkimenet esetében, valamint az ElevenLabs, a Kakao és az NVIDIA.
Az OpenAI a figyelemre méltó hiányzó szereplő. A SynthID-t beágyazza a ChatGPT képeibe, és a hangra is kiterjesztette a lefedettséget, de e cikk írásakor nem adott ki szövegvízjelet a ChatGPT-hez. Ez az aszimmetria fontos, mielőtt bármilyen egyetlen detektálási eredményből messzemenő következtetést vonnánk le: egy Claude-vízjel nélküli dokumentum egyszerűen készülhetett olyan modellel is, amely egyáltalán nem jelöl szöveget.
Mit tegyen, ha a saját írását megjelölték
Ha a szöveg valóban az Öné, és a jel egy korrektúra mellékterméke, a megoldás az, hogy újrafogalmazza a részt, hogy a tokenlánc újraépüljön. A szélek körüli szerkesztés ezt nem fogja megbízhatóan megoldani, mivel a szavak többsége egy enyhe átdolgozás során is megmarad.
Egyetlen bekezdés vagy szakasz esetén az ingyenes Claude vízjel eltávolító pontosan ezt teszi. Egyszerre legfeljebb 500 szót épít újjá friss megfogalmazásban egy másik modellen keresztül, miközben a tényeket, számokat, dátumokat, fenntartásokat és szakszavakat változatlanul tartja, és a idézeteket valamint hivatkozásokat karakterről karakterre reprodukálja. Fiókkal ingyenes, és azt az egyetlen mechanizmust használja, amely működhet: a tokenek újragenerálását, nem pedig a szöveg szűrését.
Egy teljes kézirat, szakdolgozati fejezet vagy jelentés esetén az AI text humanizer a jobb választás. A teljes humanizer-folyamat az egész dokumentumot átírja ahelyett, hogy foltozná, a gépies stílusú prózát természetes emberi stílusú írássá alakítva, és mellékhatásként eltüntetve a token szintű vízjelet annak működése révén. Mindkettő védi a hivatkozásokat; a különbség a lépték és a mélység.
És ha a mögöttes gond az, hogy az AI-val támogatott szerkesztés továbbra is gyanúba keveri a munkáját, akkor az AI proofreader teljes dokumentumokat szerkeszt követett módosításokkal, amelyeket soronként jóváhagyhat, és nem vízjelezi a szövegét.
Gyakran ismételt kérdések
Q: A Claude minden szöveges kimenetébe vízjelet tesz?
Minden, 2026. August 2. után kiadott Claude modell beágyazza a vízjelet, a Claude API, a claude.ai, a Claude Code, a Claude Cowork, a Claude Tag és az AWS, Google Cloud és Microsoft Foundry szolgáltatásokon keresztül elért Claude esetében is. Az Anthropic azt mondta, hogy egy átmeneti időszak alatt dolgozik a jelölés kiterjesztésén a régebbi modellekre is, ezért nem biztonságos automatikusan mentesnek tekinteni mindent, ami August előtt jelent meg. A rendszer világszerte érvényes, és egyik csomagban sincs leiratkozási lehetőség.
Q: Ki tudom kapcsolni a Claude vízjelét?
Nem. Az Anthropic nem biztosított olyan beállítást, csomagszintet vagy API-paramétert, amellyel ez letiltható lenne, és a szabályzat minden felhasználóra érvényes, helytől függetlenül. A jelölés az EU AI Act szerinti átláthatósági vállalás megvalósítása, ezért nem kínálják felhasználói preferenciaként.
Q: Működnek azok az AI watermark remover eszközök, amelyek eltávolítják a láthatatlan karaktereket?
Nem, és ez az egyetlen leggyakoribb félreértés a bejelentéssel kapcsolatban. Ezek az eszközök a zéró szélességű Unicode karaktereket és a láthatatlan szóközöket keresik. A Claude vízjele ezzel szemben statisztikai torzítás abban, hogy a modell mely szavakat választotta, ezért nincs benne semmi ilyesmi, amit el lehetne távolítani. Az ilyen tisztítón átfuttatott szöveg pontosan ugyanazzal az aláírással rendelkezik, amellyel elkezdte. Csak a tokenek újragenerálása, vagyis az átírás, befolyásolja a mintavételi torzításon alapuló vízjelet.
Q: Megjelenik a vízjel a Turnitinben vagy a GPTZero-ban?
Ma még nem. A jel olvasásához szükség van a beágyazásához használt titkos kulcsra, ezért az ellenőrzés az Anthropic saját eszközein keresztül történik, nem harmadik fél AI detektorain keresztül. Az Anthropic azt mondta, tervezi, hogy elérhetővé teszi az ellenőrzést, de a bejelentéskor nem adott ütemtervet. Fontos, hogy ez független attól, hogy ezek a detektorok más okokból megjelölik-e a szövegét, amit megtehetnek a vízjeltől függetlenül is.
Q: Bizonyítja a vízjel, hogy a Claude írt valamit?
Nem. Azt jelzi, hogy a szöveget esetleg a Claude dolgozta fel. Az Anthropic világosan kimondja, hogy az észlelt vízjel nem igazolja, hogy a Claude volt a tartalom szerzője, mivel a modellt széles körben használják olyan szövegek szerkesztésére, fordítására és összefoglalására is, amelyeket emberek maguk írtak. Nem tud különbséget tenni a modell által generált vázlat és egy olyan bekezdés között, amelyet csak nyelvileg csiszolt, és arról sem mond semmit, hogy a dokumentum mekkora része gépi írás.
Q: Eltávolítja a Claude vízjelét az átfogalmazás?
Az erős átfogalmazás igen, mert újraépíti a szavak sorrendjét, ahelyett hogy finomítaná azt. A könnyű átfogalmazás megbízhatatlan: ha az eredeti szóválasztások nagy része megmarad, akkor a jelből is elég marad a méréshez. Ugyanez a logika vonatkozik a fordításra, amely teljesen eltávolítja a jelet, valamint a könnyű lektorálásra, amely ezt általában nem teszi meg.
Q: Mi a helyzet a Claude által generált képekkel és fájlokkal?
Azok más rendszert használnak. A támogatott formátumú fájlok, a .svg, .png és .jpg, digitálisan aláírt provenance metaadatot kapnak a C2PA szabványra építve, nem statisztikai vízjelet. A C2PA metaadat könnyebben elveszhet: az Anthropic megjegyzi, hogy eltávolíthatja a formátumkonvertálás, egy olyan eszközben való újramentés, amely nem támogatja a szabványt, vagy egy képernyőkép készítése.

Dana a ProofreaderPro tartalomkészítője, ahol napi blogot vezet és írási műveleteket végez. Ő írja a cikkeket az online szerkesztőplatform működéséről, és minden nap kezeli az ügyfelek üzeneteit, amiről ötcsillagos elégedettségi pontszámot tudhat.