Marca de apă Claude a Anthropic, explicată (2026)
Claude încorporează acum un filigran invizibil în textul său. Cum funcționează, ce supraviețuiește acestuia și ce dovedește de fapt o detectare pozitivă.
Pe 11 august 2026, Anthropic a anunțat că Claude va începe să încorporeze un watermark invizibil în textul pe care îl scrie. În decurs de câteva ore, cea mai vehementă obiecție nu venea de la studenți. Venea de la avocați, academicieni și cercetători care folosesc Claude pentru a corecta stilistic texte care le aparțin în întregime și care aflaseră abia atunci că munca lor va purta acum un marcaj generat de mașină.
Versiunea scurtă: watermark-ul este o părtinire statistică aplicată alegerilor de cuvinte ale lui Claude, nu un caracter ascuns inserat în documentul tău. El supraviețuiește copierii, lipirii, reformatării și conversiei în text simplu. Nu supraviețuiește unei rescrieri, unei traduceri sau unei editări ample. Se aplică tuturor modelelor Claude lansate la sau după 2 august 2026, la nivel global, fără posibilitate de renunțare. Iar o detectare pozitivă îți spune că Claude poate că a procesat textul. Nu îți spune cine l-a scris.
Acest ghid acoperă ce a construit de fapt Anthropic, al doilea sistem de marcare care a primit aproape deloc acoperire, ce dovedește și ce nu dovedește marcajul și ce poți face dacă un text scris de tine a fost marcat.
Ce a anunțat de fapt Anthropic?
Politica a fost publicată în centrul de ajutor Anthropic într-un articol intitulat Cum marchează Claude conținutul generat de AI. Esențialul:
| Anunțat | 11 august 2026 |
| Se aplică la | Orice model Claude lansat la sau după 2 august 2026 |
| Modele mai vechi | Anthropic spune că lucrează la adăugarea marcării într-o perioadă de tranziție |
| Suporturi acoperite | Claude API, claude.ai, Claude Code, Claude Cowork, Claude Tag și Claude prin AWS, Google Cloud și Microsoft Foundry |
| Geografie | La nivel global |
| Renunțare | Niciuna, pe niciun plan |
| Detectare | Planificată prin propriile instrumente Anthropic, fără un calendar oferit |
Motorul este de natură de reglementare. Anthropic a semnat codul de practică al EU AI Act, Articolul 50(2), privind transparența conținutului generat de AI, care le cere furnizorilor de sisteme generative să își marcheze rezultatele astfel încât să poată fi identificate ca fiind create de mașină. Obligația este europeană. Decizia Anthropic de a o aplica fiecărui utilizator de pe Pământ, și nu doar traficului din UE, nu este.
Cum funcționează watermark-ul Claude?
Aceasta este partea pe care aproape fiecare articol a prezentat-o greșit în primele 48 de ore, iar a o prezenta greșit îi conduce pe oameni către soluții care nu pot funcționa în mod real.
Când un model de limbaj scrie, nu alege singurul cuvânt corect următor. În majoritatea punctelor dintr-o propoziție există mai multe continuări statistic aproape echivalente: câteva cuvinte dintre care oricare ar suna natural. Watermark-ul înclină această alegere conform unei chei secrete deținute de Anthropic. Fiecare alegere individuală pare banală. Pe parcursul unui pasaj suficient de lung, modelul acumulat al alegerilor formează o distribuție pe care un detector care deține cheia o poate măsura.
Rezultă trei consecințe, iar ele explică aproape totul despre comportamentul marcajului:
Nu se adaugă nimic în textul tău. Nici caractere zero-width, nici spații invizibile, nici un câmp de metadate, nici un artificiu de formatare. Watermark-ul este o proprietate a cuvintelor alese, motiv pentru care Anthropic poate spune pe bună dreptate că nu schimbă sensul, calitatea sau lizibilitatea rezultatului.
Se transmite odată cu cuvintele. Copiezi textul într-un e-mail, îl lipești în Word, îl convertești în text simplu, schimbi formatul fișierului. Cuvintele rămân aceleași, deci și semnătura rămâne aceeași.
Are nevoie de volum. O măsurare statistică făcută pe o distribuție de tokeni necesită suficienți tokeni. Chiar Anthropic enumeră conținutul „prea scurt pentru detectare fiabilă” drept motiv pentru care un watermark poate să nu fie găsit.
Al doilea sistem pe care nu l-a acoperit nimeni: metadatele fișierelor C2PA
Watermark-ul textual a luat titlurile, dar Anthropic a anunțat două mecanisme, nu unul.
Când Claude generează un fișier, nu proză, mai exact .svg, .png și .jpg, Anthropic atașează metadate de proveniență semnate digital, în conformitate cu standardul C2PA al Coalition for Content Provenance and Authenticity. Aceasta este o tehnologie diferită, care rezolvă o altă jumătate a problemei: un format susținut de industrie pentru înregistrarea originii unui asset și a istoricului său de modificare, semnat criptografic astfel încât alterarea să poată fi detectată.
Este și considerabil mai fragilă decât marcajul textual. Anthropic recunoaște că metadatele C2PA pot fi eliminate prin conversia formatului, prin salvarea din nou într-un instrument care nu suportă standardul sau pur și simplu prin realizarea unei capturi de ecran. Metadatele există alături de fișier; un watermark statistic există în interiorul cuvintelor. Această diferență de durabilitate explică de ce marcajul textual a stârnit disputa, iar marcajul din fișier nu.
Ce elimină watermark-ul și ce nu
Linia de separație este mecanică, nu o chestiune de cât efort depui. Fie o acțiune lasă cuvintele tale reale intacte, fie le reconstruiește.
| Acțiune | Supraviețuiește marcajul? | De ce |
|---|---|---|
| Copiere și lipire | Da | Cuvintele nu se schimbă |
| Reformatere, schimbarea tipului de fișier | Da | Cuvintele nu se schimbă |
| Eliminarea caracterelor invizibile | Da | Nu au existat niciodată caractere de eliminat |
| Corectură ușoară | De obicei | Majoritatea alegerilor de cuvinte supraviețuiesc unei treceri ușoare |
| Editare amplă | Adesea nu | Anthropic spune că marcajul "poate persista prin unele editări" |
| Traducere în altă limbă | Nu | Secvența de tokeni este reconstruită de la zero |
| O rescriere substanțială | Nu | Fiecare alegere de cuvânt este făcută din nou, de un model diferit |
| Fragmente foarte scurte | Nemeasurabil | Sub pragul pentru un semnal fiabil |
Rândul care contează comercial este al treilea. Majoritatea instrumentelor gratuite promovate în prezent ca eliminatoare de watermark-uri AI caută caractere Unicode zero-width și spațieri invizibile și șterg orice găsesc. A fost un răspuns rezonabil la o problemă cu adevărat diferită, iar împotriva watermark-ului lui Claude nu realizează nimic. Dacă treci unul dintre acești curățători peste rezultatul Claude, ceea ce revine măsurat este exact la fel ca la intrare.
Ce dovedește, de fapt, o detecție pozitivă?
Mai puțin decât implică cuvântul "detecție", iar acest lucru merită atenție, deoarece politicile instituționale sunt scrise rapid chiar acum.
Un rezultat pozitiv semnalează că un pasaj poate să fi fost procesat de Claude. Anthropic precizează clar că un watermark detectat nu stabilește că Claude a redactat conținutul, din motivul evident că oamenii folosesc modelul pentru editarea, traducerea și rezumarea muncii pe care au scris-o ei înșiși. Măsurarea nu poate distinge un document redactat de Claude de unul pe care Claude doar l-a ordonat.
Un rezultat negativ dovedește și mai puțin. Textul nemarcat poate fi scris de un om, poate proveni de la un model fără niciun watermark, poate fi output Claude care a fost editat intensiv sau poate fi pur și simplu prea scurt pentru a fi măsurat.
Mai există o limitare practică importantă: detectoarele AI de uz general nu pot citi acest marcaj. Detecția necesită cheia Anthropic, așa că trece prin instrumentele proprii ale Anthropic, care nu aveau un calendar de lansare la momentul anunțului. Detectoarele pe care instituția ta le folosește deja nu citesc astăzi watermark-ul lui Claude.
De ce reacția negativă a venit de la editori, nu de la oamenii care ascund AI
Reacția a fost puternic negativă, iar forma ei este partea cea mai interesantă comercial și etic din poveste.
Nemulțumirea care a dominat nu a fost „acum nu mai pot da drept al meu un text făcut cu AI”. A fost „acum propria mea scriere este marcată ca AI”. Avocatul Peter Harrell a spus-o direct: dacă își încarcă propria scriere pentru o corectură, Claude va „watermark my (human written, AI-copy edited) text as AI, which seems ridiculous”. Politologul Maya Sen a făcut același punct despre schimbarea care face modelul mai puțin util pentru oameni ca ea. Prezentatorul radio Erick Erickson: „the stuff I've written will be watermarked that Claude did the work.”
Ei descriu o problemă reală și specifică: atribuire falsă. Watermarkul înregistrează că modelul a produs o secvență de tokeni. Nu înregistrează, și structural nu poate înregistra, cine a produs ideile, argumentul, cercetarea sau schița originală. Pentru un autor al cărui angajator, editor, jurnal sau universitate citește un semnal pozitiv ca dovadă definitivă a autoratului de mașină, acel gol nu este unul academic.
Dezvoltatorii au ridicat o variantă paralelă a problemei. Codul trece în mod obișnuit prin formatori, linters și instrumente de refactorizare, fiecare rescriind orice alegeri de tokeni au mai rămas. Într-un flux de dezvoltare normal, semnul se degradează rapid, ceea ce îl face nesigur pentru cazul de utilizare legat de proveniența codului pe care unii și l-au imaginat imediat.
Unde se situează acest lucru în industria mai largă
Anthropic nu este primul, dar domeniul este mai restrâns decât sugera cea mai mare parte a acoperirii media.
SynthID de la Google a fost singurul watermark pentru text implementat la scară de un furnizor major, folosind aceeași idee de bază de a înclina probabilitățile tokenilor în timpul generării. A început cu imagini în 2023 și s-a extins la text, audio și video, iar a fost adoptat și dincolo de Google, inclusiv de OpenAI pentru imagini și output vocal, precum și de ElevenLabs, Kakao și NVIDIA.
OpenAI este golul notabil. Încorporează SynthID în imaginile din ChatGPT și și-a extins acoperirea la voce, dar, la data redactării, nu a lansat un watermark pentru text în ChatGPT. Această asimetrie merită avută în vedere înainte de a trage concluzii din orice rezultat de detecție singular: un document fără watermark Claude poate pur și simplu să fi fost scris cu un model care nu marchează deloc textul.
Ce să faci dacă propria ta scriere a fost marcată
Dacă textul este într-adevăr al tău și marca este un artefact al corecturii, soluția este să reformulezi pasajul astfel încât secvența de tokeni să fie reconstruită. Editarea la margini nu o va rezolva în mod fiabil, deoarece majoritatea alegerilor tale de cuvinte supraviețuiesc unei treceri ușoare.
Pentru un singur paragraf sau o singură secțiune, free Claude watermark remover face exact asta. Reconstruiește până la 500 de cuvinte odată, în formulare nouă printr-un alt model, păstrând fixe faptele, cifrele, datele, precauțiile și terminologia tehnică, și reproducând citatele și trimiterile bibliografice caracter cu caracter. Este gratuit cu un cont și funcționează pe singurul mecanism care poate funcționa: regenerarea tokenilor, nu filtrarea textului.
Pentru un manuscris complet, un capitol de teză sau un raport, AI text humanizer este opțiunea mai potrivită. O trecere completă de humanizer rescrie întregul document, nu doar îl parchează, mutând proza în stil de mașină într-un stil natural, uman de scriere și eliminând un watermark la nivel de token ca efect secundar al modului în care funcționează. Ambele protejează citările; diferența este de scară și profunzime.
Iar dacă problema de fond este că editarea asistată de AI continuă să vă pună munca sub suspiciune, AI proofreader editează documente complete cu modificări urmărite pe care le aprobați linie cu linie și nu vă watermarkează textul.
Întrebări frecvente
Q: Claude aplică watermark la tot textul pe care îl generează?
Fiecare model Claude lansat la sau după August 2, 2026 încorporează watermark-ul, în cadrul Claude API, claude.ai, Claude Code, Claude Cowork, Claude Tag și Claude accesat prin AWS, Google Cloud și Microsoft Foundry. Anthropic a spus că lucrează la extinderea marcării și la modelele mai vechi, pe durata unei perioade de tranziție, așa că este riscant să consideri că orice a fost lansat înainte de august este automat exceptat. Se aplică la nivel global și nu există nicio opțiune de renunțare pe niciun plan.
Q: Pot dezactiva watermark-ul Claude?
Nu. Anthropic nu a oferit o setare, un nivel de plan sau un parametru API care să îl dezactiveze, iar politica se aplică fiecărui utilizator, indiferent de locație. Marcarea pune în practică un angajament de transparență în temeiul EU AI Act, motiv pentru care nu este oferită ca preferință a utilizatorului.
Q: Funcționează instrumentele de eliminare a watermark-ului AI care șterg caractere invizibile?
Nu, și aceasta este cea mai frecventă neînțelegere legată de anunț. Aceste instrumente caută caractere Unicode zero-width și spațiere invizibilă. Watermark-ul Claude este o bias statistică în privința cuvintelor pe care modelul le-a selectat, deci nu există nimic de acest fel de eliminat. Textul trecut printr-un astfel de curățător păstrează exact semnătura cu care a pornit. Doar regenerarea token-urilor, ceea ce înseamnă rescriere, afectează un watermark bazat pe bias de eșantionare.
Q: Va apărea watermark-ul în Turnitin sau GPTZero?
Nu acum. Citirea marcajului necesită cheia secretă folosită pentru a-l încorpora, așa că detectarea se face prin instrumentele proprii Anthropic, nu prin detectoare AI terțe. Anthropic a spus că intenționează să facă verificarea disponibilă, dar nu a oferit un calendar la momentul anunțului. Rețineți că acest lucru este independent de faptul dacă acele detectoare vă marchează textul din alte motive, lucru pe care îl pot face indiferent de orice watermark.
Q: Demonstrează watermark-ul că Claude a scris ceva?
Nu. Indică faptul că textul poate să fi fost procesat de Claude. Anthropic afirmă clar că un watermark detectat nu confirmă faptul că Claude a fost autorul conținutului, deoarece modelul este folosit pe scară largă pentru editare, traducere și rezumarea textelor scrise de oameni. Nu poate separa un draft generat de model de un paragraf pe care l-a corectat stilistic și nu spune nimic despre ce proporție dintr-un document este scrisă de mașină.
Q: Parafrazarea elimină watermark-ul Claude?
Parafrazarea amplă o face, deoarece reconstruiește secvența de cuvinte în loc să o ajusteze. Parafrazarea ușoară nu este fiabilă: dacă cele mai multe alegeri de cuvinte originale supraviețuiesc, supraviețuiește și suficient din semnal pentru a fi măsurat. Aceeași logică se aplică traducerii, care elimină complet marcajul, și corecturii ușoare, care în general nu o face.
Q: Dar imaginile și fișierele pe care le generează Claude?
Acestea folosesc un sistem diferit. Fișierele în formate compatibile, .svg, .png și .jpg, primesc metadate de proveniență semnate digital, construite pe standardul C2PA, în locul unui watermark statistic. Metadatele C2PA se pierd mai ușor: Anthropic notează că pot fi eliminate prin conversia formatului, prin salvarea din nou într-un instrument care nu suportă standardul sau prin realizarea unei capturi de ecran.

Dana este creatoare de conținut la ProofreaderPro, unde conduce zilnic blogul și operațiunile de scriere. Ea scrie articolele despre modul în care funcționează platforma de editare online și se ocupă de mesajele clienților în fiecare zi, cu un scor de satisfacție de cinci stele pentru asta.