ProofreaderPro.ai
Umanizare text AI

Watermarking pentru text generate de AI în 2026: Cum diferă OpenAI, Google și Anthropic

OpenAI a construit un watermark pentru text și nu l-a lansat niciodată. Google a livrat SynthID și l-a open-source. Anthropic a făcut obligatoriu Claude. Ce face fiecare sistem, ce demonstrează și ce înseamnă asta pentru scrierea ta.

Dana|19 aug. 2026|10 min citit
Watermarking pentru text generate de AI în 2026: Cum diferă OpenAI, Google și Anthropic - ProofreaderPro Blog

OpenAI, Google și Anthropic au construit toate aceeași tehnologie: un watermark statistic pentru text generat de AI. OpenAI nu și-a lansat niciodată versiunea. Google a livrat SynthID în Gemini și a publicat metoda. Anthropic a făcut watermark-ul Claude obligatoriu pentru fiecare utilizator în august 2026. Dacă scrii cu asistență AI sub orice formă, toate cele trei decizii influențează acum modul în care sunt evaluate documentele tale.

Watermarking-ul a trecut de la un subiect de cercetare la știri mainstream pe 11 august 2026, când Anthropic a anunțat că fiecare model nou Claude marchează ieșirea sa de text. Am acoperit acel anunț în detaliu în explicarea watermark-ului Claude. Acest ghid acoperă imaginea completă: ce este un watermark pentru text, cum a implementat sau reținut fiecare dintre cele trei laboratoare majore, și ce dovedește fiecare sistem despre o bucată de scriere.

Ce este un watermark de text AI?

Un watermark de text AI este un tipar statistic ascuns în alegerile de cuvinte ale textului generat, introdus în momentul generării astfel încât un detector care deține cheia potrivită să poată verifica ulterior că textul a provenit de la un anumit sistem AI. Nu este o etichetă vizibilă, nu este un caracter ascuns și nu este metadate atașate unui fișier. Marcajul trăiește în chiar cuvintele folosite.

Această distincție contează, pentru că termenul "watermark" este folosit în mod vag pentru trei lucruri diferite:

Ce esteUnde existăSupraviețuiește la copy-paste?
Watermark statisticO bias în ce cuvinte alege modelulTextul în sineDa
Metadate ale fișierului (C2PA)O etichetă semnată de proveniențăContainerul fișieruluiNu, copierea ca text simplu o elimină
Caractere zero-widthUnicode invizibil inserat în textÎntre caracterele vizibileNu, sunt eliminate foarte ușor

Watermarking-ul statistic este singurul dintre cele trei care supraviețuiește copierii, lipirii, rescrierii într-un document nou și conversiei de format. De aceea toate cele trei laboratoare majore au ajuns la el pentru text, și de ce "watermark removers" care elimină caractere invizibile nu fac nimic împotriva lui. Pagina noastră free Claude watermark remover documentează acest mod de eșec cu surse.

Cum funcționează, de fapt, watermarking-ul statistic?

La fiecare pas al scrierii unei propoziții, un model de limbaj alege între mai multe cuvinte aproape echivalente, iar un watermark încarcă pe ascuns zarurile. Rețeta de bază a fost publicată de Kirchenbauer și colegii de la University of Maryland în ianuarie 2023, în Un watermark pentru modelele lingvistice mari (ICML 2023). Funcționează astfel:

  1. Înainte ca fiecare cuvânt să fie ales, o cheie secretă derivată din cuvintele anterioare împarte vocabularul într-un set preferat și un set neutru.
  2. Modelul își împinge alegerea către setul preferat. „Suggest” în loc de „indicate”. „Across” în loc de „among”. Fiecare alegere individuală pare complet naturală.
  3. Un detector care deține cheia numără de câte ori textul ajunge în seturile preferate. Scrierea umană atinge rata așteptată prin hazard. Textul watermarkat o atinge mult prea des, iar un test statistic semnalează discrepanța.

Niciun cuvânt singular nu este o dovadă a ceva. Semnalul apare doar pe parcursul a zeci sau sute de alegeri, motiv pentru care pasajele mai lungi sunt mai ușor de testat decât cele scurte și de ce detectarea este întotdeauna probabilistică, nu un verdict de tip da/nu.

Sistemul de producție al Google DeepMind, publicat în Nature în octombrie 2024 ca Watermarking scalabil pentru identificarea rezultatelor modelelor lingvistice mari, a rafinat această abordare cu o tehnică numită tournament sampling, care păstrează calitatea textului suficient de bine încât să ruleze discret, la scară, într-un produs pentru consumatori. Lucrarea contează dincolo de Google: ea este baza publicată la care Anthropic face trimitere pentru implementarea Claude.

Principala slăbiciune a fost publicată înainte de cele mai multe dintre implementări. În martie 2023, Krishna și colegii au arătat în Parafrazarea ocolește detectoarele de text generat de AI (NeurIPS 2023) că regenerarea formulării unui pasaj prăbușește detecția în toate metodele, inclusiv watermarking-ul. Semnalul trăiește în secvența exactă de tokenuri și nicăieri altundeva, așa că orice rescrie secvența, inclusiv un editor uman, rescrie și probele. Fiecare furnizor care livrează astăzi un watermark afirmă această limitare în propria documentație.

Cronologie din 2022 până în 2026 care arată OpenAI propunând watermarking pentru text și fără să-l lanseze, Google livrând SynthID-Text și publicând codul ca open-source, Anthropic implementând watermark-ul Claude la nivel global în august 2026 și etapele EU AI Act care au influențat calendarul

OpenAI: compania care l-a inventat și nu l-a lansat niciodată

OpenAI are de ani buni un filigran funcțional pentru text și a ales, până acum, să nu îl lanseze. Ideea a fost descrisă pentru prima dată public de Scott Aaronson, care lucra atunci la siguranță la OpenAI, într-o prelegere din noiembrie 2022: să influențezi alegerile modelului dintre cuvinte aproape echivalente cu o funcție criptografică secretă, astfel încât textul însuși să demonstreze de unde provine. Acea prelegere precede orice sistem implementat și este documentul fondator al domeniului.

În mai 2024, OpenAI a descris stadiul proiectului în actualizarea sa privind proveniența, Înțelegerea sursei a ceea ce vedem și auzim online. Compania a spus că metoda sa de filigranare a textului era precisă și eficientă în cazul editărilor minore, dar că amâna lansarea în timp ce analiza compromisurile. Două dintre riscurile menționate de OpenAI contează direct pentru autorii academici:

  • Ocolire ușoară. Parafrazarea sau traducerea textului elimină marcajul, exact așa cum a prezis cercetarea din 2023. Un filigran care prinde mai ales persoanele care nu știu că există este un instrument de aplicare slab.
  • Impact disproporționat asupra vorbitorilor non-nativi de engleză. OpenAI a declarat că filigranarea ar putea stigmatiza utilizarea legitimă a AI ca ajutor de scriere pentru persoanele care redactează într-o a doua limbă. Articolul nostru despre de ce detectorii AI semnalează scriitorii non-nativi acoperă aceeași problemă din perspectiva detectorului.

Secțiunea despre filigranarea textului din actualizarea OpenAI privind proveniența din mai 2024, care afirmă că există o metodă funcțională de filigranare a textului, că este vulnerabilă la traducere și rescriere și că ar putea afecta disproporționat vorbitorii non-nativi de engleză

Propria actualizare OpenAI privind proveniența: metoda funcționează, iar compania enumeră motivele pentru care nu a lansat-o.

Pentru imagini și audio, OpenAI a mers pe o altă cale: metadate de proveniență C2PA în ieșirile DALL-E și Sora, care reprezintă o etichetă la nivel de fișier, nu un marcaj în conținut. Pentru text, la sfârșit de august 2026, ieșirea ChatGPT nu poartă niciun filigran. Compania care a propus tehnologia rămâne singura dintre cele trei care nu a implementat-o niciodată.

Google: primul care a lansat, apoi a dat rețeta mai departe

Google DeepMind a lansat primul, a publicat integral, apoi a deschis metoda. Sistemul său, SynthID, a început ca un filigran pentru imagini în 2023 și s-a extins la text în 2024. Când a apărut articolul din Nature în octombrie 2024, SynthID-Text rula deja în interiorul Gemini în producție, ceea ce l-a făcut primul filigran statistic pentru text implementat la scară de consum.

Pagina de prezentare SynthID de la Google DeepMind, care descrie SynthID ca un instrument de filigranare pentru identificarea conținutului generat de AI în text, imagini, audio și video

SynthID acoperă text, imagini, audio și video și a fost activ în ieșirea text Gemini din octombrie 2024.

Apoi Google a publicat implementarea ca open source pe Hugging Face, permițând oricărui dezvoltator să aplice aceeași schemă de filigranare propriilor modele. În mai 2025 a anunțat SynthID Detector, un portal de verificare în care conținutul poate fi analizat pentru marcaje SynthID în text, imagini, audio și video.

O limitare de domeniu contează: SynthID marchează și detectează doar conținutul provenit din propriile modele Google. Nu spune nimic despre ieșirea ChatGPT sau Claude, iar o scanare SynthID curată nu înseamnă că un text este scris de om. Înseamnă că modelele Google nu l-au scris, ceea ce este o afirmație mult mai restrânsă.

Anthropic: ultimul care se mișcă, politica cea mai strictă

Anthropic a implementat cel mai târziu, cu cea mai largă acoperire obligatorie. Toate modelele Claude lansate la sau după August 2, 2026 încorporează un watermark statistic în ieșirea lor textuală, la nivel global, pe toate planurile, fără posibilitate de renunțare. Compania descrie mecanismul în explicația sa, Cum funcționează watermark-ul de text al lui Claude, iar domeniul de aplicare al politicii în articolul din centrul de ajutor, Cum marchează Claude conținutul generat de AI: API-ul Claude, claude.ai, Claude Code, Claude Cowork și Claude Tag sunt toate incluse. Modelele lansate înainte de prag se află într-o perioadă de tranziție, iar Anthropic spune că adaugă și pentru acestea suport pentru marcare. Pe lângă marca statistică, fișierele generate de Claude poartă și metadate C2PA, un al doilea sistem separat, pe care copierea ca text simplu îl elimină.

Articolul de politică din centrul de ajutor al Anthropic, care enumeră angajamentele privind marcarea: modelele noi sunt marcate din prima zi, marcarea se aplică la nivel global pe toate platformele Claude, este planificată asistență pentru detectare, iar modelele mai vechi se află într-o perioadă de tranziție

Politica, în cuvintele Anthropic: fiecare model nou, fiecare platformă, la nivel global, cu modelele mai vechi fiind adăugate.

Documentația Anthropic afirmă direct limitele. Detectarea este probabilistică. Marca nu poate distinge un document pe care l-a scris Claude de un document pe care l-a scris un om și pe care Claude l-a editat ușor. O rescriere completă o elimină. Am parcurs toate acestea, inclusiv ce dovedește de fapt o detectare pozitivă și ce să faci dacă propriul tău text este marcat, în ghidul dedicat despre watermark-ul Claude.

Momentul urmează reglementarea. Anthropic a semnat Codul de practică de la Articolul 50(2) privind transparența conținutului generat de AI, în cadrul EU AI Act, care le cere furnizorilor de sisteme generative de AI să se asigure că ieșirile sunt "marcate într-un format ușor de citit de mașină și detectabile ca fiind generate artificial." Aceste obligații de transparență au devenit aplicabile la August 2, 2026: data exactă de prag din politica de model a Anthropic, cu nouă zile înainte de anunțul public. Anthropic a ales să se conformeze la nivel global, în loc să mențină un comportament diferit pentru traficul din UE. Google era deja conform prin proiectare. Ieşirea de text nemarcată a OpenAI este întrebarea deschisă de conformitate pentru 2027.

Cele trei abordări, alăturate

OpenAIGoogle DeepMindAnthropic
A fost implementat watermark-ul de text?NuDa (Gemini, din Oct 2024)Da (modelele Claude din Aug 2, 2026)
TehnicăBias criptografic de eșantionare (conceput, nelansat)Eșantionare turneu SynthID-TextMarca statistică de eșantionare, în stil SynthID
AcoperireNiciuna pentru textDoar modelele GoogleToate modelele Claude noi; modelele mai vechi sunt în tranziție
Renunțare opționalăNu se aplicăNuNu
Detector publicNuPortalul SynthID Detector (2025)Planificat, încă nelansat
Schema publicată?Doar prelegeri conceptualeArticol Nature + open sourceExplicație, bazată pe lucrări publicate
Metadate de fișier (C2PA)Da, imagini și audioDa, pe toate mediileDa, pe fișierele generate
Limitări declarateOcolire, stigmatizarea ESLDomeniu limitat la propriile modeleProbabilistic, editările estompează autoria

Modelul care se vede în coloane: OpenAI tratează watermarking-ul de text ca pe o problemă de politică încă nerezolvată, Google îl tratează ca pe o infrastructură de standardizat, iar Anthropic îl tratează ca pe o obligație de conformitate de implementat integral.

Ce înseamnă asta pentru cercetători și autori academici

Consecințele practice depind de instrumentele care ating textul tău. Dacă redactezi cu ChatGPT, textul tău nu poartă astăzi niciun watermark. Dacă redactezi cu Gemini, poartă o marcă SynthID pe care doar detectorul Google o poate citi. Dacă redactezi sau editezi cu un model Claude actual, acesta poartă marca Anthropic, și nu există nicio setare care să o dezactiveze.

Trei lucruri pe care autorii academici ar trebui să le știe:

Un watermark identifică un instrument, nu un autor. Fiecare furnizor afirmă acest lucru în propria documentație, și merită repetat, deoarece politicile instituționale nu fac întotdeauna această distincție. Textul poate fi marcat pentru că un AI l-a redactat, pentru că un AI i-a făcut copy-edit la două propoziții sau pentru că a fost citat un paragraf marcat. Dacă instituția ta rulează verificări de watermark, ceea ce dovedește verificarea este că un anumit model a atins textul la un moment dat, nimic mai mult. Ghidul nostru despre contestarea unei alerte false de detecție AI explică cum să formulezi acest argument atunci când contează.

Watermarkurile și detectoarele AI sunt tehnologii diferite, cu moduri diferite de eșec. Detectoarele precum Turnitin sau GPTZero emit o estimare pe baza stilului statistic, cu problemele de acuratețe pe care le-am documentat. Detecția watermarkurilor este un test bazat pe chei, cu o rată foarte mică de fals pozitiv pe text uman nemarcat. Asimetria se inversează pentru fals negative: o verificare de watermark ratează orice text AI provenit de la un model care nu folosește watermark, iar astăzi aici intră toate versiunile de ChatGPT.

Dezvăluirea rămâne cea mai solidă poziție a ta. Watermarking-ul face utilizarea AI în mod tacit mai riscantă și utilizarea AI declarată mai sigură, deoarece un flux de lucru declarat nu are de ce să se teamă de o marcă pozitivă. Majoritatea revistelor și universităților au acum politici explicite privind utilizarea AI; politica noastră de utilizare a AI explică modul în care trasăm aceste linii în propriile noastre instrumente și este un model rezonabil pentru cum arată o utilizare transparentă.

Ce elimină un watermark de text și ce nu

Rescrierea îl elimină; reformatarea nu. Copierea, lipirea, schimbarea fonturilor, conversia între formate de fișier și eliminarea caracterelor invizibile lasă un watermark statistic complet intact, deoarece marca se află în alegerile de cuvinte. Ceea ce îl elimină este orice regenerează formularea: o editare umană profundă, o traducere sau o parafrazare autentică, așa cum a stabilit lucrarea de robusteză NeurIPS 2023 înainte ca oricare dintre aceste sisteme să fie lansate.

Ambele direcții contează aici. Faptul că marca dispare nu înseamnă că textul îți aparține, iar faptul că marca supraviețuiește nu înseamnă că textul nu îți aparține. Un draft AI rescris rămâne un document asistat de AI, la care se aplică regulile de dezvăluire ale instituției tale. AI text humanizer al nostru rescrie drafturile asistate de AI într-un registru academic natural, iar pentru că acel proces regenerează secvența de tokeni, mărcile statistice nu supraviețuiesc. Pentru textul Claude în mod specific, free Claude watermark remover reformulează fiecare propoziție în cuvinte noi, păstrând neschimbate faptele, numerele și citările. Ceea ce nu poate schimba niciun instrument este ceea ce îi datorezi cititorului tău: transparența cu privire la modul în care a fost realizat documentul.

The free Claude watermark remover on ProofreaderPro.ai, which re-expresses every sentence of a marked passage in fresh wording while keeping facts, numbers, and citations unchanged

Rescrierea este singura operațiune care elimină o marcă statistică, și asta face acest instrument, propoziție cu propoziție.

Unde urmează să ducă asta

Urmăriți trei lucruri până în 2027. Primul, dacă OpenAI lansează: aplicarea în UE a articolului 50 face din poziția „construit, dar nelansat” una din ce în ce mai costisitoare pentru text. Al doilea, dacă detectoarele converg: o lume în care fiecare laborator important aplică un watermark cu o schemă publicată este o lume în care universitățile verifică cheile în loc să ghicească după stil, ceea ce ar fi o îmbunătățire reală față de detectarea predispusă la fals pozitive de astăzi. Al treilea, dacă apare interoperabilitatea: astăzi, trei laboratoare înseamnă trei semne incompatibile și nicio verificare universală. C2PA umple acest gol pentru fișiere; nimic nu îl umple încă pentru textul brut.

ChatGPT aplică watermark textului său?

Nu. Începând cu August 2026, OpenAI a construit o metodă de watermarking pentru text, dar nu a implementat-o, poziție pe care compania a explicat-o în actualizarea sa privind proveniența din mai 2024. Textul generat de ChatGPT nu poartă niciun watermark statistic și nici caractere ascunse. OpenAI aplică totuși metadate de proveniență C2PA fișierelor media DALL-E și Sora, ceea ce este un sistem separat, la nivel de fișier.

Google Gemini aplică watermark textului său?

Da. Conținutul generat de Gemini poartă watermark-ul SynthID-Text al Google DeepMind din octombrie 2024. Este un semn statistic în alegerile de cuvinte, invizibil pentru cititori și verificabil prin detectorul SynthID al Google. Se aplică doar modelelor proprii Google, așa că un rezultat negativ SynthID nu spune nimic despre textul provenit din alte sisteme AI.

Claude aplică watermark textului său?

Da. Fiecare model Claude lansat la sau după August 2, 2026 încorporează un watermark statistic în outputul său text, pe fiecare platformă și abonament, fără opțiune de dezactivare, iar fișierele generate de Claude poartă în plus metadate C2PA. Modelele lansate înainte de acea dată nu își marchează încă outputul; Anthropic spune că le adaugă suportul de marcare în timpul unei perioade de tranziție. Detaliile complete sunt în explicația noastră despre watermark-ul Claude.

Pot universitățile detecta watermark-urile AI?

Doar cu cooperarea furnizorului, deoarece detectarea necesită cheia furnizorului. Google oferă un portal public de detectare pentru conținutul SynthID. Anthropic spune că suportul de detectare pentru utilizatori și terți este planificat, dar nu a lansat încă un detector public. Nicio suită mainstream de plagiat nu poate verifica în prezent watermark-uri statistice de la vreun laborator, așa că „detectarea AI” instituțională de astăzi înseamnă încă presupuneri bazate pe stil, nu verificarea watermark-ului.

Watermarking-ul AI este obligatoriu prin lege?

În UE, da, în practică. Articolul 50(2) din EU AI Act cere furnizorilor de AI generativă să se asigure că outputurile sunt marcate într-un format citibil de mașină și detectabile ca fiind generate artificial, cu obligații de transparență aplicabile din August 2, 2026. Anthropic a semnat Codul de Practică aferent și a ales conformitatea la nivel mondial. Modul în care autoritățile de reglementare vor trata watermark-ul textului nelansat al OpenAI este întrebarea de urmărit în 2027.

Supraviețuiesc watermark-urile AI traducerii?

Nu. Un watermark statistic trăiește în secvența exactă de cuvinte pe care modelul a ales-o, iar traducerea înlocuiește fiecare cuvânt. Același lucru este valabil pentru parafrazarea profundă și editarea umană intensivă. Această limitare este documentată în literatura evaluată de colegi și recunoscută de fiecare furnizor care lansează un watermark.

Surse

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana este creatoare de conținut la ProofreaderPro, unde conduce zilnic blogul și operațiunile de scriere. Ea scrie articolele despre modul în care funcționează platforma de editare online și se ocupă de mesajele clienților în fiecare zi, cu un scor de satisfacție de cinci stele pentru asta.

Continuă lectura

Încearcă Text Humanizer gratuit

Începe gratuit
Proofreader Pro AI
Perfecționează-ți cercetarea cu ProofreaderPro.ai, cel mai avansat corector AI din lume, special conceput pentru texte academice.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
© 2026 ProofreaderPro.ai. Un editor, corector și Humanizer academic de top. Creat cu ❤️ și cu o sintaxă gramatical corectă 🌳s