ProofreaderPro.ai
Nhân hoá văn bản AI

Giải thích về Watermark của Claude từ Anthropic (2026)

Claude hiện nhúng một watermark vô hình trong văn bản của mình. Cách nó hoạt động, những gì có thể vượt qua nó, và một lần phát hiện dương tính thực sự chứng minh điều gì.

Dana|Aug 12, 2026|11 thời gian đọc tối thiểu
Giải thích về Watermark của Claude từ Anthropic (2026) - ProofreaderPro.ai Blog

Vào ngày 11 tháng 8, 2026, Anthropic thông báo rằng Claude sẽ bắt đầu nhúng một watermark vô hình vào văn bản mà nó viết. Chỉ trong vài giờ, lời phản đối lớn nhất không đến từ sinh viên. Nó đến từ các luật sư, học giả và nhà nghiên cứu, những người dùng Claude để biên tập lại văn bản hoàn toàn do chính họ viết, và vừa biết rằng tác phẩm của họ giờ sẽ mang một dấu hiệu do máy tạo ra.

Phiên bản ngắn: watermark là một độ lệch thống kê áp dụng lên lựa chọn từ của Claude, chứ không phải một ký tự ẩn được chèn vào tài liệu của bạn. Nó vẫn tồn tại khi sao chép, dán, định dạng lại và chuyển sang văn bản thuần. Nó không tồn tại sau khi viết lại, dịch hoặc chỉnh sửa nhiều. Nó áp dụng cho mọi mô hình Claude phát hành vào hoặc sau ngày 2 tháng 8, 2026, trên toàn thế giới, không có tùy chọn từ chối. Và một phát hiện dương tính chỉ cho bạn biết rằng Claude có thể đã xử lý văn bản đó. Nó không cho bạn biết ai đã viết nó.

Hướng dẫn này giải thích Anthropic thực sự đã xây dựng gì, hệ thống đánh dấu thứ hai hầu như không được đưa tin, dấu hiệu đó chứng minh được và không chứng minh được gì, và phải làm gì nếu văn bản của chính bạn đã bị đánh dấu.

Anthropic thực sự đã công bố điều gì?

Chính sách này được công bố trong trung tâm trợ giúp của Anthropic trong một bài viết có tiêu đề How Claude marks AI-generated content. Những điểm cốt lõi:

Công bốAugust 11, 2026
Áp dụng choMọi mô hình Claude phát hành vào hoặc sau ngày August 2, 2026
Mô hình cũ hơnAnthropic nói rằng họ đang làm việc để thêm đánh dấu trong giai đoạn chuyển tiếp
Phạm vi bao phủClaude API, claude.ai, Claude Code, Claude Cowork, Claude Tag, và Claude qua AWS, Google Cloud và Microsoft Foundry
Địa lýToàn cầu
Từ chối tham giaKhông có, trên bất kỳ gói nào
Phát hiệnDự kiến thông qua công cụ của chính Anthropic, chưa có mốc thời gian

Động lực là quy định. Anthropic đã ký Bộ Quy tắc Thực hành theo Điều 50(2) của EU AI Act về tính minh bạch đối với nội dung do AI tạo ra, vốn yêu cầu các nhà cung cấp hệ thống tạo sinh phải đánh dấu đầu ra của họ để có thể được nhận diện là do máy tạo. Nghĩa vụ này là của châu Âu. Quyết định của Anthropic áp dụng nó cho mọi người dùng trên trái đất, thay vì chỉ lưu lượng từ EU, thì không.

Watermark của Claude hoạt động như thế nào?

Đây là phần mà gần như mọi bài viết đều hiểu sai trong 48 giờ đầu, và hiểu sai ở đây sẽ dẫn mọi người đến những giải pháp không thể nào hoạt động được.

Khi một mô hình ngôn ngữ viết, nó không chọn một từ tiếp theo duy nhất và đúng nhất. Ở hầu hết các điểm trong một câu đều có vài cách nối tiếp gần như tương đương về mặt thống kê: một nhóm từ mà bất kỳ từ nào trong số đó cũng nghe tự nhiên. Watermark thiên lệch lựa chọn đó theo một khóa bí mật do Anthropic nắm giữ. Mỗi lựa chọn riêng lẻ trông không có gì đặc biệt. Nhưng qua một đoạn đủ dài, mẫu lựa chọn tích lũy sẽ tạo thành một phân phối mà bộ dò có khóa có thể đo được.

Từ đó rút ra ba hệ quả, và chúng giải thích gần như toàn bộ hành vi của dấu này:

Không có gì được thêm vào văn bản của bạn. Không có ký tự khoảng trắng vô hình, không có khoảng trắng ẩn, không có trường siêu dữ liệu, không có thủ thuật định dạng. Watermark là một thuộc tính của việc những từ nào được chọn, đó là lý do Anthropic có thể nói chính xác rằng nó không làm thay đổi ý nghĩa, chất lượng hay độ dễ đọc của đầu ra.

Nó đi cùng với các từ. Sao chép văn bản vào email, dán vào Word, chuyển sang văn bản thuần, đổi định dạng tệp. Các từ không đổi, nên chữ ký cũng không đổi.

Nó cần đủ lượng. Một phép đo thống kê được thực hiện trên một phân phối token cần đủ số token. Chính Anthropic cũng liệt kê nội dung

Hệ thống thứ hai mà không ai nhắc đến: siêu dữ liệu tệp C2PA

Watermark văn bản đã chiếm các dòng tít, nhưng Anthropic công bố hai cơ chế, không phải một.

Khi Claude tạo ra một tệp thay vì văn xuôi, cụ thể là .svg, .png.jpg, Anthropic đính kèm siêu dữ liệu nguồn gốc được ký số theo tiêu chuẩn C2PA của Coalition for Content Provenance and Authenticity. Đây là một công nghệ khác, giải quyết nửa còn lại của vấn đề: một định dạng được ngành hậu thuẫn để ghi lại nguồn gốc của một tài sản và lịch sử chỉnh sửa của nó, được ký bằng mật mã để có thể phát hiện can thiệp.

Nó cũng dễ tổn thương hơn đáng kể so với dấu văn bản. Anthropic thừa nhận rằng siêu dữ liệu C2PA có thể bị loại bỏ khi chuyển đổi định dạng, khi lưu lại bằng một công cụ không hỗ trợ tiêu chuẩn này, hoặc đơn giản là bằng cách chụp màn hình. Siêu dữ liệu tồn tại bên cạnh tệp; watermark thống kê tồn tại bên trong các từ. Chính sự khác biệt về độ bền này là lý do dấu văn bản gây ra tranh luận còn dấu tệp thì không.

Điều gì xóa watermark, và điều gì không

Ranh giới ở đây mang tính cơ học hơn là phụ thuộc vào mức độ công sức bạn bỏ ra. Hoặc một hành động giữ nguyên các từ gốc của bạn, hoặc nó tái tạo chúng.

Hành độngDấu có tồn tại không?Vì sao
Sao chép và dánCác từ không thay đổi
Định dạng lại, đổi loại tệpCác từ không thay đổi
Loại bỏ ký tự vô hìnhBan đầu vốn không có ký tự nào để loại bỏ
Hiệu đính nhẹThường là cóPhần lớn lựa chọn từ vẫn tồn tại sau một lượt chỉnh nhẹ
Chỉnh sửa nhiềuThường khôngAnthropic nói rằng dấu "có thể tồn tại qua một số lần chỉnh sửa"
Dịch sang ngôn ngữ khácKhôngChuỗi token được xây dựng lại từ đầu
Viết lại đáng kểKhôngMọi lựa chọn từ được thực hiện lại, bởi một mô hình khác
Trích đoạn rất ngắnKhông đo đượcDưới ngưỡng để có tín hiệu đáng tin cậy

Hàng có ý nghĩa thương mại nhất là hàng thứ ba. Hầu hết các công cụ miễn phí hiện được tiếp thị là trình xóa watermark AI sẽ quét các ký tự Unicode không hiển thị và khoảng trắng vô hình rồi xóa bất cứ thứ gì chúng tìm thấy. Đó là phản ứng hợp lý trước một vấn đề thực sự khác, và đối với watermark của Claude thì nó không đạt được gì cả. Chạy một trong những công cụ dọn dẹp đó trên đầu ra của Claude thì kết quả trả về đo lường đúng như lúc ban đầu.

Vậy phát hiện dương tính thực sự chứng minh điều gì?

Ít hơn nhiều so với điều từ "phát hiện" gợi ý, và điểm này cần được thận trọng vì chính sách của các tổ chức đang được soạn thảo rất nhanh ngay lúc này.

Kết quả dương tính cho thấy rằng một đoạn văn có thể đã được Claude xử lý. Anthropic nêu rõ rằng một watermark được phát hiện không chứng minh Claude là tác giả nội dung, vì lý do hiển nhiên là người dùng dùng mô hình để biên tập, dịch và tóm tắt những gì họ tự viết. Phép đo không thể phân biệt một tài liệu Claude đã soạn thảo với một tài liệu Claude chỉ chỉnh gọn lại.

Kết quả âm tính chứng minh còn ít hơn. Văn bản không được đánh dấu có thể do người viết là con người, có thể đến từ một mô hình không có watermark, có thể là đầu ra của Claude đã bị chỉnh sửa nhiều, hoặc đơn giản là quá ngắn để đo.

Có thêm một hạn chế thực tế nữa đáng biết: các bộ phát hiện AI đa dụng không đọc được dấu này. Việc phát hiện cần khóa của Anthropic, nên nó phải chạy qua công cụ của chính Anthropic, mà tại thời điểm công bố thì chưa có mốc phát hành. Các bộ phát hiện mà tổ chức của bạn đang dùng hiện nay không đọc watermark của Claude.

Tại sao phản ứng dữ dội lại đến từ các biên tập viên, chứ không phải từ những người đang che giấu AI

Phản ứng đã rất tiêu cực, và hình thái của nó là phần thú vị nhất về mặt thương mại lẫn đạo đức của câu chuyện.

Lời phàn nàn chiếm ưu thế không phải là "giờ tôi không thể qua mặt tác phẩm AI như của mình". Nó là "giờ chính bài viết của tôi lại bị đánh dấu là AI". Luật sư Peter Harrell nói rất thẳng: tải bài viết của chính ông để biên tập lại nghĩa là Claude sẽ "watermark my (human written, AI-copy edited) text as AI, which seems ridiculous". Nhà khoa học chính trị Maya Sen cũng nêu cùng một ý rằng thay đổi này khiến mô hình kém hữu ích hơn với những người như cô. Người dẫn chương trình phát thanh Erick Erickson: "the stuff I've written will be watermarked that Claude did the work."

Họ đang mô tả một vấn đề có thật và rất cụ thể: gán sai tác giả. Watermark ghi lại rằng mô hình đã tạo ra một chuỗi token. Nó không, và về mặt cấu trúc cũng không thể, ghi lại ai đã tạo ra ý tưởng, lập luận, nghiên cứu hay bản thảo gốc. Với một người viết mà nhà tuyển dụng, nhà xuất bản, tạp chí hay trường đại học của họ đọc tín hiệu tích cực ấy như bằng chứng dứt khoát về quyền tác giả do máy tạo ra, khoảng trống đó không hề mang tính học thuật.

Các nhà phát triển nêu ra một phiên bản song song của vấn đề này. Mã nguồn thường đi qua formatter, linter và công cụ refactoring như một phần của quy trình, mỗi công cụ đều viết lại bất kỳ lựa chọn token nào còn lại. Trong quy trình phát triển bình thường, dấu này nhanh chóng bị suy giảm, khiến nó không đáng tin cho trường hợp sử dụng truy vết nguồn gốc mã mà một số người lập tức hình dung ra.

Vị trí của điều này trong bức tranh toàn ngành

Anthropic không phải là bên đầu tiên, nhưng lĩnh vực này mỏng hơn nhiều so với những gì các bản tin gợi ý.

SynthID của Google là watermark văn bản duy nhất được triển khai ở quy mô lớn bởi một nhà cung cấp lớn, sử dụng cùng ý tưởng nền tảng là điều chỉnh xác suất token trong quá trình tạo. Nó bắt đầu với hình ảnh vào 2023 và mở rộng sang văn bản, âm thanh và video, và đã được áp dụng ngoài Google, bao gồm cả OpenAI cho hình ảnh và đầu ra giọng nói, cùng với ElevenLabs, Kakao và NVIDIA.

OpenAI là trường hợp thiếu vắng đáng chú ý. Nó nhúng SynthID trong hình ảnh ChatGPT và đã mở rộng sang giọng nói, nhưng tính đến thời điểm viết bài này, nó vẫn chưa phát hành watermark văn bản cho ChatGPT. Sự không đồng nhất đó đáng để ghi nhớ trước khi rút ra kết luận từ bất kỳ kết quả phát hiện đơn lẻ nào: một tài liệu không có Claude watermark đơn giản có thể đã được viết bằng một mô hình không đánh dấu văn bản chút nào.

Phải làm gì nếu chính bài viết của bạn đã bị đánh dấu

Nếu văn bản thực sự là của bạn và dấu này chỉ là một hệ quả của biên tập copy, cách khắc phục là diễn đạt lại đoạn đó để chuỗi token được tạo מחדש. Chỉnh sửa quanh các mép sẽ không làm được một cách đáng tin, vì phần lớn lựa chọn từ ngữ của bạn vẫn sẽ còn sau một lượt sửa nhẹ.

Với một đoạn hoặc một mục đơn lẻ, công cụ xóa Claude watermark miễn phí của chúng tôi làm đúng việc đó. Nó tái tạo tối đa 500 từ mỗi lần bằng cách dùng một mô hình khác để diễn đạt lại, trong khi giữ nguyên dữ kiện, con số, ngày tháng, từ ngữ giảm nhẹ và thuật ngữ kỹ thuật, đồng thời sao chép nguyên từng ký tự các trích dẫn và dẫn nguồn. Công cụ này miễn phí khi có tài khoản, và nó hoạt động trên cơ chế duy nhất có thể hoạt động: tái tạo token thay vì lọc văn bản.

Với một bản thảo hoàn chỉnh, chương luận văn hoặc báo cáo, AI text humanizer là lựa chọn phù hợp hơn. Một lượt humanizer đầy đủ sẽ viết lại toàn bộ tài liệu thay vì vá víu, chuyển văn xuôi theo phong cách máy sang lối viết tự nhiên của con người, và xóa một watermark ở mức token như một hệ quả của cách nó hoạt động. Cả hai đều bảo toàn trích dẫn; khác biệt nằm ở quy mô và độ sâu.

Và nếu vấn đề cốt lõi là việc biên tập hỗ trợ bởi AI cứ khiến tác phẩm của bạn bị đặt dưới nghi ngờ, AI proofreader của chúng tôi biên tập toàn bộ tài liệu với các thay đổi được theo dõi để bạn duyệt từng dòng, và không watermark văn bản của bạn.

Câu hỏi thường gặp

Q: Claude có gắn watermark cho toàn bộ đầu ra văn bản của mình không?

Mỗi mô hình Claude được phát hành vào hoặc sau ngày August 2, 2026 đều nhúng watermark, trên Claude API, claude.ai, Claude Code, Claude Cowork, Claude Tag và Claude được truy cập thông qua AWS, Google Cloud và Microsoft Foundry. Anthropic cho biết họ đang nỗ lực mở rộng việc đánh dấu sang các mô hình cũ hơn trong giai đoạn chuyển tiếp, vì vậy coi bất cứ nội dung nào phát hành trước tháng August là đương nhiên được miễn là không an toàn. Tính năng này áp dụng trên toàn cầu và không có tùy chọn tắt trên bất kỳ gói nào.

Q: Tôi có thể tắt watermark của Claude không?

Không. Anthropic không cung cấp cài đặt, bậc gói hay tham số API nào để vô hiệu hóa nó, và chính sách này áp dụng cho mọi người dùng bất kể vị trí. Việc đánh dấu này thực thi cam kết minh bạch theo EU AI Act, đó là lý do nó không được cung cấp như một tùy chọn cá nhân.

Q: Các công cụ gỡ watermark AI xóa ký tự vô hình có hoạt động không?

Không, và đây là hiểu lầm phổ biến nhất về thông báo này. Những công cụ đó tìm các ký tự Unicode có độ rộng bằng không và khoảng trắng vô hình. Watermark của Claude là một độ lệch thống kê trong các từ mà mô hình đã chọn, nên không có kiểu ký tự nào như vậy để xóa. Văn bản đi qua một công cụ làm sạch như thế vẫn mang đúng dấu vết ban đầu của nó. Chỉ việc tạo lại các token, tức là viết lại, mới tác động đến watermark dựa trên độ lệch lấy mẫu.

Q: Watermark có xuất hiện trong Turnitin hoặc GPTZero không?

Hiện tại thì không. Việc đọc dấu này cần khóa bí mật dùng để nhúng nó, nên quá trình phát hiện diễn ra thông qua công cụ nội bộ của Anthropic thay vì qua các bộ phát hiện AI của bên thứ ba. Anthropic cho biết họ dự định sẽ cung cấp chức năng xác minh nhưng chưa đưa ra mốc thời gian khi công bố. Lưu ý rằng điều này độc lập với việc các bộ phát hiện đó có gắn cờ văn bản của bạn vì lý do khác hay không, vì họ vẫn có thể làm vậy bất kể có watermark hay không.

Q: Watermark có chứng minh rằng Claude đã viết ra một nội dung không?

Không. Nó cho thấy văn bản có thể đã được Claude xử lý. Anthropic nói rõ rằng một watermark được phát hiện không xác nhận Claude là tác giả của nội dung, vì mô hình này được dùng rộng rãi để chỉnh sửa, dịch và tóm tắt văn bản do con người tự viết. Nó không thể phân biệt một bản nháp do mô hình tạo ra với một đoạn mà nó chỉ biên tập lại, và cũng không cho biết tỷ lệ nào của một tài liệu là do máy viết.

Q: Diễn đạt lại có làm mất watermark của Claude không?

Diễn đạt lại mạnh thì có, vì nó tái tạo lại chuỗi từ ngữ thay vì chỉ điều chỉnh nó. Diễn đạt lại nhẹ thì không đáng tin: nếu phần lớn lựa chọn từ gốc vẫn còn, thì đủ tín hiệu cũng vẫn còn để đo. Cùng một logic đó áp dụng cho việc dịch, vốn loại bỏ dấu này hoàn toàn, và cho việc hiệu đính nhẹ, vốn thường thì không.

Q: Còn hình ảnh và tệp mà Claude tạo ra thì sao?

Chúng sử dụng một hệ thống khác. Các tệp ở định dạng được hỗ trợ, .svg, .png.jpg, nhận siêu dữ liệu nguồn gốc được ký số dựa trên tiêu chuẩn C2PA thay vì một watermark thống kê. Siêu dữ liệu C2PA dễ bị mất hơn: Anthropic lưu ý rằng nó có thể bị xóa khi chuyển đổi định dạng, khi lưu lại bằng một công cụ không hỗ trợ tiêu chuẩn này, hoặc khi chụp ảnh màn hình.

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana là người sáng tạo nội dung tại ProofreaderPro, nơi cô điều hành hoạt động viết blog và viết blog hàng ngày. Cô ấy viết các bài báo về cách hoạt động của nền tảng chỉnh sửa trực tuyến và cô ấy xử lý tin nhắn của khách hàng hàng ngày với điểm hài lòng là 5 sao để thể hiện điều đó.

Tiếp tục đọc

Thử Text Humanizer miễn phí

Bắt đầu dùng miễn phí
Proofreader Pro AI
Cải thiện nghiên cứu của bạn với ProofreaderPro.ai, công cụ chỉnh sửa AI hàng đầu thế giới, được thiết kế riêng cho văn bản học thuật.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
Công cụ miễn phí
Công cụ xóa dấu gạch ngangBộ đếm từCông cụ kiểm tra ngữ phápTrình tạo trích dẫnTrình kiểm tra khả năng đọc hiểuDọn dẹp văn bản AITrình kiểm tra câu bị độngTrình chuyển đổi chữ hoa đầu dòngTrình mở rộng viết tắtTrình kiểm tra mức độ trang trọngTất cả công cụ miễn phí
© 2026 ProofreaderPro.ai. Một nhà hiệu đính học thuật hàng đầu, biên tập viên và công cụ nhân hóa. Được tạo nên từ ❤️ và cấu trúc câu hợp ngữ pháp 🌳s