Cách giảm điểm phát hiện AI: Hướng dẫn thực hành dành cho nhà nghiên cứu
Hướng dẫn từng bước để giảm điểm phát hiện AI xuống dưới 15%. Phương pháp đã kiểm thử trên GPTZero, ZeroGPT và Copyleaks.
Nếu bạn đã sử dụng các mô hình AI như ChatGPT, Claude, Gemini hoặc Deepseek để hỗ trợ bài báo nghiên cứu của mình, điểm AI của bạn có lẽ sẽ cao trên các công cụ phát hiện AI phổ biến như Turnitin hoặc GPTZero. Bài viết này sẽ hướng dẫn bạn cách giảm điểm phát hiện AI xuống mức sẵn sàng để nộp.
Đây là quy trình chính xác sẽ giúp giảm tỷ lệ AI của bạn xuống mức an toàn.
Năm bước trong nháy mắt
- Chạy bản nháp của bạn qua hai công cụ phát hiện và ghi lại những đoạn nào bị đánh dấu.
- Viết lại thủ công các đoạn bị đánh dấu bằng giọng văn của chính bạn, thay đổi cấu trúc thay vì chỉ thay từ.
- Xử lý những đoạn cứng đầu bằng một công cụ nhân hóa học thuật, công cụ này giữ nguyên trích dẫn và thuật ngữ.
- Kiểm tra lại toàn bộ tài liệu bằng chính các công cụ phát hiện mà bạn đã dùng ban đầu.
- Dừng ở một mục tiêu thực tế: dưới 15% là có thể đạt được, và 0% là không cần thiết.
Các phần dưới đây trình bày chi tiết từng bước, bao gồm cả cách xử lý khi văn bản do con người viết vẫn bị đánh dấu.
Điểm phát hiện AI của bạn thực sự đo lường điều gì
Trước khi bạn bắt đầu chỉnh sửa con số, bạn cần hiểu nó có nghĩa là gì. Các bộ phát hiện AI như Turnitin, GPTZero, Originality.ai, và Copyleaks phân tích văn bản của bạn để tìm các mẫu thống kê phổ biến trong văn bản do AI tạo ra.
Những mẫu này bao gồm perplexity thấp, tức là lựa chọn từ ngữ có thể dự đoán được, burstiness thấp, tức là độ dài và cấu trúc câu đồng đều, và mức độ nhất quán cao trong nhịp điệu của các đoạn văn. Văn viết của con người thường lộn xộn, với độ dài câu đa dạng, lựa chọn từ ngữ bất ngờ, và đôi khi đi chệch hướng. Văn do AI viết thường mượt mà, đều đặn, và dễ dự đoán.
Điểm phát hiện AI của bạn không đo việc bạn có dùng AI hay không. Nó đo việc văn bản của bạn có biểu hiện những mẫu tương quan với đầu ra của AI hay không. Đây là một khác biệt quan trọng, vì rất nhiều văn bản do con người viết cũng kích hoạt chính những mẫu này, đặc biệt là văn viết học thuật trang trọng, vốn tự nhiên có cấu trúc chặt chẽ và dễ dự đoán hơn so với văn xuôi đời thường.
Một tín hiệu thứ ba mà một số bộ phát hiện cân nhắc là phân bố từ vựng. Các mô hình ưu tiên những từ có tần suất thống kê cao trong dữ liệu huấn luyện của chúng, trong khi người viết là con người có vốn từ vựng mang tính cá nhân, những thuật ngữ họ dùng quá nhiều, những từ ít gặp họ ưa thích, và thuật ngữ chuyên ngành được triển khai ở những vị trí bất ngờ.
Các bộ phát hiện cấp đại học, từng cái một
Biết bạn đang đối mặt với bộ phát hiện nào sẽ thay đổi cách bạn đọc điểm số. Đây là những công cụ mà các cơ sở đào tạo và khách hàng thực sự dùng trong năm 2026, mỗi công cụ đo lường điều gì, và thế nào được xem là một kết quả an toàn. Dù dùng công cụ nào, hãy coi mọi điểm số như một tín hiệu để xem xét lại hơn là bằng chứng: trong một nghiên cứu Stanford được trích dẫn rộng rãi, các bộ phát hiện phổ biến đã gắn nhãn 61% bài luận của người không nói tiếng Anh bản ngữ là do AI viết.
| Bộ phát hiện | Ai vận hành | Điều cần biết |
|---|---|---|
| Turnitin | Các trường đại học, triển khai toàn tổ chức | Hiển thị *% khi dưới 20%; mục tiêu thực tế là dưới 20% |
| GPTZero | Giảng viên và sinh viên | Tô sáng các câu bị gắn cờ; nhắm dưới 15% và không có chuỗi câu bị tô sáng |
| Originality.ai | Nhà xuất bản, agency, khách hàng | Chỉ trả phí, đánh giá gắt gao, cập nhật thường xuyên |
| Copyleaks | Các trường đại học qua tích hợp LMS | Đa ngôn ngữ, tỷ lệ dương tính giả công bố dưới 1% |
| Winston AI | Giảng viên và đội ngũ nội dung | Xử lý đầu vào OCR; hãy xem tuyên bố 99.98% là quảng cáo |
| ZeroGPT | Sinh viên dùng làm bước kiểm tra miễn phí đầu tiên | Điểm số dao động mạnh; không bao giờ đủ kết luận nếu dùng riêng |
| Pangram | Văn phòng liêm chính học thuật | Dương tính giả ở mức 0.5% trở xuống trong một nghiên cứu độc lập |
| Scribbr AI Detector | Sinh viên trước khi nộp bài | Độ chính xác từ cuối 70% đến giữa 80%; là bước sàng lọc, không phải bằng chứng |
| Sapling | Đội ngũ kinh doanh và hỗ trợ | Một nghiên cứu bình duyệt phát hiện 90% mẫu do người viết bị gắn cờ |
Turnitin

Mặc định ở các trường đại học. Tính năng phát hiện bài viết do AI của Turnitin được tích hợp trong cùng nền tảng chạy báo cáo độ tương đồng và được cấp phép toàn cơ sở, nên sinh viên không thể tự mua quyền truy cập để kiểm tra trước khi nộp bài. Công cụ này chia tài liệu của bạn thành từng phần và chấm xem mức độ đoạn văn có vẻ do AI tạo ra đến đâu, tách biệt với điểm tương đồng. Có hai quy tắc hiển thị quan trọng: điểm số từ 20% trở lên sẽ hiện phần trăm kèm đánh dấu ở cấp câu, trong khi kết quả từ 1% đến 19% sẽ hiển thị *% mà không ghi con số cụ thể, vì thử nghiệm nội bộ của Turnitin cho thấy nhiều dương tính giả hơn dưới 20%. Mục tiêu thực tế là giữ dưới 20%, thấp hơn ngưỡng mà báo cáo hiển thị một con số cứng. Một số trường đại học lớn đã tắt tính năng này vì lo ngại dương tính giả, và sản phẩm Clarity mới hơn của Turnitin chuyển trọng tâm bằng chứng sang quá trình soạn thảo của bạn. Phần giải thích về Turnitin Clarity và hướng dẫn điểm Turnitin của chúng tôi trình bày cả hai chi tiết.
GPTZero

Bộ phát hiện độc lập nổi tiếng nhất, được xây dựng cho giáo dục. GPTZero đo perplexity và burstiness trực tiếp, đồng thời làm nổi bật từng câu mà nó cho là do máy viết, điều này khiến nó trở thành công cụ hữu ích nhất cho quy trình chỉnh sửa có mục tiêu trong hướng dẫn này. Giáo viên dùng bảng điều khiển lớp học của nó, sinh viên dùng bản miễn phí để kiểm tra trước. Nó cho điểm khá tốt trên đầu ra mô hình chưa chỉnh sửa trong các bài kiểm tra chuẩn, và yếu đi khi văn bản đã được biên tập thực sự. Hãy nhắm dưới 15% và không có các chuỗi câu liên tiếp nào được tô nổi bật. Hướng dẫn điểm GPTZero của chúng tôi trình bày các điểm đặc thù của nó.
Originality.ai

Bộ phát hiện dành cho thế giới làm việc tự do và xuất bản hơn là lớp học. Các agency, biên tập viên và chủ website chạy toàn bộ bài viết và trang web qua nó, và một điểm màu đỏ có thể khiến tiền công của người viết bị giữ lại. Công cụ này chỉ dùng trả phí, cập nhật mô hình thường xuyên, và có xu hướng nghiêm ngặt: nó bắt được nhiều văn bản AI hơn hầu hết đối thủ, đổi lại là nhiều cảnh báo sai hơn đối với văn xuôi sạch. Nếu khách hàng dùng nó để rà soát, hãy giữ báo cáo của riêng bạn và nhắm tới kết luận rõ ràng là do con người viết. Chúng tôi bàn về tranh chấp và chiến thuật chỉnh sửa trong hướng dẫn điểm Originality.ai.
Copyleaks

Lựa chọn của doanh nghiệp. Copyleaks tích hợp với các hệ thống quản lý học tập như Canvas, Moodle, và Blackboard, phát hiện trên nhiều ngôn ngữ, và cung cấp các chế độ độ nhạy cùng các chứng nhận tuân thủ khiến các nhóm mua sắm cảm thấy yên tâm. Tỷ lệ dương tính giả được công bố của nó dưới 1%, thuộc nhóm thấp nhất trong số các công cụ phổ biến. Các trường đại học không chạy Turnitin thường chạy Copyleaks. Phần giải thích về Copyleaks của chúng tôi trình bày mức độ nên tin một cảnh báo đến đâu.
Winston AI

Được quảng bá với độ chính xác 99.98%, một con số bạn nên đọc như marketing hơn là đo lường, vì các thử nghiệm độc lập cho thấy bức tranh thận trọng hơn. Điểm khác biệt thật sự của Winston là xử lý đầu vào: nó chạy OCR, nên giáo viên có thể quét bài viết tay hoặc in sẵn và ảnh chụp tài liệu. Công cụ này bán cho giáo viên và các nhóm nội dung. Hãy coi tỷ lệ phần trăm của nó như bất kỳ kết quả đơn lẻ nào từ một công cụ khác và xác minh bằng một bộ phát hiện thứ hai. Xem phân tích độ chính xác Winston AI của chúng tôi.
ZeroGPT

Công cụ miễn phí, không cần đăng nhập mà hầu hết sinh viên thử đầu tiên. Điểm số của nó dao động mạnh trên cùng một văn bản, khiến nó hữu ích như một cái nhìn sơ bộ ban đầu và không hơn thế. Việc ZeroGPT cho điểm cao trên bài viết do chính bạn tạo ra là điều phổ biến và không dự đoán được Turnitin hay Copyleaks sẽ nói gì. Nếu ZeroGPT gắn cờ bạn, hãy kiểm tra lại bằng hai công cụ được hiệu chỉnh tốt hơn trước khi thay đổi bất kỳ từ nào. Phần đánh giá độ chính xác ZeroGPT của chúng tôi giải thích vì sao các con số của nó lại trôi dạt.
Pangram

Mạnh nhất trong thế hệ mới hơn. Trong một nghiên cứu độc lập của University of Chicago, Pangram là bộ phát hiện duy nhất giữ tỷ lệ dương tính giả ở mức bằng hoặc dưới 0.5% mà vẫn bắt được văn bản AI một cách đáng tin cậy, và độ chính xác của nó vẫn giữ vững ngay cả sau khi văn bản đã được đưa qua các công cụ humanizer. Công cụ này đang ngày càng được các văn phòng liêm chính học thuật và các nhóm biên tập vốn đã từng bị dương tính giả làm cho thất vọng ở nơi khác sử dụng nhiều hơn. Nếu bài viết của bạn sẽ phải qua Pangram, cách tiếp cận đáng tin cậy duy nhất là cách hướng dẫn này dạy, đó là chỉnh sửa cấu trúc thực sự bằng chính giọng văn của bạn.
Scribbr AI Detector

Một công cụ kiểm tra miễn phí cho sinh viên, có gói trả phí, từ công ty biên tập cùng tên. Nó đạt khoảng từ giữa 70% đến giữa 80% trong các bài kiểm tra độ chính xác, khiến nó trở thành một màn rà soát tiện lợi trước khi nộp bài và là nền tảng yếu cho bất kỳ quyết định liêm chính nào. Hãy dùng nó như một ý kiến ban đầu, rồi xác nhận bằng một công cụ mạnh hơn.
Sapling

Được xây dựng cho văn bản kinh doanh và dịch vụ khách hàng hơn là học thuật, và là một lời cảnh báo hữu ích: nó quảng cáo độ chính xác lên tới 97%, nhưng một nghiên cứu bình duyệt cho thấy nó gắn cờ 90% mẫu văn bản thực sự do con người viết là AI. Nếu một điểm số từ một công cụ như thế này từng được dùng để chống lại bạn, đó là nghiên cứu bạn cần biết. Đây cũng là lý do hướng dẫn này cứ lặp lại cùng một nguyên tắc: không có con số của bất kỳ bộ phát hiện đơn lẻ nào là bằng chứng.
Bước 1: Xác định những phần nào bị gắn cờ
Đừng viết lại toàn bộ bài của bạn. Đó là một sự lãng phí thời gian và rất có thể sẽ làm mọi thứ tệ hơn.
Thay vào đó, hãy đưa văn bản của bạn vào một công cụ phát hiện có phân tích theo từng câu hoặc từng đoạn. Tính năng tô sáng ở cấp câu của GPTZero đặc biệt hữu ích ở đây. Nó sẽ cho bạn biết chính xác những đoạn nào đang bị gắn cờ là có khả năng do AI tạo ra.
Theo kinh nghiệm của chúng tôi, điểm số phát hiện AI hiếm khi đồng đều trên toàn bộ bài. Bạn thường sẽ thấy 2-3 phần đang chi phối phần lớn điểm số - thường là phần mở đầu, tổng quan tài liệu, hoặc các mô tả phương pháp luận có cấu trúc chặt chẽ. Đó là những phần cần tập trung vào.
Hãy sao chép văn bản của bạn vào một công cụ phát hiện. Ghi lại những đoạn bị gắn cờ. Đó chính là danh sách ưu tiên của bạn.
Bước 2: Viết lại thủ công các đoạn bị gắn cờ
Đây là bước đơn lẻ hiệu quả nhất mà bạn có thể thực hiện để giảm điểm phát hiện AI, và không có đường tắt nào khác.
Hãy lấy từng đoạn bị gắn cờ và viết lại từ đầu. Đừng chỉnh sửa văn bản hiện có. Mở một tài liệu trống và viết cùng một ý theo giọng văn của riêng bạn. Cách này buộc bạn phải phá vỡ các mô thức thống kê mà bộ phát hiện đang nhận diện.
Có ba kỹ thuật cụ thể có hiệu quả:
Cố ý thay đổi độ dài câu của bạn. Văn bản do AI tạo ra thường có xu hướng dùng các câu dài 15-25 từ với mức độ nhất quán đáng chú ý. Hãy xen vào một vài câu ngắn. Sau đó nối tiếp bằng một câu dài hơn, phát triển ý đầy đủ hơn và có lồng một hoặc hai mệnh đề phụ. Chỉ riêng sự biến đổi này cũng có thể làm giảm đáng kể điểm AI của một đoạn văn.
Thêm giọng điệu học thuật cá nhân. Khi phù hợp, hãy chèn ngôn ngữ dè dặt ("điều này có thể gợi ý"), cách diễn đạt có tính điều kiện ("với điều kiện rằng"), hoặc cách dùng từ chuyên ngành đặc thù của lĩnh vực bạn. AI thường viết bằng thứ tiếng Anh học thuật chung chung. Lĩnh vực của bạn có những quy ước riêng, hãy vận dụng chúng.
Tái cấu trúc, đừng chỉ diễn đạt lại. Nếu phiên bản do AI tạo ra liệt kê ba điểm theo dạng đánh số, hãy gộp chúng thành văn xuôi mạch lạc. Nếu nó dùng cấu trúc câu chủ đề rồi mới đến dẫn chứng, hãy thử mở đầu bằng dẫn chứng và xây dựng dần đến luận điểm. Thay đổi cấu trúc sẽ hiệu quả hơn thay đổi ở cấp độ từ ngữ.
Bước 3: Sử dụng công cụ nhân hoá AI cho những đoạn cứng đầu
Một số đoạn văn chống lại việc viết lại thủ công - đặc biệt là các phần phương pháp với ngôn ngữ thủ tục cố định, hoặc các phần kết quả được xây dựng quanh việc trình bày thống kê. Những phần này vốn có cấu trúc chặt chẽ và có thể dự đoán, khiến các công cụ phát hiện gắn cờ bất kể AI có viết chúng hay không.
Với những phần này, một công cụ nhân hoá văn bản AI có thể hữu ích. Một công cụ nhân hoá tốt sẽ tạo ra biến thiên tự nhiên trong cấu trúc câu và cách dùng từ, đồng thời vẫn giữ nguyên độ chính xác kỹ thuật.
Từ khóa ở đây là "tốt". Hầu hết các công cụ nhân hoá sẽ loại bỏ vốn từ kỹ thuật của bạn và làm sai lệch các trích dẫn. Hãy dùng một công cụ được xây dựng cho văn bản học thuật - một công cụ hiểu rằng "p < 0.05" là một biểu thức thống kê, chứ không phải lỗi đánh máy cần sửa. Hướng dẫn của chúng tôi về nhân hoá văn bản AI cho viết học thuật trình bày cách chọn và sử dụng các công cụ này mà không làm tổn hại chất lượng.
Giảm điểm AI của bạn chỉ trong vài phút
Công cụ nhân hóa văn bản của chúng tôi được xây dựng cho viết học thuật. Nó giữ nguyên trích dẫn, thuật ngữ kỹ thuật và giọng điệu học thuật, đồng thời giảm điểm phát hiện AI.
Dùng thử Trình Nhân Hóa Văn Bản miễn phíBước 4: Kiểm tra lại bằng nhiều công cụ phát hiện
Sau khi viết lại và nhân hóa, hãy chạy văn bản đã chỉnh sửa của bạn qua ít nhất ba công cụ phát hiện khác nhau. Chúng tôi khuyến nghị GPTZero, ZeroGPT và Copyleaks, vì chúng sử dụng các mô hình khác nhau và phát hiện các kiểu mẫu khác nhau.
Tại sao là ba? Vì không có công cụ phát hiện nào có thẩm quyền tuyệt đối. Một đoạn văn đạt 5% trên GPTZero có thể đạt 30% trên ZeroGPT. Giảng viên của bạn có thể dùng bất kỳ công cụ nào trong số đó, hoặc hoàn toàn là một công cụ khác. Bằng cách kiểm tra trên nhiều công cụ phát hiện, bạn đang bao phủ phạm vi rộng hơn.
Nếu văn bản của bạn đạt dưới 15% trên cả ba, bạn đang ở vùng an toàn. Nếu một công cụ vẫn gắn cờ một phần nào đó, hãy quay lại đúng đoạn đó và áp dụng các kỹ thuật viết lại thủ công từ Bước 2.
Điều gì không hiệu quả
Một số kỹ thuật phổ biến thất bại một cách đáng tin cậy, và một vài kỹ thuật còn làm điểm số tệ hơn.
- Các công cụ diễn đạt lại bằng thay thế từ đồng nghĩa thay thế từ ngữ nhưng vẫn giữ cấu trúc câu điển hình của AI, đây mới là điều mà các bộ phát hiện thực sự đo lường. Điểm số thường tăng sau một lượt thay thế từ.
- Các mẹo ký tự, như Unicode vô hình, chữ cái trông giống nhau, hoặc thêm khoảng trắng, sẽ bị chuẩn hóa bỏ đi trước khi phân tích bởi các bộ phát hiện hiện đại, và một số còn gắn cờ chính hành vi thao túng đó.
- Dịch qua lại qua một ngôn ngữ khác làm suy giảm ý nghĩa và trích dẫn, trong khi vẫn giữ nguyên nhịp điệu mang tính máy móc.
- Cố tình tạo lỗi chính tả làm giảm chất lượng bản thảo mà không thay đổi các mẫu thống kê mà bộ phát hiện đọc được.
Chỉnh sửa có tính cấu trúc là cách duy nhất làm thay đổi những gì các bộ phát hiện đo lường: nhịp câu, mức độ khó đoán của từ ngữ, và hình dạng đoạn văn. Viết lại thủ công và nhân hóa học thuật đều làm được điều này, khác biệt nằm ở tốc độ.
Nên tập trung vào đâu, theo từng phần
Các phần khác nhau của bài viết sẽ bị gắn cờ khác nhau, vì vậy hãy dành thời gian viết lại vào những chỗ thực sự quan trọng.
Tóm tắt. Thường là phần dễ bị gắn cờ nhất vì bản chất của nó đặc và mang tính công thức. Hãy đa dạng hóa cấu trúc câu, và tránh mở đầu ba câu liên tiếp bằng "This study," "This paper," hoặc "This research," một kiểu viết mà AI rất dễ dùng.
Giới thiệu. Các phát biểu định vị bản thân rất hữu ích ở đây. "Chúng tôi bắt đầu quan tâm đến câu hỏi này khi..." hoặc "Khoảng trống trở nên rõ ràng trong quá trình chúng tôi rà soát..." Những yếu tố kể chuyện ở ngôi thứ nhất rất khó để một mô hình tạo ra một cách tự nhiên, và chúng thường đọc lên như văn phong của tác giả con người.
Phương pháp. Vốn dĩ mang tính công thức, nên phần này tự nhiên có điểm perplexity thấp. Đây là nơi việc phát hiện AI kém tin cậy nhất, và cũng là nơi các giảng viên mong đợi sự tuân thủ chặt chẽ quy ước. Hãy tập trung vào độ chính xác hơn là làm cho nó nghe có vẻ người hơn.
Kết quả. Trình bày các phát hiện cụ thể bằng số liệu rõ ràng. "Participants in the treatment group showed a mean improvement of 3.7 points (SD = 1.2, p = 0.003)" nghe rất tự nhiên như do con người viết. Tóm lược chung chung thì nghe như AI.
Thảo luận. Giọng diễn giải của bạn quan trọng nhất ở đây. Hãy đối chiếu với các phát hiện mâu thuẫn, nêu rõ các hạn chế thay vì nói một cách chung chung, và liên hệ kết quả với chương trình nghiên cứu rộng hơn của bạn. Những yếu tố này đòi hỏi chuyên môn thực sự và tạo cảm giác xác thực như do con người viết.
Tại sao một số văn bản do con người viết lại bị gắn cờ (dương tính giả)
Có một điều khiến đa số mọi người ngạc nhiên: văn bản hoàn toàn do con người viết vẫn thường xuyên kích hoạt các công cụ phát hiện AI.
Chúng tôi đã tự kiểm tra điều này. Chúng tôi lấy năm đoạn văn do các nhà nghiên cứu con người viết hoàn toàn, không có bất kỳ sự tham gia nào của AI, rồi chạy chúng qua GPTZero, ZeroGPT và Copyleaks. Điểm AI trung bình trên tất cả các đoạn là 18%. Một mục phương pháp thậm chí đạt 34% AI, dù được viết tay bởi một nghiên cứu sinh sau tiến sĩ có mười năm kinh nghiệm.
Dương tính giả xảy ra vì văn viết học thuật có những đặc điểm cấu trúc giống với đầu ra của AI. Cả hai đều có xu hướng dùng văn phong trang trọng, cấu trúc đoạn văn nhất quán và vốn từ dễ dự đoán trong phạm vi một ngành. Các công cụ phát hiện không thể phân biệt giữa "nghe giống AI vì AI đã viết ra" và "nghe giống AI vì đó là văn xuôi học thuật trang trọng."
Đây là lý do vì sao hoảng sợ trước một điểm AI ở mức trung bình là phản tác dụng. Một mức phát hiện nhất định là bình thường, ngay cả với những tác phẩm hoàn toàn nguyên bản. Để xem sâu hơn về mức độ đáng tin cậy thực sự của các công cụ này, hãy xem phân tích của chúng tôi về độ chính xác phát hiện AI trong năm 2026.
Grammarly, QuillBot và các công cụ chỉnh sửa khác có làm tăng điểm AI của bạn không?
Có, và điều đó khiến nhiều người bất ngờ vì bản nháp ban đầu hoàn toàn do con người viết. Điều mà các công cụ này thay đổi chính là thứ mà bộ phát hiện đo lường.
Ảnh chụp màn hình bên dưới cho thấy Grammarly đang xử lý một bản thảo kinh tế do con người viết. Gợi ý của nó thay "which can reduce" bằng "thereby reducing" và sắp xếp lại "the consumers' perspective" thành "the perspective of consumers". Mỗi thay đổi đều đúng ngữ pháp, và mỗi thay đổi đều đẩy câu văn gần hơn với giọng điệu mượt mà, trang trọng mà các mô hình ngôn ngữ thường mặc định sử dụng.

Cùng lần rà soát đó còn đề xuất "underscoring" thay cho "which highlights", một trong những từ mang tính AI dễ nhận ra nhất trong văn xuôi học thuật:

Một gợi ý được chấp nhận thì không thay đổi gì lớn. Vài chục gợi ý có thể thay đổi hồ sơ thống kê của tài liệu, nhịp câu trở nên đồng đều hơn, các liên từ trở nên trang trọng hơn, và những từ như "thereby", "moreover", và "underscoring" tích tụ dần. Chính hồ sơ đó là thứ mà các bộ phát hiện chấm điểm, và một số còn gọi thẳng tên nó. Trình phát hiện của Scribbr, được hiển thị ở phần trước của hướng dẫn này, báo cáo một danh mục riêng "Human-written & AI-refined" cho đúng kiểu văn bản như vậy. Chế độ diễn đạt lại của QuillBot còn đẩy xa hơn theo cùng một hướng, vì việc viết lại toàn bộ câu theo một phong cách nội bộ chính là bản chất của sản phẩm.
Cách khắc phục không phải là bỏ qua biên tập. Đó là dùng một trình biên tập sửa lỗi mà không làm thay đổi phong cách văn của bạn. Chế độ Light proofreading của ProofreaderPro an toàn với bộ phát hiện vì lý do này, nó sửa ngữ pháp, chính tả, và dấu câu dưới dạng các thay đổi được theo dõi riêng lẻ, đồng thời giữ nguyên cấu trúc câu và lựa chọn từ ngữ của bạn, nên các mẫu mà bộ phát hiện nhận diện vẫn là của bạn. Hãy chạy nó từ AI proofreader, xem lại từng thay đổi, và điểm số của bạn sẽ phản ánh cách bạn viết chứ không phải công cụ chỉnh sửa bạn dùng.
Mục tiêu thực tế: dưới 15%, không phải 0%
Đừng cố đạt 0%. Điều đó không thể đạt được, và việc theo đuổi nó sẽ làm cho bài viết của bạn tệ hơn.
Một điểm số AI 0% sẽ đòi hỏi văn bản phải hỗn loạn và khó đoán đến mức nó sẽ được đọc như một bài viết kém. Các mẫu thống kê mà các công cụ phát hiện tìm kiếm trùng lặp đáng kể với các mẫu của văn xuôi học thuật rõ ràng, có cấu trúc tốt. Loại bỏ mọi tín hiệu cho bộ phát hiện đồng nghĩa với việc loại bỏ tính rõ ràng và cấu trúc.
Mục tiêu thực tế cho bài viết học thuật là dưới 15% trên nhiều công cụ phát hiện. Ở mức đó, văn bản của bạn nằm trong phạm vi bình thường của nội dung học thuật do con người viết. Hầu hết các cơ sở sử dụng phát hiện AI đều đặt ngưỡng ở 20% hoặc cao hơn, thừa nhận rằng một mức độ khớp mẫu nào đó là không thể tránh khỏi.
Đây là quy trình chúng tôi khuyến nghị:
- Viết hoặc tạo bản nháp của bạn - bất kể bạn tạo ra nó như thế nào
- Chạy nó qua GPTZero để xác định các đoạn bị gắn cờ
- Viết lại thủ công những đoạn có điểm số tệ nhất bằng cách sử dụng các kỹ thuật ở trên
- Dùng text humanizer cho những đoạn cứng đầu khó viết lại thủ công
- Kiểm tra lại trên ba công cụ phát hiện - GPTZero, ZeroGPT, Copyleaks
- Nhắm mục tiêu dưới 15% trên cả ba, rồi dừng lại
Đi xuống dưới 15% mang lại lợi ích giảm dần. Thời gian bạn sẽ dùng để theo đuổi một con số thấp hơn nên được dành để cải thiện nội dung và lập luận thực sự của bài viết của bạn.
Lần tới: viết trước, dùng AI sau
Cách đáng tin cậy nhất để ngay từ đầu tránh một điểm số cao là đảo ngược quy trình AI thông thường: hãy tự viết bản thảo trước và chỉ dùng AI để tinh chỉnh. Một bản thảo nháp, chưa hoàn thiện của con người sẽ mang theo nhịp câu, lựa chọn từ ngữ và thói quen cấu trúc của bạn, còn việc tinh chỉnh bằng AI sẽ làm mượt bề mặt mà không xóa đi những mẫu sâu hơn đó.
- Viết một bản nháp sơ bộ từ ghi chú và quá trình nghiên cứu của bạn, không có sự hỗ trợ của AI
- Tự chỉnh sửa về cấu trúc và lập luận
- Dùng AI cho các nhiệm vụ cụ thể: kiểm tra ngữ pháp, độ rõ của câu, gợi ý lựa chọn từ ngữ
- Xem lại và điều chỉnh các gợi ý của AI để phù hợp với giọng văn của bạn
- Đọc lại lần cuối để xác nhận văn bản nghe giống bạn
Về lâu dài, chính thói quen đó sẽ xây dựng hàng rào phòng vệ mạnh nhất có thể: một giọng văn riêng biệt. Hãy đọc rộng trong lĩnh vực của bạn, viết đều đặn, và dùng một AI proofreading tool để trau chuốt sau khi đã hoàn tất phần tư duy. Văn viết thực sự do con người tạo ra có những mẫu mà không mô hình nào sao chép được, và một công cụ phát hiện sẽ không có gì để bắt gặp khi văn bản là của chính bạn.
Đạo đức, nói rõ ràng
Có một khác biệt có ý nghĩa giữa hai tình huống. Dùng AI để viết một bài mà bạn nhận là công trình của chính mình, rồi che giấu sự tham gia của AI, là hành vi không trung thực trong học thuật, và không có mức độ "humanizing" nào thay đổi được điều đó. Dùng AI như một công cụ viết để hỗ trợ ngữ pháp, độ rõ ràng, và cấu trúc, rồi bảo đảm đầu ra không bị gắn cờ sai, là cách sử dụng công cụ có trách nhiệm. Thước đo nằm ở đóng góp trí tuệ: các ý tưởng, phân tích, và lập luận phải là của bạn. Nhiều trường đại học hiện nay đã đưa sự phân biệt này vào chính sách AI của họ, vì vậy hãy kiểm tra chính sách của bạn và công khai việc dùng công cụ khi được yêu cầu.
Các câu hỏi thường gặp
Làm sao để giảm tỷ lệ AI của tôi xuống dưới 20%?
Phương pháp hiệu quả nhất là viết lại thủ công những phần bị gắn cờ. Hãy chạy văn bản của bạn qua một công cụ phát hiện ở cấp câu như GPTZero, xác định các đoạn cụ thể đang làm điểm số của bạn tăng lên, rồi viết lại các đoạn đó từ đầu - đừng chỉ chỉnh sửa chúng. Tập trung vào việc thay đổi độ dài câu, thêm cách diễn đạt đặc thù của lĩnh vực, và tái cấu trúc các đoạn văn. Với những phần cứng đầu, hãy dùng một công cụ nhân hoá AI học thuật. Phần lớn sinh viên có thể xuống dưới 20% trong vòng một lượt viết lại có mục tiêu.
ZeroGPT có phát hiện được mọi văn bản do AI viết không?
Không. ZeroGPT, giống như mọi công cụ phát hiện AI khác, có những hạn chế đáng kể. Trong các thử nghiệm độc lập, độ chính xác của ZeroGPT dao động từ 60-85% tùy theo loại văn bản và mô hình AI đã tạo ra nó. Công cụ này hoạt động tốt hơn với đầu ra GPT-3.5 chưa chỉnh sửa và kém hơn với văn bản từ các mô hình mới hơn hoặc văn bản đã được con người chỉnh sửa. Nó cũng tạo ra các dương tính giả - gắn nhãn văn bản do con người viết là do AI tạo ra - với tỷ lệ từ 5-15% tùy theo phong cách viết. Không nên xem bất kỳ công cụ phát hiện AI nào là tuyệt đối chính xác.
Tại sao điểm AI của tôi lại cao dù tôi tự viết nó?
Dương tính giả rất phổ biến trong viết học thuật vì văn xuôi học thuật trang trọng có chung các đặc trưng thống kê với văn bản do AI tạo ra - độ dài câu nhất quán, từ vựng trang trọng, cấu trúc đoạn văn có thể dự đoán, và cách tổ chức theo câu chủ đề. Các phần phương pháp và tổng quan tài liệu đặc biệt dễ bị dương tính giả vì chúng tuân theo những quy ước ngành rất chặt chẽ. Nếu bạn tự viết văn bản đó, hãy ghi lại quy trình viết của mình và trao đổi với giảng viên thay vì cố gắng viết lại một đoạn văn vốn đã tốt chỉ để đánh lừa công cụ phát hiện.
Mức điểm phát hiện AI nào mà hầu hết các trường đại học chấp nhận?
Không có một chuẩn chung nào. Chính sách khác nhau rất nhiều giữa các cơ sở đào tạo, và ngay cả giữa các khoa trong cùng một trường đại học. Các ngưỡng phổ biến nhất mà chúng tôi thấy dao động từ 15% đến 25%, dù một số cơ sở gắn cờ bất kỳ mức nào trên 10% để xem xét. Nhiều trường đại học không đặt ngưỡng cứng, họ dùng phát hiện AI như một công cụ sàng lọc để kích hoạt việc rà soát của con người thay vì áp dụng hình phạt tự động. Hãy kiểm tra chính sách cụ thể của cơ sở của bạn, và khi không chắc chắn, hãy nhắm tới mức dưới 15% trên nhiều công cụ phát hiện.
Phương pháp tương tự có hiệu quả với điểm AI của Turnitin không?
Có. Chỉ báo AI của Turnitin đọc cùng loại mẫu thống kê như GPTZero và Copyleaks, nên việc chỉnh sửa cấu trúc sẽ làm thay đổi nó theo cùng cách. Để biết chi tiết dành riêng cho Turnitin, xem hướng dẫn nhân hoá Turnitin và hướng dẫn điểm Turnitin.
Có phải tránh phát hiện AI trong viết học thuật là phi đạo đức không?
Điều đó phụ thuộc vào cách bạn đã dùng AI. Nếu bạn dùng AI như một công cụ hỗ trợ viết, để kiểm tra ngữ pháp, làm rõ câu chữ, hoặc cấu trúc lại các ý tưởng của chính bạn, thì việc đảm bảo văn bản của bạn không bị gắn cờ sai là hợp lý. Nếu bạn dùng AI để tạo ra nội dung mà bạn đang nhận là công trình trí tuệ của mình, việc tránh bị phát hiện là không trung thực. Vấn đề đạo đức nằm ở các ý tưởng, chứ không phải ở phong cách văn bản. Luôn kiểm tra và tuân thủ chính sách sử dụng AI của cơ sở đào tạo.
Cách hiệu quả nhất để tránh phát hiện AI là gì?
Viết bản nháp đầu tiên của chính bạn và chỉ dùng AI để tinh chỉnh. Văn bản bắt đầu từ việc con người viết sẽ giữ lại các mẫu mang tính con người ngay cả sau khi được AI chỉnh sửa. Kết hợp điều này với việc chủ động thay đổi độ dài câu, thêm giọng văn cá nhân, và kiểm tra phát hiện lần cuối sẽ tạo ra văn bản có thể vượt qua các công cụ phát hiện AI một cách nhất quán.
Công cụ phát hiện AI có hoạt động với văn bản không phải tiếng Anh không?
Các công cụ phát hiện AI cho văn bản không phải tiếng Anh kém tin cậy hơn các công cụ dành cho tiếng Anh. Phần lớn các công cụ thương mại được huấn luyện chủ yếu trên dữ liệu tiếng Anh. Nếu bạn đang viết bằng ngôn ngữ khác, tỷ lệ dương tính giả có thể cao hơn, và các chiến lược tránh bị phát hiện có thể cần được điều chỉnh theo quy ước của ngôn ngữ đó.
Turnitin có thể phát hiện bài viết được hỗ trợ bởi AI không?
Hệ thống phát hiện AI của Turnitin xác định các mẫu nhất quán với việc tạo sinh bằng AI, và nó không thể phân biệt giữa văn bản do AI tạo ra và văn bản do AI hỗ trợ. Văn bản phần lớn do con người viết rồi được AI tinh chỉnh vẫn có thể bị gắn cờ. Viết bản nháp đầu tiên của riêng bạn và thay đổi cấu trúc câu đáng kể sẽ giúp giảm mạnh việc bị gắn cờ sai.
Giảm điểm phát hiện AI trong khi vẫn giữ nguyên giọng điệu học thuật, trích dẫn, và vốn từ vựng kỹ thuật.

Moe là một kỹ sư NLP với PhD trong xử lý ngôn ngữ tự nhiên. Nghiên cứu của ông bao gồm ngôn ngữ học tính toán, phân tích văn bản và học máy, đồng thời được đưa trực tiếp vào các mô hình chỉnh sửa và nhân bản hóa đằng sau ProofreaderPro. Anh ấy viết về một phần của quá trình mà hầu hết mọi người không bao giờ thấy: cách một mô hình ngôn ngữ đọc một câu, chấm điểm và quyết định những gì cần thay đổi.