ProofreaderPro.ai
AI 文本人性化

Grammarly AI检测器:它的#1 RAID排名意味着什么

Grammarly的AI检测器在RAID上排名第1,这是一个已发布的基准测试。查看RAID测试包含哪些内容,这个排名对你的论文意味着什么,以及Grammarly如何将其AI humanizer进行关联。

Dana|2026年10月6日|8 分钟阅读
Grammarly AI检测器:它的#1 RAID排名意味着什么 - ProofreaderPro Blog

Grammarly的AI检测器在识别未经编辑的纯粹AI文本方面准确。Grammarly表示其准确率达到99%,并在RAID这项已发布的基准测试中以质量排名第1。该基准会使用共享数据集来测试不同检测器。这样的排名反映的是在一套庞大且固定的写作样本上的整体表现。它并不能保证你自己的论文会得到某一个特定分数,也不保证与你所在领域的词汇或你反复修改过多次的草稿相同。

Grammarly的AI检测器会检查什么

Grammarly的AI检测器是grammarly.com上的免费扫描工具。你粘贴文本或上传文件,然后点击“Scan for AI”。该工具会返回一个百分比评分,用于表示文本中看起来像AI生成的部分,并分为两类:“Resembles AI text(类似AI文本)”和“ No AI text patterns found(未发现AI文本模式)”。总体百分比表示文档中属于“Resembles AI text”类别的占比。有些人会把此工具称为“Grammarly AI checker”,但它是同一个免费的检测器。

Grammarly的AI检测结果面板,包含AI生成百分比仪表,以及“Resembles AI text”和“No AI text patterns found”这两个类别

该检测器是Grammarly写作套件中的一个工具,位于其语法检查器、抄袭检查器和AI humanizer旁边。Grammarly表示,它能够识别来自Grammarly的AI生成文本,以及来自ChatGPT、Gemini和Claude等工具的文本。

Grammarly Pro会加入AI Detector agent,它比单一分数更进一步。它会标出看起来由AI生成的具体段落,解释为什么某个短语会呈现出这种特征,并通过Grammarly的AI Rewriter提供“一键式”对同一段落的改写。

Grammarly还表示,该检测器旨在避免误将人类写作标记为AI生成,并且会在发布新的AI模型时持续更新其模型。Grammarly将该工具面向多种写作类型进行推广,包括研究论文、报告、文章和学校作业,作为你提交前需要进行的一项检查。

RAID是什么,以及Grammarly的#1排名意味着什么

RAID是一个学术基准,且Grammarly并没有创建它。相关论文由研究者Liam Dugan及其合作者主导,并在2024年Association for Computational Linguistics会议上进行了展示。其摘要直接指出:许多商业与开源检测器声称准确率达到99%或更高,但真正经过在难度较高数据集上测试的却很少。

RAID数据集在设计上规模很大。

RAID论文测试了什么细节
数据集中包含的生成超过600万
覆盖的写作模型11
写作领域8
对抗攻击11
解码策略4
被评估的检测器12(8个开源,4个闭源)

在这 12 种检测器中,论文作者发现了一个一致的薄弱点。当前检测器很容易被对抗性攻击、采样策略的改变、重复惩罚,以及检测器在训练期间未见过的生成模型所“骗过”。作者随后发布了完整数据集,并在其后提供了可持续更新的排行榜,供其他检测器公司拿来测试。

该公开排行榜之所以让 RAID 的排名更容易被核查,是其中的关键之一。其他研究人员和检测器公司可以使用相同数据集,通过各自的工具运行测试,并对照比较结果。这与某个单一公司在没有外部验证方式的情况下给出的“准确率”数字不同。

论文作者将其评估描述为对“域外与对抗鲁棒性”的测试。直白地说,他们不仅检查检测器在与其训练文本类似的情况下表现如何。还进一步测试每个检测器在它们可能并未被设计用来预期的领域、模型与攻击方式上的表现。

Grammarly 自己的博客表示,在该排行榜上 Grammarly 排名第 1,质量最佳。该文将 RAID 描述为针对超过 670,000 篇文本的测试,覆盖不同写作风格、AI 模型,以及试图欺骗检测器的各种尝试。Grammarly 的博客也明确写道,没有任何 AI 检测器能做到 100% 准确,即便是它自己排名第一的那一个。

排行榜排名是相对分数,通常基于一次性衡量,用同一套固定文本进行评估。它告诉你该检测器在这份数据集上的表现如何。

它无法预测同一检测器在你的论文中会给出怎样的分数。你的文章有自己领域特定的词汇,也有你自己的写作习惯,并且可能已经经历了你自己的多轮修改。RAID 的数据集以受控方式测试这类模式。它并不是为了复刻任何某个人真实论文的内容,也没有任何基准测试结果,哪怕规模再大,都能替代你在提交前对自己的草稿进行直接核查。

Grammarly 的 AI 功能以及你的 AI 分数

Grammarly 的 AI 检测器不仅会检查来自其他公司 AI 工具的文本。其页面写明,它不仅能识别由 Grammarly 生成的文本,也能识别来自 ChatGPT、Gemini 和 Claude 等工具生成的文本。如果你在起草阶段使用 Grammarly 自家的 AI 功能,这句话就很关键。

Grammarly 的计划页面将其功能列为彼此独立的条目。语法与拼写纠错被列在“无错误地写作”之下,而其生成式功能则列在“使用 AI 提示生成文本”之下,不同计划会提供不同额度的可用生成能力。这是两种不同类型的帮助。纠正错别字或错放的逗号并不会生成新的句子,而让 Grammarly 编写或重写一段内容则会。

在某份草稿中,大量使用 Grammarly 的 AI Rewriter 或其生成式提示,是可能反映在你的 AI 分数上的部分。尤其是当你生成的是整段句子或段落,而不是对你自己的写作进行编辑时,更是如此。只使用语法和拼写纠错的学生,并没有使用 Grammarly 中那部分会生成新文本的功能。仅凭这种用法,本身不太可能就是来自 Grammarly 自家检测器的“警示”来源。就学术写作而言,尤其是我们的评测 Grammarly 的 AI humanizer 用于学术写作 会重点考察 Grammarly 的生成式功能在引用和技术术语周边的表现表现如何。如果你在为研究论文或论文选题权衡 Grammarly 与其他工具,我们的 ProofreaderPro.ai 与 Grammarly 对比同样也覆盖了这些方面。

作者署名:记录你如何写作

Grammarly 的 Authorship 功能独立于 AI 检测,并且更像是“持续记录”,而不是单一分数。它会在你写作时追踪整份文档,并对每个部分进行分类:由你本人输入、来自在线来源、或由 AI 生成。Authorship 属于与 Grammarly 的查重工具和引用生成器同一套件的一部分。被标记的 AI 分数并不是 Grammarly 的工具对一篇写作唯一能提供的记录。

如果授课者或编辑曾对你作品中的 AI 分数提出质疑,Authorship 能给你一些可向对方出示的内容,不仅仅是你自己的话。这个思路和你保留草稿及版本历史是一样的。我们在 过程是新的校对 中介绍这种方法。一段写作如何逐步形成的记录,比单一百分比更有说服力。如果某个标记演变成正式争议,我们关于 对错误的 AI 检测标记提出申诉 的指南会讲解下一步。

在提交之前先检查你的草稿

我们的学术 AI humanizer 旨在以你的原声将高 AI 分数降低,同时不触碰你的引用、技术术语或数字。

试用 ProofreaderPro.ai 免费版

Grammarly 如何将其检测器与 humanizer 连接

Grammarly 的 AI 检测器和其 AI humanizer 是 Grammarly 套件中的两个独立工具,它们各自有独立页面和各自的 FAQ。检测器被描述为一种在 AI 和人工文本样本上训练的模型。humanizer 被描述为由 Grammarly 的语言学家和工程师打造的工具。它会将 AI 文本改写成四种预设语气之一,或者基于你提供的写作样本创建自定义语气。

两 个页面会在“Go beyond”部分相互链接。Grammarly 的 Authorship 功能通过展示文档中哪些内容是手动输入、哪些来自在线来源、哪些由 AI 生成,将它们连在一起。Grammarly 的 humanizer FAQ 会直接询问该工具是否能帮助你绕过 AI 检测器,而 Grammarly 的回答是它并非为此而设计。它将 humanizer 描述为一种让由 AI 辅助的写作听起来更清晰、更自然的方式。

Grammarly 与 GPTZero

Grammarly 与 GPTZero 共享同一母公司。Grammarly 网站页脚在同一处“Company”标题下列出了 GPTZero,Superhuman 也在该标题之下;而 GPTZero 自己的网站则描述它属于 Superhuman 家族,Superhuman 家族同样拥有 Grammarly。由于两家公司的检测器页面都没有说明这两个工具共享同一种检测模型,所以仅凭共同持有关系并不能告诉你它们对同一文本的评分是否一致。

在实际情况中,即使是对同一篇文章,Grammarly 的分数和 GPTZero 的分数仍可能不同,因为两家公司分别运行并持续更新各自的检测器。如果你在两个工具中都检查同一份草稿,请比较每个工具标记的段落。标记出的段落能比两个百分比更能反映你的草稿情况。我们在 我们的 GPTZero 评测 中查看了 GPTZero 自己的数字,包括其对准确性的相关主张。

免费版 vs Pro

Grammarly 的 AI 检测扫描在 grammarly.com 上免费:粘贴或上传文本,点击“Scan for AI”,即可获得百分比分数。Grammarly Pro 每月 US$12,解锁 AI Detector agent,并提供按段落级别的标记,以及通过 AI Rewriter 进行一键改写。Grammarly Enterprise 面向更大型组织,采用 Contact Sales 的定价模式,而不是列出固定价格。

方案价格AI 检测
免费每月 US$0在 grammarly.com 上点击“Scan for AI”
Pro每月 US$12AI Detector agent、按段落级别的标记、AI Rewriter、7 天免费试用

Grammarly 的 AI 提示额度也会随套餐变化:Free 为每月 100,Pro 为每月 2,000,Enterprise 为无限额度。以上限额适用于 Grammarly 的生成式功能,而不适用于检测扫描本身。检测扫描在任何套餐中都没有标明限制。想进一步了解 Grammarly 的免费层级在研究写作方面缺少哪些内容,请查看我们对 学术写作的免费 Grammarly 替代方案 的评测。

较高的基准排名是一项有用的信息,但它并不能保证你的文章表现。即使你在使用 AI 辅助修改后仍然得分很高,我们的 学术 AI humanizer 也会被打造用于将该分数降下来。它会保留你的写作声音,并且不会触碰你的引用、术语和数字。

常见问题

Q: Grammarly 的 AI humanizer 是否使用与其 AI 检测相同的引擎?

Grammarly 将这两者描述为独立的工具,各自都有自己的页面和对其工作方式的说明。检测器被描述为一种在包含人类文本与 AI 文本样本上训练的模型,而 humanizer 被描述为由 Grammarly 的语言学家和工程师打造的工具。两个页面都没有说明它们共享同一个模型。

Q: Grammarly 的 humanizer 是否旨在与其检测器配合使用?

是。Grammarly 的 humanizer 常见问题说明该工具并非用于帮助人们绕过 AI 检测。它建议将 humanizer 与检测器搭配使用,并结合 Grammarly 的引文与 Authorship 功能,以保持 AI 使用的透明度。

Q: Grammarly 是否将其 humanizer 和检测器作为一套联动工作流程进行营销?

是。两个页面都在“Go beyond”板块下相互链接。Grammarly 的 Authorship 功能通过展示文档中哪些部分是键入完成的、哪些部分来自在线来源,哪些部分使用 AI 生成,将两者连接起来。

Q: 使用 Grammarly 会让我的写作看起来像 AI 吗?

可能会。如果你过度依赖 Grammarly 的生成式功能,Grammarly 的检测器会以与识别 ChatGPT、Gemini 和 Claude 输出相同的方式来识别由 Grammarly 自身 AI 工具生成的结果。语法和拼写纠正不属于该信号的一部分;你使用 AI Rewriter 生成或进行了大量重写的文本才会被识别。

Q: Grammarly 的 AI 检测是否免费?

是。grammarly.com 上的扫描工具是免费的:粘贴或上传文本即可获得一个百分比评分。AI Detector agent(带有按段落级别的标记以及一键改写)需要 Grammarly Pro 订阅,费用为每月 US$12。

Q: Winston AI 与 Grammarly 的 AI 检测相比如何?

Winston AI 宣称准确率为 99.98%,略高于 Grammarly 99% 的说法。根据我们的拆解,外部测试表明 Winston 的真实世界准确率更接近 75% 到 83%:Winston AI 检测准确性。Grammarly 的数据来自内部测试与其 RAID 排名的综合。

Q: Grammarly 是否与 GPTZero 有关联?

是,通过所有权。Grammarly 的网站在其公司页脚中将 GPTZero 列在 Superhuman 旁边,而 GPTZero 自己的网站也描述自己属于同一由 Superhuman 所拥有的家族,拥有 Grammarly。Grammarly 并没有说它的检测器使用了 GPTZero 的技术。

Q: Grammarly 的 RAID 排名衡量的是什么?

它衡量 Grammarly 的检测器在 RAID 已发布数据集上的表现,并与 RAID 评估的其他检测器相比。Grammarly 自己的博客描述该数据集包含 670,000 多篇文本,覆盖不同写作风格与 AI 模型,其中包括刻意用来迷惑检测器的尝试。支撑 RAID 的学术论文描述了一个更大的数据集,包含超过 600 万次生成,用于进行支撑公开排行榜的检测器测试。RAID 的排名并不能衡量同一检测器在该数据集之外、对任何单篇文章的表现。

学术 AI humanizer

在保留你原本写下的引文、技术术语和数字的前提下,用你自己的声音改写由 AI 辅助撰写的草稿。

Dana - Author at ProofreaderPro.ai
DanaContent Creator

Dana 是 ProofreaderPro 的内容创作者,负责日常博客和写作业务。 她撰写有关在线编辑平台如何运作的文章,每天处理客户消息,并获得了五星级的满意度评分。

继续阅读

立即试用 Text Humanizer 免费版

立即开始免费使用
Proofreader Pro AI
使用ProofreaderPro.ai优化您的研究,全球领先的AI驱动校对工具,专为学术文本量身定制。
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
© 2026 ProofreaderPro.ai. 领先的学术校对、编辑和人性化工具, 由我们精心打造 ❤️ 以及语法上通顺的表达句式 🌳s