新比诉阿德菲:首起AI检测裁定的法院判决
新比诉阿德菲判决:首个限制AI检测执法规范的法院裁定,它对ESL误报的含义,以及如何构建你的辩护。
2026年2月,一家纽约法院作出的新比诉阿德菲(Newby v. Adelphi)裁定,是首起涉及“AI检测”的法院案件(也是首起以AI检测为由、最终进入裁定的AI检测诉讼)。在该案中,法院认定:阿德菲大学必须清除一名三年级ESL本科生的涉案记录。该学生把被指控论文中的所有文字都写成了原创,并且在Turnitin的AI评分中得分为94%。法院命令大学撤销对该学生作出的学术诚信指控。高等教育首次获得了一个关于基于AI检测实施纪律的重大先例。而且,这个先例并不站在检测工具一方。
我们一直在关注AI检测领域的申诉趋势,早在2024年初就已经开始。通往新比案的过程一度令人沮丧。在18个月内,我们记录了41起ESL研究生案例:在同一毕业班中,这些学生被标记的比例比母语为英语的同等同学高出3到6倍;同时,他们无法“证明不存在”(prove a negative)来推翻大学的学术诚信认定,因为他们无法反驳AI检测器供应商提供的置信度评分。新比诉阿德菲是首例法院要求大学在案卷记录中承认这种不平衡的案件。
本文是对该裁定内容的“通俗版”解读:它真正说了什么、没说什么、它今天保护谁、它会为明天提供何种指引,以及它为面对同类指控的学生解锁了怎样的实用辩护策略。我们聚焦ESL角度,是因为争议在此处发生转折,而且下一波申诉也很可能从这里出发。
新比诉阿德菲裁定究竟作出了什么决定?
2026年2月,纽约一家法院撤销了阿德菲大学针对一名ESL本科生作出的学术诚信认定。法院认为:仅凭一项Turnitin AI评分94%,且该评分未经过验证以适配该学生的ESL语言特征,并不足以达到大学自身要求的“优势证据”(preponderance of evidence)标准。救济措施范围很窄:清除学生记录,并在机构选择继续推进时发回,要求进行程序合规的重新听证。该裁定并未在原则上禁止AI检测;它只是限制了在纪律程序中如何为检测器评分赋权。
新比诉阿德菲案发生了什么?
2025年秋季,M. Newby为一门大二学期课程提交了文献综述。Turnitin的AI写作指示器返回94%的评分。课程任课教师将该案提交至学校学术诚信办公室。经过一次简短听证,学校作出学术不端的认定。Newby随后提起校内申诉,但未获支持。
Newby的代理律师于2025年11月向纽约州法院提起诉讼,并在2026年2月迎来裁决。法院基于三个理由撤销了该机构的认定。第一,大学无法提供证据证明:在听证所使用的置信度水平下,Turnitin AI指示器已针对ESL英语完成过验证。第二,听证将该评分视为决定性证据,而未允许就检测器的错误率进行专家证词。第三,大学自身的学术诚信政策要求“优势证据”,而法院认为:仅凭一项专有评分、且没有任何可解释的基础信息,无法达到这一门槛。
法院并未就“AI检测在原则上是否被允许”作出裁断。法院的结论是:阿德菲对该评分的使用方式,实际上相当于把它当作几乎具决定性的工具,但却没有独立佐证,也没有针对已知的ESL偏差作出任何适配;这种做法在大学自身政策框架下构成对程序公平性的否定。救济仍然很窄:撤销该认定、清除案卷记录,并在机构选择继续推进时发回,让其进行程序合规的重新听证。
为什么新比诉阿德菲的裁定重要?
仅凭某一所私立大学的胜负,并不足以形成全国性的先例。新比案的意义更为务实。它提供了一份可书面援引的记录,展示了当机构被迫在法庭上证明其适用AI检测证据时,法院如何评估这种证据。现在,无论是内部申诉还是外部申诉,相关方都可以引用新比案:一个单独的检测器评分(且没有针对特定学生语言画像所附带的证据)不足以单独构成证据。
裁定中与“举证发现”(discovery)相关的部分同样关键。为使该决定站得住脚,阿德菲必须提供Turnitin向机构提交的验证数据。法院审阅了这些数据:根据机构的入件材料,该数据在ESL本科生样本上显示28%的误报率。该数字现已进入公开案卷。未来数年内,它几乎注定会被一再用于与新比案相邻的申诉论证。
第三个影响是声誉层面。现在确实有一些大学曾把AI评分当作学术诚信认定的“盾牌”,却在不知情的情况下发现这面盾牌刚刚失灵。它们现在急于补充:除了检测器评分之外,还必须确认其他佐证证据。在裁定作出的两个月内,我们已经看到三家机构更新了学术诚信政策来应对这一问题。新比案正在做的是,供应商披露从未完成的工作。
为什么AI检测器会把ESL写作者标记为AI生成?
2023年斯坦福大学的一项研究发现:GPTZero会将52%的由非母语英语使用者撰写的文章标记为AI生成;而相同提示下,母语英语作者的文章被标记比例仅为0到12%。后续供应商更新在一些测试集上缩小了差距,但在另一些测试集上又扩大了差距。结构性原因并未改变。检测器会寻找低困惑度(perplexity)和低突发性(burstiness)。ESL写作者,尤其是接受过正式学术英语训练的人,往往会恰好写出具备这些特征的文本:短句、受控词汇表、平行结构,以及一致的文体风格,会在检测器看来呈现“低熵”(low entropy),检测器会将其编码为“类机器输出”。
Newby的写作画像几乎是这种模式的“教科书式”样本。她的文献综述使用了紧凑的句子、有限的衔接词词库(例如“however”“in addition”“therefore”),以及段落之间均衡一致的文体。对于人类ESL写作指导教师而言,这正是多年的显性教学训练出来的典型产物。对于训练于母语英语变异性的检测器来说,它却被评估为机器生成的文本。法院无需在抽象层面讨论偏差问题;在发现程序中提交的检测器自身验证数据替它完成了工作。
现在,“AI检测器对ESL写作者的误报”模式已经被在法律层面记录下来,而不只是停留在学术论证中。如果你是一名ESL学生,那么这份文献中最有用的一句话,就是对该误报模式的法律化说明。
新比案没有做什么
误读该裁定是最快的“自找麻烦”方式。该裁定有三点并未做出。
它并未禁止AI检测。 大学仍然可以使用Turnitin、GPTZero、Pangram、Originality.ai以及类似工具。该裁定限制的是:在纪律程序中如何为评分赋权,而不是是否会生成该评分本身。
它并未在纽约州之外对大学产生直接约束。 有说服力的先例确实真实且有用,但它并不等同于具有约束力的先例。德克萨斯州某所公立大学的学术诚信官并不在法律上被要求遵循新比案。然而他们已被告知:在他们各自的听证中会出现相同的论证;同时,他们的机构一般律师也会以与阿德菲最终相同的方式来阅读该案。
它并未在“AI确实被使用”的情况下给学生豁免。 法院明确指出,该裁定针对的是在存在争议的证据情境下如何保障程序公平。如果学生提交的是AI生成文本,而机构又有独立证据(例如草稿历史不匹配、证人叙述、近乎逐字的ChatGPT记录),那么新比并不能保护他们。此案讨论的是检测器如何被使用,而不是AI生成提交是否被允许。
如何证明你没有使用AI?一种“新比式”辩护
该案为每一位被指控学生提供了一个四部分的模板。每一部分都可以在不依赖律师的情况下完成,当然在涉及严重后果的案件中通常建议有律师协助。
1. 要求提供基础验证数据。 以书面形式要求机构出示检测器供应商针对测试人群的验证报告,其中应包含你的语言画像。如果你是ESL学生,请特别要求提供ESL误报率。机构往往拿不出这些数据,而这本身也构成你的辩护要点之一。
2. 提供你的写作过程记录。 版本历史、Word AutoRecover文件、OneDrive活动日志、浏览器标签历史,以及参考文献管理器的快照,都能显示你是如何在一段时间内完成论文写作的。新比裁定尤其指出:阿德菲因为“缺少草稿历史”而把它当作有罪证明,这是一个错误,即便他们的提交门户并不要求上传草稿。若你能够提供过程记录,就务必提供。如果你的门户并未能捕捉这些信息,那同样也是你的辩护组成部分。
3. 用公开的错误率来对照该评分。 阿德菲的验证数据显示ESL误报率为28%。斯坦福2023年的研究显示为52%。请把这些数字写进你的书面回应中。以该误报率为基础、作为主要证据使用的检测器评分,并不构成优势证据。
4. 要求一份可解释性报告(explainability report)。 大多数供应商提供“高亮”(highlighted)视图,用来显示哪些句子推动了评分。你可以提出请求。如果供应商无法提供,则意味着机构要求你去对一个无法解释的数字作出辩护,这本身就构成对公平性的论证。
我们的上诉信写作攻略会更详细地讲解书面回应的撰写方式,包括一份“考虑新比案因素”的信件模板,以及当课程层级申诉失败时的程序性升级路径。
流程就是新的证据
新比裁定是2025-2026年三项信号之一,表明学术诚信讨论已经从“检测器是否把你标记出来”转向“过程记录显示了什么”。同时,在2025-2026年间,Turnitin Clarity也以规模化方式上线:它会捕捉草稿取证(draft forensics)与修订节奏(revision pacing)。主要期刊(Nature、Cell、Lancet)已将其AI政策从“不得使用AI生成文本”转向“披露AI使用并保留修订历史”。2026年初,Curtin University还出现过一次Turnitin禁用事件,其逻辑是:该评分生成的争议多于它解决的争议。
对学生和研究者传递的信息是相同的:保留草稿。使用带有修订历史的工具。记录你使用的提示词(即使你写作时全部由自己完成)。我们关于稿件的AI披露指南会覆盖期刊投稿中的披露要求;在未来12个月内,随着机构更新政策,同样的逻辑也适用于课堂作业。
但humanizer这条路径同样重要,而且经常被误解。懂引文意识(citation-aware)的humanizer并不是用来隐藏AI使用的。它的用途,是在检测器无法区分差异时,保护ESL写作者的学术文句不被错误地打上AI分数,同时保留审稿人或任课教师会核对的参考文献列表。我们为正是这一特定情境构建了我们的humanizer,而新比裁定是我们迄今为止最清晰、最有力的证据,说明该争议是真实存在的。
常见问题
Q:新比诉阿德菲的法院实际裁定了什么?
法院撤销了阿德菲大学针对该学生作出的学术诚信认定。法院指出:仅凭一个Turnitin AI评分,而未提供与该学生ESL语言画像相匹配的验证证据,也未给予用专家证词对该评分提出质疑的机会,不能满足该机构自身的“优势证据”标准。救济措施仍然很窄:清除学生记录,并发回要求进行程序合规的重新听证(如果机构选择继续)。该裁定并未在原则上禁止AI检测。
Q:新比裁定能否保护纽约以外高校的学生?
不能作为具有约束力的先例。但这类裁定具有说服力的“参考权威”(persuasive authority):意味着另一家法院(或另一所大学的申诉委员会)可以引用它并采纳其理由,但并不被强制。其实际效果往往比法律效果更广泛:已经有多所位于纽约州以外的机构更新了其学术诚信政策,要求除检测器评分之外提供佐证证据,并将新比案作为推动因素之一加以引用。
Q:新比之后,我的大学还能继续使用Turnitin AI检测吗?
可以。该裁定约束的是:该评分在纪律程序中的使用方式,而不是该工具本身是否可以运行。大多数机构仍会在提交阶段运行AI检测。发生变化的是:该评分的权重正在改变,越来越多地被当作筛查信号,用来触发更仔细的人为复核,而不是作为单独的主要证据。如果你的机构仍将该评分视为决定性依据,那么新比案正好指出了这一“缺口”。
Q:我是ESL学生。我怎样在一开始就防止出现误报?
我认为这里有三个习惯确实能产生影响。第一,保留你的草稿历史。Google Docs和Word都会自动保存你作品的更早版本;不要导出到一个“干净副本”然后丢弃原文件。注意句子的节奏(pacing)。ESL训练往往会导致句式结构趋于一致,这类文本会被判定为低突发性。即便你所有写作都由自己完成,如果检测器仍给了“AI”评分,你可以在提交前先用一个懂引文意识的humanizer进行处理。它会增加检测软件所寻找的那种表面变异(surface variation),同时保留你的原话与引文。
Q:如果我面临AI检测指控,我应该找律师吗?
如果你的申诉结果是相对较小的,比如课程层级申诉所需的那类情况,那么使用上诉信写作攻略并配合流程记录,往往就能取得不错效果。但如果你可能会失去学位、被开除、签证身份受到影响(国际学生),或面临永久性成绩单标注,你应当聘请律师。大多数学院会提供免费的学生法律援助,也有一些专门机构专注于AI检测相关案件。现在确实有少数律师已经处理过新比案,并且了解相关先例与底层检测技术。
在保持每一条 APA、MLA、Vancouver 或 AMA 引文完整不变的前提下,降低您自己撰写文本的误报检测分数。

Moe 是一名 NLP 工程师,拥有自然语言处理领域的 PhD 学位。 他的研究涵盖计算语言学、文本分析和机器学习,并直接反馈到 ProofreaderPro 背后的编辑和人性化模型中。 他写了大多数人从未见过的过程的一部分:语言模型如何读取句子、对其进行评分并决定更改哪些内容。