AI检测工具
一项200万美元的图书交易因AI指控而告吹
出版商和学校正依据AI检测器的标记采取行动,其后果足以终结职业生涯:一项200万美元的图书交易被取消、学生被停学、诉讼接连不断。这些工具自己的制造商也承认,它们的准确度不足以作为行动依据。欢迎来到不信任的时代。

出版方Minotaur上月因担心其作者杰里·法拉德(Jerry Falade)使用AI撰写书稿,取消了一项200万美元的图书交易。法拉德表示自己没有使用AI。无论如何,交易都已告吹。这一连串事件最清晰地概括了当下AI猜疑的处境:指控一经提出,就没有可靠的方法去证实或反驳,而被指控者承担全部代价。
检测工具已成为课堂和新闻编辑室的标配。民主与技术中心(Center for Democracy and Technology)的一项调查,由The Verge报道,发现2024年至2025年间,美国43%的六年级至十二年级教师经常使用这些工具。一些使用Turnitin的大学发现,该服务在2023年推出时自动启用了AI检测功能。而这些工具背后的公司不断发布免责声明,削弱了自身的营销说辞。
概率如何变成裁决
抄袭检测器靠将文本与已发表作品数据库比对来证明自己的价值。AI检测器做的事情则更加模糊。GPTZero、Pangram以及Turnitin开发的检测器都依赖各自的AI模型来估算文本是否可能由机器撰写。GPTZero将自己的方法描述为一种分析措辞、节奏和结构的算法,寻找长度和语气上更常见于AI行文的模式。这是一种主观判断,而非与任何东西的比对。它在母语非英语的写作者身上会出错,也会标记那些句式一成不变的人。
这些公司公布的数字听起来令人安心。Turnitin 称其检测器错误标记的不到1%的人类撰写内容。Pangram声称误报率为万分之一。GPTZero称其比率同样较低。紧接着就是免责声明。Turnitin警告称,该工具"可能并非始终准确",不应被用来对学生采取行动。Grammarly表示,用户"绝不应仅凭AI检测器的结果"行事。GPTZero承认"没有任何AI检测器能够真正做到100%完美"。OpenAI于2023年因准确率低下关闭了自己的检测器。
这些声称与免责声明放在一起,读起来是这样的:
| 工具 | 声称的误报率 | 制造商同时说了什么 |
|---|---|---|
| Turnitin | 人类撰写文本的不到1% | "可能并非始终准确";不应被用来对学生采取行动 |
| Pangram | 万分之一 | 内置在Substack中,读者可扫描博客 |
| GPTZero | "同样较低" | "没有任何AI检测器能够真正做到100%完美" |
误报落到具体的人身上
公开案例都遵循同一个模式。法国公民蒂埃里·里尼奥尔(Thierry Rignol)在教授使用GPTZero扫描他的期末考试并指控他使用AI后,起诉了耶鲁大学;那次指控导致他考试不及格并被停学一年。诉讼称,AI检测工具被公认会不公平地针对母语非英语者。2月,一名学生在教授提出类似指控后,赢得了他对阿德尔菲大学(Adelphi University)的诉讼。阿德尔菲与Turnitin签有许可协议。
这种偏见有据可查。2023年斯坦福大学的一项研究发现,检测器把母语非英语者的文章标为AI的频率,高于母语为英语者的文章。加州大学洛杉矶分校(UCLA)解释称,这些工具是基于重复用词、听起来过于正式或过于随意、以及不合逻辑的措辞等信号训练的。QuillBot以AI倾向于选择最显而易见的词这一理论为依据,衡量文本的"不可预测性"。这些信号单独来看都无法证明任何东西。有些人就是这种行文风格,而且还有人担心这类工具对神经多样性写作者也存在偏见。
各机构正在退出
这种不确定性已促使一些学校选择退出。耶鲁、约翰斯·霍普金斯、范德堡和乔治城已经禁用或限制了AI检测工具。麻省理工学院(MIT)直言不讳地表明立场:"AI检测器不管用。"芝加哥大学则建议放慢阅读节奏、拆分长篇作业,并要求学生反思自己的作业。斯坦福建议教授考虑采用课堂评估。MIT希望给学生留出在没有处罚的情况下披露AI使用情况的空间。所有这些学校的共同模式是:重新设计作业,而不是审查产出。
指控已跑在工具前面
在网络上,指控的规模更大,利害关系依然真切。Substack已将Pangram集成到其应用中,读者可以用它扫描订阅通讯,查找涉嫌AI写作的内容。LinkedIn为帖子添加了一个"看起来像AI垃圾"按钮。在一段通过其社交媒体渠道向超过350万粉丝发布的视频中,奥兹·奥斯本(Ozzy Osbourne)的儿子杰克指控《The Verge》撰稿人卡特·滕巴奇(Kat Tenbarge)在《滚石》杂志的一篇文章中使用了AI,并挥舞着一款名为Getsolved的AI检测器作为证据。滕巴奇在一段视频和她自己网站上的一篇文章中驳斥了这一说法。奥斯本没有撤回指控,留下滕巴奇独自应对网络喷子。
真实的写作者如今开始自我编辑,让自己听起来不那么像机器, , 这是这个时代发明的最奇特的一种税。维基百科已禁止AI生成的文章,并发布了一份识别AI写作的指南,其中提到"拔高"某个话题重要性的习惯。美国作家协会(The Authors Guild)正在发放"人类创作(Human Authored)"认证。Not by AI和Written by Human提供的徽章也让人们可以给自己的作品贴上"由人创作"的标签。
这种不对称才是问题的关键。提出一项指控,只需一张截图。洗清名声则要打一场官司,或赔上公众声誉。在检测器停止夸大自身能力之前,不信任的时代只会单向运转,而为之付出代价的,是那些从未使用过AI的人。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。