返回

文章详情

AI detectors are creating a new era of distrust

人工智能检测器正在创造不信任的新纪元

The Verge2026年8月9日 12:00

这是《回顾》,一份每周通讯,深入分析科技界的重要故事。有关人工智能如何改变我们日常生活的更多新闻,请关注艾玛·罗斯。《回顾》将在我们的订阅者的收件箱中于东部时间上午8点发送。点击这里订阅《回顾》。 它是如何开始的 在ChatGPT成为热门之前,教育工作者和编辑经常使用反抄袭工具来检查作者的工作是否诚实。这些工具通过将书面作品与一个包含来自网络、学术文章等内容的数据库进行比较,以检查匹配的句子和短语。一些工具,如Turnitin,提供一个百分比,声称可以说明学生的写作与其他作品的重叠程度。在潜在的误报和对工作是否故意重复的不确定性之间,一些教育者已经开始放弃使用这一特定工具。但现在,寻找抄袭内容的战斗正在演变为对人工智能生成作品的战争。随着学生们迅速掌握ChatGPT、谷歌的Gemini和微软的Copilot,教师们同样迅速地采用了所谓的人工智能检测器。根据民主与技术中心的调查,在2024年至2025年间,美国43%的六到十二年级教师定期使用人工智能检测器。一些已经在学习管理系统中使用Turnitin的大学发现,该服务在2023年工具启动时自动启用了人工智能检测功能。与比较书面内容片段不同,像GPTZero、Pangram和Turnitin创建的检测器依赖于自身的人工智能模型来猜测某些内容是否可能非人类创作——这一过程可以说比在网上匹配文本更加模糊。正如GPTZero所指出的,人工智能检测器使用算法分析文本的用词、节奏和结构,以及捕捉长度和语气的模式,这些模式在人工智能写作的文本中可能更为常见。这种相对主观的评估没有像通过在线匹配文本那样扎实,并可能被那些将英语作为第二语言的作者弄得困惑。尽管如此,Turnitin表示,其人工智能检测器错误标记的人工写作内容不到1%,而Pangram宣称其误报率仅为万分之一。GPTZero称其错误将人类内容误认为人工智能的率也相似地低。 当前的情况 在线上的人们已经互相指责“听起来像人工智能”,但人工智能检测工具的普遍可用性只是在为大型语言模型的猎巫活动提供火力。在一些备受瞩目的案例中,人工智能写作的指控直接影响了人们的生计和声誉。上个月,出版商Minotaur因担心其作者杰瑞·法拉德使用人工智能而取消了一笔200万美元的书籍交易——他对此强烈否认。还有法国国籍的蒂埃里·里尼奥(Thierry Rignol),他在去年起诉耶鲁大学,因为一位教授指控他使用人工智能完成了期末考试的部分内容,导致他不及格并被停学一年。教授使用GPTZero扫描里尼奥的写作,但诉状主张“人工智能监控和检测工具被认为会不公平地针对以英语为非母语的说话者”,如里尼奥。二月份,阿德尔菲大学的一名学生因其教授同样声称他使用人工智能写作文而赢得对学校的诉讼。尽管诉状没有说明教授使用了哪种人工智能工具来检查学生的论文,但阿德尔菲大学与Turnitin有许可协议。2023年,斯坦福大学的一项研究发现,人工智能检测器错误标记以非母语英语写作的论文为人工智能的频率高于以母语英语写作的频率。(许多服务仍然辩称他们的工具在处理非母语者写作时是准确的。)这些工具也可能对神经多样性作家存在偏见。加州大学洛杉矶分校指出,人工智能检测工具被训练用于识别可能表明人工智能使用的模式,例如重复的术语和短语、听起来过于正式或非正式的文本,以及无意义的措辞。根据UCLA的说法,有些工具,如QuillBot,还会衡量文本的“不可预测性”,因为“人工智能往往会做出最‘明显’或最常见的语言选择,与人类创作的写作相比”。它们还可能会寻找在整篇文章中保持相同的句子结构,作为另一个人工智能的迹象。但这些测量本身并不表明是人工智能,因为有些人可能只是具有这些特质的写作风格。尽管Turnitin宣传其低误报率,但它仍然强调其工具“可能并不总是准确”,不应被用来对学生采取行动。Grammarly警告用户“绝不要单独依赖人工智能检测器的结果”,而GPTZero表示“没有任何人工智能检测器可以真正做到100%完美”。OpenAI甚至已在2023年因准确性低而关闭了其自身的人工智能写作检测器。但针对人工智能的写作指控仍在网络上肆意传播。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡