商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 因担忧准确性问题,欧美多所高校停用AI检测工具

因担忧准确性问题,欧美多所高校停用AI检测工具

  发布于2026-07-26 阅读(0)

扫一扫,手机访问

AI 检测工具,真的靠谱吗?一个学生的遭遇,或许能给我们答案。

今年1月,美国阿德尔菲大学的学生奥赖恩·纽比(Orion Newby)终于打赢了一场官司。事情的起因,是学校用了Turnitin的AI检测工具,认定他的论文“AI生成概率为100%”。但纽比提交了其他几款检测工具的结果,全都显示0%。校方却依然坚持他是学术不端。法院最后判了学校败诉,理由很简单:学校没有按自己的程序走,也没给纽比真正的申诉机会。

这个案件,其实撕开了一个更大的问题:高校广泛使用的AI检测工具,到底有多可靠?

Turnitin给出的结果,本质上只是一个概率评分,意思是“系统认为这篇论文极有可能由AI生成”。但概率不等于事实。判决一出,外界对这套检测体系的质疑声立刻高涨起来。

学生私下用AI写作业,已经不是什么秘密。爱丁堡纳皮尔大学的研究人员,对英国7所高校的6600多名学生做了调查,发现32%的受访者承认在考试或作业中不同程度地违规使用过AI。自2024年ChatGPT面世后,全球很多高校都引进了GPTZero、Copyleaks、Turnitin这类AI检测工具,想守住学术诚信的底线。

这些工具的原理,主要是分析文章的结构、语言节奏等特征,看看有没有非人类写作的痕迹。但问题是,它们的准确性,尤其是假阳性率和潜在偏见,正受到越来越多的质疑。

也因此,包括美国范德堡大学、耶鲁大学、约翰斯·霍普金斯大学、西北大学,以及加拿大滑铁卢大学、南非开普敦大学和澳大利亚科廷大学在内的一批高校,已经限制或干脆停用了AI检测工具。

美国高校协会(AAC&U)数字创新副主席爱德华·沃森(Edward Watson)说得直接:“最大的问题在于误判风险。AI检测工具在学术诚信调查中最多只能作为辅助参考,教师绝不能把它当成决定性证据或所谓的‘铁证’。”

Turnitin自家的首席产品官安妮·切奇泰利(Annie Chechitelli)也承认,公司始终把AI检测结果定位为“调查起点”和“一项参考数据”,而不是最终证据。她表示,Turnitin一直在跟高校合作,解决“过度使用或误用”检测工具的问题。去年,他们还推出了一项新功能,让教师能看到学生写作过程的演变,而不是只看最终提交的论文。

整个高等教育领域,对检测工具可靠性的担忧,正在倒逼高校重新设计考核方式。爱丁堡纳皮尔大学“AI批判性素养”教授萨姆·伊林沃思(Sam Illingworth)指出,虽然有些学校已经开始增加口头答辩、写作过程记录等考核形式,但仍有不少学校继续依赖AI检测工具。

英国贝尔法斯特女王大学负责教育事务的副校长朱迪·威廉姆斯(Judy Williams)态度很明确:“AI检测工具并不是解决方案。相关技术还在发展,误判率可能高得难以接受,而且AI生成的内容经过简单修改后就很难再被识别,检测结果并不可靠。”她认为,真正要维护学术诚信,关键在于设计更合理的考核方式。真正该问的问题不是“怎么阻止学生用AI”,而是“我们到底想评估学生的什么能力”。

不过,尽管贝尔法斯特女王大学等高校的态度已经变了,整个行业的政策依然缺乏统一标准。伊林沃思对英国163所高校做了一项研究,发现超过40%的学校没有公开可查询的AI使用政策。

政策不透明,也加剧了学生的焦虑。英国高等教育政策研究所(HEPI)2025年12月发布的一项调查显示,在1054名受访学生中,有42%表示,因为担心被误判成作弊,他们反而减少了AI工具的使用。

英国高等教育独立裁决办公室(OIA)表示,虽然正式投诉数量还不算多,但高校内部涉及AI学术不端的案件正在持续增加。该机构幕僚长亚当·沃丁厄姆(Adam Waddingham)说:“AI检测工具可以作为证据的一部分,但通常不应单独作为最终裁定依据。”

欧洲学生联盟(European Students’ Union)执行委员会成员乌尔舒拉·利斯(Urszula Lis)则担心,现在很多AI检测系统都是“黑箱”,学生根本不知道工具是怎么得出结论的。她认为,更大的问题在于,高等教育是否还应该继续依赖这种以检测为核心的模式。“我们不希望学术诚信演变成一种监控机制,其唯一目的只是抓学生犯错。”

还有研究指出,这类检测工具对英语非母语的学生更容易产生误判。斯坦福大学2024年一项广受引用的研究就发现,AI检测工具更容易把非英语母语者的文章误判成AI生成。

专门从事科技诉讼的Crowell & Moring律师事务所律师约阿希姆·施泰因贝格(Joachim Steinberg)指出:“最大的挑战在于,高校的管理规定和纪律处分流程,跟不上AI技术快速发展的步伐。AI能力不断提升,但许多高校还在摸索如何建立清晰、一致且公平的政策,这让学生和教师都处于充满不确定性的环境中。”

从全球来看,各国和各高校的指导原则仍十分零散。伊林沃思表示:“目前更多取决于具体学校的规定,这令人沮丧,因为行业并没有形成一套公认的最佳实践。”利斯补充说,在欧洲,由于缺乏国家层面的统一指导,也带来了公平性问题:“两名学生即便采用完全相同的方式使用AI,只因身处不同国家,其中一人可能受到处罚,而另一人却不会。”

伊林沃思在研究报告中指出,许多高校的AI政策实际上更像是一种合规工具,“它们宣称鼓励批判性思维,却最终变成了审计和留痕机制;口头上说提供支持,实际上却更像是在加强监控。”他说,真正长久有效的解决方案,是围绕我们希望学生展现的思考能力来设计考核,而不是一味依赖检测工具。

随着AI应用日益普及,高校未来面临的真正挑战,或许不是继续强化监督,而是重新界定什么样的AI使用方式才属于合理、可接受的范围。帮助学生申请大学的AI工具GradPilot首席执行官尼尔马尔·塔克(Nirmal Thacker)对此表示认同:“我希望大学能够重新思考考核方式,鼓励学生主动披露AI使用情况,并制定更加公开透明的相关政策。”

本文转载于:https://www.163.com/dy/article/L2OMNQQH0511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注