多所大学近期因对人工智能检测工具准确性的担忧,已限制或停止使用相关软件,包括范德堡大学、耶鲁大学、约翰斯·霍普金斯大学、加拿大滑铁卢大学、南非开普敦大学及澳大利亚科廷大学等。自OpenAI于2022年发布ChatGPT以来,大量学生秘密使用AI完成作业,各高校为维护学术诚信纷纷启用GPTZero、Copyleaks、Turnitin等具备AI检测功能的应用程序,但这些工具的可靠性——尤其是误报率和偏差问题——正面临广泛质疑。
今年1月,纽约法院在一起案件中裁定阿德菲大学一名学生胜诉。该学生被校方指控使用AI生成论文,Turnitin检测工具显示“AI生成分数为100%”。尽管学生提交了其他检测工具显示“0%可能性”的证据,校方仍维持不当行为认定。法院认定该大学未遵循自身纪律程序,且剥夺了学生有意义的申诉权利。该案凸显了大学使用的AI检测工具可靠性问题,并对整个评估体系提出质疑。
爱丁堡纳皮尔大学研究人员对英国七所大学6600余名学生的调查显示,32%的受访者承认在评估中存在不同程度的未经许可使用AI行为。美国高校协会数字创新副总裁指出,主要担忧在于误报可能性,并强调AI检测最多在学术诚信案件中“扮演次要角色”,教师“绝不应将AI检测作为‘硬证据’或‘确凿证据’”。
Turnitin首席产品官表示,其检测工具仅为“起点”和“数据点”,而非决定性证据,公司正与大学合作解决相关问题。然而,行业内的可靠性担忧正迫使高校转向不同类型的评估方式。贝尔法斯特女王大学教育与学生事务副校长表示,AI检测工具并非解决方案,技术仍在发展中,误报率高且AI生成文本易被修改,使检测不可靠。
政策碎片化加剧了学生焦虑。对英国163所大学的审计发现,超过40%没有公开可访问的AI政策。英国高等教育政策研究所2025年12月的研究显示,42%的受访学生因担心被误判作弊而不愿使用AI。欧洲学生联盟执行委员会成员批评检测系统运作方式“封闭”,学生无法了解AI工具如何得出判断,并质疑高等教育是否应依赖检测型方法。此外,2023年斯坦福大学的研究表明,检测工具对非英语母语者存在不成比例的误报问题。
爱丁堡纳皮尔大学教授指出,许多大学政策仅作为合规工具运作,“承诺批判性思维,却交付审计追踪;声称提供支持,却实施监视”。他主张持久的解决方案是围绕“希望看到的思维”来设计评估方式。随着AI使用日益普遍,高校面临的挑战或在于超越监控,明确定义何为真正可接受的使用。