本文转自:泉州晚报


□曾于里
近日,半月谈杂志报道了一个令人不安的现象:高校毕业生投注大量心血的原创论文,正被AIGC(生成式人工智能)检测系统判定为AI生成。报道中列举了种种令人瞠目结舌的案例。有学生独立查阅文献、反复打磨的原创论文,综述部分被判定为超70%的AI生成率;一篇2024年发表的原创通讯报道,被测出91.81%的“AIGC总体疑似度”;而《荷塘月色》被测出62.88%的AI疑似度,《滕王阁序》竟被测出100%的AI生成率……
为了通过检测,学生被迫将长句改成短句,把流畅的论述改得支离破碎,原本规整的学术写作被“改造”得语病百出。商业力量的介入使这一困局雪上加霜。有的检测平台在给出高疑似度的结果之后还会提供付费“降AI率”服务,既当裁判又卖解药。一篇论文仅此一项开支就可能耗费数百上千元,各种私人降重服务趁机大行其道,明目张胆地代改论文、包过检测。本应维护学术纯粹性的机制,反倒催生了灰色产业链。
要理解这一荒诞现象的根源,就要弄明白AI检测工具的工作原理。
虽然AI生成和AI检测的方向不同,前者是生成文本,后者是推断来源,但是二者底层的逻辑是一样的,都是大模型在海量人类文本中统计出的语言习惯上,推算下一个词或下一句话出现的可能性。AI生成是用概率“写字”,习得了“哪种写法最符合概率”,AI检测是用概率“验字”,判断一段文本是否刚好处于“最符合概率”的位置。
从理论上说,人类日常写作不会与机器的概率分布完全契合,因为人的语言包含情绪、跳跃和个人风格。但学术写作追求的是高度理智、逻辑严密、表述简洁,而这正是“最符合概率”的写法,一篇优秀的学术论文,句子规整、逻辑缜密、用词精准,这些特征也是AI生成文本的典型特征。于是荒谬的循环就产生了:写得越好就越像是人工智能,表述得越清楚就越接近机器。
然而,一些学校将“AI率”设为硬性指标,一旦超标即不予通过。学生由此陷入了难以自证的困局:完善的表达反而成为被质疑的理由,学术写作在概率逻辑的审判下被迫降格。正如学者所言,这实际上是一种“劣币驱逐良币”,让学生舍弃了原本“优美的东西”。
高校引入AI检测的初衷,是防止学生直接依赖AI完成写作任务,无法在文献梳理、逻辑推演和观点提炼的过程中获得应有的学术训练;但当前的实践显然走向了另一个极端,当一份检测报告就能决定论文生死,这个工具便僭越了它本该扮演的辅助角色,依然无法真正衡量学生经过训练后所达到的学术能力,甚至误伤了一批写作风格本就规范理性的学生,他们不得不为了一个虚无缥缈的概率数字,亲手毁掉自己精心打磨的文字。
事实上,面对AI技术的普及,学术评价体系需要更为理性的应对。搜索引擎普及之初也曾面临“搜索而来的知识不算自己的本事”的疑虑,如今早已成为理所当然的学术工具。同样的,AI正在逐渐工具化,真正有学术积淀的学生能够利用AI提炼思路、优化表达,同时保持核心观点、论证逻辑和材料组织的独立性;而缺乏思考的学生即便使用同一工具,交付的内容也截然不同。
因此,与其刻舟求剑地先判定“AI率”,不如回归论文本身的质量。如果一篇论文存在明显瑕疵——观点错漏、逻辑混乱、事实虚构,即便“AI率”很低,也不该通过。反过来,如果一篇论文原创性强、思想新颖、论述自洽,答辩现场学生也能经得起追问,那么关注的焦点应当是这些实质内容本身,而非其是否借助了AI工具。
学术评价终究要回归到人的判断,学术诚信的最终判官只能是读得懂论文、看得见过程的人,而不是冷冰冰的概率模型。