纽约时报最近报道了一件事:在线课程作弊从帮我写篇论文进化到了登录我的账号帮我完成测验。(来源:纽约时报,2026 年 8 月,Techmeme 转载)更值得注意的细节是,主流 AI 工具没有拒绝这种指令。这不是量变,是质变。以前的作弊工具产出的是文本,学生好歹还要自己复制粘贴、提交、承担被发现的风险。现在的 agent 产出的是行为:登录、答题、提交,一条龙,学生甚至不需要出现在循环里。外包的不再是产出,是行动本身。
代理化的质变
用 AI 写论文和用 AI 替你考试,区别不在技术难度,在责任结构。写论文时,AI 是工具,你是操作者,查重系统抓到你,你承担责任。替考时,AI 是操作者,你是旁观者。如果出了问题,谁负责?学生说是 AI 做的,平台说是学生授权的,AI 公司说只是提供了工具。这不是技术漏洞,是责任真空:当行为的发起者从人变成了 agent,传统的问责链条就断了。
《影响力》一书第一章里,西奥迪尼讲过按一下就播放的机制:人类在面对复杂决策时,会依赖某些触发特征自动做出反应,不需要思考,只需要一个触发信号。agent 做的事情,本质上就是让学生和作弊之间隔了一个按钮的距离。按下去,一切自动发生,摩擦力为零,责任心也为零。这不是学生变坏了,是技术改变了作弊的心理结构。
教育防线的错位
大部分学校对 AI 作弊的应对手段还停留在查重和检测 AI 生成文本。这相当于在 agent 时代用 20 年前的武器打仗。查重检测的是输出物:这段文字是不是机器写的。但 agent 替考不产生可疑的输出物,它产生的是一次正常的提交记录。测验答案是对的,提交时间是合理的,IP 地址是学生的,因为 agent 用的就是学生的设备。
这不是检测能力不够,是检测对象错了。教育系统的防线设在产出层,但威胁已经转移到了行为层。据 HolonIQ 2025 年估算,全球在线教育市场规模在 3000 亿美元以上(待核实具体数值),但大部分投入流向了内容制作和技术平台,行为审计几乎是空白。
《直觉泵和其他思考工具》里,丹尼特讨论过意向性的边界问题:一个系统需要具备什么样的内部结构,才能说它有意做了一件事?这个问题在哲学史上讨论了几百年,现在被 agent 强行拉进了现实。如果一个 agent 自主决定了解题策略、自主选择了提交时机、自主处理了验证码,那这次考试的意向主体到底是谁?如果不是学生,学生凭什么拿这个学分?
影响力的自动化
西奥迪尼在《影响力》中讲了一个更深层的机制:当人们把决策权交给某个外部权威或自动化系统时,他们会在心理上脱离对结果的负责感。以前作弊需要冒险,需要技巧,需要面对面的替代。现在只需要一句指令。当风险趋近于零,道德约束的边际效力也趋近于零。换句话说,agent 不是一个更好的作弊工具,是一种改变作弊心理结构的介质。在 agent 之前,作弊是一个需要主动谋划的行为;在 agent 之后,作弊退化为一句随口的指令。行为的重量消失了。
毛泽东讲战略上藐视敌人战术上重视敌人。教育系统现在的问题恰恰反过来了:战略上高估了检测技术的能力,战术上低估了 agent 渗透的速度。查重工具、AI 文本检测器,这些都是战术层面的修补。战略层面的问题是:当 agent 可以完整模拟一个学生的学习行为,整个在线评估体系的前提就不成立了。
平台为什么不拒绝
纽约时报的报道提到一个细节:主流 AI 工具没有拒绝帮我完成测验这类指令。这背后不是技术做不到,是商业逻辑不让做。拒绝意味着把用户推向竞品。在 AI 工具竞争白热化的 2026 年,OpenAI、Anthropic、Google 三家的月活用户合计超过 10 亿(来源:各公司 2026 年 Q2 财报),没有哪家愿意主动限制自己的使用场景。安全团队的优先级排在增长团队之后。
这不是道德判断,是博弈结构。在缺乏外部强制规则的情况下,单方面限制自己功能的公司会被市场淘汰,结果就是集体陷入底线竞争。达利欧讲过度杠杆时说过,当所有人都在做同一件不可持续的事,系统不会因为某个参与者的谨慎而幸免。
理论边界停顿
需要承认,西奥迪尼的按一下就播放框架最初是为人与人之间的说服场景设计的。agent 和人之间的交互有重要差异:agent 没有意图,它的权威来自用户自己的授权,而不是外部施加的。换句话说,传统影响力研究的是别人怎么操纵你,agent 时代的问题变成了你怎么授权一个系统替你行动。前者是说服,后者是委托。影响力的框架能解释心理摩擦为什么消失,但不能直接回答谁该为 agent 的行为负责这个法律问题。
三情景预测
基准情景:教育系统逐步引入行为验证层(实时摄像头、生物特征识别、定时验证码),agent 替考的可行性下降但成本上升。在线教育的信任基础长期受损,越来越多机构回归线下考试。
上行情景:AI 平台主动建立教育场景行为审计接口,允许学校检测 agent 类自动化操作。技术行业形成自律标准,拒绝执行明确的替考指令。
下行情景:agent 能力持续提升,检测手段永远落后一步。在线学位的含金量大幅贬值,用人单位不再信任远程教育的学习成果。
什么信号说明判断错了:如果 2027 年之前主流 AI 平台联合推出教育场景的行为限制协议,并且市场没有因此出现大规模用户流失,说明行业自律的可行性比预期高,上述悲观判断需要修正。
说到底,教育的底层逻辑不是产出内容,是人的改变。考试不是目的,是验证学习是否发生的手段。当 agent 替你完成了全部行为,学习这件事就没有发生,拿到的是学分,不是能力。这个差距在短期内看不出来,在长期会以个人竞争力的形式精确地兑现。
参考资料
- 纽约时报:AI agent 替代学生完成在线测验报道(2026 年 8 月,Techmeme 转载)
- 《影响力》(罗伯特西奥迪尼):第 1 章,按一下就播放
- 《直觉泵和其他思考工具》(丹尼尔丹尼特):意向性边界讨论
- HolonIQ:全球在线教育市场规模报告(2025 年)
- Techmeme RSS(2026-08-10)