最近知乎热榜上挂着一件挺扎眼的事:北京大学数学教授刘济豪,把一篇标注由AI生成的文章挂到了arXiv的代数几何板块,内容未经验证,争议随之而来,知乎上的问题标题直接就是"挨骂"。
骂点在哪?热榜讨论里流传最广的一个观点是:此类数学工作的荣誉,不应该归于编写提示词的人,而应该归于AI系统。
我把这件事的前因后果扒了一遍,越看越觉得,它给所有正在用AI干活的人——不只是数学家——提了一个非常具体的醒。
先说背景:这不是"AI乱写论文"的故事
刘济豪不是第一次碰AI数学。北大数学科学学院有一支AI4Math团队,2026年5月交过一份重磅答卷:他们研发的Rethlas-Archon系统,在全自动、无人类参与的条件下,通过构造反例否定了交换代数领域悬置十余年的Anderson猜想,并完成了近两万行Lean 4代码的形式化验证——简单说,就是让计算机逐行检查证明的每一步。Nature在5月21日的专题报道里,把这项工作作为AI与数学深度融合的前沿案例。刘济豪后来基于Rethlas搭建了专用智能体,通过数学家与AI的深度协作,解决了代数几何领域的多个公开问题。
同一个团队体系,5月的成果登上Nature,9月的文章挂上arXiv却挨了骂。区别在哪?
验证。
前者有近两万行机器逐行核验过的形式化证明兜底;后者,用热榜问题标题里的原话说——"未经验证"。
真正的分界线:AI能不能生成,和你敢不敢署名
这件事让我想起arXiv自己在今年5月宣布的规则:如果投稿内容出现明显未经人工查核的AI生成痕迹——比如虚构的参考文献、残留的AI对话提示语——作者最重会被禁止投稿一年,禁令结束后还得先通过期刊或会议审查才能再投。arXiv方面说得很直白:只要在论文上署名,无论内容是否由AI协助撰写,作者必须对所有内容负全责。
把两条线放在一起看,逻辑就清楚了:
平台不禁止你用AI,禁止的是你不核查就署自己的名字。
AI生成一篇看起来像模像样的数学文章,成本已经趋近于零;但验证它是不是真的对,成本依然高昂——高到北大团队要专门搭一套形式化基础设施才做得动。生成和验证之间的这道成本鸿沟,才是这场争议的真正主角。谁跨过了鸿沟再发布,谁就是Nature专题里的前沿探索;谁没跨就发布,谁就是热榜上的"挨骂"。
数学家陶哲轩此前一直在倡导AI数学成果的验证规范。规范为什么重要?因为AI时代"抢先发布"的速度,远远跑在了"确认真的对"的速度前面。
这套逻辑,普通人一样用得上
你可能不做代数几何,但只要你在用AI写周报、做方案、出内容,同一道考题就摆在你面前:
1. 署名即担保。 你的名字出现在AI生成的东西上,责任就是你的。"这是AI写的"不是免责条款,在arXiv的规则里恰恰相反——是加重条款。
2. 发布前给自己搭一道"Lean"。 北大团队用近两万行代码给证明落法槌;你的"法槌"可以朴素得多:AI给出的每个数字、每条引用、每个日期,发布前手动核一遍出处。核不到出处的,删掉或改成模糊表述。我自己的习惯是,稿子里凡有具体数字,先问一句"这句话的信源原文在哪",答不上来就不让它见读者。
3. 分清"生成"和"完成"。 AI帮你产出了初稿,不等于工作完成了。中间那段验证、修正、注入你自己判断的过程,才是你真正的价值所在——也是"荣誉归于谁"这个问题的答案。
AI把"做出来"的门槛降到了地板上,同时把"敢认账"的门槛抬得很高。这其实是好事:它让认真核查的人变得更稀缺,也更值钱。你不需要成为数学家,只需要在按下发布键之前,多做那一步验证——这一步,就是你和"挨骂"之间的距离。
💬 评论