今天上午,知乎热榜挂上一个新问题:七大千禧年难题之一的BSD猜想,「疑被OpenAI或Anthropic解决」。
动笔之前我做了个固定动作:把近十天AI数学新闻按时间顺序排成一条线,逐条标注信源。排完发现一个有意思的事——同样是「被AI解决」,这十天里传出的三道题,证据含量差了不止一个量级。
先把时间线钉死
9月3日,数学家陶哲轩发帖,假想「AI解决重大开放数学问题之后会发生什么」。当时这还是一场思想实验。
9月8日,OpenAI正式官宣:内部模型调用约1万个智能体,耗时88小时攻破纳维-斯托克斯方程的存在性与光滑性问题,并释出166页论文和通过检验的Lean形式化验证代码。这是千禧年七大难题之一,2000年由克雷数学研究所设立,每题悬赏100万美元,26年间人类此前只攻克过一道——2003年佩雷尔曼证明的庞加莱猜想,他后来拒领了奖金。
9月9日,剧情反转:纽约大学数学家Buckmaster公开指控OpenAI抢跑,质疑自己上传至Codex的研究草稿是否被用于模型训练;OpenAI方面否认,Altman称遭遇「毫无依据的抄袭指控」。
9月11日,也就是今天,风声升级。据36氪、凤凰网报道,《纽约时报》特稿给出OpenAI官方确认:攻克NS方程后,他们在另一道千禧年难题上取得实质性进展——最新消息指向霍奇猜想。与此同时,OpenAI和Anthropic「双双向第三道难题BSD猜想发起最后冲锋,部分工作已进入验证阶段」。腾讯新闻同日报道,OpenAI向《纽约时报》确认「过去五天内」取得进展;一个数学推理能力大幅超越Astra的新内部模型约两周前完成训练,外界推测代号Aeon——注意,连模型名字都是「外界推测」。
10天,从一道题官宣,到三道题「在路上」。如果全部坐实,人类将在一个月内目睹三道封印几十年的千禧年难题被AI接连攻破。
但证据分三层,别混着看
**第一层:NS方程。**有官方公告、166页论文、可检验的Lean形式化代码。这是唯一拿得出完整证据链的。即便如此,腾讯新闻也明确提醒:还需进一步验证复核,才能被克雷数学研究所正式认定。官宣不等于拿钱。
**第二层:霍奇猜想。**OpenAI官方确认「取得实质性进展」「正在评估如何审慎公布」,但论文没有,题目名称还是「最新的消息显示」。有个细节很能说明传播的毛糙程度:腾讯新闻援引的说法是「过去五天内」取得进展,36氪转引《纽约时报》特稿却是「过去五年」——时间跨度差了近千倍的两版表述,同时在中文互联网上流转。
第三层:BSD猜想。也就是今天知乎热榜这道题。信源是「X上的一条爆料」,措辞是「据传」「接近」「如果这一切属实」。连是谁解的都没定——热榜标题里那个「OpenAI或Anthropic」的「或」字,恰恰暴露了它停留在传闻层。顺带一提,这道题的中文译名也已经开始漂移:知乎写「贝赫和斯维纳通-戴尔猜想」,腾讯新闻写「伯奇-斯维讷顿-戴尔猜想」,同一道题,两个版本。
为什么传闻跑得比论文快
道理不复杂:AI时代,「宣称解决」的成本降到了发一条推,而「验证解决」的成本没变——数学家还是要一行行读证明。宣称和验证之间的剪刀差,就是传闻的生存空间。
再看竞速背景:36氪报道里提到Anthropic传出筹备IPO,两家头部实验室在科学前沿的军备竞赛白热化。每一道「接近解决」的传闻,都在给这场竞赛添柴。媒体标题的情绪也在同步升温——「OpenAI杀疯了」「奇点已至」。当叙事跑得比证据快,读者就成了最后一道核查工序。
你能带走的一个习惯
以后刷到「XX被AI解决了」,不用急着转发,也不用懂数学,只找一样东西:**有没有可供下载的论文、可运行的验证代码?**有,是第一层,值得讨论;只有官方说「有进展」,是第二层,等等看;只有爆料和「据传」,是第三层,先让它飞一会儿。
我自己核对多信源时有个笨办法:把搜索、资讯类工具在 spark1.cn/tools/ 里并排开几个,同一件事分别问一遍——报道之间的矛盾,常常自己就浮出来了,根本不需要专业背景。
千禧年难题的100万美元悬赏还在那儿,克雷数学研究所的认定流程一步没少。AI跑得再快,证据的门槛一寸没降。这对普通读者其实是好消息:你不需要比AI聪明,只需要比传闻多等一步,就能始终站在事实这边——从容,从来都是核查出来的。
本文素材综合自36氪、凤凰网科技、腾讯新闻、澎湃新闻、新京报等公开报道。
💬 评论