今天下午两点,知乎热榜上挂着这样一个问题:「如何评价霍奇猜想(七大千禧难题之一)疑似被 OpenAI 解决?」
写这类选题之前我有个固定动作:先搜官方原文,再看媒体报道,最后才动笔。这次搜完,我盯着屏幕犹豫了很久——因为我用了多个关键词组合、限定近一天和近一周的报道时间范围,翻遍了腾讯新闻、新浪财经、科学网、36氪的稿子,没有任何一篇提到 OpenAI 解决了霍奇猜想。
所有报道指向的都是另一道题:纳维-斯托克斯方程。
先把已核实的事实钉死
9月8日,OpenAI 官宣其内部 AI 系统解决了纳维-斯托克斯方程的存在性与光滑性问题。这是克雷数学研究所 2000 年列出的七大「千禧年大奖难题」之一,每题悬赏100万美元,此前只有一道被人类解决过。《Nature》以「OpenAI宣称在著名的千禧年难题上取得重大数学突破」为题做了报道。
关键数字我都对着信源核了一遍:约1万个并行 AI 智能体运行88小时,智能体之间交换近500万条信息;随后另一模型用约17小时把结果形式化为 Lean 证明;OpenAI 研究人员估计计算成本达数百万美元。执行任务的是一款仍在训练、能力高于 GPT-6 Astra 的内部模型。OpenAI 数学家 Bubeck 透露,团队先用1000个智能体花50小时做出简化版,再决定加码挑战完整问题,9月5日拿到最终结果。
证明的结论用大白话说:存在一类初始完全平静的流体,在这套方程下会在有限时间内速度变得无穷大。OpenAI 科学家 Chandrasekaran 补充说,现实中的液体气体不可能真出现这种现象——也就是说,这套统治流体力学的方程,在特定条件下可能无法可靠反映物理现实。
同样要钉死的是边界:这份证明尚未经过长期同行审查,也未获得克雷数学研究所正式认可。克雷所长 Bridson 的表态是「这无疑是激动人心的一天」,但激动不等于盖章。
而霍奇猜想——它确实是七大千禧难题之一,但和纳维-斯托克斯是两道完全不同的题。截至本文写作时,我没有搜到任何可信信源说它被解决了。
为什么热搜会把题目名都传错?
这才是我觉得最值得聊的部分。
把这一周的时间线摆出来看:9月3日,陶哲轩发帖假想「AI 解决重大开放数学问题之后会发生什么」;随后博主 Andrew Curran 发帖「预测」Anthropic 已经解出纳维-斯托克斯问题,浏览量超过250万;9月8日 OpenAI 正式官宣,同日纽约大学数学家 Buckmaster 发声明指控 OpenAI 抢跑,Altman 回应称遭遇「毫无依据的抄袭指控」。
你看,这条新闻里挤满了戏剧元素:传闻、抢跑、内斗、百万美元、天才数学家互撕。传播链条每转一手,最抓人的部分被保留,最不起眼的部分被丢弃——而「这道题到底叫什么名字」,恰恰是全新闻里最不戏剧化的元素。于是纳维-斯托克斯传着传着,就成了同为千禧难题的霍奇猜想。
AI 新闻的传播有个规律:先失真的是限定词和专有名词,最后留下的全是情绪。上周的热搜问「AI 会不会抢走数学家的成果」,这周的热搜直接连题目都换了。如果没有人回去核对原始信源,一个月后大家记住的版本可能就是「OpenAI 解决了霍奇猜想」——一个从未发生过的「事实」。
你能带走的两个动作
以后刷到「AI 又攻克了 XX」的大新闻,别急着转发,做两件小事:
第一,回溯到一手信源。 公司官方博客、《Nature》这类期刊的报道、当事人本人的声明,三选一去看原文。这次我只需要打开 OpenAI 官网公告的转述报道,三十秒就能确认题目名是纳维-斯托克斯。
第二,盯住专有名词和限定词。 「疑似」「宣称」「尚未获认可」这些词是真相的护栏,「解决了霍奇猜想」这种斩钉截铁的具体名词反而最该被怀疑——因为传错一个名字,比编造一个情节容易一百倍。
我这次整理十几篇报道、拉时间线用的就是 spark1.cn/ai-writer 里的资料梳理功能,把散在各家媒体的数字和日期归到一张表里,交叉核对起来快很多,零基础也能直接上手。
真正强大的 AI 时代,不是人人都能解千禧难题,而是人人都能从容分辨:哪句是事实,哪句是传话。这件事,你今天就能开始练。
本文素材综合自腾讯新闻、新浪财经、科学网、36氪、中华网等公开报道,所有数字均逐一对照信源核实。
💬 评论