四友汇
申请加入
人物故事 · AI周报第001期 简版 · 2026年8月14日
AI周报 · 第001期 · 人物故事

被动成为裁判的人

这周最值得讲的AI人物,不是发布模型的人,是验证模型的人——曼彻斯特大学数学家Thomas Bloom。

覆盖时间点2026年8月
分类人物故事 · AI与数学
发布日期2026年8月14日

摘要

  • 这周最值得讲的AI人物,不是发布模型的人,是验证模型的人——曼彻斯特大学数学家Thomas Bloom。当AI能把一件曾经稀缺的专业能力(解开数学难题)变得唾手可得时,真正抗跌的不是"会不会解题",而是"谁能可信地验证这件事解没解成"——而验证本身也正经历一次静默的范式转移,从"找权威学者背书"变成"发布一份任何人都能在自己电脑上跑一遍的机器可验证协议"。Bloom靠一个2023年出于个人方便搭建的业余项目,意外成了全球唯一有资格给"AI解开数学难题"这类宣称盖章或撕掉的裁判——两次被卷进AI数学突破争议核心,给出两次截然相反的判决。

关键事实

  • 一个业余项目变成了公共基础设施。 Bloom 2014年在布里斯托大学拿到数学博士,专业是算术组合数学与解析数论,2020年曾与人合作证出Erdős等差数列猜想相关的重要部分性结果。2023年初,他把埃尔德什遗留猜想收集成一份清单(起初只图自己方便,网站背后的代码是用ChatGPT写的),如今这个网站(erdosproblems.com)收录近一千道问题,约三分之一已被解决。
  • 第一次判决:一次戏剧性的失实陈述。 2025年10月,时任OpenAI VP Kevin Weil宣称GPT-5解出十道Erdős猜想。Bloom核实后发现模型没有产出原创证明,只是检索出了已有解法——他公开称这是"一次戏剧性的失实陈述"。同一时期,网站社区内部还发生过一起类似乌龙:有人宣称"LLM首次自主解开"一道题,几小时后被指出埃尔德什本人1977年已给出解法。
  • 第二次判决:这次是big news。 2026年8月,面对OpenAI未发布模型Astra解开十道难题的宣称,Bloom核实后在X上称之为"big news",评价高于5月的另一结果——依据是证明用Lean 4形式化,"一份Lean证书不是社会性信号——它要么编译通过,要么不通过,任何人拿一台笔记本电脑就能跑一遍"。两次判决相反,不是因为他改了标准,而是核实对象本身的可验证程度发生了质变。
  • 另一个反应:顶尖数学家已经不再费力气。 普林斯顿数学家Noga Alon,一生估计解过几十道Erdős猜想,现在已经停止尝试,原话是"一旦AI开始解决这些问题,就没有意义了"。

别处读不到的洞见

Bloom能扮演这个裁判角色,不是因为他被任命或雇佣,而是他此前出于个人兴趣做了一件笨功夫——把近千道问题逐一收录、标注状态——这件事本身构成了别人没有的核查基础设施。这暴露了一个更普遍的规律:当AI开始大规模宣称"突破"时,能可信验证这些宣称的,往往不是最聪明的人,而是最早开始做那件笨功夫、把领域知识结构化到可核查程度的人;生物、材料、化学这些实验驱动的学科,验证一个AI"新发现"往往需要真实世界的湿实验,不存在"Lean证书秒验证"这种捷径——这是被低估的系统性风险,不只是数学圈的趣闻。

我的判断

Noga Alon那句"一旦AI开始解决,就没有意义了,所以我不再费劲了",是一种理性的撤退:当一件事曾经的价值构成里"稀缺性"占了很大比重,而AI让这种稀缺性快速贬值时,连顶尖学者都会诚实承认"不再费这个劲了"。这对任何以专业稀缺性为核心竞争力的知识工作者(含教育、内容、咨询从业者)都是一个具体的先兆。但Bloom选择了相反的路径——把自己的角色从"解题者"转移到"验证基础设施的建造与维护者",这可能是知识工作者面对这一波替代浪潮时,最值得考虑的一种转型方向。

本报告局限

最薄弱的环节:Bloom对Astra结果的正面评价、Alon的原话均出自Quanta Magazine一手报道,可信度高;但"验证基础设施跟不上宣称速度是系统性风险"这一判断、"实验驱动学科验证周期更长更危险"这一延伸推理,是本文的推理延伸,不是任何一手信源直接下的结论。数学家Carlo Pagano也提醒:Bloom的验证权威目前局限在"Erdős遗留问题"这一特定问题域,不能直接外推到数学研究的全部前沿。完整局限说明见完整版。

结语

数学证明、验证协议、专业稀缺性贬值,讲的是同一件事:当AI把一件难事变得唾手可得时,真正值钱的角色,正在从"会做这件事的人"转向"能可信判断这件事有没有做成的人"。读者若需完整证据链与逐项置信度评估,可查阅本报告完整版。

完整版还原了Bloom其人其事的完整细节:他为什么会成为这个位置上的"唯一裁判"、erdosproblems.com的运作方式、以及另一位数学家Noga Alon对"AI数学能力"更谨慎的对照视角。

阅读完整版 →