四友汇
申请加入
人物故事 · AI周报第002期 完整版 · 2026年8月15日
AI周报 · 第002期 · 人物故事 · 完整版

一句"别放弃",撬动了37年没人推动的纪录

这周最值得讲的AI人物故事,主角不是数学家,是一个自称"不懂数学"的软件工程师——JavaScript运行时Bun的创始人Jarred Sumner。

覆盖时间点2026年8月9日-15日
分类人物故事 · AI科研可信度
发布日期2026年8月15日

← 先看简版(3分钟速览)

摘要

  • 这周最值得讲的AI人物故事,主角不是数学家,是一个自称"不懂数学"的软件工程师——JavaScript运行时Bun的创始人Jarred Sumner。他去年12月随Bun被Anthropic收购加入公司,今年8月,只靠一句"来真的试一把黎曼猜想",外加几句"继续""相信自己"的鼓励,把一个未发布的Claude研究版本推向了黎曼zeta函数临界线零点比例这项165年历史难题上、37年来最大的一次单次进展——已证明下界从41.6%推到67.2%,一次性拿下的进度,是过去37年人类学界总共只推进的0.8个百分点的约32倍。这起事件里真正稀缺、真正决定产出上限的技能,可能已经不是"精通某个数学分支",而是"愿意花一天半时间不断催促、鼓励一个AI系统别放弃、继续试"。
  • 但这套"教练驱动突破"模式目前的可信度,建立在一个尚未拆掉的脚手架上:不可外部复现(用的是未发布模型)、未经正式同行评审,且公开发布的时间点,恰好卡在Anthropic据多家媒体报道正在筹备的一场估值可能高达2万亿美元、有望成为史上规模最大IPO的窗口期。

一个从未打算研究数学的人

Jarred Sumner是湾区自学成才的程序员,2021年写出Bun——一款以性能著称的JavaScript运行时,长期活跃在GitHub上做开源开发。2025年12月2日,Anthropic收购Bun,团队整体并入并继续以MIT协议开源维护;Sumner本人成为Anthropic员工,岗位仍是把Bun继续做好,不是数学研究员。(Bun官方博客Anthropic官方新闻稿

第一轮:650个想法全部失败,Claude表现出"自我怀疑"

据Anthropic官方研究博客披露,这一切始于Sumner让Claude"来真的试一把黎曼猜想"。第一轮尝试,Claude生成并测试了650个想法,全部失败,过程中一度表现出"自我怀疑"——Anthropic的解释是,这可能源自Claude在训练数据里学到的"数学开放问题有多难""AI模型能力有极限"这类认知,进而影响了自己的判断。是Sumner连续发去"继续""相信自己"这类鼓励性消息,推动Claude没有放弃、发起第二轮尝试。(Anthropic研究博客

第二轮:一天半,60个子智能体,37年最大单次进展

第二轮,Claude花一天半时间协调约60个子智能体分工作战:2个提出关键数学思路、13个提供辅助性想法、30个尝试新想法但未成功、13个负责互相核验论证、2个协助撰写论文初稿。整个过程执行了2400条shell命令、写了数百个Python脚本、对已知zeta函数零点做了数千次数值校验,子智能体之间还互相审阅彼此的论证。两轮总计消耗3100万个输出token。最终结果:黎曼zeta函数零点位于临界线上这一比例的已证明下界,从41.6%提高到67.2%,一次性跃升25.6个百分点。这项工作的核心突破,并非发明了新数学工具,而是把此前分属不同学者(Baluyot、Goldston、Suriajaya、Turnage-Butterbaugh、Bombieri等人)、彼此从未被连接过的两套现成理论框架拼接在了一起。(Anthropic研究博客Forbes

核验:内部数学家、外部"抽空看了一眼",和一个尚未完成的脚手架

Anthropic自己的两位数学家Levent Alpöge与Ralph Furman,负责理解Claude这份论文、核对它与既有文献的关系,并与Eric Easley一起把结果做成了通过标准工具校验的Lean形式化证明(一种可由计算机程序逐步验证每一步推理是否成立的数学证明工具,不依赖人工通读判断对错)。外部方面,两位相关领域权威——Brian Conrey(其1989年的证明正是此前那条37年纪录的基础)与Dan Goldston(其论文正是Claude这次拼接所用的基础工作之一)——"在很短时间内"审阅了论文,Anthropic在文中对二人的"慷慨"表示感谢。但报道明确指出:这次审阅是"短时间内的善意审阅",不等于正式同行评审;这篇论文目前尚未投给任何学术期刊,也无法被外部完整复现——因为用的是一个尚未公开发布的研究版本模型。(XenoSpectrum

数学界的欢呼与谨慎并存

Menlo Ventures合伙人Deedy在社交平台上给出了目前流传最广的评价:"这个来自Claude的结果非同寻常——这可能是自2013年有界素数间隔结果以来,解析数论领域最重大的突破。"他给出的对比数字很直白:37年里人类只把这个比例往前推了0.8个百分点,Claude一次性推了25.6个百分点。(X/Deedy)但同一批报道里,也有更冷静的框架提醒读者:Claude"没有发明新的数学技术",只是把已发表文献里的两块拼图连了起来;Anthropic自己也明确写道"我们不认为这里用到的技术会通向黎曼猜想本身的证明"。换句话说,这是一次真实、具体、可核实的数论进展,但它离"AI证明了世纪难题"这类更耸动的说法,还有相当的距离。(XenoSpectrum

一个诚实的读者应该主动问的问题

这次成果公布的时间点,恰好卡在Anthropic据多家媒体报道正在筹备一场估值可能高达2万亿美元、有望成为史上规模最大IPO的窗口期——这不构成"造假"的证据,但构成一个诚实的读者应该主动问的问题:一项尚未经同行评审、无法外部复现的数学成果,选择在这个时间点公开发布并配以官方博客、媒体通稿式传播,是否也承担着"证明模型能力仍在快速进步、对冲'大模型能力见顶'这类投资者疑虑"的公关功能?这两种动机(真实的科研进展vs上市前的叙事管理)完全可以同时为真,不互斥,但报道时应该分开标注,而不是只讲前一半。(Fortune

"教练"驱动的突破,可信度锁在哪一层脚手架上

这次突破的发起动作,不是任何数学家的专业判断,而是一个自认"不懂数学"的软件工程师的一句提示词加几句鼓励;真正的数学专业能力,只出现在结果产出之后的核验环节,而这个核验环节本身还未走到"同行评审+公开可复现"的成熟阶段。这意味着在"AI驱动科研"这套新流程里,决定产出能否发生的关键动作,已经从"具备该领域的深厚知识"位移到了"知道怎么把AI系统的探索坚持下去"——某种介于产品经理、教练与"啦啦队长"之间的新角色,其价值不取决于他懂不懂黎曼猜想,而取决于他能不能在AI表现出"自我怀疑"、想放弃的时候把它推回去继续试。这与Anthropic官方原文的一句话高度吻合:"这项进展本来就摆在已发表的文献里,只是在等一个没有专业背景的读者。"(Forbes

但这套"教练驱动突破"模式的可信度天花板,目前被锁在一个尚未拆除的脚手架里——不可外部复现(模型未发布)、无正式同行评审、核验依赖同一家公司雇的两位内部数学家加两位"抽空帮忙"的外部专家。这意味着"AI数学突破"这类新闻标题下,实际站得住的证据基础,差异可以很大,不该被一律当作同一种可信度对待——有的已经做到机器可验证证书任何人都能本地核实,有的还停留在"内部人背书"阶段,Sumner这个故事目前属于后者。

"科研突破"的发布节奏,正在越来越像财报季

多数报道要么聚焦"AI数学能力又进步了"的技术叙事,要么聚焦"Anthropic要IPO了"的资本叙事,鲜有报道把这两条线放在一起看。但一旦对照时间线——Claude的黎曼zeta突破消息经媒体密集传播是8月10-13日,而"Anthropic投资人正瞄准2万亿美元10月IPO"的报道同样出现在8月13日前后——就会发现一个值得记住的规律:在这一轮AI竞赛里,"重大科研突破"的发布节奏,正在越来越像上市公司财报季的业绩发布节奏——挑一个对叙事最有利的时间窗口,讲一个最动人的故事。这不是说这个数学结果是假的(它有具体、可检验的技术细节支撑),而是提醒任何评估"AI公司科研公告"的人:除了看"结果是什么",还要看"为什么选这个时间点讲""讲的时候留了哪些验证步骤没做完"——这两件事同样重要,却常被读者忽略。

对任何把AI当作工具在用的普通人而言,这个故事比"AI又破了什么纪录"更值得记住的一点是:AI给出的判断(包括它一度表现出的"自我怀疑")不是终点,很多时候只是过程里的一个信号,值得质疑,也值得再试一次。这种"敢对AI说别放弃"的能力,可能会成为这个时代一项被低估的具体技能——不是编程能力,也不是数学能力,而是在AI给出否定判断时,判断这个否定本身是不是也可能出错、要不要坚持推进下去的那份自信。

置信度与局限

Jarred Sumner的背景(Bun创始人、Anthropic收购Bun)交叉核对了Bun官方博客与Anthropic官方新闻稿,可信度高。Claude的技术过程细节(token数/子智能体数量/角色分工/650个失败想法)均出自Anthropic官方研究博客一手披露,可信度高;但因模型未发布,外部完全无法复现,这是本文反复强调的核心局限。Deedy的评价属于个人社交媒体观点,不代表学术共识,已如实标注为"目前流传最广的评价"而非定论。"发布时间点与IPO窗口期重合"这一判断属推理延伸,不构成对Anthropic动机的指控,只是提醒读者留意两条时间线的重合,这个判断本身站得不算特别稳,留待后续观察是否有更多类似节奏出现。

参考文献

  1. Bun官方博客, "Bun Joins Anthropic," bun.com
  2. Anthropic官方新闻稿, "Anthropic Acquires Bun as Claude Code Reaches $1B Milestone," anthropic.com
  3. Anthropic研究博客, "Riemann Zeta," anthropic.com
  4. Forbes, "Claude Just Broke a Math Record That Stood for 37 Years," 2026-08-13,forbes.com
  5. XenoSpectrum, "Claude Riemann Zeta Critical Line Lower Bound," xenospectrum.com
  6. X/Deedy, x.com
  7. Fortune, "Anthropic IPO $2 Trillion October Largest Ever," 2026-08-13,fortune.com