四友汇
申请加入
企业动态 · AI周报第001期 完整版 · 2026年8月14日
AI周报 · 第001期 · 企业动态 · 完整版

三条新闻,一场仗

这周OpenAI、Google、Anthropic各出了一条新闻,看起来毫不相干:一个解数学题,一个送走了几位老将,一个把价格砍了一半。

覆盖时间点2026年8月2日-8日
分类企业动态 · 大模型三巨头
发布日期2026年8月14日

← 先看简版(3分钟速览)

摘要

  • 这周OpenAI、Google、Anthropic各出了一条新闻,看起来毫不相干:一个解数学题,一个送走了几位老将,一个把价格砍了一半。三条新闻分别落在研发、人事、定价三条战线上,放到一起看,其实是同一场仗——三家公司都在教AI去干过去只有最顶尖的人才能干的事:发现新知识,压低自己的成本。上一阶段,大模型比的是考试分数;这一阶段,比的是谁的模型能自己造血。

一个2000美元的证明,验证权不再交给权威

2026年8月1日,OpenAI宣布一个尚未发布的模型Astra解开了十道数学难题——横跨高维几何、编码理论、群论等八个领域,每一道都被数学界搁置至少十年。算力成本约2000美元。OpenAI把249页手稿和Lean 4形式化证明一并公开在GitHub上,证明里"sorry"(未证完标记)计数为零,意味着每一步都能被机器逐行验证。其中包括Gromov在1999年提出、悬而未决二十七年的"非亚有限群"显式构造。(TechTimesYahoo

这不是OpenAI第一次宣称自己解开了数学难题。上一次,是个教训。2025年10月,时任OpenAI VP Kevin Weil公开宣称GPT-5解出十道Erdős猜想,几天后被数学家Thomas Bloom(erdosproblems.com站长,本期人物篇主角)当众拆穿——模型压根没产出原创证明,只是从文献里检索出了已有解法,而这些解法此前没被Bloom收进他的数据库,才让网站误标成"未解决"。Bloom当时的评价是"一次戏剧性的失实陈述"。(Quanta Magazine

这次不一样,不一样在验证的方式上。Bloom亲自核实Astra的结果后,在X上称之为"big news",评价高于OpenAI今年5月发布的那次结果。他给的理由很具体:证明用Lean 4形式化,任何人拿一台笔记本电脑就能跑一遍,编译通过就是通过,不通过就是不通过。这句话背后是一次验证方式的转移:从"请几位权威数学家读一遍、拿他们的声誉背书",转向"发布一份任何人本地都能跑通过、跑不过的代码"。信任的来源,从人换成了协议。(explainx.ai

划边界的是OpenAI自己的研究员Noam Brown(扑克AI Libratus/Pluribus、Meta外交游戏AI CICERO、o1推理模型的核心贡献者,CMU博士):Clay数学研究所的七个千禧年大奖难题,一个都没被Astra碰。这十道题是"Astra恰好有理论基础可以借力"的题目,同一套架构能不能啃动最难的已知难题,现在还不知道。OpenAI同期宣布向10万名学术研究者免费开放前沿模型访问权限至2027年——一手拉近与科研界的关系,一手把研究基础设施沉淀到自己的平台上。

Google送走了自己最资深的四个人,却给他们投了钱

2026年8月5日,Google首席科学家Jeff Dean宣布离职。他1999年以第30号员工身份加入公司(当时公司只有二十来人),和Sanjay Ghemawat一起发明了MapReduce和Bigtable——今天所有大规模分布式计算系统的地基。2011年他联合创立Google Brain,第一次证明机器可以在无监督状态下识别"猫"这种高层概念,后来又推动了TensorFlow和TPU的立项。他离职后联合创立Discovery Loop,一家专注于用AI自动化科学与工程实验循环的公益公司(Public Benefit Corporation)。同一天出走的还有Sanjay Ghemawat(Google高级研究员)、Quoc Le(Google Brain联合创始人)、Oriol Vinyals(DeepMind Gemini技术负责人)。(TechCrunch

首轮融资由Radical Ventures和Khosla Ventures领投,Kleiner Perkins、Lightspeed、Doerr Capital跟投。真正该细看的一笔是:Alphabet自己也是这家新公司的founding investor和云计算合作伙伴。一家公司把最资深的四位科学家送走,转身却给他们投钱、当他们的云服务商——这不是慷慨,是买保险:与其防着这几位另起炉灶变成对手,不如继续绑定他们,提前买下他们未来产出的期权。Dean在X上说使命是"自动化实验循环……初期聚焦机器学习研究与工程,但相信这套方法能帮助解决科学与工程众多领域的重要子问题"。(Jeff Dean on X

这次出走是当天更大范围重组的一部分。Demis Hassabis卸任DeepMind CEO,转任董事长兼Alphabet首席科学家;原DeepMind CTO Koray Kavukcuoglu升任高级副总裁,直接向Sundar Pichai汇报,全面接管Gemini的日常开发。Alphabet股价当日跌了约4%——这已经是今年第二次因人才流失重挫股价,6月Noam Shazeer转投OpenAI、诺贝尔奖得主John Jumper转投Anthropic的消息,曾让股价一度暴跌7%。两次加起来,Alphabet市值蒸发约2250亿美元。(CNBC

触发这次重组的,是Bloomberg 7月16日的一条报道:Google旗舰模型Gemini 3.5 Pro的发布落后计划数月,尤其编程能力没达到内部目标,而OpenAI和Meta同期发布的模型已经在代码生成上超过了Google现有产品。这次架构调整,把"交付责任"从一个可以被CEO层层委托的董事长职位,挪到了直接向Alphabet CEO汇报的SVP职位——升级路径变短了,下一次模型延迟谁该负责,变得更清楚。(CNBC

Anthropic把旗舰做到半价,OpenAI把入门砍到两折

Anthropic在7月24日发布Claude Opus 5,定价和上一代持平(每百万输入token 5美元、输出25美元),性能却逼近旗舰Fable 5,价格只是Fable 5的一半。编程基准Frontier-Bench v0.1上,Opus 5拿到43.3%,是上一代(21.1%)的两倍还多;ARC-AGI-3上拿到30.2%,是第二名的三倍。但它不是全面领先——SWE-bench Pro上输给Fable 5,DeepSWE上输给GPT-5.6 Sol。一位评测者的说法很实在:"它不像那种给出令人印象深刻第一个答案的模型,更像那种会一直干到任务真正完成的模型";但同一份评测也提醒:简短写作、FAQ、简单分类、样板代码这类常规工作,Opus 5并不比便宜得多的Sonnet 5或Haiku 4.5表现更好。(eesel AILayer3Labs

同期(7月30日),OpenAI反向操作,把最小模型GPT-5.6 Luna的输入价格砍到每百万token 20美分,是原发布价的五分之一。这次降价的技术来源要说清楚:OpenAI让旗舰模型Sol在Codex环境里对自己的GPU推理内核做自我优化,用自家的Triton/Gluon重写内核,把端到端服务成本降低约20%,同时重新设计投机解码的草稿模型,把token生成效率提升超过15%。这两个数字是两回事,不能直接相加成35%——这更像一次抢占轻量任务市场份额的战略定价,不是纯粹的成本传导。(TechTimes

份额数字印证了这场仗打到了哪一步。2023年,OpenAI的企业API支出份额超过50%,Anthropic约12%;到2026年,这两个数字已经反过来——Anthropic约32%,OpenAI约25%(2026年4月首次反超)。落到具体产品线上更悬殊:Claude Code已经占了企业编程市场54%,OpenAI占21%;这款产品2025年5月发布,三个月内增长超过10倍,超过1000家客户在它上面年支出过百万美元,德勤向约47万名员工推广了它,是目前已知规模最大的公开企业级部署之一。(uncoveralpha

但OpenAI的总营收(约130亿美元ARR)仍然领先Anthropic(约50亿美元)——两家走的是完全不同的生意。OpenAI 85%的收入来自ChatGPT个人订阅,Anthropic 85%来自企业客户。Anthropic产品负责人Dianne Penn的一句话,点出了他们定价策略的逻辑:"客户优先看重的是价值交付,不是单纯降本,一个更便宜但做不到同等质量的模型,并不实用。"这解释了Anthropic为什么把Opus 5做成"逼近旗舰、半价",而不是单纯打价格战。(ValueAddVC

模型定价与市场份额对照
厂商/模型时间输入价($/百万token)输出价($/百万token)定位
OpenAI GPT-5.6 Luna(降价后)2026-07-300.201.20轻量任务,抢份额
OpenAI GPT-5.6 Terra(降价后)2026-07-302.0012.00中档任务
OpenAI GPT-5.6 Sol(旗舰)2026上半年未变未变旗舰,自我优化内核
Anthropic Claude Opus 52026-07-245.0025.00逼近旗舰智力,半价
Anthropic Claude Fable 5(旗舰)此前发布10.0050.00旗舰对照基准
维度20232026
企业API份额 · OpenAI超50%约25%
企业API份额 · Anthropic约12%约32%(2026-04反超)
企业编程市场份额 · Claude Code54%
企业编程市场份额 · OpenAI21%
年营收ARROpenAI约130亿 / Anthropic约50亿

数据来自第三方分析(ValueAddVC/MindStudio综合口径),非两家公司官方审计披露,存在方法论差异,仅供方向参考。

三条线,一件事

把三件事摆在一起看,顺序很关键。Google的旗舰模型先延期(7月16日曝光),编程能力没达标;紧接着(8月5日)公司最资深的四位研究骨干集体出走,DeepMind CEO交出了日常运营权。技术骨干在旗舰产品交付失利后短时间内集体离开、另立门户,通常说明一件事:这些人判断"留在体制内的边际研究自由和速度,已经低于自立门户的机会成本"。这是对"大公司做前沿研究的效率"投出的不信任票,不只是薪酬或个人选择的问题。Discovery Loop的定位——自动化科学发现循环——本身就是一个判断:下一阶段的竞争焦点,是谁能让AI自己加速产出新知识,而不再是谁的聊天模型更强。

OpenAI同一时间用一个尚未发布的模型去解数学难题,用旗舰模型重写自己的推理内核来降价,是同一个逻辑的两种呈现:用模型自己的智能,去自动化本该由人做的高价值劳动。一次做在知识生产端(数学证明),一次做在成本结构端(内核优化)。Anthropic把Opus 5做到"接近旗舰、半价",是这场仗在价格维度上的打法——当模型能力增速放缓、边际收益递减,厂商开始比谁能用更少的钱拿到同等或更高的智力。

我的判断是:这周表面是三条独立新闻,底层是同一场"用AI自动化AI研发本身"的竞赛进入了新阶段。这个判断可能错——但如果"研究和工程本身可被自动化"这件事真的兑现,它改变的不是模型排行榜,而是一个人、一个小团队能触达的产出规模上限。这比"哪家模型更强",值得任何小团队多想一层。

Google为什么反过来给离职的人投钱

多数报道停在"人才流失加重组"这个层面。真正该细看的一笔,是Alphabet亲自成为Discovery Loop的founding investor和云计算合作伙伴——公司没有把离职的核心科学家当竞争对手来防,反而选择继续绑定他们,买下他们未来产出的期权。据报道,Sundar Pichai多次与这几位研究员会面,想说服他们留下,但这几位最终还是选择彻底离开大公司体系,换取初创公司才有的乐趣、速度与自由。

这透露出一个比"人才战争"更冷静的判断:大公司自己也承认,像"自动化科学发现"这类前沿探索性研究,放在大公司的科层结构里做,效率天然更低——不是留不住人的问题,是"愿不愿意主动放这批人出去、用钱换未来接入权"的问题。这条对任何规模较小的团队都有直接的镜鉴价值:大厂尚且认定探索性研究该从主体业务里剥离出去单独跑,规模再小的团队,在"稳态执行"和"探索性研究"之间,也该有清楚的组织边界——不能用同一套流程,管两种性质完全不同的工作。

置信度与局限

Astra的十道数学证明经Bloom亲自核实、Lean 4机器可验证,证据链本身可信;但证明本身正确,不代表这十道题目有多大的数学意义或原创价值——这个判断权在数学共同体,不在OpenAI。"Google重组由Gemini 3.5 Pro延迟直接触发"这条因果链,是Bloomberg、Axios、CNBC多家媒体交叉印证的合理推断,但Google官方声明只用"加速AI前沿工作"一句话带过,没有正式承认这个因果关系——这是推理,不是Google自证的事实。企业API份额数字(Anthropic 32%/OpenAI 25%)与Claude Code相关营收数字,来自第三方分析和聚合博客,不是两家公司官方披露的审计数字,存在方法论差异导致的浮动空间,应当当方向性参考,不是精确统计。

结语

数学证明、人才出走、价格战,讲的其实是同一件事:模型能力增速放缓之后,竞争焦点已经从"谁更聪明",挪到了"谁能让AI自己加速产出新知识、自己压低自己的成本"。这件事离一个人的产出规模上限有多近,现在还没有答案。

参考文献

  1. TechTimes, "OpenAI's Astra Solves Ten Decade-Old Math Problems With Machine-Checkable Lean Proofs," 2026-08-02, techtimes.com
  2. Quanta Magazine, "Why the Legendary Erdős Problems Are Falling to AI," 2026-08-03, quantamagazine.org
  3. explainx.ai, "OpenAI Astra: Ten Math Proofs With Lean Certificates," 2026, explainx.ai
  4. TechCrunch, "Jeff Dean and Other Top AI Researchers Are Leaving Google to Launch Their Own Startup," 2026-08-05, techcrunch.com
  5. CNBC, "Google Chief Scientist Jeff Dean Leaving Company After 27 Years," 2026-08-05, cnbc.com
  6. CNBC, "Alphabet Stock Falls on Gemini 3.5 Pro Delay Report," 2026-07-16, cnbc.com
  7. eesel AI, "Claude Opus 5 Review," 2026, eesel.ai
  8. TechTimes, "OpenAI Cuts Luna 80%, Sol Rewrote Its Own Inference Stack to Fund Price Drop," 2026-07-30, techtimes.com
  9. uncoveralpha, "Anthropic's Claude Code Is Having Its ChatGPT Moment," 2026, uncoveralpha.com
  10. ValueAddVC, "OpenAI vs Anthropic: Which AI Company Is Winning the Enterprise in 2026," 2026, valueaddvc.com