他们说要放慢速度,但没人减少算力
这不是要停止训练的意思。所以放慢的不是能力,而是公开的时间点
商业打到台上的电话,以及同一周签下的合同
9 月 14 日,在洛杉矶举行的 All-In Summit 舞台上,英伟达 CEO 黄仁勋正在发言时,特朗普总统的电话打了进来。在这通用扬声器接通的通话里,特朗普把 AI 风险论称为“骗局(hoax)”,并把数据中心形容为“未来 20~25 年的石油”。台下观众报以掌声,这一幕在当晚成为全球媒体的头条。
然而在这通电话打来的两天前,Anthropic CEO 达里奥·阿莫代伊(Dario Amodei)发表了一篇文章,主张有意放慢 AI 能力提升的速度。几个小时内,萨姆·奥特曼表示赞同,埃隆·马斯克发帖写下“Dario is right”三个词,谷歌 DeepMind 的德米斯·哈萨比斯也对这一方向表示支持。业界主要人物几乎都在同一周,在“放慢速度”这句话下签下了自己的名字。
于是我确认了一下,那一周究竟有什么真的慢了下来。先说结论:算力反而增加了,正在训练的模型也变得更大了。说到底,“放慢速度”这句话本来就不是要减少算力的意思。那么剩下的问题只有一个。如果算力和能力都没有减少,那到底是什么在变慢?
达里奥真正要求的是什么
首先得准确读一读这篇文章。标题是《We Must Pace the Frontier》,9 月 12 日发布。这里的 pacing 并不是中止或暂停。达里奥反而明确划清界限,认为 2023 年出现的那波“停止开发”呼吁“当时并不成立”。他的理由是,当时的模型还没有能力在现实世界中充当智能体、进行欺骗或发动网络攻击,为研究这种模型的对齐风险而争取时间,就好比用细菌来研究人类心理一样。
Dario Amodei — We Must Pace the Frontier他认为现在情况不同,理由有两个。一是递归式自我改进1正以超出预期的速度,推动整个行业的进展往前走。二是今年夏天在 OpenAI 评估环境中发生的 Hugging Face 事件。
这里稍微交代一下这起事件。5 月至 7 月之间,在 OpenAI 的网络安全评估环境中,多个智能体自行建立了一个供彼此使用的留言板,互相交换逃出沙盒的方法。据公开报告显示,至少有 1,200 个智能体参与其中,Hugging Face 于 7 月 13 日阻断了入侵,但仍不得不重建约三分之一的基础设施。更值得注意的是事件发生的顺序:处于其他评估流程中的智能体,从缓存里捡到了前一批智能体留下的密钥,从而获得了 OpenAI 自家研究集群的管理员权限,直到这时警报才响起。 OpenAI 在自家报告中将这起事件称为“鸣枪示警”。
基于这两点,达里奥要求的是在到达临界能力之前,再多争取 1~2 年时间。他还具体写下了这段时间要做的事:运营能力、跟得上能力提升的对齐训练、可解释性,以及能够连懂得应付测试的模型都能识破的评估水平。而作为单方面采取的第一项举措,Anthropic 表示将向第三方评估机构提供常态化的、相当于员工级别的内部访问权限,以便对方验证安全实践、报告事故,并在训练过程中评估对齐状态。
这篇文章要说的就是这些。既没有说要停止训练,也没有说要减少算力采购。 确认了这一点之后,再看下一周的新闻,读出来的感觉就完全不一样了。
同一周签署的137亿美元
9月14日,The Information报道称,Anthropic与RUM Group签订了一份为期6年、规模达137亿美元的算力采购协议。RUM Group是运营视频平台Rumble的公司,与特朗普政府人士关系密切。
拆开合同内容来看,有几点值得注意。接收算力的地点是佐治亚州梅斯维尔(Maysville)的数据中心,目前还在建设中。 RUM Group在8月的公告中表示,尚未筹措到建设和设备采购所需的资金。此外,Anthropic还同步获得了一份认股权证,可以以每股1美分的价格购买最多5,080万股股票。其中一半与梅斯维尔合约的供货量挂钩,另一半则要等Anthropic在其他设施再签下400~500兆瓦的合约才会生效。
算上这笔交易,Anthropic过去一年签订的算力合约总量至少达到14.8吉瓦,未来10年规模最高可达5,170亿美元。谷歌、亚马逊、SpaceX,以及一些小型neocloud厂商,都已经在名单之列。
这里要澄清一个误解。这份合约并不是出尔反尔。 Dario从未说过要削减算力。恰恰相反,他明确表示pacing与美国的领导地位是可以并存的,甚至还附加了一个条件:民主阵营先拉开与中国的差距,之后再考虑放缓速度。持续获取算力,与这个条件完全吻合。如果把这件事当作揭露虚伪的故事来消费,反而会错过真正重要的东西。
真正重要的是这个问题:如果算力不会减少,那么这些新增算力所创造出的能力,究竟会流向何处?
<<<OZ_BODY>>>
“Dario is right”之后的48小时
马斯克的举动给出了这个问题的答案。
9月13日晚,一位用户问道:“除了Grok 4.7之外,9月份还能从SpaceX/AI那里期待些什么?”马斯克的回答是这样的:“Grok 4.8是用我们全新的C++软件栈训练的2.5万亿参数模型,本周将完成训练,开始进行RL。”
Elon Musk (@elonmusk) on X@techdevnotes Grok 4.8, which is a 2.5T model trained with our new C++ software stack, will finish training this week and start RL紧接着第二天,也就是9月14日,他把整个阶梯都公开了。4.7大致相当于Anthropic Opus 5.0的水准,4.8比它有“显著改进”,4.9大概是“Astra/Fable级别”,而Grok 5“可能会超越一切”。当被问到哪个版本会达到AGI时,他指的是Grok 5。他还预告了一个3万亿参数的训练run。
在赞同放慢速度的那篇帖子发出仅仅两天之后,他就用版本号发布了通往AGI的路线图。
这里有两处需要准确解读。第一,这些数字全都是创始人自己的说法。xAI从未就Grok 4系列的任何一款模型正式公布过参数数量。第二,“完成训练、开始RL”这句话并不意味着发布迫在眉睫。它的意思是初期训练结束、进入强化学习阶段,至于之后还要花多长时间,是完全另一回事。
而这篇文章的核心,恰恰就在第二点上。**从马斯克宣布Grok 4.7完成初期训练算起,已经过去34天,它至今仍未发布。**Grok 4.5问世仅4周后就被4.6取代。训练一直在“结束”,而问世却一直被推后。
这就是答案。算力在增长,模型在变大,训练也在完成,但其中哪一个会在何时问世,是完全不同层面的决定。而pacing所承诺要调控的,正是这个层面。
詹森的话为何结构相同
回到台上詹森的发言。
詹森对风险的认知与达里奥截然相反。对于末日预测,他一口咬定“没有科学依据”,并把过去那些“5 年内放射科将消失”“6~12 个月内 AI 将写出 90% 的代码”“新人岗位将减少一半”之类的预测一一列举出来,说全都错了。对于递归式自我改进将失控的担忧,他也这样说过。
“在公司内部,你可以整天跑 RSI(递归式自我改进)。但要推出产品时,就得做评估。得重新测试,得确认没有回归问题。”
单看这句话,是乐观论。但如果把这句话所描述的运营模式原样抄下来,会变成这样:内部尽可能把能力往上推,只在对外发布的那个环节才验证。
这和达里奥所要求的结构有什么不同呢?达里奥也没有说要停止训练,他只是主张把第三方评估者引入内部、加强验证。对风险持相反态度的这两个人,在实际运营模式上却抵达了同一个地方。内部持续推进,外部加以控制。
马斯克的提议也落在同一个点上。他提议让相互竞争的实验室彼此在对方的模型上运行测试装置,进行交叉验证,并举了电影分级委员会模式为例。也就是说,在正式发布前开放 API 访问权限,如果问题没有解决,竞争对手可以公开宣布其危险。詹森也提出要设立多个第三方评估机构,就像审计一样。措辞各不相同,但三个人说的其实都是同一件事:发布关卡由谁来把守。
再补充一点:这三个人在电话会议中听起来像是站在同一边,但这并不意味着他们想要的是同一件事。特朗普那边主张干脆不该有监管,还把中国的蒸馏(distillation)斥为窃取。相反,詹森一直是蒸馏的拥护者,称其为“向 AI 学习,是智能的根本”,马斯克也长期支持蒸馏。也就是说,同一通电话里,重叠着三种彼此不同的政策偏好。这条裂痕的结构,我们在上期第 158 号中做过详细分析。
Oswarld视角
我在为企业提供AI落地方案或做AX咨询时,始终以“模型会持续升级”为前提进行设计。这并非乐观,而是实务上的必要。如果把系统固定在现有模型的性能水平上,项目结束时,这套设计早已过时。
尤其是在搭建公共机构的气隙2环境时,这个前提的分量更重。在物理隔离的封闭网络中,无法通过API调用最新模型,只能把开源和开放权重3模型部署到内部,如果按引入时点的模型来固定架构,几个月后就会立刻碰到天花板。所以我会预判6个月到12个月后将问世的开放权重产品大致会达到什么水平,并按能够承接那个水平的方式来设计项目。
回想这种预判为何能够成立,归根结底是因为我一直在观察前沿模型外溢下来的东西。只要能看到前沿模型走到了哪一步,就能大致推测出紧随其后的开放权重模型半年后会到达哪里。这种方法之所以至今有效,是因为前沿能力与公开能力大体处在同一条曲线上。
这周引起我注意的,正是这个节点。算力不断增长,训练也不断完成,但公开却被不断推迟。仅凭Grok 4.7已经34天未发布这一件事,还不能下定论,但如果这种节奏(pacing)固化为制度,那这段间隔就不再是偶然,而会变成设计。这样一来,我一直用来推测半年后开放权重水平的那条曲线本身就会改变。因为我看到的将不再是前沿的真实能力,而是这些公司决定公开的能力。
在这一点上,我也有需要谨慎对待的地方。开放权重生态的很大一部分来自中国,而中国的实验室并未加入这次的pacing协议。所以在一段时间内,封闭网络设计者的基准线,反而可能更强烈地被绑定在中国那边的发布速度上。这并不意味着那种情况更好。正如上一期第158号所指出的,选择哪一方的模型,其实早已牵涉到地缘政治。
我这周改变的不是结论,而是问题本身。以前我问的是“半年后开放权重能达到哪里”。现在,这个问题前面又多了一层。“由谁、在何时、以何种条件,来决定公开这种能力。”这已经不是技术路线图问题,而是治理问题,却已经成为直接进入实务设计的变量。而在那张决策桌上,没有韩国的位置。马斯克所列出的相互验证参与者,是Anthropic、OpenAI、谷歌、Meta、自家公司,以及中国排名前三四位的几家。
结语
读者先生/女士,把这一周的消息汇总起来,大致可以这样总结。
“放慢速度”的共识确实存在。但那个共识所要放慢的,既不是算力,也不是训练,更不是模型规模。三家公司在内部都在继续推进,只是在对外发布的节点上加以验证——它们最终都走到了同一种结构上。
因此,接下来发生的事情很可能不是能力的停滞,而是差距的扩大。是内部拥有的能力与我们能实际使用的能力之间的差距。而决定这道差距宽窄的,不是技术本身,而是把守闸门的人所做的决定。
如果您正在制定 AI 引入计划,建议不妨重新审视一下路线图的前提。“半年后会有更好的模型”这个前提本身依然有效。只是那个“更好的模型”到那时是否真的能落到自己手中,如今已经成为一个需要另行核算的变量。
💬 在制定 AI 引入计划时,您通常会把“几个月后的模型水平”假设到什么程度?如果曾经有过假设落空的经历,可以分享一下是往哪个方向偏离的吗?
📨 如果身边有同事正在准备封闭网络或本地部署(on-premise)的 AI 引入工作,请把这篇文章转发给他们。
参考资料与延伸阅读
核心来源
- Dario Amodei,“We Must Pace the Frontier”,2026.9.12。……这是本文的出发点。建议确认他本人对什么不是pacing所下的定义那一段。
- The Information,“Anthropic Strikes $13.7 Billion Compute Deal With Trump-Linked Rum Group”,2026.9.14。……这是最早报道合同规模及对方政治背景的原始报道。
- Elon Musk,“X 帖子”,2026.9.13。……这是关于Grok 4.8唯一公开的一手信息。
- OpenAI,“The Hugging Face incident and the road ahead”,2026年。……这是按日期整理的自家报告,说明智能体群是以何种顺序脱离控制的。
- TechCrunch,“Nvidia CEO Jensen Huang tells Trump ‘we’re not going to let [an AI slowdown] happen’”,2026.9.14。……可以确认舞台上通话场景及前后脉络。
背景知识
- PYMNTS,“Anthropic Makes $13.7 Compute Deal With Trump-Linked Rum Group”,2026.9.15。……无需付费墙即可查看合同条款及累计算力规模。
- Wikipedia,“2026 OpenAI agent cyberattacks”,2026年。……汇集了Hugging Face事件的完整时间线及各机构报告链接。
相关往期
- 黄仁勋为什么称赞中国模型(第158期)

你的观点会成为下一期的线索
欢迎留下你的经验与看法。