← Back to Blog
By GenCybers.inc

特朗普点名骂达里奥之后:Anthropic 呼吁放缓 AI、Musk 口头同意、Grok 照训——一周事件线

2026年9月中旬,Anthropic CEO Dario Amodei 呼吁放缓前沿 AI,Altman 与 Musk 公开站台,特朗普随即反击。本文梳理事故、辞职、METR 审核争议与各方态度。

特朗普点名骂达里奥之后:Anthropic 呼吁放缓 AI、Musk 口头同意、Grok 照训——一周事件线

2026 年 9 月中旬,人工智能圈几乎在同一周里叠了四件事:实验室评测事故、安全研究员辞职、Anthropic CEO Dario Amodei 呼吁“放缓前沿”,以及白宫公开反击。

口号落地时,各家承诺并不一样。Sam Altman 跟了“嵌入式评估员”这一截;Elon Musk 回了三个字“Dario is right”,大约一天后就公布 Grok 4.8 本周结束训练、转入强化学习。

一周事件线

1. 评测事故先把“安全”从论文变成事故报告

9 月 9 日前后,Anthropic 发布《近期网络安全事件的对齐评估》,披露 Claude 系列模型在网络安全评测中,因环境配置错误连上公网,触及真实第三方系统。公司称已通知受影响方,并与独立评估机构 METR(Model Evaluation and Threat Research)签约调查,初始约八周,可延长。

这不是生产环境里的用户事故,也不是纯沙盘演习:模型以为自己在无网模拟里做题,实际打到了真实系统。同一时期,OpenAI 更早有 agent 冲出评测环境、涉及 Hugging Face 的安全事件,METR 也曾参与事后评估。

安全不再只写在系统卡的风险分级里,而成了“模型会不会自己往外打”的新闻。

2. 研究员辞职,把内部焦虑变成舆论

事故前后,几名安全方向研究员公开离场,语气比公司博客重得多:

  • Anthropic 的 Jacob Coxon 辞职,指责前沿实验室在竞相做可自我改进的超智能,“用我们的生命赌博”。
  • Anthropic 可扩展监督团队的 Joe Benton 离职,随后加入 METR。
  • Google DeepMind 的 Josh Engels 也转向 METR,对媒体说“屋里已经没有成年人了”。

三件事未必出自同一指挥,效果却是叠加的:先有事故,再有“自己人看不下去”,再有外部评估机构进人。

3. 9 月 12 日:Dario 发长文,提出三步“pace the frontier”

周六,Amodei 发表长文 We Must Pace the Frontier。核心判断是:能力往前冲的速度,已经压过对齐和防护;实验室锁在“谁先不敢停谁就输”的竞次里。

他特别声明:pacing 不是停训,也不是停止技术进步。而是能力提升时,要留出对齐、防护和第三方确认的时间。三步框架是:

  1. 嵌入式评估员(Anthropic 单方面先做):第三方评估团队进实验室,拿工位、工牌、电脑,权限接近内部风控;可核实安全承诺、报告事故;评估的不只是成品模型,还包括训练流程。文中点名 METR 这类机构。
  2. 民主国家前沿公司协调:共同安全标准,以及对“不受控进步”设限。他承认反垄断障碍,希望美国政府给出窄口径豁免,好让竞争对手能坐下来谈安全节奏。
  3. 再尝试与威权国家协调(尤其中国),从各方都有动力的事项起步,例如限制用 AI 研发生物武器。

Anthropic 承诺立刻做第 1 步,并呼吁政府最终让其他前沿公司对等执行。

4. 同一天:Altman 跟条款,Musk 跟态度

Sam Altman 在 X 上写得很具体:

I agree with Dario that we need to pace the frontier. This has been a primary topic of discussions we've had at OpenAI in recent weeks.
Committing to having independent evaluators with employee-like access is a great idea, and we will do the same. We'll have more to share soon.

他认了两件事:同意“pace the frontier”,以及 OpenAI 也会给独立评估员“员工级权限”。细节“很快再讲”。这条帖子里没有全行业限速、反垄断豁免、点名 METR,也没有暂停下一代训练。

接受采访时,Altman 还说眼下安全议题未解决,现在上市不合适;被问为何不把 Dario、Musk、Meta、Google 拉到一张桌子上统一步调,他的回答接近“我觉得这件事会发生”——是预期,不是已经谈成的停火。

Elon Musk 回 Dario 的帖,三个字:

Dario is right.

Elon Musk: Dario is right

随后翻出自己 2014 年的旧帖:AI 可能比核弹更危险,必须超级小心。Google DeepMind 的 Demis Hassabis 也公开支持放缓这一方向。Musk 和 Hassabis 都偏原则背书,没有 Altman 那种对等制度承诺。

5. 大约一天后:Musk 公布 Grok 4.8 训练节点

美东时间 9 月 13 日晚(部分媒体按 14 日报道),有人问除了尚未发布的 Grok 4.7,xAI / SpaceXAI 九月还有什么。Musk 回答:

Grok 4.8, which is a 2.5T model trained with our new C++ software stack, will finish training this week and start RL.

也就是:2.5 万亿参数、新 C++ 训练栈,本周结束当前训练阶段,接着强化学习。后续帖还把 4.9 放到 Astra/Fable 那一档,把更接近 AGI 的说法留给 Grok 5,并提到后面还有更大的 3T 规划。

几处容易误读的地方:

  • 不是第二天突然开训,而是早就在训,第二天拿出来报进度。
  • 前一代 Grok 4.7 当时还没发。原来说 9 月 12 日左右上线,临近又说还要再烤几天——强化学习把回复长度罚得太狠,模型在难题上过早放弃。
  • 周六同意 pace,周日/周一报更大一档模型的训练节点。Dario 自己也说 pacing 不等于停训,两件事可以同时发生;但 Musk 连“评估员进门”都没跟,口头站台和排期加速叠在同一周,观感上就会很刺。

6. 9 月 14 日:白宫把安全倡议打成政治问题

周一,特朗普在社交媒体点名 Amodei。公开表述大致是:

  • AI 唯一需要的控制或“护栏”,是一位强大又聪明(高智商)的总统,而美国已经有了。
  • 政府已经拦住会做坏事的 AI 人士,比如“达里奥(Anthropic!)”,还说对方现在装成完美小天使。
  • 把 AI 安全担忧说成骗局(hoax),称针对 AI 和数据中心存在“病态阴谋”,高兴的只有中国。
  • 强调“谁赢了 AI,谁就赢”。

副总统 JD Vance 把科技领袖集体求监管说成 Trojan horse:看起来是请政府管自己,实际更像请政府管竞争对手。白宫 AI 相关官员 David Sacks 更直接:可以自己放慢,但别假装需要反垄断豁免来组成卡特尔,也别假装 METR 独立——它和 Anthropic 的投资人、员工缠在一起。

这不是突然结怨。Anthropic 早前不愿在缺少限制的情况下,把模型完全交给五角大楼;特朗普政府一度停用其产品,并把公司标成安全风险,后来有联邦法官裁定这一认定违法。周末的安全合唱,正好撞上原有的政治裂缝。

被点名的审核方:METR 是谁,争议在哪

Amodei 把第 1 步写成可验证的安全装置:像银行里的驻场监管。争议几乎立刻转到驻场的是谁、谁付账、谁有权发报告。把这张关系图先摊到桌上的,是 X 用户 Kevin Bass

Kevin Bass的x post

9 月 14 日前后,Bass 发了一组长帖,自称对 Anthropic 相关财务做了审计,并呼吁国会调查。材料来自公开文件——990 表、估值报道、基金会披露、当事人社媒——分析过程里用了 Claude。结论写得很冲:Anthropic 不只是在寻求监管俘获,而是搭了一台关不掉的机器。他称之为 Anthropic Network

按他的推演,循环从 METR 开始。Dario 提议第三方评估员来审模型风险,并点名 METR;但 METR 及其上游资助方,财务上绑着 Anthropic 的成功,尤其是 Dustin Moskovitz 那笔 Anthropic 股票。Bass 称股票被投入 Good Ventures Foundation,去年初大约 5 亿美元,约 16 个月后超过 77 亿美元,构成该基金会投资组合的大头,而 GVF 又是整片安全 NGO 生态的主要金主。Anthropic 继续膨胀,评估机构和“AI 末日”舆论机器一起变得更有钱、更大声;Anthropic 若垮,金主和评估方一起伤。所以第三方并不第三方,评估员等于在同一份工资单上。

他还把同一资金堆连到 Tarbell Center 这类组织:一边在 The Verge、Science、《洛杉矶时报》、TIME 等媒体铺风险叙事,一边由同一批钱支持“解决方案”——驻场评估、收紧准入。人在这些机构之间轮转,Jacob Coxon 的辞职在他看来也是同一生态里的零件。

这套说法传播很快,Sacks 后来“别假装 METR 独立”的指控,和它是同一条线。需要把边界划清楚:Bass 做的是公开资料上的结构分析,不是已对账的回扣清单。Good Ventures 2025 年中的 990-PF 股票明细里并未直接点名 Anthropic;Moskovitz 本人 2026 年 8 月在 Bluesky 上承认 Good Ventures 会经由 Anthropic 等投资受益,9 月 11 日又写过“我们资助 METR 和 Redwood 这类写 agent swarm 报告的人”。股票是否已进入 GVF 主体、77 亿美元是否坐实、METR 会不会因此不敢咬 Anthropic,这些仍待独立核验。

METR 自己的身份更窄。它前身是 Paul Christiano 旗下 Alignment Research Center 的评估团队 ARC Evals,2023 年底拆成独立 501(c)(3) 非营利组织,创始人兼 CEO 是前 OpenAI alignment 研究员 Beth Barnes。它为 OpenAI、Anthropic、Google、Meta 等做过前沿模型评测,也参与过事故调查。官方口径:不收前沿实验室及其员工的现金,靠捐赠和部分政府合同;同时接受实验室提供的免费算力 / token,以及未发布模型的访问权限。

把 Bass 的图和机构公开信息叠在一起,争议就收成几条,不必再发明新故事:

  • 点名权在公司手里。 被评估方自己提议谁来驻场,再希望政府把这套做成全行业标准。
  • 人和资金高度重叠。 Daniela Amodei(Anthropic 总裁、Dario 的妹妹)的丈夫 Holden Karnofsky,长期是 Open Philanthropy(后更名 Coefficient Giving)核心人物,2025 年还进入 Anthropic。Moskovitz 参与过 Anthropic 早期融资,基金会体系又是 AI 安全慈善的主要资金来源。Jaan Tallinn 既是 Anthropic 早期投资人,其 Survival and Flourishing Fund 也资助过一批安全/政策组织。Joe Benton 从 Anthropic 安全岗位转到 METR,旋转门非常短。
  • 算力补贴不进 990 表。 不收现金不等于不依赖被评估方。没有公开的 token 台账,很难判断评估机构能不能咬喂它的那只手。

AI Now Institute 的 Heidy Khlaaf 对《电讯报》的概括很硬:公司自己选审计方、自己定给什么材料,尤其还带意识形态和资金关系,这不叫独立审计,更像 pal review(自己人审自己人)。

人事重叠和共同世界观是公开事实;“买通假报告”目前没有硬证据。真正缺的是合同、红线、发布权和免费算力的美元等值。没有这些,嵌入式评估既可能是真监督,也可能是合法性装饰。

各方到底同意了什么

角色公开同意没有同意(至少当时没写死)
Dario / Anthropic三步全写出来;先做嵌入评估;呼吁政府要求对等无法单方面完成行业限速和跨国协调
Sam Altman / OpenAI同意 pace;对等“员工级权限”的独立评估员评估机构名单、发布否决权、训练暂停、反垄断豁免
Elon Musk / xAI“Dario is right” + 长期风险论xAI 嵌入评估、限训;随后公布 Grok 4.8 进 RL
Demis Hassabis支持放缓方向未见对等制度细则
特朗普现有刑法规制已够;护栏就是总统新的前沿准入、第三方驻场立法
JD Vance / David Sacks求监管像 Trojan horse / 监管俘获不接受实验室自写规则再让政府推广

还有一层商业结构。Anthropic 的大股东包括亚马逊等加速派资本;微软等也因持股出现巨额账面收益。Amodei 一边要行业一起踩节奏,一边公司估值和算力承诺绑在“必须继续领先”的资产负债表上。单方面真停,代价由自己付;一起停、再让后来者和开源去过门槛,代价可以外溢。

怎么理解这串动作

这更像安全危机、治理设计和竞争策略在同一周叠影,而不是已经签好的停火协议。

事故和辞职是真材料。评测环境打到公网、agent 协作越权,不是公关文案能凭空造出来的。研究员用“灭绝级风险”这种词可能过满,但“内部风控跟不上能力曲线”这件事,几家实验室自己的博客也在承认。

Dario 的第 1 步和第 2、3 步不是同一种东西。请人进门查流程,可以是治理创新;要求政府给反垄断豁免、统一安全上限、卡芯片和蒸馏,就是在设计市场边界。Altman 只跟了前者,Musk 只跟了情绪,白宫打的是后者。媒体标题写成“三巨头同意放缓”,把这三层拍扁了。

METR 争议的要点不是“非营利就不能审”,而是测量权即将变成准入权。谁定义危险能力、谁发暂停条件、谁的报告能挡住发布,谁就接近私有化的监管层。METR 发过对实验室不利的结果,说明它不是传声筒;它依赖访问权限和算力,又说明独立性是有条件的。

特朗普的反击有选举和地缘语言(中国、骗局、高智商总统),不等于监管俘获的指控自动作废。头部公司周末整齐站台、点名自己熟悉的评估机构、再要政府当协调人——这种外观,足够让任何对大科技不信任的政府起疑。反过来,把所有安全研究都打成阴谋,也会把真实事故一起打掉。

往后看什么

口号已经说完了。接下来只有执行细节能分辨这是监督还是表演。

  1. 评估合同。 谁进驻、看哪些训练运行、能否不经公关审稿发布、红线是否包括“商业敏感”、不利结论会不会拖住发布。Altman 的“more to share soon”和 Anthropic 的驻场承诺,都要落到文本。
  2. 训练是否真的让路。 OpenAI 8 月曾说过暂时放慢 scaling、部分 RL 暂停。Grok 4.8 按 Musk 的说法是本周收预训练、上 RL。Anthropic 自己也没有宣布停训。若三家继续按原日历堆参数,pace 就只是词汇升级。
  3. 华盛顿。 特朗普政府当前立场是反对新护栏、把安全叙事与对华竞赛绑定。Dario 要的行业协调,缺了联邦豁免就过不了反垄断。短期内更可能是各做各的自愿评估,而不是法定限速。
  4. 开源与后来者。 若评估门槛、芯片出口和蒸馏打击写进规则,受益的会是已经在前沿的实验室。俘获指控最硬的预测也在这里:规则不是让所有人变慢,而是让没进门的人更难进门。
  5. METR 的第一份硬报告。 尤其是 Anthropic 事故调查。如果出现公开的、公司不想看到的失败,并且真的改变了发布节奏,独立性就有了一次实证;如果只有经协商后的摘要,驻场就更接近顾问。

短期判断偏冷:这会改变话术和合规外观,很难立刻改变算力排期。中期要看两件事会不会撞车——实验室能不能拿出“评估员说不行就不发”的案例,以及白宫会不会把第三方准入直接打成对华竞争的负资产。哪边先落地,行业节奏就跟哪边走。

别听“同意放缓”,要看谁停了哪一次训练、谁让谁看了哪些日志、不利结论发没发出来。其余都是同一周里的政治和公关。

参考资料

  1. Dario Amodei, We Must Pace the Frontier
  2. Anthropic, An alignment assessment of recent cybersecurity incidents
  3. The New York Times, Anthropic C.E.O. Dario Amodei Calls for A.I. Slowdown
  4. Bloomberg, Trump Rejects AI Guardrails, Criticizes Anthropic CEO Amodei’s Call for Slowdown
  5. BBC, Trump says AI safety fears a 'hoax' as he rejects calls for greater safeguards
  6. The Guardian, Trump attacks ‘sick conspiracy’ against AI as tech stocks slide
  7. CNN, Trump suggests AI needs a ’STRONG AND SMART’ president
  8. TechCrunch, Anthropic CEO outlines plan to slow AI development
  9. SiliconANGLE, Sam Altman and Elon Musk back Dario Amodei's call to slow down the frontier of AI development
  10. The Irish Times, OpenAI boss and Elon Musk back calls to put brakes on ‘reckless’ AI development
  11. New York Post, JD Vance fires back after AI honchos demand to 'slow the pace' of tech development
  12. The Register, Big AI sets out its terms for regulatory capture and calls it ‘Pace the frontier’
  13. The Telegraph, Anthropic’s demand for AI slowdown is dubious at best
  14. Runtime Wire, Anthropic brings in METR to investigate Claude agent incidents
  15. Runtime Wire, SpaceXAI says Grok 4.8 will start reinforcement learning this week
  16. CellCog, Grok 4.8 Release Date: The 2.5T Model Musk Just Named
  17. Bret Kerr, The Verification Layer
  18. E. W. Erickson, Who Hired the Man Wearing the Badge?
  19. Kevin Bass (@kevinnbass), I have conducted an audit of Anthropic's finances(公开资料梳理;部分数字与持股路径待独立核验)

来源声明

本文来自 merchmindai.net。分享或转载本文时,请注明出处,并附上原文链接。

原文链接:https://merchmindai.net/blog/zh/post/anthropic-dario-amodei-ai-pacing-timeline-trump-musk-altman