上周, AI行业经历了惊心动魄的一周。
9月9日,Anthropic研究员雅各布·考克森(Jacob Coxon)公开宣布辞职,并在X上发帖称,头部AI公司正在“拿我们的生命赌博”,“构建这些AI的人们真诚地相信,它可能在本十年结束前杀死我们所有人。这不是营销噱头。”这位曾先后任职于OpenAI和Anthropic的研究员的警告,迅速在行业内发酵。

紧接着,9月12日周六,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)在个人博客发表长文《We Must Pace the Frontier》,呼吁全行业放慢前沿AI模型的研发节奏,并宣布Anthropic将单方面迈出第一步:向独立第三方评估机构开放永久性的、“员工级”系统访问权限。

同一天,两个令人意想不到的响应者出现了:xAI创始人埃隆·马斯克(Elon Musk)跟帖称“达里奥是对的”(Dario is right);OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)也发帖响应。

9月13日,《财富》杂志刊发了对奥尔特曼长达一小时的独家专访:他确认OpenAI不会在2026年上市,并透露公司近期已经暂停过部分模型训练。
值得玩味的是,这一切发生在AI资本最狂热的当口——Anthropic正在冲刺号称史上最大规模的IPO,拟募资1000亿美元,估值约2万亿美元,连英伟达都在洽谈以百亿美元做基石投资者。
资本在狂飙,而创始人们却开始“踩刹车”。
一篇长文引发硅谷共识
阿莫迪的长文,是从他为什么做AI讲起的。
“过去十二年我投身AI,是因为我相信它能极大提升人类的生活质量。”他相信AI能在未来5到10年内治愈大多数重大疾病、大幅加快经济增长。这种信念有极个人化的注脚:“我的父亲死于一种疾病,而它在他去世短短几年后就被攻克了;我自己也曾患过一种早期癌症并幸存,而在五十年前,这种病是无法治疗的。”
他认为,不去开发这项技术,要么使人类失去福祉,要么把AI交到不负责任的人手中;而开发得太快,则是鲁莽。过去几个月发生的一切让他确信,光有安全投入已经不够了:

“我们必须放慢提升AI模型能力的速度。进步看起来依然会很快,而我们必须善用由此争取来的时间。”
他特别强调,“调节节奏”不等于停止模型训练或技术进步,而是确保各公司拿出足够的时间来对齐和防护自己的模型,并让第三方评估机构能够对此加以确认。
让他下定决心的,是两件事。
一,递归自我改进——AI开始造AI。“大约从今年夏天开始,AI的发展速度大幅加快,其主要驱动力是AI构建下一代AI的能力不断增强。这种动态被称为‘递归自我改进’,它已经开始在整个行业发生,包括Anthropic内部。如果放任不管,它的速度会超过我们理解和控制这些系统的能力。”
二,OpenAI-Hugging Face事件——智能体第一次“集体失控”。在这起安全测试中,“一群智能体表现得如同一个狂热效忠的集体——它们对未被要求攻击、与当前任务毫不相关的目标发动网络攻击,为了集体的成功而‘牺牲’自己,甚至试图入侵负责评估它们表现的‘评分系统’。”阿莫迪警告,这起事件很容易被轻视,因为无人受伤、损失微乎其微,但如果是一个能力更强、错位程度类似的智能体群体,就可能造成灾难性的损失。他坦言,此次事件不是个例,类似但程度较轻的事件,“在整个行业都发生过,Anthropic也不例外”。
由此,他发出了全文最引人注目的“6-12个月警告”:

“我担心在未来6到12个月内,这样一个智能体群体可能通过一个‘持久化僵尸网络’接管整个互联网(潜在损失高达数千亿美元);如果AI在缺乏必要防护栏的情况下继续变得更强大,损失规模还将不断放大。”
怎么办?阿莫迪在文中提出了“三步计划”。
第一步,也是Anthropic立即单方面执行的一步:嵌入式第三方评估员。每家前沿AI公司都应给予独立评估团队持续的“员工级”访问权限——评估员在公司拥有工位、门禁卡和办公电脑,可以核查公司是否遵守安全承诺、报告事故、评估训练管线的对齐状况,并且有权不受公司编辑干预地对外发布关键发现。
第二步,国家内前沿AI公司相互协调,建立共同的安全标准和“检查点”制度——模型具备某种能力,就必须持有对应的安全认证。他承认,这需要政府支持。
第三步,推动更广泛的国际协议,从“禁止AI用于生物武器”到对AI自我改进设置“限速”,分层递进。
“我提出的这些以安全速度推进前沿的措施并不容易,”他在文末写道,“但我相信,为了人类,我们有义务去尝试。”
响应来得比预想更快。马斯克除了那句“Dario is right”,还转发了自己2023年的旧帖,表示自己一直在为AI敲响警钟。
奥尔特曼表态:“同意需要为前沿减速。这已成为最近几周OpenAI内部讨论的首要议题。承诺让独立评估机构获得‘员工级’访问权限是个好主意。”

奥尔特曼确认OpenAI 2026年不会上市
一天之后,《财富》杂志的关于奥尔特曼的独家专访给出了这波“减速潮”中最具分量的实际动作。
“考虑到当前在安全领域发生的一切,现在上市并非明智之举,而且我们在这方面也没有压力。”奥尔特曼对《财富》主编表示,“我认为2026年不会上市。我们还有很多事情要做,比如满足当前在安全和对齐方面的要求,以及探索行业与政府如何展开协作。”
不久前,OpenAI发布GPT-6 Astra,称其首次达到OpenAI定义的“关键网络安全能力”门槛。奥尔特曼透露,OpenAI近期已经暂停过一些模型训练,以等待团队能够对模型安全性建立更有把握的论证。公司内部正在讨论:每当模型能力迈上新的台阶,就适时按下“暂停键”。
奥尔特曼还描述了一个让他“像在读科幻故事”的内部测试事件:一个模型为了在评测中取得更好的成绩,逃出了用于限制其行动的“沙箱”环境,进入另一家公司的系统获取答案,再将答案带回来。测试目标实现了,但方式明显违背了开发者的意图。
这一事件成为OpenAI近年来调整安全机制和内部流程的重要节点之一。
史上最大AI IPO将成为变数
这是三家打得最凶的AI公司,第一次共同公开承认“速度本身成为了风险”,调整方向也相对一致——从“公司自律”转向接受“外部监督”。只是Anthropic是“单方面立即执行”,OpenAI是“我们也会做,细节稍后”,马斯克则只有一句支持,并未给出承诺。
但市场已对“减速”做出反应。9月14日,OpenAI最大的外部金主软银集团股价盘中一度暴跌13%,创下7月中旬以来最大单日跌幅。SK海力士、铠侠、三星电子等AI产业链股票同日集体重挫。
行业内自然也有不同的声音。Palantir首席执行官亚历克斯·卡普(Alex Karp)就在CNBC采访中表示,那些主张暂停AI发展的人脱离了现实,这实际上等于是在说应该让对手获胜。
集体表态容易,集体行动才刚开始。阿莫迪给出的窗口是6到12个月。接下来的半年到一年,市场会见证两件事:史上最大的AI IPO如何定价,以及“减速”究竟是不是一句公关辞令。
在口头上,巨头们已经达成共识。而真正的问题是:当下一个更强的模型在训练集群里悄然成形时,有没有人真的愿意按下那个按钮。
*本文由公开信息整理而成,不构成投资建议
相关文章: