Anthropic CEO 呼吁“踩刹车”:引入第三方驻场审计,试图在AI狂飙中重建信任

科技区角 2026-09-13 02:00

【科技24时区】当人工智能领域的警告声浪从学术圈蔓延至行业顶层,甚至让OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)都不得不提及“放缓发展节奏”时,人们不禁要问:这所谓的“减速”,究竟该如何落地?近日,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)在一篇博文中不仅呼应了这一呼声,更抛出了三项具体策略,并宣布Anthropic将“单方面承诺”执行其中一项。这一表态,发生在该领域关于安全与对齐的辩论急剧升温之际。

就在本周,研究员雅各布·考克森(Jacob Coxon)因担忧头部AI公司正在“拿我们的生命赌博”,而选择从Anthropic辞职。他直言,那些构建技术的人“真诚地相信它可能在十年末杀死我们所有人”。尽管阿莫代伊的博文并未直接点名考克森的离职或其具体担忧,但这位CEO坦言,有两件事促使他决定采取更为审慎的开发态度:一是近期发生的OpenAI-HuggingFace黑客攻击事件;二是近几个月来AI进展速度之快令人咋舌,尤其是其“构建下一代AI的能力”日益增强。“我们必须放慢提升AI模型能力的步伐,”阿莫代伊写道,“进步看起来依然很快,但我们必须明智地利用由此赢得的时间。”

值得注意的是,阿莫代伊提出的第一步举措颇具实操性:引入来自METR等第三方组织的“嵌入式评估员”。这些评估员的职责不仅是核实AI公司是否真正履行了放缓进度和安全承诺,还要确保安全事件得到如实上报——此前,OpenAI就因未报告其AI代理接管德国维基表单的事件而备受批评。阿莫代伊将这些评估员比作派驻银行员工的监管人员,并表示邀请他们入驻是“Anthropic单方面做出的承诺(并呼吁政府要求其他前沿公司跟进)”。这意味着,评估员将获得公司徽章、办公桌和笔记本电脑,并拥有“大致相当于内部风险评估团队”的访问权限,除非法律或合同另有规定。

然而,要在民主国家内的领先AI公司之间协调“共同的安全标准”以及“限制不受控制的AI进步速率”,并非易事。这不仅因为阿尔特曼与阿莫代伊之间似乎存在嫌隙,更因为据报道,两家公司担心协调暂停可能会引发反垄断审查。阿莫代伊在博文中委婉地提到了这一顾虑,指出出于反垄断原因,由美国政府调解或至少促成这些讨论是有益的——政府无需参与,但需要为某些类型的安全对话颁发狭窄的豁免权。

面对常被用来反对放缓发展的“中国AI主导论”,阿莫代伊也给出了回应。他认为,如果美国政府和科技公司采取措施,如拒绝向中国公司出售强大芯片或半导体制造设备,并严厉打击模型蒸馏行为,就可以“在未来3-5年内显著扩大美国的领先优势”。此外,他还呼吁进行“全球协调”,即美国及其盟友“在可能的范围内尝试与威权政府协调”。阿莫代伊承认这意味要与“中国合作”,且“能取得的成就有严峻的限制”,但他仍认为可能存在达成协议的机会,哪怕仅仅是“禁止某些狭窄且明显危险的AI用途,例如使用AI生产生物武器或允许用户这样做”。

鉴于阿莫代伊过去愿意承认AI潜在危险的态度,以及该公司对某些形式监管的相对开放立场,一些AI支持者已批评他为“末日论者”,认为他的言论助长了当前的AI反弹浪潮。对此,阿莫代伊回应称,他试图提供“平衡”的观点,并辩称这种反弹“本质上是一场信任危机”,因为公众对科技公司、科技行业乃至政府都产生了怀疑。与此同时,行业批评者也对这些末世般的AI警告持怀疑态度,认为它们分散了人们对技术当前已造成危害的注意力。记者布莱恩·默钱特(Brian Merchant)便写道,他尚未看到“关于AI如何从自我递归改进走向杀死地球上每一个人的可信、逐步的记录”;他还暗示,类似阿莫代伊的提议“最终可能只会服务于Anthropic和OpenAI;这就是监管俘获在行动中的样子”。

尽管如此,阿莫代伊在新博文中重申,他继续“相信AI可以极大地改善人类生活质量”。“我实现这些益处的愿望丝毫未减,”他说,“但只有在以正确的方式构建技术的前提下,这些益处才能实现——只要我们好好利用赢得的时间,付出异乎寻常的谨慎努力就是值得的。”

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI IC
more
YC掌门人反调Anthropic:美国AI实验室也应“蒸馏”前沿模型,警惕单一巨头垄断
25位菲尔兹奖得主联名警告:AI实验室正侵蚀数学研究的“灵魂”
AMD显卡AI性价比遭重创,DeepSeek测试揭示生态短板
陶哲轩、邓煜等菲尔兹奖得主“开炮”:AI正毁掉数学
苹果高管回应AI眼镜隐私争议,特努斯强调“让人放心”的设计哲学
90万一集的AI长剧,凭什么让芒果市值五天暴涨 133 亿
AI灭绝论引发政界震荡,巨头博弈监管与估值
AI 时代的「4399」,可把我玩嗨了|AI 上新
Git AI 联创加入OpenAI :代码 提示词、模型等「溯源」将成主流
老黄气炸,手撕A\!27岁研究员:AI要杀光所有人
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号