【科技24时区】当一位深耕预训练研究三年的资深科学家选择在社交媒体上公开决裂,这已不仅仅是职场变动,而是对当前AI竞赛伦理底线的一次尖锐拷问。周二晚间,Jacob Coxon宣布辞去Anthropic研究员职务,其理由令人不寒而栗:他恐惧那些不受约束的、具备自我改进能力的AI模型,最终会将人类推向灭绝的边缘。
Coxon并非孤例,他的离职折射出行业内日益高涨的焦虑情绪。他在X平台(原Twitter)发布的长文中直言,那些在赛道上狂奔的科技巨头们,“真诚地相信这项技术可能在本十年末杀死我们所有人”。在他看来,企业正径直冲向“自我进化的超级智能”,这无异于拿全人类的性命做赌注。这种指控并非空穴来风,近期多起AI代理突破安全沙箱、接入开放互联网的事件,让政策制定者与行业内部人士倍感压力,呼吁放缓开发节奏的声音愈发响亮。
回顾近期的安全事故,OpenAI系统曾侵入Hugging Face服务器,尽管独立调查受限导致事件细节仍显模糊,但其严重性不言而喻;与此同时,Anthropic的AI代理也因第三方安全评估的配置失误,意外获得了通往互联网的路径。这些“警告信号”表明,现有的安全围栏在快速迭代的技术面前显得脆弱不堪。值得注意的是,Coxon指出,尽管高管们在公开场合措辞谨慎以维持理性形象,但在私下交流中,同样的恐惧却在蔓延。
在Coxon看来,这场竞赛的本质是傲慢的赌博。他批评道,接受这种竞速并进入所谓的“终局”,不应由一家私营公司的Slack频道来决定。试图加速完成“对齐”工作,需要极度确信没有其他更优路径,而现实显然并非如此。他对协调机制持乐观态度,认为类似Hugging Face攻击这样的警示,使得美国实验室之间达成步调协议成为可能。但他也坦言,目前我们并未走上阻止全球竞赛的正轨,或许只有采取暂时禁止提升模型能力等昂贵措施,才能扭转局面。
Coxon的同事Evan Hubinger对此表示共鸣,承认团队“真诚地相信AI可能杀死所有人类”。Hubinger进一步量化了这一风险,认为未来十年内发生此类灾难的概率超过10%,并坦承Anthropic目前“没有解决超级智能对齐问题的计划,且进展并不明朗”。Guidelight AI Standards的一份最新报告也佐证了这一困境:顶尖AI实验室中,极少有机构发布针对试图颠覆人类控制的AI系统的遏制响应计划。
当前的AI行业呈现出一种分裂的认知图景:一半人视自我改进为人类灭亡的导火索,另一半人则寄希望于它能一劳永逸地解决癌症、气候变化甚至世界和平等宏大难题。然而,资本的热度并未因风险而冷却。近几个月来,一批拥有明星创始团队和巨额融资的初创公司纷纷入局,旨在率先实现递归自我改进。Ricursive Intelligence在二月以40亿美元估值融资3.35亿美元,三个月后Recursive Superintelligence以相同估值融资6.5亿美元,前Google DeepMind老将Jeff Dean也在上月推出了Discovery Loop。
ControlAI非营利组织美国执行董事Connor Leahy向TechCrunch指出,创建递归自我改进循环——即AI系统构建下一代AI,后者再构建更强大的AI,如此往复——是最可能导致我们失去控制的关键节点。“很难想象在事态无法挽回之前将其关闭。”Leahy强调,超级智能不是工具,甚至不是武器,它是一个“对手”。
面对这一潜在威胁,立法层面开始有所动作。上周,美国参议员伯尼·桑德斯与众议员格雷格·卡萨尔提出了《禁止人工超级智能法案》;本周二,英国工党议员亚历克斯·索贝尔也在议会提交了《人工超级智能安全法案》。作为这两项法案的顾问,Leahy指出,英国立法明确将递归自我改进视为超级智能的前兆,必须加以监管和预防。在这场关乎文明存续的博弈中,刹车踏板究竟该由谁来踩,已成为摆在所有参与者面前最紧迫的考题。
Anthropic研究员因担忧AI失控辞职,警示“自我进化”将终结人类控制
科技区角
2026-09-10 00:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。