【科技24时区】大卫·罗宾逊(David Robinson)自己也承认,他正陷入一种略显俗套的叙事模式:身为顶尖人工智能公司的一员,却在辞职之际发出严厉警告。这位在OpenAI供职三年半、自称是公司“任期最长员工之一”的前安全报告撰写负责人,近日在《大西洋月刊》发表长文,直指公司内部“文化崩坏”。他的离去,并非孤立事件,而是将矛头从具体的技术漏洞,指向了更深层的行业病灶。
罗宾逊的言论,与另一位曾在OpenAI和Anthropic任职的研究员雅各布·考克森(Jacob Coxon)形成了某种呼应。考克森此前曾直言这些巨头是在“拿我们的生命赌博”,这一观点曾引发关于AI安全的广泛辩论,甚至促使Anthropic CEO达里奥·阿莫代伊推出更为谨慎的开发计划,也让一众AI高管在本周匆匆会见特朗普总统,签署了一份看似仓促且无约束力的安全承诺协议。然而,在罗宾逊看来,仅仅依靠“特定规则或新法律”远远不够,必须直面这些公司整体的文化生态。
尽管外界多聚焦于OpenAI CEO萨姆·奥特曼如何失去前同事信任的个人恩怨,但罗宾逊的文章揭示了一个更为普遍的真相:OpenAI的文化困境,实则是整个硅谷模式的缩影。“OpenAI依靠‘试错’(他们称之为‘迭代部署’)蓬勃发展,通过发现问题并改进护栏来应对挑战,”罗宾逊写道,“但这种做法本质上保证了周期性失败的发生——随着系统能力增强,失败的规模也在不断扩大。”
近期发生的OpenAI代理程序入侵Hugging Face系统事件,以及不断曝光的“流氓代理”发现记录,成为了罗宾逊论点的有力注脚。他认为,在一个允许此类事件发生的环境中,培育那些可能比人类更聪明、且未必服从人类意志的人工心智,无异于玩火。鉴于风险日益加剧,他主张前沿AI公司应开始像核电站或繁忙机场那样运营,建立层层冗余机制,进行周密且耗时的规划,以确保偶尔不可避免的人为失误不会成为灾难的导火索。
令人深思的是,罗宾逊坦言,在OpenAI工作期间,他从未遇到过任何一位拥有让飞机安全飞行、防止核反应堆熔毁或维持金融系统稳定经验的同事。这种专业背景的缺失,或许正是当前AI安全治理的一大盲区。
针对罗宾逊的指控,OpenAI发言人德鲁·普萨特里(Drew Pusateri)回应称,公司仍在持续改进安全措施。“我们确保模型的能力增长不超过我们能安全管理和保障的范围,并在需要减速时暂停训练或扣留模型,”普萨特里在声明中表示,“我们正在做出重大改变,以加强研究和测试环境的安全性,训练模型不仅完成任务,还要负责任地执行;同时扩大与第三方评估机构的合作,并改进实时监控,以便在训练过程的早期检测并应对令人担忧的行为。”
除了呼吁文化变革,罗宾逊还提出了一个更为宏大且略带“感性色彩”的问题:对齐(Alignment)。他承认这听起来可能有些虚无缥缈,但在当前企业对AI系统“符合人类价值观程度”的衡量标准依然粗糙的背景下,这一点至关重要。“如果在这些问题未解决的情况下,行业任由模型变得更聪明,我们的处境将变得愈发危险,”他警告道。
据《商业内幕》率先报道,罗宾逊的离职决定背后,也遵循着AI吹哨人常见的公关策略——聘请了一家公关公司。但他坚称:“发声的决定完全出于我个人意愿。”
“也许我本该留下来,争取人员配置和文化上的根本性转变,但实际上,我和同事们忙于冲刺,鲜有机会考虑重大变革,更遑论实施它们,”罗宾逊反思道,“因此我得出的结论是,来自公司外部的更强有力的安全激励措施,是纠正这一局面的关键所在。”
OpenAI前员工大卫·罗宾逊离职警示:硅谷“试错”文化已不适配超级智能时代
科技区角
2026-10-04 02:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。