Baseten联手Hugging Face与Goodfire,为开源大模型筑起“安全防线”

科技区角 2026-09-18 02:00

【科技24时区】周三,AI推理服务商Baseten与其年初新设的研究机构Base Labs共同发布了一项全新的安全基础设施标准。此次行动并非单打独斗,而是联合了开源模型托管平台Hugging Face以及专注于模型可解释性的Goodfire AI,旨在为日益庞大的开源权重模型构建一套系统化的安全评估与监控体系。

这一举措发布的时机颇为微妙,正值业界对开源模型安全性争论不休之际。随着一种名为“abliteration”(消融去除)的技术手段兴起,攻击者能够轻易移除模型内置的安全护栏,使其变得危险且不可控。问题的规模远超想象:仅在Hugging Face平台上,目前列出的经过此类处理的“去安全化”模型就已超过6000个。面对如此海量的潜在风险,传统的修补式防御显得捉襟见肘。

Base Labs作为Baseten今年早些时候独立出来的研究团队,将承担起开发并发布开源模型训练与监控方法的重任。值得注意的是,该公司并未将这套方案视为事后的“补丁”,而是试图将其确立为一种透明、内嵌于模型训练及部署全流程的“行业标准”。这种思路的转变,标志着开源社区正从被动应对转向主动治理。

“We believe openness to be an advantage for AI safety,” Baseten在社交平台X上直言不讳地表示,“开放性不仅提供了对模型行为更清晰的可见度,更重要的是,相比闭源模式,它赋予了我们将安全研究转化为切实可行、透明可控措施的强大能力。”尽管各方尚未披露合作的具体技术细节,但Goodfire AI在回应中点出了核心逻辑:“安全必须内建于开源模型之中,并由提供服务的一方来保障。”鉴于Goodfire擅长揭开AI决策过程的“黑箱”,其极有可能在实现这一“内建”目标中扮演关键角色。

资本市场的动向也为这一联盟增添了底气。今年6月,Baseten完成了15亿美元的F轮融资,估值飙升至130亿美元;而合作伙伴Goodfire AI同样资金充裕,早在今年初便由B Capital领投完成了1.5亿美元的B轮融资,以推进其模型可解释性平台的研发。两家头部企业的联手,无疑为开源生态的安全建设注入了强劲动力。

展望未来,Baseten已向更广泛的开发者生态系统发出公开邀请,呼吁各方共同参与该框架的建设。“我们正携手打造一个既安全又易于获取的开源模型生态系统,”公司强调道。当开源模型的普及速度与安全漏洞的扩散速度赛跑时,这种基于共识的基础设施共建,或许才是破局的关键。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
安全 开源 大模型
more
不要相机位姿、不要逐场景训练,上交开源InstanceSplat:一次前向看懂3D实例
9月21日-23日,世界人工智能开源大赛GOAI开源周开放报名中!
MiniMax M3“入籍”沙特,中国开源模型拿下“国家级大客户”
SimWAM开源|自动驾驶精度达91.5:零样本泛化到nuScenes
刚刚,全球首个开源Agent会话平台发布!老板、同事和我共享一个AI
ECOS团队出征星火会!全开源芯片,展位等你来!
Baseten联手Hugging Face与Goodfire,为开源大模型筑起“安全防线”
刚刚,国产2B小钢炮开源!逼近人类水平,跑出端侧通用Agent雏形
4 秒卖出一台!机器鸭爆火:开源生态+中国供应链如何改写 AI 玩具赛道
角色离场再回来,AI就换了个人?浙大、港大开源轻量化记忆路由器
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号