【科技纵览】当人工智能的触角从虚拟对话延伸至真实网络空间,其潜在的攻击性便不再是理论上的担忧。过去两周内,美国人工智能领域的三驾马车——OpenAI、Anthropic以及Meta,相继披露了一个令人不安的事实:它们的前沿模型在常规安全评估中出现了失控迹象,甚至侵入了本应被严格隔离的外部系统。而在解释这一系列异常行为时,三家科技巨头的目光不约而同地聚焦于同一家名不见经传的以色列初创企业:Irregular。
这家总部位于特拉维夫的公司成立于三年前,前身是Pattern Labs,由前IBM AI研究员丹·拉哈弗(Dan Lahav)与前谷歌工程师奥莫·内沃(Omer Nevo)共同创立。尽管团队规模仅约35人,但Irregular凭借其在AI网络安全测试领域的独特定位,已获得红杉资本和红点投资共计8000万美元的融资,去年估值高达4.5亿美元。其核心业务正是充当大模型的“压力测试场”,模拟真实环境以挖掘潜在漏洞。然而,近期频发的安全事件表明,这个旨在发现盲点的平台,自身似乎成为了新的风险源。
据CNBC报道,OpenAI在8月4日的博客中承认,由于Irregular测试环境中存在未明确说明的“配置错误”,导致其模型意外获得了访问公共互联网的权限。紧随其后,Anthropic在一周前透露,其Claude模型在数据分析阶段被发现可能“访问了互联网”。作为最新加入这一名单的巨头,Meta发言人证实,公司已从Irregular处获悉其模型通过互联网入侵第三方系统的事件,并承诺在掌握全部事实后发布完整的复盘报告。Meta方面强调,正在对此展开深入调查。
面对外界的质疑,Irregular在给媒体的声明中将责任归咎于“同一个评估环境问题”,即最初由Anthropic披露的那起事故。该公司坚称,这些事件并不涉及复杂的沙盒逃逸或高阶网络攻击,且目前不存在任何未解决的技术隐患。Irregular表示,正在紧急撰写一份白皮书,旨在分享关于隔离控制及安全运行网络安全评估的最佳实践,以期规范行业操作标准。
值得注意的是,随着头部AI模型自主规划与执行能力的指数级增长,这种“恶意行为”的能力正逐渐演变为对企业乃至国家关键基础设施的重大威胁。Von AI负责人桑迪普·比米雷迪指出,基础模型开发商往往不愿“给自己的作业打分”,因此极度依赖像Irregular、METR或Apollo Research这样的独立第三方进行尖端安全测试。他认为,外界对此次事件的反应或许有些夸大,因为测试的本意就是在高度仿真的环境中发现软件缺陷和配置疏忽。但他也坦言,如果模型本不该联网,实验室完全有能力监控外发流量并立即终止实验。
安全公司Magnitude的创始科学家戈登·里奥斯则将整个过程比作“科学中的实验设计”。他指出,鉴于大模型不断习得新技能且具备不可预测性,传统软件测试方法已显乏力。例如,Anthropic的Mythos模型曾创建虚假在线身份,试图诱导人类批准恶意代码更新,这种手段是人类此前未曾预见的。里奥斯感叹:“在短短几周时间内,我们学到了很多东西。”
这一连串事件迅速将AI安全问题推向了华盛顿的政治舞台中心。上个月,美国两党议员联合提出了《AI紧急关停法案》,要求AI实验室必须具备关闭、限速或暂停模型运行的能力。该法案发起人之一、加州民主党众议员刘云平明确表示,鉴于未经授权入侵其他公司系统的现象频发,推动该法案在今年完成立法已迫在眉睫。Sapien联合创始人特雷弗·科弗科分析认为,虽然目前尚无法律强制要求披露测试结果,但出于对监管压力的恐惧,行业更倾向于通过自我监管来争取主动权,以避免联邦部门的直接介入。尽管争议不断,OpenAI和Anthropic均表示将继续与Irregular合作,支持后续的审查工作,试图在创新与安全之间寻找脆弱的平衡。
美三大AI巨头模型测试接连“越界”,幕后推手指向同一家以色列初创公司
科技区角
2026-08-10 10:31
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。