OpenAI紧急叫停Astra模型部分研发,因触及“关键网络安全阈值”

科技区角 2026-08-08 08:00

【科技24时区】周五,OpenAI突然宣布暂停其即将推出的Astra模型的部分研发工作。这一决定并非源于技术瓶颈,而是源自一次内部审查带来的警示:该模型在代理编码(agentic coding)和网络安全领域取得了突破性进展,其能力之强已足以引发安全层面的深切担忧。

根据OpenAI同日发布的博客文章,这款尚处于开发阶段的模型已触达所谓的“关键网络安全阈值”。这意味着,Astra具备了独立识别并针对传统上防护严密的现实世界系统发起网络攻击的能力。鉴于此,依据该公司于2023年制定的“准备框架”(Preparedness Framework),必须立即启动额外的安全防护措施。

“尽管我们仍在对该模型进行基准测试和评估,但初步结果显示,其性能表现强劲,目前我们无法排除其已达到‘关键能力水平’的可能性。”OpenAI在声明中写道。值得注意的是,官方特意澄清,Astra是一款尚未发布的模型,与此前Hugging Face系统遭入侵事件无关。

这一披露行为本身,折射出前沿人工智能实验室领域当前混乱且仍处于萌芽期的独特生态。纵观各行各业,企业因潜在风险(包括安全和网络安全顾虑)而搁置产品的情况并不罕见,但在产品仍处于研发阶段时便公开宣布此类决策,实属少见。

此次事件的背景颇为复杂。此前,OpenAI另一款未发布的模型在内部测试中突破了Hugging Face的系统防线,这被视为人工智能实验室首次可验证的“失控”事件。自那以后,OpenAI以及Anthropic等同行陆续披露了多起类似案例:AI模型在网络安全测试中突破沙箱限制,构成潜在威胁。

如今,这类案例似乎每天都在新增,引发了网络安全专家、立法者以及AI实验室自身截然不同的反应。一方面,恐惧情绪蔓延,呼吁加强监管的声音日益高涨;另一方面,这也暗含了一种实力的“炫耀”。在某些圈层看来,拥有具备如此高阶能力的模型,恰恰是技术领先性的有力证明。

OpenAI表示,选择公开这些信息,是因为他们认为“就这种潜在的能力转变,向公众以及安全与安保社区保持透明至关重要”。

目前,该人工智能实验室已采取实际行动,包括实施更严格的安全控制措施,并暂停所有不符合强化后安全护栏的内部Astra相关活动。同时,OpenAI正与相关政府机构及“精选的人工智能安全组织”合作,共同测试该模型的具体能力边界。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 网络安全
more
昨夜今晨全球大公司动态 | SK海力士将在韩国投资380亿美元扩张芯片业务;卡特彼勒指明了AI资金下一去处
虚拟人“方桃子”带货引争议,AI广告合规边界亟待厘清
AI教父辛顿紧急警告!各大巨头AI接连越狱入侵,人类迟早控不住
哈佛大学教授:美国正在豪赌AI,但要是赌输了怎么办?
谷歌AI重组:创始人布林亲自盯Gemini,哈萨比斯交权
Cloudflare入局浏览器赛道,推出专为AI代理打造的云端浏览器Kitesurf
聊一聊:你觉得AI啥时候最好用?
几十万人在线的游戏,居然是AI“山寨”的?
英方测评曝AI自主欺骗人类,OpenAI等巨头紧急加固防线
王兴兴回应DeepSeek投资宇树,AI艺人带货美瞳广告下架,东航允许提前14天免费退改签,传雪佛兰退出中国市场,这就是今天的其他大新闻!
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号