【科技纵览】在人工智能领域,“唯快不破”曾是行业共识,但OpenAI近期却罕见地按下了暂停键。这一举动并非出于技术停滞,而是源于对下一代大模型Astra潜在网络攻击能力的深度担忧。据OpenAI官方博客披露,经过内部多轮严苛评估,团队发现Astra在代码生成、漏洞挖掘及自动化攻击规划等方面的能力已突破常规界限,甚至可能具备关键性的网络破坏力。官方直言:“我们无法排除Astra具有关键网络攻击能力的风险。”这种将多种高危技能集于一身的特性,使得该模型更像是一个被点满黑客属性的“数值怪”,迫使公司不得不重新审视其发布节奏。
为应对这一挑战,OpenAI决定全面强化安全测试体系,并主动放缓Astra的研发进程。在新的防护机制部署到位前,研发速度将受到严格限制。首席执行官山姆·奥特曼对此解释称,Astra无疑是一款强大的模型,公司的终极目标仍是让公众广泛使用它,而非将其长期禁锢在少数人手中。然而,鉴于其展现出的惊人网络能力,解决安全问题需要“更多时间”。这一决策严格遵循了OpenAI于2023年发布的“防范框架”(Preparedness Framework),可谓是自己制定的规则,含着泪也要执行到底。
值得注意的是,这种谨慎态度在行业内显得尤为突兀。在近日举行的Black Hat网络安全大会上,OpenAI技术人员Michael Dalton公开承认,公司正“有意识地放缓研究以增强安全性”。为此,Astra被置于完全隔离的测试环境中,并接受针对所有代理应用的全局无死角监控。更令人玩味的是,据美国白宫官员透露,OpenAI是“自愿”向政府通报推迟发布计划的。这在充斥着AI错失恐惧症(FOMO)、各大厂商疯狂追求规模扩张的背景下,堪称一次罕见的自我克制。毕竟,此前鲜有前沿实验室因担忧模型的赛博破坏力而主动承诺减速。
相比之下,竞争对手Anthropic的操作则显得有些反复横跳。该公司曾誓言若AI能力超越人类控制便暂停训练,却在今年2月更新政策时悄然撤回了这一条款,理由是单方面暂停可能导致其他厂商无序竞争,反而加剧不安全因素。尽管嘴上说着“被迫内卷”,Anthropic仍在6月发布了具备强大网络攻击潜力的Mythos 5的安全阉割版——Fable 5,并在博客中警告AI正展现自我进化能力,呼吁全球暂停开发。这种既当选手又当裁判的姿态,与OpenAI此次的务实避险形成了鲜明对比。
当前,美国政府正紧锣密鼓地构建AI模型发布前的评估框架,头部企业虽已参与闭门吹风会,但对审查流程时长、政企对接机制及责任归属等核心问题仍存疑虑。框架中关于“国家级风险”和“最先进模型”的定义模糊,令业界感到困惑。此外,OpenAI特意强调Astra与此前Hugging Face漏洞事件无关,这一看似多余的澄清,反而引发了外界对其内部数据流动及安全边界的更多联想。从某种角度看,这标志着AI发展已从单纯的性能竞赛,转向了对安全边界与伦理责任的深层博弈。
OpenAI主动“刹车”Astra模型,网络安全风险成研发新瓶颈
科技区角
2026-08-08 10:32
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。