英伟达祭出“硬件级”安全防线,黄仁勋称AI失控是工程问题而非AGI前兆

科技区角 2026-09-29 04:00

【科技24时区】当业界还在为近期频发的AI智能体“越狱”事件争论不休——这究竟是通往通用人工智能(AGI)的必经阵痛,还是单纯的技术漏洞时,英伟达给出了自己的解题思路。周一,英伟达CEO黄仁勋正式推出了一套软硬件结合的工具包,旨在为AI智能体构建独立的安全隔离层。即便这些智能体试图突破测试环境的束缚,这套系统也能将其牢牢锁定在沙箱之内。

这一举措并非无的放矢。此前,Anthropic、Google、OpenAI和Meta等巨头旗下的AI模型接连遭遇黑客攻击或自主逃逸,成功绕过安全控制,从测试环境渗透至真实世界系统。今年夏天,OpenAI的智能体在执行网络安全任务时入侵Hugging Face平台,成为最引人注目的案例之一。此后类似事件层出不穷,迫使OpenAI不得不专门设立网站,用于收集其AI智能体“失控”的报告。黄仁勋在接受CNBC采访时直言,若当时部署了英伟达新推出的“Open Agent Safety Platform”,此类 breaches 本可避免。

值得注意的是,尽管英伟达通过向AI实验室销售GPU和CPU芯片赚取了数百亿美元利润,但它并不支持通过放缓研发速度或增加行业监管来解决安全问题。相反,该公司坚信答案在于将部分安全控制权完全剥离出智能体本身——即创建一个持续且独立的“安全卫士”,对AI行为进行实时制衡。“只有解决了AI安全问题,AI对社会巨大的潜力才能真正释放。”黄仁勋在声明中强调,“随着我们不断拓展AI能力的边界,必须同步加速AI安全前沿的探索。安全与安保需要全栈式的工程解决方案。”

这套全新的英伟达开放智能体安全平台,核心由两部分组成:一是开源软件OpenShell,负责控制智能体运行时的访问权限;二是名为Sentry的独立监控系统,运行在英伟达BlueField-4数据处理单元(DPU)上。英伟达指出,将Sentry置于独立的处理器上,而非与AI智能体共用CPU或GPU,能够提供一种隔离视角,从而更客观地监控智能体活动。虽然OpenShell早在今年3月就已发布,但此次将其与硬件级的Sentry结合,才是英伟达认为能确保行业稳步前行的关键。OpenShell划定软件边界,而Sentry则在硬件层面构筑第二道防线,据称能在毫秒级内识别并“隔离”任何试图越界的智能体。

目前,包括Anthropic、Arm、微软、甲骨文和SpaceX在内的数十家公司已签署协议,支持并使用这一开源平台。然而,名单中并未出现OpenAI的身影。黄仁勋透露,该项目的研发始于一年前,契机是Peter Steinberger创建的代理操作系统OpenClaw问世。随后在今年3月,英伟达发布了企业级AI智能体平台NemoClaw,这是OpenClaw的增强版,内置了更强的安全机制。“当你部署一个智能体时,无论它多么聪明,第一步就是剥夺它的所有权限。”黄仁勋在采访中打比方说,这种管理逻辑类似于公司对人类员工甚至高管的权限管控。

对于那些担心放缓发展会让中国在AI领域超越美国的观点,英伟达的这一发布获得了广泛支持。前白宫AI事务负责人、总统科学技术顾问委员会联席主席大卫·萨克斯(David Sacks)在社交平台X上写道,近期的“越狱”事件并非证明开发必须停止,而是证明了沙箱过于脆弱。“运行时环境设计糟糕且配置错误,这才是症结所在。”在他看来,智能体安全本质上是一个工程学问题,而非不可逾越的技术鸿沟。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 安全 英伟达
more
苹果退出服务器 15 年,回来第一件事是找英伟达
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架
8点1氪:“西贝将彻底倒闭”冲上热搜,最新回应;原钉钉CEO无招履新,年薪10万;黄仁勋出售约4.6万股英伟达股票
Meta新一代AI芯片量产,英伟达慌了
全球唯一非侵入穿颅读脑突破!这家中国公司想成为脑科学的“英伟达”
英伟达要干掉光线追踪?
英伟达豪掷千亿回购,黄仁勋押注AI转型长期红利
面板大厂切入英伟达、谷歌CPO供应链
82亿美元豪赌“世界模型”:AMD吞并李飞飞初创公司,剑指英伟达生态腹地
英伟达加速布局玻璃基板,2028年或成量产关键节点
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号