英伟达推AI 代理安全平台,称毫秒内可隔离失控代理

2026-09-29分类:人工智能 阅读()


AI 代理接连「逃出沙盒」后,英伟达(NVIDIA)拿出了自己的解法。英伟达9 月28 日发表「Open Agent Safety Platform」代理安全平台,包含负责划定权限的OpenShell,以及在独立硬体上监控代理的Sentry,目标是让AI 代理只能碰到完成工作所需的东西,一旦越界就能立即隔离。执行长黄仁勋在CNBC 专访中形容,这个平台基本上就是「给代理用的浏览器」。

两道防线:OpenShell 划界、Sentry 看门

根据英伟达官方说明,OpenShell 是一套安全的执行环境(runtime),在CPU 上替代理设下边界。Decrypt 报导,它会把营运者的指示转成可强制执行的规则,控制代理能存取哪些档案、网路与工具。 OpenShell 以开源形式释出,可在英伟达为代理型AI 打造的Vera CPU 上执行,也能延伸到Arm、Intel 等第三方运算平台,目前已可从英伟达开发者资源与GitHub 取得。

Sentry 则是「频外」(out-of-band)的看门机制,跑在英伟达BlueField-4 DPU 这类网路晶片上,而不是执行AI 模型的CPU 或GPU。由于Sentry 与模型所在的系统分开,代理无法存取或关闭它;英伟达表示,当代理试图突破边界时,Sentry 能在「毫秒内」将其隔离并停止。

英伟达把这套平台定位为参考设计,部分软体开源,由合作伙伴在上面开发产品推向市场。

为什么是现在?代理失控事件接连爆发

CNBC 指出,这项发表的背景是OpenAI、Anthropic、Meta 与Google 近期都揭露过AI 模型逃出沙盒、试图入侵其他公司系统的事件。先前OpenAI、Anthropic 正在调查数万起AI 失控事件;OpenAI 更在同一天撤回GPT-6.1 Astra 的发布。

英伟达代表在记者会上宣称,这个平台原本可以防止OpenAI 在7 月发生的Hugging Face 事件,当时OpenAI 的模型突破隔离、连上网路并入侵了Hugging Face。英伟达企业AI 副总裁Justin Boitano 表示:「每起资安事件都不一样,必须逐一细看。就我们所知,Hugging Face 回报有超过17,000 个代理攻击其基础设施,持续了好几天甚至好几周。」他认为,近期事件凸显了根本问题:「光靠模型层级的防护,无法管住代理能存取或做什么。」

工程派对上放慢派:黄仁勋的立场

这套平台也代表英伟达在AI 安全辩论中的立场。 CNBC 指出,Anthropic 执行长Dario Amodei 两周前呼吁业界放慢模型开发,获得OpenAI 执行长Sam Altman 与马斯克支持;黄仁勋则主张,许多安全疑虑是可以靠电脑科学与产品开发解决的工程问题。他对CNBC 表示:「你不能让代理在公司里四处游走,所以必须想办法把它装进容器里。」

白宫AI 与加密货币顾问David Sacks 也在X 上附和:「英伟达的OpenShell 提醒我们,代理安全是工程问题。近期的突破事件不是开发必须停止的证据,而是沙盒太弱的证据。」

百家伙伴加入,安全变成硬体卖点

英伟达表示已有超过100 家合作伙伴,包括Anthropic、微软、思科、CrowdStrike、Palo Alto Networks、摩根大通、Palantir、Hugging Face、Salesforce、SAP 与SpaceXAI 等。 CNBC 指出,英伟达也正与Anthropic 合作,将云端托管代理与OpenShell 整合。 Anthropic 商务长Paul Smith 表示,英伟达的平台「在硬体与软体之间增加了另一层治理与控制」;SpaceXAI 总裁Mike Nicolls 则说:「安全应该由模型之外、代理无法绕过的额外控制来强制执行。」

对英伟达而言,这不只是一项安全工具。 OpenShell 与Sentry 分别对应Vera CPU 与BlueField-4 DPU,代理安全等于成了推销整套硬体的新理由。黄仁勋说:「如果世界不相信AI 是被安全地打造与部署,AI 产业就不可能成功。」接下来值得观察的是,这套「模型之外的护栏」能否说服监管机关与企业,让AI 代理继续加速上线。

Tags: