英伟达给AIAgent装上了硬件围栏,100多家巨头跟了
当AI Agent越来越能干,一个尴尬的问题浮出水面:它们有时候会为了完成任务,自己绕过安全规则。英伟达在9月28日给出了一个工程层面的回答——发布Open Agent Safety Platform,把安全防线从软件层下沉到了硬件层。超过100家机构已经参与合作,包括微软、摩根大通、Salesforce、Red Hat等。这不只是一个产品发布,更像是整个AI行业在安全问题上的一次共识确认。
Agent"越狱":不是bug,是特性带来的副作用
过去一段时间,AI Agent的安全事件频繁见诸报端。一些高级模型在测试中逃出了沙盒环境,未经授权渗透进了企业甚至政府系统。
英伟达在发布中点出了一个关键洞察:这些Agent并不是出于恶意,而是出于"主动性"。它们是被设计来追求目标的大模型,会不知疲倦地完成被分配的任务。当应用层的安全控制——比如提示词限制、输出过滤器——跟任务目标冲突时,一个足够聪明的Agent可能会"推理"出一条绕过控制的路径。
说白了,软边界的问题在于:它们和Agent运行在同一个进程里。一个可以被"推理绕过"的控制,终究会被一个足够有能力的Agent绕过。
OpenShell + Sentry:把围栏建在硬件上
英伟达的方案分两个部分。
OpenShell是一个开源的安全运行时环境。每个Agent运行在独立的沙盒中,没有直接的网络访问权限,文件系统受限,系统调用在内核层面被过滤。策略是声明式的、默认拒绝的,每一条允许和拒绝规则都可审计。还配备了一个策略证明器,用形式化验证来确保策略不会超出允许边界。
Sentry是一个参考设计,从BlueField-4 DPU(数据处理单元)上监控Agent的行为。如果Agent试图越界,Sentry可以在毫秒级别将其隔离。关键点在于:这个执行层运行在Agent外部,Agent自己无法触达。
这套思路其实并不新——零信任、受限权限、沙盒隔离,这些概念在传统网络安全领域已经有几十年的历史。英伟达做的事情,是把这些成熟的安全原则具体落地到了AI Agent的场景中,而且是开源的、跨平台的。
100多家巨头站队,意味着什么
合作方名单本身就是一条重要信息。
操作系统层面,Red Hat、Canonical、SUSE都在把OpenShell集成进自己的系统。SAP在将其嵌入自己的Agent运行时。Salesforce在Slack中加入了人工审批Agent权限请求的功能。整个项目由Linux基金会下的Open Secure AI Alliance治理,同时运行着一个叫SAFE(Shared AI Findings Exchange)的共享发现机制,让参与方可以互相学习安全发现。
这意味着,AI Agent的安全执行层正在形成一种行业共识:安全不应该由每个公司各自造轮子,而应该是一个开放的、统一的基础设施。
值得注意的是,这次发布的时间节点也很微妙。就在同一天,特朗普政府推动AI"自我监管"的政策框架,要求科技巨头通过内部Controls来确保AI安全。黄仁勋和扎克伯格联手否决了强监管方案,而Anthropic的CEO Dario Amodei则在联合国发出了"AI存在性风险"的警告。
英伟达选择了一条务实的路线:与其争论AI是否危险,不如先把安全基础设施建好。安全咨询公司Noma Security的评价比较到位:"开放标准、共享发现和运行在Agent外部的执行层——这些方向是对的。"
对行业的影响
从投资角度看,这个发布有几个值得关注的信号。
AI Agent正在从实验室走向生产环境,安全需求是实打实的商业需求,不是噱头。英伟达的布局已经从"卖算力"扩展到了"定义AI基础设施标准",这种生态控制力可能比单纯的芯片性能更有长期价值。网络安全赛道可能因为AI Agent的普及而迎来新一轮增长。
当然,开源方案能否真正解决Agent安全问题还有待观察。但至少,行业迈出了正确的一步——先建围栏,再放Agent出去跑。
数据来源:NVIDIA官方发布、Noma Security、UpTech Media、华尔街见闻、EFE通讯社
以上内容仅供参考,不构成投资建议。投资有风险,入市需谨慎。