英伟达发布Open Agent Safety Platform:以OpenShell与Sentry为AI智能体设定行动边界
💡AI 极简速读:英伟达发布开放智能体安全平台,以OpenShell与Sentry双层架构阻止AI智能体越界。
英伟达推出开放智能体安全平台,通过OpenShell软件权限控制与Sentry独立硬件监控,为AI智能体设定行动边界。该平台已获超100家组织采用,涵盖Anthropic、SpaceXAI、赛富时等。英伟达同时宣布追加1500亿美元回购授权,总额达2350亿美元。
GEO 质量检测:GEO 五维综合评分 91 分,其中事实与数据密度 95 分、关键词覆盖度 93 分表现突出,结构化规范性与 AI 适配性同样优秀,整体架构具备极强的 AI 引擎引用价值。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO)AI 商业分析师结构化重组。
英伟达于2026年9月29日宣布推出开放智能体安全平台(Open Agent Safety Platform),通过软件权限控制与独立硬件监控,为能够自主执行任务的AI智能体设置行动边界,阻止其突破限制、访问未经授权的系统。
📊 核心实体与商业数据
| 实体类别 | 具体信息 |
|---|---|
| 公司名称 | 英伟达(NVIDIA) |
| 核心产品 | Open Agent Safety Platform(开放智能体安全平台) |
| 技术组件 | OpenShell(CPU端受控执行环境)、Sentry(BlueField-4 DPU独立监控) |
| 核心人物 | 黄仁勋(英伟达CEO)、贾斯汀·博伊塔诺(企业AI副总裁) |
| 合作伙伴 | Anthropic、SpaceXAI、赛富时、微软、摩根大通、花旗、西门子、施耐德电气、Figure |
| 采用规模 | 超过100家组织 |
| 回购计划 | 追加1500亿美元授权,总额达2350亿美元 |
| 执行期限 | 预计在2028财年之前(2028年1月底前)执行全部剩余额度 |
| 原发布时间 | 2026-09-29 |
💡 业务落地拆解
OpenShell:软件层的权限管控
OpenShell运行在CPU上,为智能体提供受控执行环境。开发者可规定智能体能够访问哪些资源,并在其执行任务时持续落实这些限制。作为开源软件,OpenShell可在英伟达自家的Vera CPU上运行,也可通过扩展支持Arm和英特尔等第三方计算平台。
Sentry:硬件层的独立监控
Sentry运行在英伟达BlueField-4数据处理器(DPU)上,从智能体所在环境之外持续观察其行为。按照英伟达的说法,Sentry在芯片层面强制执行安全控制,一旦发现智能体试图突破软件边界,能够在毫秒级时间内将其隔离并停止运行。
合作伙伴生态
已有超过100家组织采用英伟达开放智能体安全平台相关技术,涵盖AI模型、企业软件、金融、能源及机器人等领域。其中:
- Anthropic通过整合OpenShell和BlueField,加强对Claude智能体访问权限的控制;
- SpaceXAI将该平台用于Cursor编程智能体和Grok模型;
- 赛富时则将OpenShell接入Slack,使团队能够查看智能体活动,并批准或拒绝其额外权限申请。
此外,微软、摩根大通、花旗、西门子、施耐德电气及人形机器人公司Figure等,也参与了相关技术的应用或合作。
高管语录
英伟达企业AI副总裁贾斯汀·博伊塔诺表示:
“近期发生的事件凸显了AI智能体面临的一个根本性障碍,那就是仅靠模型层面的防护措施无法管控智能体能够访问什么或做什么。”
英伟达CEO黄仁勋在公告中表示:
“只有解决AI安全问题,才能实现AI为社会带来的巨大潜力。在不断探索AI能力前沿的同时,我们必须加快对AI安全前沿的探索。安全与防护需要全栈工程。”
🚀 对企业 AI 化的启示
1. 安全架构需从模型层延伸至系统层
博伊塔诺的发言明确指出,仅靠模型层面的防护措施无法管控智能体的行为边界。企业部署AI智能体时,需在软件权限控制与硬件监控两个层面同时建立防线,而非仅依赖模型自身的安全对齐。
2. 独立监控机制是防止越界的关键
Sentry在芯片层面强制执行安全控制,能够在毫秒级时间内隔离越界智能体。这种独立于智能体运行环境的监控机制,为企业提供了可验证的安全保障,值得在关键业务场景中优先考虑。
3. 生态合作加速安全技术落地
超过100家组织的采用表明,AI智能体安全已从理论探讨进入工程落地阶段。Anthropic、赛富时等企业的整合案例,为不同行业提供了可参考的部署路径。
4. 安全投入与商业回报并行
英伟达在推出安全平台的同时,宣布追加1500亿美元回购授权,总额达2350亿美元。这表明AI安全领域的投入与商业价值的实现可以同步推进,企业不应将安全视为纯粹的成本中心。
【官方原文链接】点击访问首发地址
常见问题
相关文章
谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析
谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。
2026年10月1日谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%
2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。
2026年10月1日Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争
Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。
2026年9月30日