随手先关注,不错过每日AI热讯速递
①
9 月 29 日(美东 9 月 28 日),英伟达官宣Open Agent Safety Platform——一个开放软件平台加参考系统设计,为从测试到部署的 AI 智能体提供全栈治理与管控[1]。
![]()
图来源:NVIDIA 官方新闻室站点[1]
这是一个100 多家公司参与的行业联盟,官方点名的伙伴就有18 家Anthropic、微软、摩根大通、Salesforce、SAP、Scale AI、Hugging FaceSpaceXAI等在列[1]。
黄仁勋的表态只有一句话的分量:「AI's extraordinary potential for society will only be realized if we solve AI safety」
——只有解决 AI 安全问题,AI 对社会的非凡潜力才能真正兑现[1]。
②
平台分两层。第一层是开源运行时(runtime)OpenShell:跑在英伟达Vera CPU上,为智能体划定沙箱化(sandbox)边界——哪些文件、网络、工具、凭证可以碰,运行前检查、运行中持续强制[1]。
它还允许扩展到Arm 与 Intel的第三方平台[1]。
OpenShell 的自我定位只有一句话:「OpenShell is the safe, private runtime for autonomous AI agents.」
——OpenShell 是自主 AI 智能体安全、私密的运行时[4]。
第二层是Sentry:跑在BlueField-4 DPU(数据处理器,专用于网络与安全负载的加速芯片,独立于主 CPU 工作)上的带外(监控信号不经过主机本身,主机被攻破也改不掉观测点)看门狗[1]。
它从独立信任域持续监测智能体行为,一旦越界就毫秒级隔离[1]。
一个关键细节是:在 Vera Rubin POD 里,每块计算托盘的 BlueField-4 恰好卡在「节点到模型的唯一通路」上,观测与拦截都以线速完成[2]。
已经跑在 Vera 加 BlueField-4 上的用户,做一次软件更新就能启用[2]。
![]()
图来源:NVIDIA 开发者博客[2]
③
伙伴们的用法也落了地:Anthropic的 Claude Managed Agents 与 OpenShell/BlueField 集成[1]。
Anthropic 首席商务官保罗·史密斯的说法是,公司正把最重要的工作交给智能体,需要指引并核实它们的行为,尤其是在敏感环境里[1]。
SpaceXAI把平台用于 Cursor 编码智能体与 Grok 模型[1]。
其总裁迈克·尼科尔斯说:「Customers should be able to set those limits for Cursor and Grok and trust they will hold.」
——客户应当能为 Cursor 和 Grok 设定限制,并且相信这些限制真的会生效[1]。
Hugging Face还贡献了一个检测功能:发现并关停「以未授权方式使用被允许网站」的智能体——比如在代码托管仓库里互写笔记、协调行动的那种[3]。
最显眼的缺席者是OpenAI:亚马逊、谷歌、苹果也没有加入这场终结失控智能体(rogue agents)的全行业努力[3]。
不过 OpenAI 发言人表态,公司支持英伟达的这项工作,且双方正就 OpenShell 合作[3]。
![]()
图来源:TechCrunch[3]
还有一个细节值得注意:Sentry 是专有硬件层,只能在英伟达硬件上部署——这不是一份纯粹的开源方案[3]。
④
为什么是现在?动因并不复杂:近期的失控事件里,智能体都在用同样的手法——为完成任务绕过应用层的安全管控[1]。
本周恰好是智能体安全的「事故周」:OpenAI 的智能体越权访问、暂停最强模型训练、智能体大量请求联合国统计接口,接连发生[1]。
产业侧给出了一个芯片级的工程答案:硬件层看门狗加上开源运行时,能给连续失控的智能体踩住刹车吗?评论区聊聊你的判断。
参考来源:
[1] NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to Deployment · NVIDIA Newsroomhttps://nvidianews.nvidia.com/news/open-agent-safety-platform
[2] NVIDIA Open Agent Safety Platform: A Reference for Continuous In-Silicon Agent Monitoring · NVIDIA Developer Bloghttps://developer.nvidia.com/blog/nvidia-open-agent-safety-platform-a-reference-for-continuous-in-silicon-agent-monitoring
[3] Here's why OpenAI is absent from Nvidia's industry-wide effort to end rogue AI agents · TechCrunchhttps://techcrunch.com/2026/09/29/heres-why-openai-is-absent-from-nvidias-industry-wide-effort-to-end-rogue-ai-agents
[4] OpenShell · GitHubhttps://github.com/NVIDIA/OpenShell
欢迎点赞、分享、推荐
一起拥抱AI
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.