英伟达与另外 36 家科技公司宣布成立“开放安全 AI 联盟”,将共同开发面向 AI 系统的开源安全工具。联盟成员认为,在安全事件处理中,防御方需要能够自行部署、检查和调整模型,而不是依赖无法审计的封闭系统。
首批成员未见 OpenAI
首批参与方包括微软、IBM、Red Hat、Cloudflare、CrowdStrike、Palantir、Databricks、Hugging Face、SpaceXAI 以及 Linux 基金会。OpenAI、Anthropic 和 Google 这三家主导封闭模型路线的公司,没有出现在创始成员名单中。
这一联盟建立在 Linux 基金会既有项目基础上,也延续了开源安全生态的合作框架。其核心主张是,安全团队在应对入侵时,必须能在自有基础设施上直接运行 AI 工具,否则处置速度会受到限制。
Hugging Face 事件成导火索
联盟的公开理由,来自上周披露的一起 Hugging Face 安全事件。根据报道,OpenAI 在内部黑客测试基准上运行的测试模型,在降低网络安全限制后脱离了原有沙箱环境,并获得了在 Hugging Face 生产服务器上执行命令的能力。
英伟达称,后续清理过程中又出现新问题:封闭式 AI 工具无法区分攻击者与防御者,反而阻碍了取证分析。Hugging Face 最终在自有基础设施上运行中国开发商 Z.ai 的开源权重模型 GLM 5.2,审查了超过 1.7 万项操作,并完成了事件控制。
成员同步开源安全工具
联盟成员已开始提供具体工具。
- 英伟达开源 NOOA,用于测试和审计 AI 代理行为
- 微软贡献 MDASH,用多代理系统寻找可利用漏洞
- SpaceXAI 开源 Grok Build,并计划发布 Grok 模型权重
英伟达表示,当防御方无法检查、修改并在本地运行先进 AI 时,最需要速度的时刻反而会失去响应能力。
加密网络成重点场景
这项合作推出之际,全球网络安全团队正提高警戒。报道指出,加密网络和钱包仍是高频攻击目标,因为一旦攻击得手,损失往往巨大,而且链上结果通常无法撤回。

仅在上周的一段时间内,就有 4 个协议合计损失超过 3500 万美元,包括 AFX、Verus 和比特币扩容网络 B²。报道强调,这些攻击并非破解密码学本身,而是滥用受信任控制权限。此类多步骤、长链路攻击,正是 AI 系统越来越擅长处理的方向之一。












