Google 与 Google DeepMind 的研究人员宣布成立 DeepMind Institute,试图把围绕通用人工智能(AGI)的讨论从原则性表态,推进到更具体的安全、评估和政策设计层面。该机构由 DeepMind 联合创始人 Shane Legg、Google 高管 James Manyika 以及 Google DeepMind 负责人 Demis Hassabis 担任董事。
首批发布四篇文章
新机构表示,其目标是让 Google、Google DeepMind 以及更广泛研究界对 AGI 的不同看法被公开讨论,而不是只保留单一立场。首批发布的四篇文章,分别涉及应对 AGI 可能带来的经济冲击、保留模型可读推理过程、促进人类福祉的原则,以及前沿 AI 模型的评估框架。
这意味着相关讨论正在从笼统的安全担忧,转向更可执行的制度设计。文章重点不只在风险判断,也开始触及开发者应承担哪些披露义务,以及外部机构如何介入审查。
聚焦模型推理可见性
其中一篇文章由 DeepMind 安全研究人员 Rohin Shah 和 Anca Dragan 撰写,核心观点是:模型推理过程越来越难被外界看见,并非无法改变的趋势。两人认为,随着新架构让最强模型更难监测,开发者和监管方需要正面处理性能与可监督性之间的取舍。
文章提出的方向包括,限制模型在不给出可读推理痕迹的情况下进行连续计算的深度,或者要求开发者证明,即便系统透明度下降,外部仍能以同等程度对其进行监测。
Hassabis提出前沿模型评估机构
另一篇文章中,Hassabis 提出建立一个由美国主导的前沿 AI 标准机构,专门评估最先进的 AI 模型。按照这一设想,开发者起初可在模型发布前最多 30 天自愿提交审查;如果这套评估机制被证明有效,未来通过测试可能成为前沿模型在美国部署的前提条件。
该机构初期会与 AI 公司共同设计评估方式,之后再逐步转向独立、且不提前公开内容的测试,以避免实验室按已知题目定向优化模型。Hassabis 还提到,如果风险形势进一步升级,措施可以继续加码,甚至不排除前沿 AI 开发者之间进行协调放缓。
行业讨论转向具体方案
这批文章发布之际,AI 行业关于安全的讨论正在发生变化。过去常见的是原则性警示,如今更多焦点开始落在信息披露、外部审查和必要时的开发节奏控制上。
这一转向本周进一步升温,原因是多位行业人士公开支持 Anthropic 首席执行官 Dario Amodei 提出的“控制前沿 AI 开发节奏”部分主张。DeepMind Institute 的推出,也让 Google 系在这场讨论中的立场变得更具体。










