谷歌与谷歌DeepMind的研究人员于周三共同成立了DeepMind研究院,旨在推动围绕通用人工智能(AGI)的讨论。该研究院由DeepMind联合创始人Shane Legg、谷歌高管James Manyika以及谷歌DeepMind董事长Demis Hassabis担任董事,Legg同时担任执行编辑。

新成立的研究院旨在揭示谷歌、谷歌DeepMind与全球更广泛研究社区在AGI问题上的不同观点。公告中指出:“他们不会总是意见一致,随着更多数据和信息在快速发展的前沿领域出现,他们的看法也可能发生变化。”

首批发布的四篇论文涵盖多个主题:应对AGI潜在冲击的经济政策、保持模型推理的可读性、促进人类福祉的原则,以及评估前沿AI模型的框架。

其中一篇由DeepMind安全研究员Rohin Shah和Anca Dragan撰写的论文指出,AI透明度窗口的缩小——即观察和检查模型逐步推理过程的能力——并非不可避免。随着新架构使得最强大的模型更难以监控,作者认为开发者和监管者应直接面对安全权衡问题。这可能意味着限制“不可见的连续深度”——模型在不产生可读推理轨迹的情况下能执行的连续计算量,或者要求开发者证明透明度较低的系统同样可被有效监控。

另一篇由Hassabis撰写的论文提出建立一个由美国主导的前沿AI标准机构,用于评估最先进的AI模型。根据他的框架,开发者最初可自愿在发布前30天提交模型进行评审。一旦评估体系被证明有效,合格通过评测可能成为在美国部署前沿模型的必要条件。

该机构初期将与AI公司协商设计评估方案,最终将开发独立且保密的评测——论文称之为“保留测试”,以防止实验室针对已知评测调整模型。Hassabis表示,如果形势严峻,该框架可以“逐步加强”,甚至可能包括前沿AI开发者之间的协调放缓。

这些论文发布之际,行业内关于安全的讨论正从广泛的担忧转向具体的披露、外部审查提案,以及如果安全措施滞后,协调放缓的可能性。本周,随着行业领导者支持Anthropic首席执行官Dario Amodei提出的“放缓”前沿AI开发的部分建议,这一转变进一步加速。