Google DeepMind成立新研究院拓展AGI讨论

谷歌与谷歌DeepMind的研究人员周三宣布成立DeepMind研究院,旨在推进关于通用人工智能(AGI)的讨论。该研究院的董事名单包括DeepMind联合创始人沙恩·莱格、谷歌高管詹姆斯·马尼卡,以及谷歌DeepMind董事长戴密斯·哈萨比斯,莱格担任总编辑。
这家新研究院的目标是呈现谷歌、谷歌DeepMind与全球更广泛研究界在AGI问题上的不同观点。官方公告写道:“他们不会总是意见一致,随着这个快速发展的前沿领域出现更多数据和信息,他们的看法也可能随之改变。”
首批发布的四篇文章涵盖多个主题:应对AGI潜在冲击的经济政策、保持模型推理过程的人类可读性、促进人类福祉的原则,以及评估前沿AI模型的框架。
其中一篇文章由DeepMind安全研究员罗欣·沙阿和安卡·德拉根撰写,指出AI透明度窗口的不断收窄——即观察和核查模型逐步推理过程的能力下降——并非不可避免。随着新架构使最强大的模型愈发难以监控,两位作者认为开发者和监管机构应直接面对其中的安全权衡问题。这可能意味着限制“不透明的串行深度”——即模型在不产生可读推理轨迹的情况下所能进行的连续计算量,或者要求开发者证明透明度较低的系统依然具备同等的可监控性。
在另一篇文章中,哈萨比斯提议建立一个由美国主导的前沿AI标准机构,用以评估最先进的AI模型。根据他的设想,开发者最初可在模型发布前最多30天自愿提交模型接受评估。一旦该评估体系证明其有效性,通过测试或将成为在美国部署前沿模型的必要条件。
该机构最初会与AI公司协商设计评估标准,但最终将开发独立、不公开的评估方式——文章中称之为“留存测试”——以防止实验室针对已知的评估标准对模型进行“定向优化”。哈萨比斯表示,该框架可以“根据形势的严峻程度逐步升级”,其中可能包括前沿AI开发者之间的协调性放缓举措。
这些文章的发布,正值行业安全讨论从泛泛的担忧表态转向具体的披露、外部审查提案,以及在安全措施滞后时采取协调性放缓行动。本周,随着业界领袖纷纷认同Anthropic CEO达里奥·阿莫代伊有关为前沿AI发展“设定节奏”的呼吁中的部分内容,这一转变进一步加速。
Q&A
Q1:DeepMind研究院是什么?
A:DeepMind研究院是谷歌与谷歌DeepMind联合成立的新机构,旨在推进关于通用人工智能(AGI)的讨论,呈现谷歌、谷歌DeepMind与全球研究界在AGI问题上的不同观点。
Q2:戴密斯·哈萨比斯提出了什么样的AI评估框架?
A:哈萨比斯提议建立一个由美国主导的前沿AI标准机构,开发者最初可自愿提交模型在发布前接受评估,未来这一评估或将成为部署前沿模型的必要条件,机构还会开发独立的“留存测试”防止模型被针对性优化。
Q3:为什么AI模型的透明度正在下降?
A:随着新架构使最强大的模型愈发难以监控,模型的“不透明串行深度”增加,即模型能在不产生可读推理轨迹的情况下进行更多连续计算,这使观察和核查模型推理过程变得更加困难。