Vault

前沿 AI 的治理框架与新时代的曙光

这是一个关乎人类命运的历史性时刻。通用人工智能(AGI)——一个具备人脑全部认知能力的系统——可能仅需短短数年就会到来。

Demis Hassabis · 2026 年 7 月 14 日

Demis Hassabis 文章封面


TL;DR DeepMind CEO Demis Hassabis 发表长文,认为 AGI 可能在短短数年内到来,其影响将是工业革命的 10 倍、以 10 倍的速度展开。他提出一个美国主导的"前沿 AI 标准机构"框架——参照 FINRA 模式、公私合作、顶级技术专家治理——负责制定基准测试、评估前沿模型,模型须通过评估方可进入美国市场。同时呼吁国际社会尽快就 AI 治理达成共识,利用 AGI 到来之前的窗口期,确保这项堪比"电与火"的技术造福全人类。


这是一个关乎人类命运的历史性时刻。通用人工智能(Artificial General Intelligence, AGI)——一个具备人脑全部认知能力的系统——可能仅需短短数年就会到来。当数十年后我们回望此刻,我相信我们将会意识到,自己当时正站在奇点(singularity)的山脚下——这无疑是人类新时代的曙光。

我这一生都在为 AGI 而努力,因为我始终深信:如果以负责任的方式构建和部署,它将成为人类有史以来最有益、最具变革性的技术之一。

AGI 不能与一般的技术突破相提并论,甚至不能与互联网或移动通信这样影响深远的发明并列——它更接近于电或火的发现。

我们本质上找到了让沙子思考的方法。这堪称奇迹。

这项技术的影响规模将是空前的——或许是工业革命的 10 倍,以 10 倍的速度展开。

它将帮助我们解决社会面临的诸多重大问题:从加速药物发现,到开发新型清洁能源,再到创造全新的先进材料。我们甚至可能达到一个资源不再成为人类进步限制因素的节点,进入一个令人惊叹的丰裕新时代。

前沿的挑战

AI 已经开始带来现实世界的益处,但要实现其巨大潜力,我们必须深思熟虑、小心翼翼地穿越这个关键的发展时期。我们需要采取紧急行动,应对随着接近 AGI 而可能出现的风险。我们已经看到前沿模型(frontier models)对网络安全带来的挑战,随着能力的持续进步,核风险与生物风险等其他威胁也可能很快浮现。展望未来,我们需要强有力的防护措施来维持对日益自主、递归自改进系统的控制——并解决那些随着时间推移才会逐渐清晰的不明问题。

我一直相信人类的聪明才智和创造力能够解决任何问题。我深信,减轻与技术相关的 AI 风险是一个我们能够共同应对的挑战——但前提是,我们要给自己留出足够的时间和空间,把接下来这关键一步走对。而目前,无论是这个领域还是整个社会,都没有做到这一点。

眼下,我们深陷一场极其激烈、多层级的商业和地缘政治竞赛。这些竞争动力固然推动了快速进步并加速了令人难以置信的正面收益,但前沿的进展正在超越我们对这项技术的理解。

这个世界上没有人确切知道接下来会发生什么,即使是专家们也众说纷纭。

当不确定性极高、赌注如此巨大的时候,采取"审慎乐观"(cautious optimism)的态度是明智且正确的策略。这需要公共政策既促进创新,又激励责任感与安全性;在关键安全问题上推动国际合作;并鼓励审慎考虑如何为了社会利益而部署 AI。

前沿 AI 标准机构的框架

AI 的快速进步需要一种新的方法来测试前沿 AI 模型的能力——这种方法必须是动态、可适应且严谨的。美国凭借其经济和技术地位,完全有能力率先制定这样的框架。它可以建立一个新的标准机构(Standards Body),模式上参考联邦监管下的公私合作伙伴关系或自律组织,类似于美国金融业监管局(FINRA),其董事会应包括独立的顶尖技术专家和开源社区代表。资金需要充足,且应主要来自产业界,以吸引世界级技术人才并提供大规模测试所需的算力资源。

该标准机构将负责制定评估协议(assessment protocols),并与相应的联邦机构及美国国家实验室合作,在与国家安全相关的领域开展测试。如果一个模型在一组由标准机构确定、并定期更新以跟上 AI 能力演进的基准测试中达到特定阈值,则该模型将被认定为"前沿级"(Frontier-class)。拥有这些基准所定义的"前沿模型"的组织将被认定为"前沿实验室"(Frontier Labs),并被鼓励采纳最佳实践,如发布包含技术细节的模型卡(model cards)、维护强大的内部网络安全、审查关键人员、为安全研究提供充足资源等。

初期,前沿实验室将自愿在发布前最多 30 天将模型提交标准机构审查。一旦评估协议被证明有效且可靠,可以迅速将其正式化——这意味着前沿模型必须通过评估才能在美国市场部署。实验室还将与标准机构合作,解决发布后的任何关键漏洞。

模型评估应包括对网络安全、生物威胁及其他高风险领域能力的严格科学评估。针对自主 AI(agentic AI)的专项测试,可以检查模型是否存在绕过安全护栏的尝试或欺骗迹象,并确保最佳实践得到落实——例如对 AI 生成的图像进行数字水印,以及生成人类可读的输出 Token 以理解模型的推理过程。

这些评估将定期更新——初始阶段可能每季度一次——过时或饱和的基准将被废弃和替换。最初,评估将在咨询前沿实验室后制定,但最终该标准机构应建立自己的技术能力,创建独立于实验室的、保密的测试集,以防止过拟合(overfitting)。通过与美国政府合作,它可以推动建立第三方审计机构生态,协助进行评估以及新基准和评估方法的开发。

这一方法的优势在于:它以技术为核心,同时支持创新并激励负责任的行为。它旨在跟上领域的加速步伐,适应已识别出的最大风险,并且可以在形势严峻时进一步加强——包括必要时协调前沿实验室之间的发展放缓。"前沿实验室"的称号将具有重要的声望,任何组织只要构建出符合基准标准的模型,都可以获得。该框架适用于所有前沿级模型,无论其来源国是哪里,也不论其是开源还是闭源;但任何非前沿模型——比如来自初创公司或学术界的模型——将豁免于这一流程。

这一由美国发起的努力,将为创建共享的国际前沿 AI 标准提供一个坚实的起点。由于这项技术将影响整个地球,理想情况下,这一框架将推动国际社会就如何管理最严重的风险达成共识,同时确保每个人都能获得并受益于 AI 带来的机遇。

未来尚未写就

AGI 有潜力成为推进科学与医学的终极工具,并驱动巨大的生产力提升和经济增长。但要实现这一点,我们需要通过围绕一个共享的全球框架进行协调,运用最严谨的科学方法,汇聚最优秀的头脑共同应对挑战,从而把技术基础打牢。

即使我们解决了这些艰难的技术挑战,还将有更复杂的经济和哲学问题等待处理:在后稀缺(post-scarcity)世界中,我们需要什么样的新经济模式来帮助每个人蓬勃发展?我们希望遵循什么价值观?意义和目的将是什么?甚至连人类的处境本身会如何改变?解决这些问题显然不能、也不应只交给技术专家。它需要社会每个部分共同参与,来帮助定义这个新的篇章。

围绕 AI 的既有巨大的兴奋,也有巨大的不确定性——两者都是合理的。但

未来尚未写就。

我们必须利用好 AGI 到来之前这个宝贵的窗口期,塑造这项技术,使其造福全人类。我们现在的集体行动,将决定文明的下一阶段如何展开。通过安全地将 AGI 引入世界,我们可以进入一个科学发现与进步的新黄金时代,迎来一个令人难以置信的人类繁荣的璀璨未来。


原文:Demis Hassabis(@demishassabis)于 X 发布的文章 "A Framework for Frontier AI and the Dawning of a New Age"
链接:https://x.com/demishassabis/status/2076957440109625718

觉得有用?分享给一个需要的朋友 🙏