前沿 AI 的框架与新时代的黎明

A Framework for Frontier AI and the Dawning of a New Age

中文译文 · 9k 字

一句话摘要

标题主题:前沿 AI 的思考框架与新时代开端

前沿 AI 的框架与新时代的曙光 · 2026 年 7 月 14 日 · 7 分钟阅读 · 查看原文 ↗ AI Loops 这是人类历史的一个关键时刻。人工通用智能(AGI)——一个拥有大脑全部认知能力的系统——很可能只剩下短短几年就会到来。当我们在未来几十年回望这段时光时,我想我们会意识到,自己当时正站在奇点的山脚下——这不过是人类新时代的黎明罢了。 我毕生都在研究 AGI,因为我始终怀有坚定的信念:如果能够负责任地建造并部署它,它必将成为有史以来最有价值、最具变革性的技术之一。AGI 无法与普通的技术突破相提并论,哪怕是互联网或移动互联网这样影响深远的技术也不行——它更接近于电或火的发现。如果你停下来想一想,我们本质上已经找到了一种让沙子思考的方法。这堪称奇迹。 这项技术的影响之巨将是前所未有的,其影响力或许是工业革命的 10 倍,而速度也是 10 倍。它将帮助我们解决社会面临的一些最重大的问题,从加速药物研发,到开发新的清洁能源,再到创造全新的先进材料。我们甚至可能抵达这样一个节点:资源不再构成人类进步的制约因素,从而迎来一个丰饶的、令人惊叹的新时代。 前沿的挑战 AI 已经开始带来现实的益处,但要实现它巨大的承诺,我们必须谨慎、周密地度过这个关键的发展阶段。随着我们越来越接近 AGI,我们需要采取紧迫行动来应对可能出现的风险。我们已经看到前沿模型给网络安全带来的挑战,而随着能力持续提升,包括核风险与生物风险在内的其他威胁也可能很快浮现。在不远的将来,我们将需要强有力的安全保障来维持对日益自主化、递归自我改进系统的控制——并应对那些只会随时间推移而逐渐明朗的未知问题。 我一直相信人类的聪明才智与创造力能够解决任何问题。我确信,缓解与 AI 相关的技术风险是我们能够共同应对的挑战,但前提是我们给自己留出足够的时间和空间,把接下来这关键的一步走对。而目前,无论是作为领域还是作为更广泛的社会,我们并没有做到这一点。 眼下,我们正陷入一场极其激烈、多层次叠加的商业与地缘政治竞赛。虽然这些竞争态势推动着快速进步、加速着巨大的正面收益,但前沿领域的进展正在超越我们对这项技术的理解。世界上没有人确切知道接下来会发生什么,就连专家们也意见不一。当存在很大程度的不确定性、且赌注如此之高时,带着谨慎的乐观继续前行,才是明智且正确的策略。这就要求公共政策既能促进创新,又能激励责任与安全,促进在关键安全议题上的国际合作,并鼓励对 AI 如何部署以造福社会进行审慎考量。 一个前沿 AI 标准机构的框架 我们在 AI 领域看到的快速进步,要求以一种动态、可适应且严谨的新方式来测试前沿 AI 模型的能力。凭借其经济与技术地位,美国处于率先制定此类框架的有利位置。它可以建立一个全新的标准机构,其模式仿照联邦政府监督下的公私合作或自律组织,很像金融业监管局(FINRA),董事会中包括独立的顶尖技术专家和开源代表。资金必须充足,且很可能主要来自产业界,以吸引世界级的技术人才,并为大规模测试提供必要的算力资源。 该标准机构将负责制定评估协议,并与相关联邦机构和美国国家实验室合作,在与国家安全相关的领域开展测试。如果一个模型在标准机构确定的一组基准上达到特定阈值,它就将被认定为"前沿级"模型;这些基准会定期更新,以跟上不断演进的 AI 能力。那些拥有符合这些基准定义的"前沿模型"的组织,将被认定为"前沿实验室",并被鼓励采用最佳实践,例如发布包含技术细节的模型卡、维持强大的内部网络安全、审查关键人员、为安全与保障研究提供充足的资源,等等。 初期,前沿实验室将自愿在发布前最多 30 天将模型交由标准机构审查。一旦评估协议被证明有效且稳健,正式化可能很快跟进,这意味着前沿模型必须通过该评估才能在美国市场部署。实验室也将与标准机构合作,处理发布后出现的任何关键漏洞。 模型评估应包括对网络安全、生物威胁及其他高风险领域能力的严谨科学评测。针对智能体(agentic)AI 的特定测试可以寻找绕过安全护栏的企图或欺骗迹象,并确保落实最佳实践,例如为 AI 生成的图像打上数字水印、生成人类可读的输出 token 以理解模型的推理过程。 这些评估将定期更新,或许起初是每季度一次,过时或饱和的基准将被弃用并替换。初期,它们将在与前沿实验室协商下制定,但最终标准机构应建立起技术能力,独立于各实验室创建自己的保密测试,以防止过拟合。通过与美国政府合作,它可以推动建立第三方审计机构生态系统,以协助评估以及新基准和新评估的开发。 这种做法的优势在于它以技术为核心,同时支持创新并激励负责任的行为。它旨在跟上该领域的加速步伐,并在识别出最大风险时加以适应;如果事态严重性要求,还可以逐步收紧,包括在必要时协调前沿实验室之间放缓开发。被认定为前沿实验室将带来显著声望,任何组织都可以通过构建达到基准标准的模型而获得这一资格。无论前沿级模型来自哪个国家、是开源还是闭源,该框架都适用;但任何非前沿模型,例如来自初创公司或学术界的模型,则可豁免于此流程。 这项由美国发起的努力,将为建立前沿 AI 的共享国际标准提供一个强有力的起点。由于这项技术将影响整个地球,理想情况下,这一框架将促使国际社会就如何管理最严重的风险达成共识,同时确保每个人都能获得 AI 带来的机遇并从中受益。 未来尚未书写 AGI 有潜力成为推动科学与医学进步的终极工具,并带来巨大的生产力提升与经济增长。但为了实现这一点,我们需要围绕一个共享的全球框架进行协调,运用最严谨的科学方法,并汇聚最优秀的人才来共同应对我们面临的挑战。 即便我们解决了这些艰难的技术挑战,也还会有更复杂的经济与哲学问题需要应对:在稀缺不复存在的世界里,需要什么样的新经济模式来帮助每个人蓬勃发展?我们想要以什么样的价值观生活,意义与目的何在,甚至人类的处境本身又将如何改变?解决这些问题显然不能、也不应只交给技术专家。它需要社会的每一个部分共同参与,来定义这一新的篇章。 围绕 AI 既存在巨大的兴奋,也存在巨大的不确定性,两者都有其道理。但未来尚未书写,我们必须在 AGI 到来之前,利用好这段宝贵的窗口期,把这项技术塑造为造福全人类之物。我们现在集体所做的一切,将决定文明下一阶段的走向。通过安全地把 AGI 引入世界,我们能够迈入一个科学发现与进步的全新黄金时代,开启一个人类空前繁荣的光明未来。 Tags: # X # AI # Loops # Guide 相关文章 How to Build an AI-Native Company: Hiring, Standards, and Cadence *我们花了一年时间办黑客松、AI 培训和答疑会,但直到我们把 AI 能力变成硬性要求,一切才真正改变。* AI Loops Claude Marketing

原文参考:https://maxed.wiki/posts/a-framework-for-frontier-ai-and-the-dawning-of-a-new-age/ (Maxed.wiki,本页为站内中文整理)