Anthropic提出“放慢前沿”方案:AI竞赛需要刹车吗?
导语
前沿AI公司是否应该主动放慢能力竞赛?Anthropic CEO达里奥·阿莫代伊近日给出了较为具体的答案。他在一篇博客文章中提出,行业应当“放慢前沿”(pace the frontier),不是停止研发,而是降低未经充分评估的能力跃升速度,为安全测试、治理和事故响应争取时间。OpenAI CEO山姆·奥特曼表示认同,称这已成为OpenAI近期讨论的重点;埃隆·马斯克也公开回应称阿莫代伊的判断是正确的。
三条路径
阿莫代伊的方案主要包括:
- 引入嵌入式第三方评估人员。 Anthropic承诺允许METR等外部机构的评估人员进入公司,获得徽章、办公位和设备,并拥有大体接近内部风险团队的访问权限。他们既可以核验公司是否遵守放慢开发与安全承诺,也可以推动安全事件得到报告。奥特曼表示OpenAI也将采取类似安排。
- 在民主国家内协调标准。 阿莫代伊建议领先AI公司建立共同的安全标准,并讨论对未经检查的能力进展设置速度限制。他承认企业间协调可能触发反垄断问题,因此主张由美国政府进行调解或提供针对特定安全讨论的有限豁免。
- 推动全球最低限度协作。 美国及其盟友可以尝试与包括中国在内的其他国家合作,即使无法达成广泛共识,也可以先禁止一些明显危险的用途,例如利用AI生产生物武器,或帮助用户完成此类行为。
为什么现在提出
阿莫代伊认为,近期两件事强化了他的谨慎立场:一起涉及OpenAI与Hugging Face的黑客事件,以及AI能力“急剧加速”的趋势。尤其值得注意的是,模型正在增强构建下一代AI系统的能力,这可能使能力增长形成更快的循环。他还提到,Anthropic研究人员雅各布·考克森因担心头部公司低估风险而离职,进一步凸显了行业内部的信任压力。不过,阿莫代伊的文章并未直接回应这起离职事件。
影响与争议
这套方案的价值在于把“AI安全”从抽象警告转化为可执行的监督安排。嵌入式评估人员如果拥有足够独立性和访问权限,或许能弥补企业自我审查的不足;共同标准也可能减少公司在安全投入上的竞争劣势。
但它并非没有问题。行业协调可能被监管机构视为合谋,全球协作则受到中美竞争和技术出口限制的影响。批评者还担心,安全规则由少数领先公司主导,最终可能抬高后来者门槛,形成“监管俘获”。此外,关于AI是否会带来极端生存风险,行业内外仍缺少一致判断,也有人认为企业应先处理已经发生的偏见、失业和滥用问题。
因此,“放慢前沿”更像一项需要被验证的治理试验,而不是现成答案。它能否获得公众信任,取决于评估机构是否真正独立、事故是否透明披露,以及安全承诺能否适用于所有主要参与者。阿莫代伊仍强调AI有望显著改善人类生活,但前提是行业愿意用争取到的时间把技术做得更稳妥。
评论
正在确认登录状态……
正在加载评论……