核心导读
我们不断听到 AI 研究人员发出越来越严峻的警告,称人工智能存在危险;就连 OpenAI CEO 山姆·奥特曼也表示,或许到了该“控制”AI 发展节奏的时候。但这具体会是什么样子?
在一篇新博文中,Anthropic CEO 达里奥·阿莫代伊不仅呼应了“控制前沿节奏”的呼吁,还概述了三种实现这一目标的总体策略。他还表示,Anthropic 正在“单方面承诺”采取其中一项。
本周,围绕 AI 安全与对齐的辩论进一步升温。此前研究人员雅各布·考克森写道,他将从 Anthropic 辞职,因为他担心领先 AI 公司正在“拿我们的生命赌博”,而构建这项技术的人“真诚地相信它可能在本十年结束前杀死我们所有人”。Anthropic 的其他一些人重复了这一说法。
阿莫代伊的博文没有明确提到考克森的辞职或其担忧,但这位 CEO 写道,有两件事让他确信,是时候对 AI 发展采取更谨慎的做法:OpenAI-HuggingFace 黑客事件,以及“AI 近几个月一直在以急剧加快的速度推进”,尤其是其“构建下一代 AI 的能力日益增强”。
“我们必须放慢提升 AI 模型能力的速度,”阿莫代伊写道。“进展仍会显得很快,而我们必须善用争取到的时间。”
他提议的第一步是引入来自 METR 等第三方组织的“驻场评估员”——这些评估员可以核实 AI 公司是否确实遵守其节奏控制与安全承诺,也能确保安全事故被上报。(OpenAI 最近因未报告一起事件而受到批评,该事件中其 AI 代理接管了一个德国维基表单。)
阿莫代伊将这些评估员比作被派驻到银行员工中的监管者,并表示邀请他们入驻是“Anthropic 单方面承诺要做的事(并呼吁各国政府要求其他前沿公司也照做)”。这意味着给评估员公司工牌、办公桌和笔记本电脑,并提供“大体上与内部风险评估团队相当的权限”,法律或合同要求时除外。
接下来,阿莫代伊呼吁“民主国家内”的领先 AI 公司协调“共同安全标准,以及对不受约束的 AI 进展速度的限制”。
这种协调可能看似不太可能,既因为奥特曼和阿莫代伊之间明显的敌意,也因为据报道,他们的公司担心协调暂停可能招致反垄断审查。阿莫代伊在博文中暗示了这一担忧,写道:“出于反垄断原因,美国政府出面调解、或至少促成这些讨论会有所帮助——政府不必参与,但需要为某些类型的安全对话发布范围有限的豁免。”
阿莫代伊也承认中国 AI 主导地位这一常被用来反对放慢发展的担忧。但他说,如果美国政府和科技公司采取措施,例如拒绝向中国公司出售强大芯片或半导体制造设备,并打击模型蒸馏,他们就可以“在未来 3 到 5 年足够放慢中国的进展,从而显著扩大美国的领先优势。”
最后,阿莫代伊呼吁“全球协调”,即美国及其盟友“在可能的情况下尝试与威权政府协调”。阿莫代伊说,这将意味着“与中国合作”,他承认“能取得的成果存在严峻限制”,但仍提出也许有达成一致的机会,哪怕只是“禁止某些范围狭窄且明显危险的 AI 用途,例如用 AI 生产生物武器,或允许用户这样做”。
鉴于阿莫代伊过去愿意承认 AI 的潜在危险,以及公司对某些形式监管相对开放,一些 AI 支持者已批评他是末日论者,称其言论助长了当前对 AI 的反弹。作为回应,阿莫代伊说,他试图提供一种“平衡”的视角,并认为这种反弹“从根本上是一场信任危机”,因为人们已对科技公司、科技行业和政府变得怀疑。
行业批评者也对这些末日式 AI 警告持怀疑态度,认为它们转移了人们对这项技术已经造成的危害的注意力。
例如,记者布赖恩·默钱特写道,他尚未看到“一份可信、逐步的记录,说明 AI 究竟如何从自我递归改进走向杀死地球上的每一个人”;他还提出,类似阿莫代伊的提议“很可能最终只会服务 Anthropic 和 OpenAI;这就是监管俘获在行动中的样子。”
在他的新博文中,阿莫代伊写道,他继续“相信 AI 能极大改善人类生活质量”。
“我实现这些益处的愿望未曾减弱,”他说。“但只有以正确方式构建这项技术,这些益处才能实现;而且——只要我们善用争取到的时间——就值得格外审慎地把它做对。”
