近年来,人工智能研究人员对AI潜在风险的警告日益严峻,甚至OpenAI CEO Sam Altman也表示,可能是时候“放缓”AI的发展步伐了。但这具体该如何实施呢?
Anthropic的CEO Dario Amodei在一篇最新博客文章中,不仅呼应了“控制前沿速度”的呼声,还提出了三大策略,并宣布Anthropic将“单方面承诺”执行其中之一。
本周,关于AI安全与对齐的讨论愈发激烈。研究员Jacob Coxon因担忧领先AI公司在“拿我们的生命赌博”,并认为开发者“真诚地相信AI可能在本世纪末杀死我们所有人”,而选择辞职。这一观点也得到了Anthropic其他成员的呼应。
Amodei虽然未直接提及Coxon的辞职及其担忧,但他表示,有两件事促使他认为现在是采取更谨慎AI开发态度的时机:一是OpenAI与HuggingFace的安全漏洞事件,二是AI在近几个月内的飞速进步,尤其是其“构建下一代AI能力的提升”。
他写道:“我们必须放慢提升AI模型能力的速度。虽然进展仍会显得迅速,但我们必须明智地利用获得的时间。”
Amodei提出的第一步是引入第三方机构(如METR)的“嵌入式评估员”,以验证AI公司是否真正遵守其节奏和安全承诺,并确保安全事件得到报告。(此前OpenAI因未报告其AI代理接管德国维基表单事件而受到批评。)
他将这些评估员比作嵌入银行员工的监管者,并表示Anthropic将“单方面承诺”邀请他们进入公司工作,呼吁政府要求其他前沿公司也采取类似措施。这意味着给予评估员公司证件、办公桌和笔记本电脑,并提供与内部风险评估团队相当的访问权限,除非法律或合同另有规定。
接下来,Amodei呼吁“民主国家内的领先AI公司”协调制定“共同的安全标准以及对无节制AI进展速度的限制”。

尽管由于Altman与Amodei之间的明显敌意以及担心协调暂停可能引发反垄断调查,这种协调看似不太可能实现,Amodei在文中提到:“出于反垄断原因,美国政府介入调解或至少促成这些讨论是有帮助的——政府不必直接参与,但需要为某些安全对话发放有限豁免。”
他还提及了常被用来反对放缓发展的“中国AI主导”问题,认为如果美国政府和科技公司采取措施,比如拒绝向中国企业出售高性能芯片或半导体制造设备,并打击模型蒸馏技术,就能“在未来3-5年内显著拉大美国的领先优势”。
最后,Amodei呼吁“全球协调”,即美国及其盟友“尽可能与威权政府协调”,这意味着“与中国合作”。他承认“能达成的共识有限”,但仍认为有可能达成协议,比如“禁止某些狭义且明显危险的AI用途,如利用AI制造生物武器或允许用户这样做”。
鉴于Amodei过去对AI潜在风险的坦率承认及公司对某些监管形式的相对开放,一些AI支持者批评他是悲观主义者,助长了当前的AI反弹。对此,Amodei表示自己试图提供“平衡的观点”,并认为反弹“根本上是信任危机”,因为公众对科技公司、科技行业和政府产生了怀疑。
业界批评者则对这些末日式的AI警告持怀疑态度,认为这可能转移了人们对技术已造成伤害的关注。
例如,记者Brian Merchant指出,他尚未见到“可信的、逐步说明AI如何从自我递归改进走向消灭全人类的文档”,并暗示类似Amodei的提议“很可能最终只服务于Anthropic和OpenAI,这就是监管俘获的表现”。
在新文章中,Amodei重申他依然“相信AI能极大提升人类生活质量”。
他说:“我实现这些益处的愿望未曾减弱,但只有以正确方式构建技术,且善用我们获得的时间,才值得我们格外谨慎地去做好这件事。”


