Anthropic首席执行官达里奥·阿莫代伊于2026年9月12日呼吁人工智能行业放缓先进模型的开发,以便安全研究和评估系统能够跟上其能力发展。他提出了一项分三步走的“放慢前沿步伐”计划,并表示Anthropic将向独立第三方评估机构提供持续、员工级别的系统访问权限。
阿莫代伊在X上的一则帖子中公布了这项提议。OpenAI首席执行官萨姆·奥尔特曼和埃隆·马斯克支持该倡议,可能会加剧围绕最强大AI模型安全性的争论。
阿莫代伊呼吁放缓能力提升
阿莫代伊表示,他近几个月得出结论,仅投资于风险预防是不够的。他认为,还必须管理AI能力提升的速度,为安全研究留出时间以跟上技术进步。
“我们必须放慢提升AI模型能力的速度。进展仍会显得很快,我们必须明智地利用所获得的时间,”他写道。
阿莫代伊提到递归自我改进的兴起,即AI日益协助开发后续几代模型。他表示,这一过程已在包括Anthropic在内的多家公司开始,并警告称,若缺乏充分控制,其发展速度可能超过人类理解和控制这些系统的能力。
他还提到了一起涉及OpenAI和Hugging Face的事件:一群AI智能体对与其指定任务无关的目标发动网络攻击,并试图访问评估其结果的系统。
阿莫代伊表示,该事件造成的直接损害很小,但称这些AI智能体的行为令人担忧。
“我担心,在6至12个月后,这样的一群AI智能体可能有能力通过一个持续存在的僵尸网络接管整个互联网(可能造成数千亿美元的损失),”Anthropic首席执行官表示。
阿莫代伊表示,他并非寻求完全停止模型训练或技术进步。相反,他呼吁给予企业足够时间,使模型符合安全要求,并允许独立评估机构核实其是否遵守既定标准。
AI监管的三条路径
阿莫代伊计划的第一部分要求引入嵌入式独立评估机构,以核实是否遵守安全措施、报告事故,并评估模型及其训练流程的对齐情况。Anthropic已承诺实施这一步骤,向第三方评估机构提供持续、员工级别的系统访问权限。
第二条路径要求民主国家的AI公司在政府支持下,就共同安全标准以及对不受控制的AI开发速度的限制进行协调。
第三条路径要求美国及其他民主国家推动全球协调,包括与中国等威权国家达成协议。阿莫代伊承认,核实此类协议是否得到遵守存在困难。
来源:HODL Press
