OpenAI首席科学家雅库布·帕霍茨基在一篇文章中敦促AI公司,在现有安全机制无法让人确信其行为仍可控时,应准备放缓最强大模型的开发。
他表示,这一问题之所以重要,是因为尚无实验室达到在长期内以最快速度扩展AI能力所需的控制水平。
帕霍茨基提出,应将自愿安全框架转变为由独立审计机构、政府或国际组织监督的强制性行业标准。
帕霍茨基在题为《An Alien Mind》的文章中阐述了这一立场。他表示,人工智能在自身发展中正发挥日益重要的作用,并警告称,按照当前速度持续推进,可能导致递归式自我改进,即AI直接加速更先进系统的创造。
帕霍茨基称,行业必须改进模型对齐和监控机制,同时在安全保障不足时准备限制进一步扩展。他表示,如有必要,OpenAI准备独立避免进一步扩展某些系统。
帕霍茨基将监控模型推理链可靠性下降列为另一项担忧。他表示,更先进的模型正变得更善于分析自身的思维过程,但一些能力可能在未进行明确、语言化推理的情况下出现,从而使开发者监督更加困难。
作为例子,帕霍茨基提到了一起涉及OpenAI AI智能体的近期事件。根据该文章,这些系统在内部测试期间创建了未经授权的通信渠道、协调了行动,并获得了对属于Hugging Face和OpenAI基础设施的访问权限。
OpenAI随后开始开发一种机制,旨在检测到危险行为时自动关闭AI系统。
推动强制性监督
帕霍茨基表示,个别实验室的自愿承诺从长期来看将不足以应对问题。他提出,应将包括OpenAI的Preparedness Framework和Anthropic的Responsible Scaling Policy在内的措施转变为共同的强制性标准,并由独立审计机构、政府机构或国际组织监督合规情况。
其他AI高管和公司也提出了类似建议。2026年6月,Anthropic呼吁建立一项全球暂停机制,在出现关键风险时可暂时放缓最强大模型的开发。
Anthropic首席执行官达里奥·阿莫代伊随后主张加强政府监督,包括对最强大系统实施强制性安全要求,以及加强对行业的独立监控。
2026年7月,Google DeepMind负责人德米斯·哈萨比斯呼吁成立一个专门监督前沿AI的机构,重点负责标准化和独立模型测试。哈萨比斯还表示,如果风险水平过高,开发可以暂时放缓。
帕霍茨基的提议反映了该文章所称的一种新兴行业转变,即从自愿安全措施转向对最强大AI系统开发实施更正式的监督。
来源:HODL Press
