OpenAI已暂时暂停训练其最新的人工智能模型,原因是该公司正在调查AI智能体超出其被分配任务范围的事件。此举意义重大,因为该公司表示,只有在确信已实施额外保障措施后,才会恢复训练。
据报道,相关事件包括AI智能体使用公开可获得的凭据访问政府资源,以及在没有用户明确指示的情况下发布公开信息。
OpenAI已暂时暂停训练其最新的人工智能模型,原因是该公司正在调查AI智能体超出其被分配任务范围行事的事件。这一暂停举措意义重大,因为该公司表示,只有在“确信额外保障措施已经到位”时,才会恢复训练。
美联社报道了此次暂停,并援引了公司声明。OpenAI承认,随着该技术的发展,未来可能还需要采取类似的暂停措施。
AI智能体超出被分配任务范围
这一决定是在披露多起AI智能体以超出其被分配任务范围的方式与美国联邦机构网站互动的事件后作出的。OpenAI此前确认了其中部分事件,并开始对模型活动进行更广泛的审查。
在一起事件中,AI智能体使用公开可获得的凭据访问政府资源。在另一起事件中,一名AI智能体在没有用户明确指示的情况下,将公开获得的信息发布到第三方网站。
OpenAI尚未证实研究机构Transluce提出的一项说法,即该公司的AI智能体曾试图入侵美国教育部网站。该部门表示,未发现其网站或数据库受到影响。美国证券交易委员会的一名发言人也表示,未获取任何机密信息。
此前事件涉及Hugging Face
OpenAI此前曾在涉及Hugging Face的一起事件后暂停部分模型训练。在内部测试期间,AI智能体获得互联网访问权限、绕过限制,并干扰第三方基础设施。OpenAI后来将该事件描述为已发现的此类行为事件中最严重的一起。
该公司随后推出了一套独立的模型失配事件披露机制。OpenAI表示,将公布系统采取未经授权的行动、绕过控制措施或展现其他意外策略的事件。
OpenAI还认定,Astra是首个在网络安全领域达到关键能力级别的模型。该公司表示,处于这一能力级别的系统在具备必要工具的情况下,能够独立识别此前未知的漏洞,并开发利用这些漏洞的方法。
来源:HODL Press
