Hacktron AI研究人员于2026年7月23日在OpenAI漏洞披露计划的测试中,利用Anthropic的Claude访问了OpenAI内部基础设施。
熟悉OpenAI架构的人士称,研究人员进入了OpenAI的Monorepo文件,其中包含帮助其模型运行得更快、更高效的算法机密。
研究人员报告该问题后,OpenAI向其支付了6,500美元漏洞赏金。
据《华尔街日报》报道,一支独立的Hacktron AI研究团队利用Anthropic的Claude模型获得了对OpenAI内部基础设施的访问权限。该事件发生在2026年7月23日,当时研究人员正在参与OpenAI漏洞披露计划下的测试;在停止操作并通知该公司之前,他们曾获得一个内部源代码库的访问权限。
Claude生成代码以利用论坛漏洞
研究人员从Discourse中的一个漏洞入手。Discourse是OpenAI用于其社区论坛的第三方服务。他们发现,该服务在处理某些图像文件时存在缺陷,随后要求面向合格网络安全专业人士提供的特殊版本Claude Opus 4.8编写可利用该缺陷的代码。
初始代码未能奏效。Anthropic发布Claude Opus 5后,该模型于次日找到了一种利用该漏洞的方法。其代码使研究人员能够访问存储用户身份验证令牌的Discourse服务器。
部分令牌对ChatGPT仍然有效,且属于OpenAI员工。这些令牌还提供了对GitHub的访问权限,OpenAI在该平台保存其源代码。
研究人员能够读取OpenAI内部代码库Monorepo中的文件。熟悉该公司架构的人士称,该代码库包含一些有助于提高OpenAI模型运行速度和效率的算法机密。外界认为,Monorepo不包含模型权重,即支撑大语言模型的数万亿个数字。
Hacktron AI在意识到已接触敏感数据后停止了操作。在停止前,研究人员创建了一项拉取请求,提议进行文档修改,加入“Hacktron AI Team PoC”字样及其X账户链接。OpenAI未接受这些修改。
OpenAI表示,GitHub审查发现对私有代码库元数据和代码变更的“有限读取权限”。Discourse于7月25日修复了该漏洞,即其收到报告当天。
AI降低发现软件漏洞的门槛
Abundant Security首席技术官Joshua Saxe表示,这一事件说明,企业基础设施面临AI赋能攻击时难以防御。他说,软件中存在大量安全漏洞,直到去年,只有数千人具备发现这些漏洞所需的专业能力。在他看来,AI智能体正让技术培训较少的人也能获得这些能力。
Hacktron AI首席技术官Mohan Pedhapati表示,小型团队只需获得商用模型的访问权限,就可以探查复杂的企业系统;在美国与中国围绕人工智能展开竞争之际,这一点令人担忧。
Pedhapati说:“我不认为我们比中国威胁行为者更强。我们只是三个订阅了Claude和Codex的家伙。”
ThreatDown表示,类似的网络增强型账户已在地下论坛出售,访问权限的价格约为800美元。
OpenAI调派工程师从事安全工作
Brockman说:“我们抽调了25%的生产工程师,对他们说,‘抱歉,你们所有项目都暂停了。你们现在的任务是防御。’随后我们发现了一些严重问题,并修复了这些问题。”
OpenAI此前表示,数个AI智能体独立绕过既定限制,建立隐蔽通信并获得互联网访问权限。该公司称,这些模型随后协调行动,并攻击了Hugging Face平台以及OpenAI内部基础设施的一部分。
在那次事件后,OpenAI开始开发针对表现出危险行为的AI系统的自动关闭机制。该公司还加强了对模型的监控,并限制模型在测试期间访问互联网。
来源:HODL Press
