9月18日消息,据《华尔街日报》报道,一组网络安全研究人员在OpenAI的漏洞赏金计划中,借助竞争对手Anthropic的Claude成功进入OpenAI内部系统。这起事件再次显示,随着AI模型能力快速提升,它们给网络安全攻防带来的影响也越来越明显。
安全初创公司Hacktron AI的研究人员表示,他们首先获得了一个OpenAI员工的ChatGPT账户访问权限,随后进一步访问了OpenAI在GitHub上的内部代码。
由于研究人员是在OpenAI授权的漏洞测试计划中开展相关工作,并主动披露了发现的问题,OpenAI最终向他们支付了6500美元漏洞奖金。
Hacktron在报告中透露,团队最初尝试使用Anthropic的Claude Opus 4.8寻找并利用漏洞,但经过多轮尝试,始终没能生成真正可用的攻击方案。
Anthropic推出Opus 5之后,研究人员再次进行了尝试,这次成功了。团队因此感叹,每一代新模型的能力都在明显变强。
报道称,研究人员使用的是Claude的一个特殊版本,主要提供给符合条件的网络安全专业人士使用。
OpenAI表示,已经感谢研究人员提交相关发现,并修复了这些漏洞。
更值得注意的是,研究人员表示,这次针对OpenAI的渗透工作,AI智能体只用了几天,而人类研究人员真正投入的时间只有几个小时。
此次测试属于一个名为HEIF Heist的更大研究项目,目标是研究各种软件和服务处理特定图片文件时可能出现的安全漏洞。研究人员称,同一类方法还发现了Slack、Zoom、Meta等公司的相关漏洞。
整个研究项目只持续了两个月,由3名研究人员完成,在AI模型上的Token成本总计不到3000美元。
研究团队认为,这背后反映出的变化比某一个OpenAI漏洞更加重要。
过去,复杂的软件系统本身就是一种隐形的安全门槛。想要找到深层漏洞,攻击者往往需要很强的专业知识、充足的资源,以及数周甚至数月的人工分析。
AI正在削弱这道门槛。过去只有少量高水平安全专家掌握的部分能力,现在开始可以通过模型能力和算力获得。以前需要一支资源充足的团队花几个月完成的工作,如今可能被压缩到几天。
研究人员因此警告,网络安全领域过去的一些基本假设必须改变,因为攻击者能够使用的能力正在快速提升。


